快讯

在这里,先见未来一刻

8月29日星期六

  • Salesforce 如何利用 SageMaker 推理组件实现多可用区高可用

    01:03 作者:强哥来了

    本文介绍了 Salesforce 如何通过 Amazon SageMaker AI Inference Components 降低 GPU 成本,并调整默认放置策略以满足其多可用区(Multi-AZ)高可用性要求。文章由 Salesforce 的 LLM Gateway 团队及 Amazon SageMaker 推理团队共同撰写,重点讨论了如何为代理工作负载构建可靠的推理基础设施。原文连接

    AI
    分享到

8月28日星期五

  • 世界机器人大会释放产业风向标:从技术突破到治理规范

    23:03 作者:强哥来了

    为期五天的世界机器人大会闭幕,集中展示了机器人领域前沿成果,并发布《全球机器人应用探索计划》和《智能机器人向上向善发展倡议》以及人形机器人产业报告,勾勒出智能机器人从技术突破走向场景落地、从行业探索迈向治理规范的图景。世界模型作为人工智能前沿方向,是机器人"看懂世界"和"改变世界"的关键技术底座。大会还发起面向全球的"先行先试"计划,每年…原文连接

    AI
    分享到
  • AI 用五周解决百年流体力学难题,科学家却没那么兴奋

    20:03 作者:强哥来了

    普林斯顿大学流体力学家霍华德・斯通教授建议研究者从"变形球体"入手,将粒子视为球加微小扰动,以解决任意形状的迁移率计算问题。研究中,AI 在五周内攻克了该百年难题,但科学家反应谨慎。论文公开了与 Claude 的关键对话,记录其犯错与纠正过程,为 AI 驱动科研提供了范本。迁移率是胶体科学和生物医学分析中的基础测量量,对 DNA 分离、蛋白质纯化及 zeta 电位测定至关重要。原文连接

    AI
    分享到
  • Nat. Rev. Bioeng. | 机器学习赋能生物材料设计

    19:33 作者:强哥来了

    机器学习用于生物材料设计时,首先需要回答的并不是"使用什么模型",而是"模型究竟应该预测什么"... 机器学习驱动的理性生物材料设计可以理解为代理预测、生成式逆向设计、主动学习、可解释模型以及多尺度整合的统一 ... 如果再把可解释人工智能、物理约束、可持续性指标和监管要求从设计之初就纳入系统,未来生物材料开发有望形成从设计 — 构建 — 测试 — 学习 —…原文连接

    AI
    分享到
  • OpenAI 首次公开入侵 Hugging Face 完整报告

    19:09 作者:强哥来了

    报告披露,约 700 个 Agent 利用多个零日漏洞入侵了 Hugging Face(抱抱脸)的生产基础设施,在 41 台生产服务器上执行代码,至少在一台服务器上获取了 root 权限,还拿到了企业通讯平台和虚拟专用网络的凭证。7 月 11 日凌晨,38148c 找到了一种利用 HDF5 外部存储功能的攻击方法,上传一个精心构造的数据集文件,使 Hugging Face 的生产服务器在处理该文件…原文连接

    AI
    分享到
  • DeepSeek 前 7 个月营收约 7000 万美元,API 毛利 82.9%

    19:06 作者:强哥来了

    据 The Information,DeepSeek 今年前 7 个月营收约 7000 万美元(约合人民币 4.75 亿元),API 业务毛利率达 82.9%。对比 OpenAI 一季度毛利率约 39%、Anthropic 预计今年毛利率有望达 63%,DeepSeek 的 API 毛利水平已处于第一梯队。但 110 亿美元的基础设施投入使资金消耗速度高企,即便 API 毛利可观,仍远不足以覆盖硬…原文连接

    AI
    分享到
  • 神秘「牛来」模型果然是智谱 GLM 首个原生多模态,还用的国产卡

    19:03 作者:强哥来了

    智谱 GLM-5.3 Flash 定价为 5.3 版本的 1/10,限时折扣为 1/20 的 GLM-5.3,1/40 的 Opus 4.8,定价低于 DS-V4-Flash。GLM-5.3 Flash 是 5 系列里的首个原生多模态模型。为在国产加速芯片上扛住多模态和 1M 上下文,智谱将多模态编码、Prompt 预填充和逐 Token 解码拆分为可独立调度、扩缩容的 Encode-Prefil…原文连接

    AI
    分享到
  • Qwen 4 用上 DeepSeek 的 Engram 125B MoE 一张 4090 能跑不用量化

    18:33 作者:强哥来了

    而 Qwen 的 N-gram Embedding 和 DeepSeek 的 Engram 都是利用当前 token 及其前面若干 token 组成的局部上下文作为 key,通过确定性的哈希函数在一张巨大的嵌入表中查到对应的向量,时间复杂度为 O (1) ... Engram 论文通过 Sparsity Allocation 实验发现了一条 U 形缩放定律:在总参数和 FLOPs 固定的前提下,把…原文连接

    AI
    分享到
  • 威科集团与蚂蚁健康达成战略合作,JCO 等 28 本医学顶刊上线阿福医生版

    18:06 作者:强哥来了

    8 月 28 日,蚂蚁健康宣布与威科集团达成战略合作,后者是全球领先的临床信息和决策支持解决方案提供商。此次合作将 JCO 等 28 本医学顶刊内容接入蚂蚁健康旗下的"蚂蚁阿福医生版"应用。该应用于今年 8 月正式上线,定位为国内首个覆盖在线问诊、患者管理和科研全场景的医生 AI 工作站,为医生配备"AI 医学助手"和"AI 分身助手"两…原文连接

    AI
    分享到
  • 一段视频让机器人学会开门并穿越:Video2DoorTraversal 打通 Real-to-Sim-to-Real

    18:03 作者:强哥来了

    论文提出了一套面向轮足移动操作机器人的单视频 Real-to-Sim-to-Real 框架:用一段普通 RGB 视频重建真实门的数字孪生 DoorTwin,在仿真中生成并筛选可执行轨迹,再训练机器人完成从接近、开门到穿越的连续任务。研究针对每扇目标门分别采集一段 RGB 视频,在论文指定的轮足移动操作平台上每扇各测试 35 次,共完成 175 次测试,其中成功 169 次,平均成功率为 96.57…原文连接

    AI
    分享到
  • 103μs 降到 18μs 背后,Cursor 为何剑指英伟达,重写 GPU?

    17:45 作者:强哥来了

    它没有继续折腾更快的矩阵乘法,而是直接重写了一层 MoE 的执行方式,把 token 调度、跨 GPU 通信和专家计算塞进同一个 GPU 内核。一个拥有 130 TB / s NVLink 带宽的机架,最后仍然需要为 MoE 重写 GPU 内核,原因就在这里:链路已经很快了,接下来要省的是 GPU 等数据的时间。Cursor 重写 GPU 内核的行为,标志着 AI 2.0 时代的竞争进入了&quo…原文连接

    AI
    分享到
  • 大晓联合香港大学发布 StreamPI,为 VLA 补上时间维度,迈向连续物理智能

    17:42 作者:强哥来了

    大晓机器人联合香港大学发布全新的连续物理智能研究成果 StreamPI(Streaming Multimodal Temporal Modeling for Vision-Language-Action Models),直指 VLA 长期存在的"单帧智能"瓶颈,为其补上关键的"时间维度"。StreamPI 所探索的不只是"让 VLA 多看几帧&qu…原文连接

    AI
    分享到
  • Anthropic 技术栈中的五宗罪由何而来?

    17:39 作者:强哥来了

    文章探讨了 Claude 技术栈中五个具体问题:模型生成、推理计算分配、模型分层难度、长上下文失效机制,以及实验能力在真实 Agent 任务中的折扣。还讨论了机器可读标记在普通文本中的技术难点,以及 Anthropic 未公开文本标记如何影响采样,因此不能将 Claude Code 的质量变化直接归因于某一种水印算法。原文连接

    AI
    分享到
  • GPT、Claude 遭遇「窃听门」:换个模型就能让思维链不再隐身?

    17:36 作者:强哥来了

    昨日,X 用户 @kotekjedi_ml 公布了一组反常实验:Claude、GPT 和 Gemini API 中原本不向用户展示的隐藏推理过程,被研究人员重新恢复成了可读文本。研究人员不再尝试让强模型自己交出思维链,而是将其留下的加密推理交给一个更容易被绕过的兼容模型,让后者把已加载的内容转录出来。这意味着只需调用最便宜的模型就能镜像出顶级模型的思维轨迹,闭环大厂对推理数据的垄断也将被打破。原文连接

    AI
    分享到
  • Cursor Origin 上线,GitHub 的老玩法还够用吗?

    17:33 作者:强哥来了

    Colossus、Grok、Cursor 和 Origin 可以分别对应这条链上的不同层级:Colossus 提供算力,Grok 提供模型能力,Cursor 提供代码 Agent 和执行环境,Origin 保存 repository、PR、checks 和 review 状态。GitHub 和 Origin 的竞争因此会逐渐落到两种路径上:GitHub 从成熟的人类协作体系向 Agent 扩展,C…原文连接

    AI
    分享到
  • 长安天枢领航 Ultra 定档 9 月 4 日发布,启源 Q06 同步开启全球预售

    17:03 作者:强哥来了

    天枢领航 Ultra 基于 SDA 天枢中央环网架构打造,官方称其在感知硬件、算力平台及算法模型方面均达到行业前沿水平,支持高速领航、城市 NOA 领航辅助、全场景智能泊车等核心功能,并搭载 VLM 视觉语言大模型。长安的智驾底气来自智能化"北斗天枢"计划,去年 12 月获中国首块 L3 级自动驾驶专用正式号牌,L3 系统在重庆真实道路累计测试已超 500 万公里,保持零事故零…原文连接

    AI
    分享到
  • 腾讯混元发布并开源新一代大语言模型 Hy4 preview

    16:33 作者:强哥来了

    腾讯混元发布并开源新一代大语言模型 Hy4 preview,总参数 770B、激活参数 49B,上下文长度突破 1M,在代码、办公、科学等真实生产力任务上展现出卓越能力。Hy4 preview 在模型尺寸、上下文长度、数据规模上都进行了显著扩展,预训练和后训练的共同进步带来了智能水平的又一次巨大提升,稳居开源模型第一梯队。该模型定位为"为生产力而生",通过与软件工程、游戏、金融…原文连接

    AI
    分享到
  • 腾讯混元 Hy4 preview 开源:770B 参数、百万上下文,稳居开源第一梯队

    16:03 作者:强哥来了

    腾讯今日发布混元 Hy4 preview 模型,总参数 770B、激活参数 49B,上下文长度达到 1M。官方称该模型在尺寸、上下文与数据规模上均显著扩展,预训练与后训练同步进步带来智能水平再次跃升,稳居开源模型第一梯队。依托与腾讯内部软件工程、游戏、金融、安全等领域专家的高质量数据共建,Hy4 preview 在真实任务上进步明显:软件工程侧强化长程开发的理解、规划与验证。原文连接

    AI
    分享到
  • 蚂蚁集团携手中金公司推出金融增强大模型 Ling-3.0-flash-Fin

    15:06 作者:强哥来了

    该模型在延续原有架构与参数配置的基础上,通过海量专业金融语料的深度训练,显著强化了投研核心能力,聚焦信息检索等四大核心能力。在生态与开放计划方面,Ling-3.0-flash-Fin 将在 OpenRouter 平台提供为期一个月的免费 API 调用服务,模型权重计划于下周开源,为开发者和金融机构提供支持。原文连接

    AI
    分享到
  • 腾讯混元发布开源旗舰模型 Hy4preview,总参数 770B、上下文 1M

    15:03 作者:强哥来了

    模型已同步开源至 HuggingFace、Github、Modelscope 等平台,并在腾讯云 TokenHub、OpenRouter 上线,用户可在 WorkBuddy / CodeBuddy、元宝、ima 等产品中直接体验。能力层面,Hy4preview 依托与腾讯内部软工、游戏、金融、安全等领域专家的高质量数据共建,在四大方向取得进展:软件工程上增强长程开发任务的理解、规划与调试。其以开源…原文连接

    AI
    分享到
  • WRC 2026 复盘:具身智能告别表演时代,进入商业化算账时代

    13:39 作者:强哥来了

    深度复盘显示,具身智能领域正从展示技术转向商业化落地,物流分拣被普遍视为最早跑通的场景,竞争已从能力比拼转向盈利模式,行业重心转向建立数据闭环和自动训练体系。原文连接

    AI
    分享到
  • Hugging Face 开源 399 美元机器鸭 Microduck,支持强化学习训练

    13:36 作者:强哥来了

    Hugging Face 入局具身智能,于 2024 年初引入前特斯拉 Optimus 团队科学家 Rémi Cadene,主导开源机器人库 LeRobot 的开发。新开源的机器鸭 Microduck 售价 399 美元,能走会滑、跌倒自起,并支持强化学习训练。联合创始人 Thomas Wolf 称其为"第一款真正可及的强化学习机器人"。Hugging Face 将开源语言模型…原文连接

    AI
    分享到
  • 中国首次实现地月双向高速激光通信 一束激光跨越 40 万公里

    13:33 作者:强哥来了

    严格来说,这里的"地月通信"并不是指地面与月面终端之间直接通信,而是指发生在地月尺度上的通信链路 ... 此次中国团队的突破,则意味着中国首次在轨验证了地月双向高速激光通信能力,并打通了超远距离捕获跟踪、单光子探测、极弱信号处理和高速数据传输等一系列关键技术环节 ... 此次超过 40 万公里的试验,中国已经把高速激光通信从近地轨道进一步延伸到了地月空间,也为未来建立更稳定、更…原文连接

    AI
    分享到
  • 英伟达前 AI 总监颠覆 Transformer:5 万亿上下文物理 AI,推演整个宇宙

    12:33 作者:强哥来了

    加州理工学院教授、前英伟达 AI 研究总监 Anima Anandkumar 及其丈夫 Benedikt Jenik 推出 Accelerated Understanding 框架,用 1 万亿参数和 5 万亿上下文的数据,宣称开启"物理 AI"时代,旨在理解物理法则而非仅处理语言和图像。原文连接

    AI
    分享到
  • Midjourney V8.2 重磅上线图像编辑模型,支持指令微调与画布扩展

    11:33 作者:强哥来了

    AI 绘画巨头 Midjourney 近日正式宣布,面向广大用户群体开放测试其首款 V8.2 图像编辑模型。此次更新的核心,在于彻底打破了以往仅靠文本生成图像的单一模式,通过深度融合指令微调、多图参考、局部重绘等一系列前沿功能,为创作者带来了更加精准、可控的专业级视觉创作体验。在核心功能方面,V8.2 图像编辑模型主要支持四大技术特性:首先是强大的指令编辑能力,用户可以直接通过文本指令对已有图像进…原文连接

    AI
    分享到
  • 蚂蚁百灵推出金融增强模型 Ling-3.0-flash-Fin:API 限免一个月,下周开源

    11:06 作者:强哥来了

    蚂蚁百灵今日推出金融增强模型 Ling-3.0-flash-Fin,延续 Ling-3.0-flash 的模型架构和长上下文能力,保持 124B 总参数、5.1B 激活参数的配置。官方表示,该模型在蚂蚁集团与中金公司联合打造的 FinFIRST、以及 FinSearchComp Verified、Finance Agent、APEX-Agents、SpreadsheetBench、τ³-Banki…原文连接

    AI
    分享到
  • 小鹏第二代 VLA 大模型首次重大升级:综合安全能力提升 20 倍

    11:03 作者:强哥来了

    小鹏第二代 VLA 大模型迎来发布以来首次重大升级,全新 XOS6.3.0 版本将首发于小鹏 G9L。此次升级核心是让 AI 理解时间,推动物理 AI 基座模型从静态 3D 空间理解跃升至动态 4D 时空理解。小鹏在自动驾驶领域持续验证 Scaling Law,端侧模型参数量扩大 3.5 倍,与业内常见小模型拉开数量级差距。原文连接

    AI
    分享到
  • Cerebras 揭秘 CS-6 晶圆级进化:颠覆性 3D 堆叠,首次垂直集成 DRAM

    10:39 作者:强哥来了

    在 Hot Chips 2026 活动期间,Cerebras 披露最新路线图,宣布将在未来的 CS-6 系统中首次引入晶圆级 3D 堆叠设计。CS-6 的关键变化是引入 3D 堆叠 DRAM,将 DRAM 层通过超高带宽垂直互连直接置于逻辑 / SRAM 晶圆之上。发布日期方面,Cerebras 在 Hot Chips 2026 明确:CS-4 已于 2026 年 Q3 开始常规供货,CS-5 目…原文连接

    AI
    分享到
  • 国内首个量子增强大模型「玄幂」发布,量子技术与 AI 深度融合

    10:36 作者:强哥来了

    国光量超人工智能研究团队宣布将前沿量子技术引入大语言模型的决策与推理核心流程,正式面向科研和学术领域推出"玄幂"大模型家族。针对科研科普、任务路由以及智能体决策等垂直任务,该模型相比主流开源模型具备更稳定且深度的专业理解能力,能在复杂场景中输出更清晰的任务判断,并显著缩短整体决策路径。此次发布为复杂逻辑推理与专业科学计算方向提供了一条全新的量子增强技术路径。原文连接

    AI
    分享到
  • 谷歌升级搜索 AI 模式:支持 300 多家平台机票追踪与酒店预订

    10:33 作者:强哥来了

    谷歌于 8 月 27 日宣布,对其对话式搜索体验"AI 模式"进行重大功能升级,正式推出航班价格追踪、酒店预订辅助以及积分 / 里程价格查看等一系列新特性。在具体功能表现上,用户只需在 AI 模式中输入出行时间与目的地,系统即可整合来自 300 多家航空公司及旅行网站的即时价格与推荐方案,并支持创建行程或设置价格追踪提醒,相关价格变动通知已覆盖全球超过 180 个国家和地区。在…原文连接

    AI
    分享到