开放模型与智能机器人引领AI新赛道,资本与政策同步加速

关键政策动向
本周,NVIDIA CEO 黄仁勋在X(Twitter)上发表公开信,联合25家企业呼吁美国政府避免对开放权重模型的过早限制,强调开放模型是美国保持AI领导力的关键生态。信中指出,仅靠少数闭源系统难以支撑长期创新,必须让初创、学术和公共机构能够审查、改进并部署先进模型。
前沿模型发布
月之暗面(Moonshot)同步发布了Kimi K3 权重,参数规模达2.8万亿,采用混合专家(Mixture‑of‑Experts)架构,支持原生多模态并拥有一百万 token 上下文窗口。虽然在单项指标上未必全面超越商业闭源系统,但其开放权重已使开源大模型进入与闭源竞争的平行前沿。
DeepMind 在Gemini Robotics 2 中将语言模型能力延伸至物理控制,展示了全身 humanoid 任务规划、精细抓取以及跨模态协同。该套件强调“推理→行动”的架构转变,预示未来模型竞争将从答案质量转向可靠执行。
机器人技术突破
Gemini Robotics 2 的核心在于将大模型的抽象推理映射为机器人指令,提升了任务成功率和安全性。研究团队指出,令牌的“后果”在机器人场景中得到实际体现,为具身智能提供了可量化的评估基准。
市场与资本动态
对冲基金 Situational Awareness 在高杠杆持仓 AI 资产后遭遇剧烈回撤,被迫清仓,引发业界对 AI 资产集中风险的关注。与此同时,微软公布 Azure 年收入突破千亿美元,Copilot 采用率持续上升,显示生成式AI已转化为可观的云服务收入。亚马逊 AWS 同步报告基础设施投入带动收入增长。相较之下,Meta 虽然广告业务稳健,但其 AI 基础设施开支增长速度超出市场预期,导致股价承压;苹果则凭借强大现金流维持研发,但缺乏明确的 AI 产品叙事。
研究亮点回顾
- Kimi K3 论文:提出 Kimi Delta Attention 与多域强化学习,显著提升长程推理与代码生成能力。
- ScientistOne:Google Cloud 提出的链式证据框架,实现每条生成结论皆可追溯至可验证证据,消除幻觉引用。
- Shieldstral:Mistral AI 推出的 3B 参数安全分类器,以二元问答方式统一文本与多模态安全评估,性能媲美七倍模型。
- VIPE:DeepMind 通过视觉提示工程将任务图像转化为写实场景,提升视频模型的视觉推理表现。
整体来看,AI 竞争正从“能否生成”转向“能否可靠执行并实现商业化”。开放模型、具身机器人以及资本运作的协同,将决定下一轮技术领先者的格局。