OpenAI预览GPT-5.6三款模型、Grok 4.5低成本逼近Fable 5、MiniMax研发2.7万亿参数M3 Pro | 7月9日 AI日报

💡 今日趋势速览:Grok 4.5以十分之一成本逼近榜首Fable 5,性能价格比引发关注;MiniMax同步推进2.7万亿参数M3 Pro研发,若开源将刷新全球开源模型规模纪录。

🎯 今日要点

  1. OpenAI 预览 GPT-5.6 含三款模型
  2. Grok 4.5 以十分之一成本逼近 Fable 5
  3. MiniMax 研发 2.7 万亿参数 M3 Pro 并计划开源

📋 今日内容汇总

🤖 AI动态

  1. OpenAI 预览 GPT-5.6 含三款模型
  2. Grok 4.5 以十分之一成本逼近 Fable 5
  3. MiniMax 研发 2.7 万亿参数 M3 Pro 并计划开源
  4. xAI 将于明日向公众开放 Grok 4.5
  5. OpenAI 发布 GPT-live 新一代语音能力
  6. 谷歌发布开源多模态模型 Gemma 4
  7. 工信部称 Claude Code 存在监控机制
  8. 中国模型占 OpenRouter 企业调用比例超 30%
  9. Meta 测试持续录音拍照的超级感知 AI 眼镜

🔌 AI基础设施

  1. 中国计划少量批准采购英伟达 H200 芯片
  2. 英伟达下一代 Rosa CPU 采用 Rigel 核心

🦾 机器人具身智能

  1. Mistral 发布首款具身导航模型 Robostral Navigate
  2. 阿里推出 RynnWorld-Teleop 数字遥操作方案
  3. 蚂蚁集团发布 LingBot-VLA v2.0 视觉语言动作模型

📌 模型排行榜

  1. Artificial Analysis AI 模型能力排行榜

🤖 AI动态

1. OpenAI 预览 GPT-5.6 含三款模型

OpenAI 预览 GPT-5.6,同步推出旗舰款 Sol、均衡款 Terra 和低本款 Luna 三款模型。Terra 据报以半价匹配 GPT-5.5 性能。因美国政府要求,旗舰款暂未全面公开,Sol 先向受信任合作伙伴开放,并与即将出台的网络安全行政令框架挂钩。

OpenAI 预览 GPT-5.6 含三款模型

OpenAI 预览 GPT-5.6 含三款模型

2. Grok 4.5 以十分之一成本逼近 Fable 5

CursorBench 最新结果显示,Grok 4.5 总榜第三得分 66.7%,与榜首 Fable 5 Max 的 70.5% 差距不大,但成本仅为其十分之一。Grok 4.5 High 单任务 1.51 美元,Fable 5 Max 为 17.32 美元,大模型竞争正从智力战转向价格战。

Grok 4.5 以十分之一成本逼近 Fable 5

Grok 4.5 以十分之一成本逼近 Fable 5

3. MiniMax 研发 2.7 万亿参数 M3 Pro 并计划开源

稀宇科技 MiniMax 正在研发约 2.7 万亿参数大语言模型,内部代号 M3 Pro,预计第三季度发布并计划开源。该规模约为现有旗舰 M3(4280 亿参数)的 6.3 倍,若开放权重将成为全球参数最大的开源模型,重点强化复杂推理与多步指令能力。

MiniMax 研发 2.7 万亿参数 M3 Pro 并计划开源

MiniMax 研发 2.7 万亿参数 M3 Pro 并计划开源

4. xAI 将于明日向公众开放 Grok 4.5

基于 beta 测试的积极反馈,xAI 旗下 SpaceXAI 宣布将于次日向公众开放 Grok 4.5。该模型定位为 Opus 级别,但在速度、token 效率和成本上更具优势,主打更快推理与更低使用门槛。此举标志着 xAI 旗舰模型正式进入大规模公开服务阶段。

xAI 将于明日向公众开放 Grok 4.5

5. OpenAI 发布 GPT-live 新一代语音能力

OpenAI 首席执行官 Sam Altman 宣布,新一代语音能力 GPT-live 当日在 ChatGPT 上线。Altman 称其体验自然真实,并坦言自己此前更偏好打字而非语音交互,认为这一习惯将因此改变。该功能面向 ChatGPT 用户开放使用。

OpenAI 发布 GPT-live 新一代语音能力

6. 谷歌发布开源多模态模型 Gemma 4

谷歌发布开源权重多模态模型 Gemma 4,参数规模从 2.3B 到 31B,原生支持多模态理解。该系列提供 Dense 与 MoE 两种架构、无编码器 12B 变体,并加入面向推理的思考模式,覆盖从轻量到旗舰的多档开源需求。

谷歌发布开源多模态模型 Gemma 4

谷歌发布开源多模态模型 Gemma 4

7. 工信部称 Claude Code 存在监控机制

中国工信部网络安全机构称其发现 Anthropic 的 Claude Code 存在监控机制,建议用户立即卸载或升级至最新安全版本。该工具在国内开发者中广泛使用,事件涉及 AI 编程工具的安全合规问题,但具体监控细节尚未公开披露。

工信部称 Claude Code 存在监控机制

8. 中国模型占 OpenRouter 企业调用比例超 30%

OpenRouter 数据显示,DeepSeek、智谱 GLM 等中国模型的周调用占比长期超 30%,最高达 46%。企业将非核心任务转向更便宜的中国模型,价格可比美国顶级模型低 60% 到 90%。报告认为中国模型与美国顶级的性能差距已缩小至约 6 到 9 个月。

中国模型占 OpenRouter 企业调用比例超 30%

中国模型占 OpenRouter 企业调用比例超 30%

9. Meta 测试持续录音拍照的超级感知 AI 眼镜

据英国《金融时报》报道,Meta 正在测试超级感知 AI 眼镜原型,可持续录制音频并每隔几秒拍照,让用户查询或回溯所见所闻。报道还指出 Meta 计划关闭录制指示灯,引发隐私争议,相关功能仍处于内部测试阶段。

Meta 测试持续录音拍照的超级感知 AI 眼镜

🔌 AI基础设施

10. 中国计划少量批准采购英伟达 H200 芯片

据知情人士透露,中国计划允许部分头部 AI 公司少量采购英伟达 H200 芯片,以缓解 AI 算力需求激增导致的供应短缺。采购总量可能不足 20 万颗,不到今年年初申请量的一半,政府尚未最终批准全部买家,审批时间仍可能变化。

中国计划少量批准采购英伟达 H200 芯片

11. 英伟达下一代 Rosa CPU 采用 Rigel 核心

英伟达在 GTC2026 更新数据中心 CPU 路线图,下一代 Rosa CPU 将采用基于 Arm v9.2 架构的 Rigel 核心。此举是英伟达进军数据中心 CPU 市场的重要一步,旨在挑战英特尔与 AMD 的长期主导地位,面向 AI 推理与高并发工作负载。

英伟达下一代 Rosa CPU 采用 Rigel 核心

英伟达下一代 Rosa CPU 采用 Rigel 核心

🦾 机器人具身智能

12. Mistral 发布首款具身导航模型 Robostral Navigate

Mistral 发布首款具身导航模型 Robostral Navigate,参数规模 8B,可引导机器人按自然语言指令自主执行导航任务。该模型仅需单个 RGB 摄像头即可工作,并在 R2R-CE 基准上达到当前最优水平,降低了机器人导航的硬件门槛与部署成本。以下是官方给出的 demo以下是官方给出的 demo,展示了上述功能的实际运行效果

Mistral 发布首款具身导航模型 Robostral Navigate

13. 阿里推出 RynnWorld-Teleop 数字遥操作方案

阿里巴巴推出 RynnWorld-Teleop 数字遥操作方案,通过手部姿态流驱动世界模型,从单张图片实时渲染高保真机器人视频,从而在训练流程中移除实体机器人。该方案降低了机器人遥操作的数据采集与训练成本,为具身智能提供新范式。

阿里推出 RynnWorld-Teleop 数字遥操作方案

阿里推出 RynnWorld-Teleop 数字遥操作方案

14. 蚂蚁集团发布 LingBot-VLA v2.0 视觉语言动作模型

蚂蚁集团机器人团队发布 LingBot-VLA v2.0,参数规模 6B,采用 Apache 2.0 开源协议。该模型预训练约 6 万小时数据,支持 20 种机器人构型,覆盖手臂、灵巧手、腰部、头部和移动底盘的全身体动作空间,面向具身智能的视觉语言动作控制。

蚂蚁集团发布 LingBot-VLA v2.0 视觉语言动作模型

蚂蚁集团发布 LingBot-VLA v2.0 视觉语言动作模型

📌 模型排行榜

15. Artificial Analysis AI 模型能力排行榜

最后是今日的 AI 模型能力排行榜单,从三榜来看,Claude Fable 5以60/76.5/52.8的分数稳居榜首,Claude Opus 4.8与GPT-5.5紧随其后,闭源阵营形成Claude、OpenAI与Grok三方争霸格局。

Artificial Analysis AI 模型能力排行榜

Artificial Analysis AI 模型能力排行榜

Artificial Analysis AI 模型能力排行榜

以上是今天的AI 风向标,欢迎在评论区提出建议,我们明天见。

内容概要:本文系统研究了在高阶矩约束下,如何通过数值稳定的算法重建最大熵分布,并将其应用于扩展不确定度的评估中。该方法基于有限的统计矩信息(如均值、方差、偏度、峰度等)构建最符合实测数据的概率分布,克服传统方法中人为设定分布形态所带来的偏差。文中提出了一种改进的数值求解策略,有效缓解了高阶矩条件下常见的病态问题与计算不稳定性,显著提升了算法的收敛性、鲁棒性与计算效率。结合Matlab代码实现,验证了该算法在复杂工程系统不确定度量化中的实用性和优越性,尤其适用于高阶统计特征显著的场景。; 适合人群:具备概率统计、数值分析与优化算法基础,从事科学研究或工程建模的研究生、工程师及科研人员,尤其适用于需要进行高精度不确定性量化、风险评估与概率建模的领域从业者。; 使用场景及目标:①在仅有少量实验数据且缺乏完整分布先验时,重建最合理的概率分布;②提升扩展不确定度评估的科学性与准确性,避免主观假设干扰;③为复杂系统建模、可靠性分析、质量控制、金融风险评估等提供稳健的概率建模工具; 阅读建议:读者应结合所提供的Matlab代码深入理解算法实现细节,重点关注拉格朗乘子的迭代求解过程、数值正则化技巧与高阶矩条件下的稳定性处理机制,并建议通过实际工程数据进行测试与对比,以掌握算法在不同阶数约束下的性能边界与优化策略。
内容概要:本文档围绕2026年高教社杯全国大学生数学建模竞赛A题“药材的烘干问题”及相关课题,提供了一系列数学建模、仿真与优化的研究资源,涵盖SEM广告投放策略、电力系统优化、路径规划、信号处理等多个方向。其中,对SEM广告投放策略的研究尤为深入,构建了从问题诊断、关键词分类、优化建模到鲁棒决策的完整框架。研究提出基于成本—效益二维归一化的关键词分类方法,将关键词划分为黄金词、重点词、潜力词、问题词和无效词五类,并建立了以注册量最大化为目标的0-1整数规划模型。为应对不确定性,进一步引入条件风险价值(CVaR)框架进行鲁棒优化,并设计贪心选词与拉格朗对偶定价相结合的两阶段求解算法,以及基于情景生成与滚动优化的动态调整策略,实现了投放策略的精细化与稳健性提升。; 适合人群:具备一定数据分析与建模基础,参加数学建模竞赛或从事运筹优化、数字营销、电力系统等相关领域研究的本科生、研究生及科研人员。; 使用场景及目标:① 学习如何构建完整的广告投放优化模型并应用于实际业务决策;② 掌握整数规划、聚类分析、鲁棒优化等建模方法在复杂决策问题中的综合应用;③ 为数学建模竞赛提供高质量的参考案例与代码资源支持。; 阅读建议:建议结合文档中提供的Matlab代码与论文框架进行实践操作,重点关注模型构建逻辑与算法实现细节,同时可参考其他配套课题拓展技术视野,提升综合建模能力。
评论
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

一只云卷云舒

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值