GPT-6 Sol首支演示泄露碾压Astra!DeepSeek灰度测试语音,微信小微突袭上线,Qoder开放自定义模型接入 | 9月13日 AI日报

AI 时代程序员必备技能

Codex、Claude Code、Cursor、Hermes Agent、OpenClaw等工程化实战专栏 ,讲透 AI 如何接管脏活累活

🎬 视频版直达https://www.bilibili.com/video/av117261364895226/

💡 今日趋势速览:GPT-6 Sol演示版疑似泄露,效果超预期并碾压同代GPT-6 Astra,震动业界;DeepSeek灰度测试语音对话提供四种音色,微信灰度上线小微AI功能矩阵,AI助手加速多模态化,巨头正面硬刚,行业竞争再度升温。

🎯 今日要点

  1. GPT-6 Sol 演示版本泄露,效果超预期
  2. DeepSeek 灰度测试语音对话功能,提供四种朗读音色
  3. 微信灰度上线 AI 功能矩阵「小微」,覆盖修图与翻译

📋 今日内容汇总

🤖 AI动态

  1. GPT-6 Sol 演示版本泄露,效果超预期
  2. DeepSeek 灰度测试语音对话功能,提供四种朗读音色
  3. 微信灰度上线 AI 功能矩阵「小微」,覆盖修图与翻译
  4. 阿里 Qoder CLI 个人版 v1.1.50 开放自定义模型接入
  5. 阿里千问办公上架麒麟软件商店,已原生适配全部主流操作系统
  6. Codex 宠物改版:弹窗直接回复,支持语音与文本
  7. 微软 Copilot 接入 Grok,先面向 Frontier 客户
  8. Grok Bot 疑似向 Grok Heavy 用户逐步推出
  9. 旗舰模型 Fugu Ultra v2 登陆 OpenRouter
  10. Qwen3.8-27B 登陆 Cerebras,开放模型获得极速推理
  11. Astra 官方致信用户:完成重置并修复多项质量问题
  12. DeepSeek V4.1 Flash 的 Agent 框架性能对比
  13. 配套CLI与Skills,浙大开源可插拔Agent评测底座

🧪 芯片半导体

  1. OpenAI 公开自研 AI 推理芯片 Jalapeno 完整架构
  2. 英特尔 NPU 驱动 1.38 支持 Ubuntu 26.04 LTS
  3. 苹果 A20 Pro 刷新 Geekbench 7 单核纪录
  4. DeepSeek 减少 HBM 使用量,三星、SK 海力士股价同时下跌

📌 模型排行榜

  1. Artificial Analysis AI 模型能力排行榜

🤖 AI动态

1. GPT-6 Sol 演示版本泄露,效果超预期

GPT-6 Sol 首个演示版本疑似遭泄露,据称其输出效果远超预期,表现力直接碾压同代模型 GPT-6 Astra,令业界震惊。有观点认为这将是 OpenAI 对整个 AI 生态系统的又一次重大变革。以下是官方给出的 demo

GPT-6 Sol 演示版本泄露,效果超预期

GPT-6 Sol 演示版本泄露,效果超预期

🔗 https://x.com/Mr_Salio/status/2098832275261546641


2. DeepSeek 灰度测试语音对话功能,提供四种朗读音色

来源:原文 | cnBeta

DeepSeek 正在灰度测试语音对话功能,被测试到的用户可在 App 右上角看到一个小喇叭按钮。同时,设置页面新增了音色选择选项,提供四种朗读音色供用户切换。此次测试标志着 DeepSeek 正从纯文本交互向多模态交互拓展,进一步完善 AI 助手的使用体验。

DeepSeek 灰度测试语音对话功能,提供四种朗读音色

DeepSeek 灰度测试语音对话功能,提供四种朗读音色

DeepSeek 灰度测试语音对话功能,提供四种朗读音色

🔗 https://www.ithome.com/1/001/498.htm


3. 微信灰度上线 AI 功能矩阵「小微」,覆盖修图与翻译

来源:原文 | IT之家 (ITHome)

微信灰度上线一批 AI 功能,统一绑定在小微:发图可美化、修图、提取文字,朋友圈长按可 AI 点评,扫码可识别翻译,聊天里说句话就能让 AI 润色或翻译,此前公众号也已有 AI 总结。目前仅部分用户可体验,是否全量看官方。

微信灰度上线 AI 功能矩阵「小微」,覆盖修图与翻译

🔗 https://x.com/RocM301/status/2098629460572639334


4. 阿里 Qoder CLI 个人版 v1.1.50 开放自定义模型接入

阿里Qoder宣布,自v1.1.50起,Qoder CLI正式向个人版用户开放自定义模型接入。该工具是阿里2025年10月发布的AI编程命令行工具,属Qoder智能体编程平台形态之一。填入API地址、模型ID和API Key即可接入自带模型,国际版和CN版均适用。

阿里 Qoder CLI 个人版 v1.1.50 开放自定义模型接入

阿里 Qoder CLI 个人版 v1.1.50 开放自定义模型接入

🔗 https://www.ithome.com/1/001/597.htm


5. 阿里千问办公上架麒麟软件商店,已原生适配全部主流操作系统

阿里企业级 Agent 产品千问办公上架麒麟软件商店,银河麒麟用户搜索即可安装。千问办公已支持 Windows、macOS、HarmonyOS、银河麒麟、统信 UOS 等主流操作系统;双方团队在系统登录联动、设备互联、技能调用等核心链路完成攻坚与原生适配。

阿里千问办公上架麒麟软件商店,已原生适配全部主流操作系统

阿里千问办公上架麒麟软件商店,已原生适配全部主流操作系统

🔗 https://www.ithome.com/1/001/562.htm


6. Codex 宠物改版:弹窗直接回复,支持语音与文本

Codex 宠物功能改版:无需打开客户端主界面,直接通过宠物的弹出窗口即可回复特定内容,交互更方便快捷,并支持语音和文本两种输入模式。这次改版让宠物从陪伴展示变成可交互的快捷入口,进一步降低 Codex 的日常使用门槛。以下是官方给出的 demo

Codex 宠物改版:弹窗直接回复,支持语音与文本

🔗 https://x.com/xiaohu/status/2098743051170795859


7. 微软 Copilot 接入 Grok,先面向 Frontier 客户

微软宣布在 Copilot 中上线更多模型:来自 SpaceXAI 的 Grok 模型正在 Word、Excel 和 PowerPoint 的 Copilot 中逐步推出,首先面向 Microsoft Frontier 项目客户进行小范围发布,后续有望逐步扩大覆盖范围,让更多办公用户用上第三方模型。以下是官方给出的 demo

微软 Copilot 接入 Grok,先面向 Frontier 客户

🔗 https://x.com/Microsoft365/status/2098791167185785301


8. Grok Bot 疑似向 Grok Heavy 用户逐步推出

TestingCatalog发现,Grok Bot正在Grok网页版向Grok Heavy订阅用户推出,上线后用户可直接在网页界面创建自己的机器人并与之互动。目前官方尚未发布公告,此次推出可能分阶段进行或存在地区限制,开放范围与时间表有待确认。

Grok Bot 疑似向 Grok Heavy 用户逐步推出

Grok Bot 疑似向 Grok Heavy 用户逐步推出

🔗 https://x.com/testingcatalog/status/2098533001403515368


9. 旗舰模型 Fugu Ultra v2 登陆 OpenRouter

Sakana AI 宣布旗舰编排引擎 Fugu Ultra v2 正式上线 OpenRouter 平台。该引擎面向复杂多步推理、自主研究与全栈软件开发场景打造,追求极致性能表现。开发者现在即可通过 OpenRouter 调用这款旗舰模型,体验其在长程任务编排与自主研究方面的能力。

旗舰模型 Fugu Ultra v2 登陆 OpenRouter

🔗 https://x.com/SakanaAILabs/status/2098795892895580512


10. Qwen3.8-27B 登陆 Cerebras,开放模型获得极速推理

阿里 Qwen 团队宣布 Qwen3.8-27B 现已在 @cerebras 上运行,推理速度飞快,用户可立即体验。开放权重模型与极速推理硬件相遇,开发者无需自行部署 27B 模型即可低延迟调用,Qwen 开放生态的可用性再获提升。以下是官方给出的 demo

Qwen3.8-27B 登陆 Cerebras,开放模型获得极速推理

Qwen3.8-27B 登陆 Cerebras,开放模型获得极速推理

🔗 https://x.com/Alibaba_Qwen/status/2098676748972122394


11. Astra 官方致信用户:完成重置并修复多项质量问题

来源:原文 | rohanpaul_ai

Astra 团队说明重置与质量问题整改进展:一些为旧模型编写的技能触发过于频繁或阻止模型自查,已修复;一项可选的上下文管理实验曾导致回复过早停止或回复旧消息,影响约 4000 至 5000 名用户,已禁用;并移除了配置不当的引擎。

Astra 官方致信用户:完成重置并修复多项质量问题

🔗 https://x.com/thsottiaux/status/2098612714704891959


12. DeepSeek V4.1 Flash 的 Agent 框架性能对比

DeepSeek V4.1 Flash 技术报告的章节 5.3.4 对比了模型在不同 Coding Agent 框架下的表现具体来看,测试涵盖 Claude Code、Codex、OpenCode 等,极简主义的 mini-SWE 反而以 74.2 拿下 DeepSWE 全场最高分,各框架下性能表现相对一致,对工具选型有实用参考价值。

DeepSeek V4.1 Flash 的 Agent 框架性能对比

DeepSeek V4.1 Flash 的 Agent 框架性能对比

🔗 https://x.com/shao__meng/status/2098615707953254567


13. 配套CLI与Skills,浙大开源可插拔Agent评测底座

浙大团队开源可插拔 Agent 评测底座,配套 CLI 与 Skills,主打告别海量脚手架。传统 Agent 评测需为每个被测对象单独搭脚手架,维护成本高;该底座以可插拔方式接入,借助自带 CLI 与 Skills 降低成本,让开发者专注 Agent 能力而非测试基础设施。

配套CLI与Skills,浙大开源可插拔Agent评测底座

🔗 https://mp.weixin.qq.com/s?__biz=MzIzNjc1NzUzMw==&mid=2247922331&idx=2&sn=31d53cffe48bc2b01fe20512a63dc043


🧪 芯片半导体

14. OpenAI 公开自研 AI 推理芯片 Jalapeno 完整架构

OpenAI在Hot Chips 2026大会上公布了与博通联合开发的首颗定制推理加速器Jalapeno的完整架构,采用台积电3nm工艺设计上不追求纸面峰值性能,而是力求让ChatGPT和API用户感受到更快的响应速度, siliconcodesign 也对其展开系统架构解析,超越单纯的FLOPS参数,探讨周边网络架构。

OpenAI 公开自研 AI 推理芯片 Jalapeno 完整架构

OpenAI 公开自研 AI 推理芯片 Jalapeno 完整架构

🔗 https://x.com/dotey/status/2098836752765006266


15. 英特尔 NPU 驱动 1.38 支持 Ubuntu 26.04 LTS

英特尔正式发布Linux NPU Driver 1.38,核心变化是官方支持Ubuntu 26.04 LTS,此前已能在该系统运行驱动覆盖从Meteor Lake到Wildcat Lake的全部五代NPU平台,实现跨代兼容,搭配默认Linux内核即可稳定使用。此外,较新硬件负载测试通过率达98%,用户可从GitHub发布页面下载安装包。

英特尔 NPU 驱动 1.38 支持 Ubuntu 26.04 LTS

英特尔 NPU 驱动 1.38 支持 Ubuntu 26.04 LTS

英特尔 NPU 驱动 1.38 支持 Ubuntu 26.04 LTS

🔗 https://news.mydrivers.com/1/1150/1150696.htm


16. 苹果 A20 Pro 刷新 Geekbench 7 单核纪录

苹果 A20 Pro 手机 SoC 在 Geekbench 7 单核测试中刷新纪录:这颗 2nm 芯片大幅领先所有智能手机处理器,对比台式机英特尔酷睿 i9 与 AMD 锐龙 9 最高领先 32%,甚至超越了最新的笔记本电脑处理器,移动端芯片的单核性能优势进一步扩大。

苹果 A20 Pro 刷新 Geekbench 7 单核纪录

苹果 A20 Pro 刷新 Geekbench 7 单核纪录

🔗 https://www.tomshardware.com/pc-components/cpus/apples-a20-pro-shatters-geekbench-7-single-core-record-2nm-chip-beats-desktop-intel-core-i9-and-amd-ryzen-9-by-up-to-32-percent


17. DeepSeek 减少 HBM 使用量,三星、SK 海力士股价同时下跌

DeepSeek V4.1 Flash 通过 CSA2 架构与 FP4 存储将 KV Cache 压缩至上一代约四分之一,引发市场对 HBM 单位需求下降的担忧,三星与 SK 海力士股价一度分别下跌约 3.5% 和 2.2%,但当前 HBM 供应依然紧张,对供需格局的冲击仍有待观察。

DeepSeek 减少 HBM 使用量,三星、SK 海力士股价同时下跌

🔗 https://www.bestblogs.dev/article/7b17ee7c93?utm_source=rss&utm_medium=feed&utm_campaign=resources&entry=rss_article_item


📌 模型排行榜

18. Artificial Analysis AI 模型能力排行榜

最后是今日的 AI 模型能力排行榜单,智力榜前三为Claude Fable 5.1与GPT-6 Astra并列第一(均53分),Claude Opus 5以51分居第三。头部呈双雄缠斗、Anthropic系紧随之势。国产开源方面,GLM-5.3以45分列第7,Kimi K3以44分列第9,稳居前十。

Artificial Analysis AI 模型能力排行榜

🔗 https://artificialanalysis.ai/

以上是今天的AI 风向标,欢迎在评论区提出建议,我们明天见。

AI 时代程序员必备技能

Codex、Claude Code、Cursor、Hermes Agent、OpenClaw等工程化实战专栏 ,讲透 AI 如何接管脏活累活

内容概要:本文聚焦于电力系统中风场景的生成与削减问题,系统性地应用m-ISODATA、k-means和HAC三种无监督聚类算法对大规模风力发电数据进行处理,旨在降低风电不确定性带来的计算负担并保留关键时序特征。研究基于Matlab平台实现了完整的数据预处理、聚类建模与结果可视化流程,深入探讨了各算法在确定聚类簇数、划分数据结构及构建层次关系方面的机理差异,并通过实验对比验证了其在场景削减效果、计算效率与鲁棒性方面的性能表现。该方法为含高比例风电的电力系统提供了高效、可靠的典型场景集构建手段,支撑后续的随机优化、风险评估与调度决策。; 适合人群:具备电力系统分析基础、熟悉Matlab编程的研究生、科研人员以及从事新能源并网、电力系统规划与运行优化的工程技术人员。; 使用场景及目标:①应对风电出力强随机性与波动性,为随机规划、鲁棒优化等高级应用提供精简且具代表性的输入场景;②深入比较m-ISODATA(自适应确定簇数)、k-means(高效快速划分)与HAC(构建层次化场景结构)三类算法的技术特点与适用边界,指导实际项目中算法选型;③通过代码实践掌握从原始风速/功率数据清洗、特征提取、距离度量选择、聚类有效性评估到最终场景概率赋值的全流程技术栈。; 阅读建议:学习者应结合提供的Matlab代码进行动手实践,重点理解数据标准化、欧式距离与动态时间规整(DTW)等相似性度量的选择依据、聚类数目评估指标(如肘部法则、轮廓系数)的应用,以及如何通过削减前后场景的概率分布和典型性来检验结果质量,并可进一步将此方法迁移至光伏发电、负荷等其他不确定性场景的建模与简化研究中。
内容概要:本文围绕2026年高教社杯全国大学生数学建模竞赛A题“药材的烘干问题”,提供了一套完整的数学建模解决方案,涵盖问题分析、模型构建、算法求解与结果验证全过程。文中详细探讨了药材烘干过程中温度、湿度、风速等关键参数对干燥效率与品质的影响,建立了基于传热传质理论的动态数学模型,并结合实际约束条件,采用优化算法对烘干工艺进行参数调优。此外,资源包内还包含配套的MATLAB代码与论文撰写模板,实现了从理论建模到编程实现再到成果输出的一体化支持,具有较强的实践指导意义。; 适合人群:全国大学生数学建模竞赛参赛学生,尤其是具备一定数学建模基础、编程能力(如MATLAB)和优化理论知识的本科高年级学生或研究生;也可供从事农业工程、中药加工、干燥技术等领域研究的技术人员参考。; 使用场景及目标:①应用于数学建模竞赛中对实际工程问题的建模与求解训练;②掌握传热传质模型在农产品干燥中的应用方法;③学习如何将物理过程转化为数学模型并利用优化算法求解;④获取可复用的代码框架与论文写作范式,提升竞赛备赛效率。; 阅读建议:建议读者结合所提供的代码与数据同步运行、调试模型,深入理解各模块的设计逻辑;在学习过程中重点关注模型假设的合理性、参数敏感性分析及结果可视化表达技巧,以全面提升建模综合能力。
内容概要:本文围绕2026年高教社杯全国大学生数学建模竞赛C题“网与外部电网电力调控策略”展开,系统研究了电网内部源--储的协同优化调度及其与主电网的能量交互机制。内容涵盖电力系统建模、不确定性因素(如风光出力波动、负荷变化)的处理方法,重点引入鲁棒优化、两阶段优化等先进建模技术以提升策略的稳定性与实用性。研究不仅构建了完整的数学模型,还配套提供了Matlab代码实现、仿真结果分析及论文撰写框架,帮助使用者从理论到实践全面掌握问题求解路径。此外,资源包中包含了详细的运行结果展示、参考文献支持以及可复现的完整资料下载链接,极大提升了学习与参赛效率。; 适合人群:全国大学生数学建模竞赛参赛学生,尤其是具备一定数学建模基础、Matlab编程能力及电力系统相关知识的本科生与研究生;同时也适用于从事电网优化、能源调度、智能电网等领域研究的科研人员和技术开发者。; 使用场景及目标:①用于备赛训练,快速掌握C题核心建模思路与求解流程,提升竞赛实战能力;②学习电网在不确定性环境下的优化调度方法,深入理解鲁棒优化、场景削减、多目标协调等关键技术在能源系统中的实际应用;③通过提供的代码与论文模板进行修改与拓展,完成高质量的建模作品或科研原型。; 其他说明:该资源为免费分享内容,包含题目解析、完整代码、仿真结果与论文框架,可通过指定公众号“荔枝科研社”或百度网盘链接获取全套资料。建议使用者结合实际数据进行模型调参与结果验证,以增强模型的适应性与创新性,同时鼓励在原有基础上开展延伸研究,提升学术与应用价值。
评论
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

一只云卷云舒

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值