智谱神秘模型Ox Alpha被曝光、DeepSeek周末统一低峰价、5090跑DeepSeek-V4-Flash每秒25 token | 8月23日 AI日报

AI 时代程序员必备技能

Codex、Claude Code、Cursor、Hermes Agent、OpenClaw等工程化实战专栏 ,讲透 AI 如何接管脏活累活

💡 今日趋势速览:社区通过报错信息扒出神秘模型Ox Alpha出自智谱,开源侦探精神持续发力,DeepSeek取消周末峰谷价差降低API使用成本,UC Berkeley与MIT开源推理引擎在RTX 5090上跑通284B模型且快于llama.cpp,开源生态正加速追赶闭源能力。

🎯 今日要点

  1. 神秘模型 Ox Alpha 被曝出自智谱,报错信息暴露身份
  2. DeepSeek 取消周末峰谷价差,周六日全天按低峰价计费
  3. UC Berkeley 与 MIT 开源推理引擎,实测跑 284B 模型

📋 今日内容汇总

🤖 AI动态

  1. 神秘模型 Ox Alpha 被曝出自智谱,报错信息暴露身份
  2. DeepSeek 取消周末峰谷价差,周六日全天按低峰价计费
  3. UC Berkeley 与 MIT 开源推理引擎,实测跑 284B 模型
  4. VA-Judger 发布,首个音视频一体的裁判模型
  5. ChatGPT Android 客户端被发现藏有社交功能字符串
  6. 曝 OpenAI 研发两款新图像模型,代号 mona-lisa-1 等
  7. Claude Code 支持从手机直接启动远程会话
  8. 国产开源 8B 生图模型发布,号称比肩闭源 Image 2
  9. Inherent 发布小参数智能体 Faraday,科研复现超越 GPT-5.5

🔌 AI基础设施

  1. 中诚华隆发布 HL200 推理芯片,集群可扩展至万卡

🦾 机器人具身智能

  1. 众擎机器人发布仿人脑具身智能引擎 EngineAI Awaken
  2. 荣耀机器人闪电百米跑出 9 秒 32,快于人类纪录

📦 开源项目

  1. 开源自进化 Agent 项目 Prime Agent 登上 GitHub 热榜

📌 模型排行榜

  1. Artificial Analysis AI 模型能力排行榜

🤖 AI动态

1. 神秘模型 Ox Alpha 被曝出自智谱,报错信息暴露身份

神秘模型Ox Alpha的身份被曝出自智谱(Zhipu)。此前社区只能靠分词器特征和emoji频率猜测。作者另辟蹊径,向模型发送格式错误请求,使其抛出Java堆栈跟踪,暴露内部类名paas/v4/ch,让服务器亲口报出了自己的名字。

神秘模型 Ox Alpha 被曝出自智谱,报错信息暴露身份

神秘模型 Ox Alpha 被曝出自智谱,报错信息暴露身份

🔗 https://x.com/chetaslua/status/2091086141764354364


2. DeepSeek 取消周末峰谷价差,周六日全天按低峰价计费

DeepSeek宣布8月23日起调整API计费:周六周日全天统一按低峰价格收费,工作日维持峰谷分时计费。此前,DeepSeek已将V4-Flash和V4-Pro的API切换为峰谷计费模式,峰时价格最高可达低峰的两倍。在此基础上,工作日(周一至周五)继续执行峰谷分段计费

DeepSeek 取消周末峰谷价差,周六日全天按低峰价计费

DeepSeek 取消周末峰谷价差,周六日全天按低峰价计费

🔗 https://x.com/0xLogicrw/status/2091152910378012891


3. UC Berkeley 与 MIT 开源推理引擎,实测跑 284B 模型

UC Berkeley与MIT研究人员开源新推理引擎,在RTX 5090上运行DeepSeek-V4-Flash 284B模型,每秒处理25 token,速度比llama.cpp快1.46倍,Ollama无法运行;Qwen3.6-35B基准测试速度是Ollama的3倍。在此基础上,游戏电脑可交互运行前沿模型,使用官方权重无需极端量化以下是官方给出的 demo

UC Berkeley 与 MIT 开源推理引擎,实测跑 284B 模型

UC Berkeley 与 MIT 开源推理引擎,实测跑 284B 模型

🔗 https://x.com/Hesamation/status/2090930324817498246


4. VA-Judger 发布,首个音视频一体的裁判模型

VA-Judger 是首个音视频一体的裁判模型。针对 AI 生成内容中画面声音不同步、嘴型对不上台词等问题,它不再把画面清晰度与声音质量分开打分,而是像真人一样将画面、声音和文字要求综合评判,并依据打分指导生成模型优化。以下是官方给出的 demo

VA-Judger 发布,首个音视频一体的裁判模型

🔗 https://x.com/Gorden_Sun/status/2091138655859696100


5. ChatGPT Android 客户端被发现藏有社交功能字符串

有博主在最新版ChatGPT安卓客户端中发现一批未发布的功能字符串,包括ChatGPT with Friends、Inbox等。这些功能涉及与朋友分享回复、图片和创作内容,然后在ChatGPT上继续对话。功能界面显示ChatGPT with Friends、Inbox、Connections、创建群聊、邀请好友等选项,显示ChatGPT可能正在筹备社交功能。

ChatGPT Android 客户端被发现藏有社交功能字符串

ChatGPT Android 客户端被发现藏有社交功能字符串

ChatGPT Android 客户端被发现藏有社交功能字符串

🔗 https://x.com/MaxForAI/status/2091250456429510699


6. 曝 OpenAI 研发两款新图像模型,代号 mona-lisa-1 等

消息称 OpenAI 研发两款新图像模型:mona-lisa-1 推测为 GPT-Image-2.5,luna-lisa-alpha 为基于 GPT Luna 的 GPT-Image 2.5 Mini。大模型较 GPT-Image-2 有明显但不惊艳的提升,小模型更快、水平与当前相当,两者仍存在噪点伪影问题。

曝 OpenAI 研发两款新图像模型,代号 mona-lisa-1 等

🔗 https://x.com/mark_k/status/2091212198722822347


7. Claude Code 支持从手机直接启动远程会话

Claude Code 现支持从手机直接启动会话:任何运行 claude remote-control 的机器都会在 Code 标签页顶部显示为设备卡片,点击后选择目录即可在那台机器上启动会话。手机还会与机器上的运行状态保持同步,会话恢复或 Claude Code 退出时手机端会相应更新。

Claude Code 支持从手机直接启动远程会话

🔗 https://code.claude.com/docs/en/remote-control


8. 国产开源 8B 生图模型发布,号称比肩闭源 Image 2

国产生图模型三周内迎来重大升级,正式版主打更完整、更准确、更稳定,号称比肩闭源Image2。模型开源且仅8B大小,支持4K直出在此基础上,多图协同生成能力显著提升:输入九张美食照片并附Prompt,即可自动统一风格与布局

国产开源 8B 生图模型发布,号称比肩闭源 Image 2

国产开源 8B 生图模型发布,号称比肩闭源 Image 2

🔗 https://hub.baai.ac.cn/view/57331


9. Inherent 发布小参数智能体 Faraday,科研复现超越 GPT-5.5

伦敦 AI 实验室 Inherent 由前 DeepMind 员工创立,以 5000 万美元种子轮出道数周后推出科研智能体 Faraday:使用远小于旗舰规模的模型,在事先不知答案、自主复现已发表论文结果的科研任务上击败 GPT-5.5 与 Claude Opus 4.8,长期目标是发现全新科学知识。

Inherent 发布小参数智能体 Faraday,科研复现超越 GPT-5.5

🔗 https://www.ithome.com/0/993/133.htm


🔌 AI基础设施

10. 中诚华隆发布 HL200 推理芯片,集群可扩展至万卡

中诚华隆推出HL200推理芯片及超节点智算集群方案,能效比达5.12 TFLOPS/W,集群最高可扩展至万卡。该芯片单卡FP4算力4P、FP8算力2P、FP16/BF16算力0.5P,原生支持FP4、FP8低精度推理;集群单机柜支持64张GPU互联

中诚华隆发布 HL200 推理芯片,集群可扩展至万卡

中诚华隆发布 HL200 推理芯片,集群可扩展至万卡

🔗 https://www.ithome.com/0/993/108.htm


🦾 机器人具身智能

11. 众擎机器人发布仿人脑具身智能引擎 EngineAI Awaken

据界面新闻报道,众擎机器人正式发布仿人脑具身智能引擎 EngineAI Awaken。该引擎以仿人脑为设计方向,定位于具身智能领域,是众擎机器人对外发布的最新技术成果,具体技术细节与落地应用尚待官方进一步披露。

众擎机器人发布仿人脑具身智能引擎 EngineAI Awaken

🔗 https://www.jiemian.com/article/14970195.html


12. 荣耀机器人闪电百米跑出 9 秒 32,快于人类纪录

8月22日第二届世界人形机器人运动会在北京开幕,荣耀战队机器人闪电备赛百米测试,成绩9秒32、峰值14.5米/秒,打破人类百米纪录。随后,本届运动会设50个赛项,闪电将参与100米等项目。闪电还将参加100米、400米和1500米三个竞速项目

荣耀机器人闪电百米跑出 9 秒 32,快于人类纪录

荣耀机器人闪电百米跑出 9 秒 32,快于人类纪录

荣耀机器人闪电百米跑出 9 秒 32,快于人类纪录

🔗 https://www.ithome.com/0/992/981.htm


📦 开源项目

13. 开源自进化 Agent 项目 Prime Agent 登上 GitHub 热榜

基于pi构建的开源Agent项目Prime Agent登上GitHub热榜,Star数已达17.7K。它定位面向编程、研究和长时间自主任务,能把复杂任务拆分给多个子Agent,终端断开后仍可继续工作,还会从自身执行记录中总结经验,用于更新下一代版本。

开源自进化 Agent 项目 Prime Agent 登上 GitHub 热榜

开源自进化 Agent 项目 Prime Agent 登上 GitHub 热榜

🔗 https://mp.weixin.qq.com/s?__biz=MzUxNjg4NDEzNA==&mid=2247536098&idx=1&sn=f5d705af93475ffc2faa1d42915a7d61


📌 模型排行榜

14. Artificial Analysis AI 模型能力排行榜

最后是今日的 AI 模型能力排行榜单,智力榜上,Claude Opus 5(63分)领跑,Claude Fable 5(62分)第二,GPT-5.6 Sol 与 Grok 4.6 同以61分并列第三。智能体榜头部胶着,Claude Opus 5、GLM-5.3、Grok 4.6 同以59分并列第一。

Artificial Analysis AI 模型能力排行榜

Artificial Analysis AI 模型能力排行榜

🔗 https://artificialanalysis.ai/?intelligence=artificial-analysis-intelligence-index#intelligence-tabs

以上是今天的AI 风向标,欢迎在评论区提出建议,我们明天见。

AI 时代程序员必备技能

Codex、Claude Code、Cursor、Hermes Agent、OpenClaw等工程化实战专栏 ,讲透 AI 如何接管脏活累活

内容概要:本文系统研究了在高阶矩约束下,如何通过数值稳定的算法重建最大熵分布,并将其应用于扩展不确定度的评估中。该方法基于有限的统计矩信息(如均值、方差、偏度、峰度等)构建最符合实测数据的概率分布,克服传统方法中人为设定分布形态所带来的偏差。文中提出了一种改进的数值求解策略,有效缓解了高阶矩条件下常见的病态问题与计算不稳定性,显著提升了算法的收敛性、鲁棒性与计算效率。结合Matlab代码实现,验证了该算法在复杂工程系统不确定度量化中的实用性和优越性,尤其适用于高阶统计特征显著的场景。; 适合人群:具备概率统计、数值分析与优化算法基础,从事科学研究或工程建模的研究生、工程师及科研人员,尤其适用于需要进行高精度不确定性量化、风险评估与概率建模的领域从业者。; 使用场景及目标:①在仅有少量实验数据且缺乏完整分布先验时,重建最合理的概率分布;②提升扩展不确定度评估的科学性与准确性,避免主观假设干扰;③为复杂系统建模、可靠性分析、质量控制、金融风险评估等提供稳健的概率建模工具; 阅读建议:读者应结合所提供的Matlab代码深入理解算法实现细节,重点关注拉格朗乘子的迭代求解过程、数值正则化技巧与高阶矩条件下的稳定性处理机制,并建议通过实际工程数据进行测试与对比,以掌握算法在不同阶数约束下的性能边界与优化策略。
内容概要:本文档围绕2026年高教社杯全国大学生数学建模竞赛A题“药材的烘干问题”及相关课题,提供了一系列数学建模、仿真与优化的研究资源,涵盖SEM广告投放策略、电力系统优化、路径规划、信号处理等多个方向。其中,对SEM广告投放策略的研究尤为深入,构建了从问题诊断、关键词分类、优化建模到鲁棒决策的完整框架。研究提出基于成本—效益二维归一化的关键词分类方法,将关键词划分为黄金词、重点词、潜力词、问题词和无效词五类,并建立了以注册量最大化为目标的0-1整数规划模型。为应对不确定性,进一步引入条件风险值(CVaR)框架进行鲁棒优化,并设计贪心选词与拉格朗对偶定相结合的两阶段求解算法,以及基于情景生成与滚动优化的动态调整策略,实现了投放策略的精细化与稳健性提升。; 适合人群:具备一定数据分析与建模基础,参加数学建模竞赛或从事运筹优化、数字营销、电力系统等相关领域研究的本科生、研究生及科研人员。; 使用场景及目标:① 学习如何构建完整的广告投放优化模型并应用于实际业务决策;② 掌握整数规划、聚类分析、鲁棒优化等建模方法在复杂决策问题中的综合应用;③ 为数学建模竞赛提供高质量的参考案例与代码资源支持。; 阅读建议:建议结合文档中提供的Matlab代码与论文框架进行实践操作,重点关注模型构建逻辑与算法实现细节,同时可参考其他配套课题拓展技术视野,提升综合建模能力。
评论
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

一只云卷云舒

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值