💡 今日趋势速览:社区通过报错信息扒出神秘模型Ox Alpha出自智谱,开源侦探精神持续发力,DeepSeek取消周末峰谷价差降低API使用成本,UC Berkeley与MIT开源推理引擎在RTX 5090上跑通284B模型且快于llama.cpp,开源生态正加速追赶闭源能力。
🎯 今日要点
📋 今日内容汇总
🤖 AI动态
- 神秘模型 Ox Alpha 被曝出自智谱,报错信息暴露身份
- DeepSeek 取消周末峰谷价差,周六日全天按低峰价计费
- UC Berkeley 与 MIT 开源推理引擎,实测跑 284B 模型
- VA-Judger 发布,首个音视频一体的裁判模型
- ChatGPT Android 客户端被发现藏有社交功能字符串
- 曝 OpenAI 研发两款新图像模型,代号 mona-lisa-1 等
- Claude Code 支持从手机直接启动远程会话
- 国产开源 8B 生图模型发布,号称比肩闭源 Image 2
- Inherent 发布小参数智能体 Faraday,科研复现超越 GPT-5.5
🔌 AI基础设施
🦾 机器人具身智能
📦 开源项目
📌 模型排行榜
🤖 AI动态
神秘模型Ox Alpha的身份被曝出自智谱(Zhipu)。此前社区只能靠分词器特征和emoji频率猜测。作者另辟蹊径,向模型发送格式错误请求,使其抛出Java堆栈跟踪,暴露内部类名paas/v4/ch,让服务器亲口报出了自己的名字。


🔗 https://x.com/chetaslua/status/2091086141764354364
DeepSeek宣布8月23日起调整API计费:周六周日全天统一按低峰价格收费,工作日维持峰谷分时计费。此前,DeepSeek已将V4-Flash和V4-Pro的API切换为峰谷计费模式,峰时价格最高可达低峰的两倍。在此基础上,工作日(周一至周五)继续执行峰谷分段计费


🔗 https://x.com/0xLogicrw/status/2091152910378012891
UC Berkeley与MIT研究人员开源新推理引擎,在RTX 5090上运行DeepSeek-V4-Flash 284B模型,每秒处理25 token,速度比llama.cpp快1.46倍,Ollama无法运行;Qwen3.6-35B基准测试速度是Ollama的3倍。在此基础上,游戏电脑可交互运行前沿模型,使用官方权重无需极端量化以下是官方给出的 demo


🔗 https://x.com/Hesamation/status/2090930324817498246
VA-Judger 是首个音视频一体的裁判模型。针对 AI 生成内容中画面声音不同步、嘴型对不上台词等问题,它不再把画面清晰度与声音质量分开打分,而是像真人一样将画面、声音和文字要求综合评判,并依据打分指导生成模型优化。以下是官方给出的 demo

🔗 https://x.com/Gorden_Sun/status/2091138655859696100
有博主在最新版ChatGPT安卓客户端中发现一批未发布的功能字符串,包括ChatGPT with Friends、Inbox等。这些功能涉及与朋友分享回复、图片和创作内容,然后在ChatGPT上继续对话。功能界面显示ChatGPT with Friends、Inbox、Connections、创建群聊、邀请好友等选项,显示ChatGPT可能正在筹备社交功能。



🔗 https://x.com/MaxForAI/status/2091250456429510699
消息称 OpenAI 研发两款新图像模型:mona-lisa-1 推测为 GPT-Image-2.5,luna-lisa-alpha 为基于 GPT Luna 的 GPT-Image 2.5 Mini。大模型较 GPT-Image-2 有明显但不惊艳的提升,小模型更快、水平与当前相当,两者仍存在噪点伪影问题。

🔗 https://x.com/mark_k/status/2091212198722822347
Claude Code 现支持从手机直接启动会话:任何运行 claude remote-control 的机器都会在 Code 标签页顶部显示为设备卡片,点击后选择目录即可在那台机器上启动会话。手机还会与机器上的运行状态保持同步,会话恢复或 Claude Code 退出时手机端会相应更新。

🔗 https://code.claude.com/docs/en/remote-control
国产生图模型三周内迎来重大升级,正式版主打更完整、更准确、更稳定,号称比肩闭源Image2。模型开源且仅8B大小,支持4K直出在此基础上,多图协同生成能力显著提升:输入九张美食照片并附Prompt,即可自动统一风格与布局


🔗 https://hub.baai.ac.cn/view/57331
伦敦 AI 实验室 Inherent 由前 DeepMind 员工创立,以 5000 万美元种子轮出道数周后推出科研智能体 Faraday:使用远小于旗舰规模的模型,在事先不知答案、自主复现已发表论文结果的科研任务上击败 GPT-5.5 与 Claude Opus 4.8,长期目标是发现全新科学知识。

🔗 https://www.ithome.com/0/993/133.htm
🔌 AI基础设施
中诚华隆推出HL200推理芯片及超节点智算集群方案,能效比达5.12 TFLOPS/W,集群最高可扩展至万卡。该芯片单卡FP4算力4P、FP8算力2P、FP16/BF16算力0.5P,原生支持FP4、FP8低精度推理;集群单机柜支持64张GPU互联


🔗 https://www.ithome.com/0/993/108.htm
🦾 机器人具身智能
据界面新闻报道,众擎机器人正式发布仿人脑具身智能引擎 EngineAI Awaken。该引擎以仿人脑为设计方向,定位于具身智能领域,是众擎机器人对外发布的最新技术成果,具体技术细节与落地应用尚待官方进一步披露。

🔗 https://www.jiemian.com/article/14970195.html
8月22日第二届世界人形机器人运动会在北京开幕,荣耀战队机器人闪电备赛百米测试,成绩9秒32、峰值14.5米/秒,打破人类百米纪录。随后,本届运动会设50个赛项,闪电将参与100米等项目。闪电还将参加100米、400米和1500米三个竞速项目



🔗 https://www.ithome.com/0/992/981.htm
📦 开源项目
基于pi构建的开源Agent项目Prime Agent登上GitHub热榜,Star数已达17.7K。它定位面向编程、研究和长时间自主任务,能把复杂任务拆分给多个子Agent,终端断开后仍可继续工作,还会从自身执行记录中总结经验,用于更新下一代版本。


🔗 https://mp.weixin.qq.com/s?__biz=MzUxNjg4NDEzNA==&mid=2247536098&idx=1&sn=f5d705af93475ffc2faa1d42915a7d61
📌 模型排行榜
最后是今日的 AI 模型能力排行榜单,智力榜上,Claude Opus 5(63分)领跑,Claude Fable 5(62分)第二,GPT-5.6 Sol 与 Grok 4.6 同以61分并列第三。智能体榜头部胶着,Claude Opus 5、GLM-5.3、Grok 4.6 同以59分并列第一。


🔗 https://artificialanalysis.ai/?intelligence=artificial-analysis-intelligence-index#intelligence-tabs
以上是今天的AI 风向标,欢迎在评论区提出建议,我们明天见。


被折叠的 条评论
为什么被折叠?



