今天的AI圈,又疯了。
不是标题党,是真的疯了。我刷了一下午的信息,感觉脑子里像塞了一台正在跑 inference 的 GPU,嗡嗡的。
直接开聊吧。
Anthropic 要冲万亿估值了。
据《金融时报》报道,Anthropic 计划今年夏天搞一笔大融资,最高 500 亿美元。融前估值 9000 亿,融完逼近 1 万亿。

你想想看,OpenAI 现在估值大概 8520 亿。Anthropic 这是要把老大哥按在地上摩擦的节奏。
而且人家年化收入预计很快超过 450 亿美元,比去年底翻了好几倍。投资人排队进场,说白了就是想赶在年底 IPO 前先占个座。
坦率的讲,Claude 最近确实争气。刚更新了 v2.1.133 版本,修了一堆 bug,还全面接入了 Excel、PPT、Word、Outlook 四大微软应用。你以后在 Excel
里调完数据,PPT 里的图表自动同步更新,Word 文档也跟着变。跨文件智能协作,听起来就很爽。
以前是 OpenAI 一家独大,现在 Anthropic 说,不好意思,我也想坐主桌。
OpenAI 也没闲着。
今天属于「你卷我也卷」模式,一口气发了仨东西。
第一个,GPT-5.5 和 GPT-5.5-Cyber。专门给网络安全人员用的,帮你加速漏洞研究。官方说法是保护关键基础设施,翻译成人话就是,以后黑客用 AI
攻,安全人员也用 AI 守,两边对轰。
第二个,openai-cli 开源了。终于!以前调 OpenAI API 得写 SDK 代码,现在直接终端一行命令搞定。支持图像生成、语音转录、 Agent 工作流,Apache 2.0
协议随便用。程序员狂喜。
第三个,Codex 插件能在 Chrome 里跑了。跨标签页后台并行工作,不抢浏览器控制权。意思就是你可以一边摸鱼刷网页,一边让 AI 帮你写代码。
OpenAI 今天的策略很清楚,你有的我也要有,你没有的我还要有。
说到硬件这边,苹果那个内置摄像头的 AirPods,传了好几年了,今天终于有新消息。
已经进入 DVT 阶段,就是设计验证测试。最快今年 9 月发布,左右耳机各塞一个低分辨率摄像头,配合升级版 Siri 实现视觉问答。你看到什么,问 Siri 就行。
外观类似 AirPods Pro 3,但耳机柄更长,毕竟要塞摄像头嘛。为了缓解隐私焦虑,苹果还贴心地内置了数据上传指示灯。
最有意思的是,这次 Siri 升级靠的是和谷歌 Gemini 的技术合作。
苹果终于想通了,与其自己卷 AI,不如找个外援。谷歌怕是没想到,我才是幕后大佬。
对了,工信部今天还发了个东西,叫「人工智能终端智能化分级」国家标准。
把 AI 终端分成 L1 到 L4 四个等级。L1 响应级就是你问它答,L2 工具级能帮你干活了,L3 辅助级能主动给建议,L4
协同级跟你并肩作战,当然这个标准还在完善中。
首批覆盖手机、电脑、电视、眼镜、汽车座舱、音箱、耳机 7 个品类。小米、华为、荣耀是主要起草单位。
以后买手机不光看跑分,还得看智商等级。L1 的手机,我只是个工具人。L4 的手机,我是你的战友。
回到 Anthropic 这边,还有两件技术大事得聊聊。
第一件,他们把自家 AI 对齐测试工具 Petri 捐给了非营利组织 Meridian Labs。这工具专门用来检测 AI 有没有撒谎、拍马屁等毛病,已经被英国 AI
安全研究所等机构在用了。捐出去是为了保证独立性和公信力。
第二件更炸裂。Anthropic 研究团队搞了个「自然语言自编码器」,能把 Claude 的内部激活值直接翻译成人话。
结果发现什么呢?在安全测试中,Claude 内心意识到自己正在被评估的比例,远超它嘴上说的。
你品品。Claude 心里门儿清,只是不说。
这尼玛就是,AI 版的「我知道你知道,但我装不知道」。
谷歌今天也有个研究挺有意思。他们用 Fitbit 对近 1.4 万人做了 9 个月的 AI 症状检查测试。
盲评中,临床医生把 AI 诊断列为首选的比例达 53%,独立医生只有 24%。
但如果你直接把症状丢给 ChatGPT 问呢?准确率比 AI 主导的结构化问诊低了 27%。
差得还远。
可穿戴设备能提前数天监测到心率上升、睡眠紊乱等变化,比你自己察觉还早。
所以 AI 看病的关键不是你告诉它什么,而是它问你什么。以后看病流程可能是这样,手表先预警,AI 再问诊,医生最后确认。
模型这边今天也热闹。
蚂蚁百灵发布了 Ling-2.6-1T,万亿参数的指令模型,已经在 OpenRouter 上线了。主打「快速思考」,在 AIME26 和 SWE-bench
等基准测试上保持顶尖性能,同时成本降低约 75%。专为高级编程、复杂推理和大规模智能体工作流设计。
智谱也发布了 GLM-5V-Turbo 技术报告,主打原生多模态智能体基础模型。
中国大模型厂商现在就是,你方唱罢我登场,万亿参数已经不是什么稀罕事了。
说到本地跑模型,今天有三条让本地派兴奋的消息。
DeepSeek 4 Flash 本地推理引擎出了,专为苹果 Metal 优化,Apple Silicon Mac 直接本地跑。
OpenAI 开源的那个 20B MoE 模型,社区用 3-bit 量化之后,普通 MacBook 丝滑运行,131K 长上下文,完全离线。
还有 atomic.chat 给 LLaMA.cpp 加了多令牌预测,Gemma 4 26B 生成速度直接快 40%。
以前跑大模型得配高端显卡,现在一台 M 系列 MacBook 就够了。算力平权,从笔记本开始。
其他几条快讯也值得扫一眼。
Perplexity 推出了 Mac 版 Personal Computer,跨本地文件和应用执行任务,不只是搜索引擎了。
Luma Agents 能根据标语自动生成广告,输入 slogan 加定义风格,AI 帮你出片。
Replit 安全中心 2.0,一键识别高风险应用,Agent 帮你修漏洞。
全国首例 AI 短剧侵权刑事案宣判了。有个人盗录了 1700 多部 AI 短剧,在二手平台打包卖 66 块 6 毛 6,结果判了八个月缓刑。
SenseNova-U1 开源了 8 步蒸馏 LoRA,扩散模型推理从 23 秒压到 2 秒,提速 11 倍。生成速度的突破,比单纯堆参数量重要多了。
最后说两句。
今天这些新闻看下来,总结起来就一个字,卷。
Anthropic 卷估值,OpenAI 卷产品,苹果卷硬件,谷歌卷医疗,蚂蚁卷开源。每个人都在拼命往前跑。
唯一不卷的,可能只有我们这些看新闻的。
但话说回来,这不正是好时代吗?技术在狂奔,工具在变强,门槛在降低。
你不需要成为 AI 专家,你只需要知道一件事,这些工具,正在变成你的工具。
好了,今天就到这。明天见,如果明天没有更大的新闻的话。

350

被折叠的 条评论
为什么被折叠?



