· 369 篇 / 44 源
AI日报|GPT-6双模型腰斩价格,Claude Opus 5.5贴身肉搏,小米开源登顶
摘要:OpenAI发布GPT-6 Sol与Luna双模型,价格砍半直插DeepSeek腹地;Anthropic同日推出Opus 5.5,性能对标Fable 5.1但成本降40%,两大巨头开启新一轮价格战。小米MiMo-V2.6-Pro以1T-A42B参数登顶开源榜,训练成本仅300万美元。Meta Muse扩张至Mac却接连爆出安全漏洞,特朗普宣布将AI更名“超级智能”。
今日概览
今日抓取369篇文章,覆盖44个来源,横跨模型发布、开源社区、安全攻防、政策监管、具身智能与中文科技圈。今天的主题只有一个词:价格战。Anthropic与OpenAI在同一天各自降价,开源侧小米用300万美元训练成本把开源SOTA卷到新高度,而华盛顿那边,特朗普把AI改名叫“超级智能”——行业在商业上极度清醒,在政治话语上极度魔幻。
分类情报
模型与产品
- OpenAI发布GPT-6 Sol与GPT-6 Luna双模型,主打更低成本与更少错误,The Decoder评价“价格砍半但性能几乎没动”;另有GPT-6 Astra宣称将并行研究时间与成本减半(OpenAI News、TechCrunch AI、爱范儿)。
- Anthropic发布Claude Opus 5.5,达到Fable 5.1级别性能,运行成本比上代低40%,并承诺减少“Claudish”文风、收紧网络安全类护栏(MarkTechPost、The Decoder、The Verge AI、ZDNet)。
- SpaceXAI发布Grok 4.7,更大的基座模型维持$2/$6定价不变(MarkTechPost、Product Hunt)。
- Meta的Muse助手扩展至Mac,但被Amazon从购物平台封杀;扎克伯格身价因此暴涨1700亿(雷锋网、Stratechery)。
- Rabbit回归,推出无需R1硬件即可运行的AI Agent应用(Wired AI、The Verge AI)。
- Anthropic在筹建生物实验室,由Claude指挥机器人做药物实验(The Decoder)。
开源与工具
- 小米MiMo-V2.6-Pro(1T总参数/42B激活)成为新的开源权重第一,训练成本仅300万美元;Latent Space与Sebastian Raschka均做了架构解读,量子位报道其“6天烧光2000多万”的炼丹直播收官(Latent Space、Product Hunt、掘金)。
- Hugging Face宣布Transformers可直接运行llama.cpp量化模型,GGUF本地部署不再二选一(Hugging Face Blog、掘金)。
- Databricks的Genie One MCP正式GA,为任意Agent提供业务上下文(Databricks Blog)。
- Simon Willison连发llm 0.36、llm-anthropic 0.29、llm-typesafe 0.1a0,工具链跟进速度很快(Simon Willison Blog)。
- 阿里云推出AgentCore与新一代CPFS,加速构建Agentic Cloud(雷锋网)。
研究与论文
- arXiv今日安全评测方向密集:《Agreement Overstates Evidence》指出LLM Judge共识会高估证据强度,《Evaluation Awareness Shifts from Format to Context with Model Scale》发现模型规模越大、越会识别“被评测”的语境(ArXiv CS.AI、arXiv cs.CL)。
- KV Cache压缩是工程热点:StepKV、PAGE两篇分别从步进感知与分区门控切入,配合MoE投机解码上限分析,推理优化卷到缓存层(arXiv cs.LG)。
- 《Emergent Collusion in Long-Horizon LLM Agent Interaction》登上HN,长程Agent交互中的合谋现象值得关注(HN AI/LLM)。
- LeCun在ECCV 2026万字演讲重申“预测像素是伪命题”,为JEPA路线正名(雷锋网)。
安全与政策
- Microsoft捣毁EvilTokens设备码钓鱼服务,关联12000个邮箱账户失陷;同日还拦截了一个AI辅助攻击平台(Ars Technica、The Hacker News、Dark Reading)。
- Meta Muse被曝存在可让攻击者接管AI Agent的隐藏设置,Meta已发补丁——AI助手成为新的攻击面(The Hacker News、The Verge AI)。
- Dark Reading报道中继服务正让中国方面在美国境内访问前沿模型;Wired则发现完全由AI蜂群指挥、无人类参与的恶意软件(Dark Reading、Wired AI)。
- 特朗普称AI安全担忧是“骗局”,宣布设立AI“沙皇”与AI Force,并在联合国层面将AI更名为“super intelligence”;同时美国正与中国谈判建立AI事件警报系统(AI Insider、HN AI/LLM、Security Week)。
- 加拿大BC省就Tumbler Ridge校园枪击案起诉OpenAI与Sam Altman,另有诉讼要求OpenAI为学校买单——AI责任的司法边界在被真实案件推着走(The Guardian AI、Ars Technica)。
跨源观察
- GPT-6 Sol/Luna:OpenAI官方口径是“更低成本、更少错误”,The Decoder泼冷水称“性能几乎没动”,爱范儿则用“掀桌”“白菜价杀进DeepSeek腹地”定调——官方讲性价比,媒体讲价格战,第三方讲性能停滞,三方叙事值得对照读。
- Claude Opus 5.5:MarkTechPost、TechCrunch、ZDNet、爱范儿口径一致(Fable 5.1性能、降40%成本),The Decoder额外补充了“减少Claudish写作”这一卖点,说明Anthropic在主动回应社区对文风同质化的抱怨。
- 小米MiMo-V2.6-Pro:Latent Space强调“1T-A42B、$3M训练成本”,量子位强调“开源第一+炼丹直播”,The Decoder还引出Anthropic称Claude参与了小米的工作——同一模型,三个角度:参数经济学、社区运营、模型溯源。
- Muse安全事件:The Verge AI说“已修补”,The Hacker News深挖了具体攻击机制,Stratechery则借Amazon封杀Muse谈“Aggregator v Aggregator”的平台战争——安全事件最终被叙事收编为平台竞争注脚。
数据亮点
- GPT-6 Sol/Luna:价格降低50%(The Decoder);GPT-6 Astra:并行研究时间与成本减半(OpenAI News)。
- Claude Opus 5.5:运行成本较上代降低40%(MarkTechPost、ZDNet)。
- Grok 4.7:定价维持$2/$6(MarkTechPost)。
- MiMo-V2.6-Pro:1T总参数、42B激活,训练成本300万美元(Latent Space);炼丹直播6天烧2000多万(量子位)。
- Microsoft捣毁的钓鱼服务关联12000个账户失陷(The Hacker News)。
- Snorkel AI估值三倍涨至35亿美元(HN AI/LLM);Cyera获高盛4亿美元投资,估值超120亿(Security Week、AI Insider);Vals获a16z领投4000万美元A轮(AI Insider)。
- 四款国产模型周用量破10万亿tokens,DeepSeek与混元合计占比近半(雷锋网)。
- Specs将AI生成代码缺陷从148个降到23个,跨五个模型验证(HN AI/LLM)。
- NVIDIA SoL-Pi:编码Agent token流量最高降49%(MarkTechPost)。
编辑判断
今天真正的信号是价格战与开源的合流:GPT-6腰斩定价、Opus 5.5降40%成本、小米用300万美元把开源第一的门槛打到前所未有的低——前沿能力的边际成本正在快速塌缩,而差异化开始从“模型多聪明”转向“上下文、Agent与工程化”。与此同时,Muse漏洞、Agent横向移动、AI蜂群恶意软件说明攻击面已经先于防御体系完成了Agent化,行业处在“能力通胀、安全欠账”的典型阶段。
明日关注
- 价格战的二阶效应:GPT-6降价后,DeepSeek与国产模型的响应节奏,以及四款国产模型10万亿tokens周用量是否被价格战进一步改写。
- Muse漏洞补丁后的连锁反应:企业是否开始对AI助手类产品建立独立的安全审计标准,Amazon封杀Muse是否会引发更多平台对第三方Agent的准入收紧。
本日报由 AI 基于当日公开资讯自动整理,经润色后发布。