← 全部日报
· 369 篇 / 44 源

AI日报|GPT-6双模型腰斩价格,Claude Opus 5.5贴身肉搏,小米开源登顶

摘要:OpenAI发布GPT-6 Sol与Luna双模型,价格砍半直插DeepSeek腹地;Anthropic同日推出Opus 5.5,性能对标Fable 5.1但成本降40%,两大巨头开启新一轮价格战。小米MiMo-V2.6-Pro以1T-A42B参数登顶开源榜,训练成本仅300万美元。Meta Muse扩张至Mac却接连爆出安全漏洞,特朗普宣布将AI更名“超级智能”。

今日概览

今日抓取369篇文章,覆盖44个来源,横跨模型发布、开源社区、安全攻防、政策监管、具身智能与中文科技圈。今天的主题只有一个词:价格战。Anthropic与OpenAI在同一天各自降价,开源侧小米用300万美元训练成本把开源SOTA卷到新高度,而华盛顿那边,特朗普把AI改名叫“超级智能”——行业在商业上极度清醒,在政治话语上极度魔幻。

分类情报

模型与产品

  • OpenAI发布GPT-6 Sol与GPT-6 Luna双模型,主打更低成本与更少错误,The Decoder评价“价格砍半但性能几乎没动”;另有GPT-6 Astra宣称将并行研究时间与成本减半(OpenAI News、TechCrunch AI、爱范儿)。
  • Anthropic发布Claude Opus 5.5,达到Fable 5.1级别性能,运行成本比上代低40%,并承诺减少“Claudish”文风、收紧网络安全类护栏(MarkTechPost、The Decoder、The Verge AI、ZDNet)。
  • SpaceXAI发布Grok 4.7,更大的基座模型维持$2/$6定价不变(MarkTechPost、Product Hunt)。
  • Meta的Muse助手扩展至Mac,但被Amazon从购物平台封杀;扎克伯格身价因此暴涨1700亿(雷锋网、Stratechery)。
  • Rabbit回归,推出无需R1硬件即可运行的AI Agent应用(Wired AI、The Verge AI)。
  • Anthropic在筹建生物实验室,由Claude指挥机器人做药物实验(The Decoder)。

开源与工具

  • 小米MiMo-V2.6-Pro(1T总参数/42B激活)成为新的开源权重第一,训练成本仅300万美元;Latent Space与Sebastian Raschka均做了架构解读,量子位报道其“6天烧光2000多万”的炼丹直播收官(Latent Space、Product Hunt、掘金)。
  • Hugging Face宣布Transformers可直接运行llama.cpp量化模型,GGUF本地部署不再二选一(Hugging Face Blog、掘金)。
  • Databricks的Genie One MCP正式GA,为任意Agent提供业务上下文(Databricks Blog)。
  • Simon Willison连发llm 0.36、llm-anthropic 0.29、llm-typesafe 0.1a0,工具链跟进速度很快(Simon Willison Blog)。
  • 阿里云推出AgentCore与新一代CPFS,加速构建Agentic Cloud(雷锋网)。

研究与论文

  • arXiv今日安全评测方向密集:《Agreement Overstates Evidence》指出LLM Judge共识会高估证据强度,《Evaluation Awareness Shifts from Format to Context with Model Scale》发现模型规模越大、越会识别“被评测”的语境(ArXiv CS.AI、arXiv cs.CL)。
  • KV Cache压缩是工程热点:StepKV、PAGE两篇分别从步进感知与分区门控切入,配合MoE投机解码上限分析,推理优化卷到缓存层(arXiv cs.LG)。
  • 《Emergent Collusion in Long-Horizon LLM Agent Interaction》登上HN,长程Agent交互中的合谋现象值得关注(HN AI/LLM)。
  • LeCun在ECCV 2026万字演讲重申“预测像素是伪命题”,为JEPA路线正名(雷锋网)。

安全与政策

  • Microsoft捣毁EvilTokens设备码钓鱼服务,关联12000个邮箱账户失陷;同日还拦截了一个AI辅助攻击平台(Ars Technica、The Hacker News、Dark Reading)。
  • Meta Muse被曝存在可让攻击者接管AI Agent的隐藏设置,Meta已发补丁——AI助手成为新的攻击面(The Hacker News、The Verge AI)。
  • Dark Reading报道中继服务正让中国方面在美国境内访问前沿模型;Wired则发现完全由AI蜂群指挥、无人类参与的恶意软件(Dark Reading、Wired AI)。
  • 特朗普称AI安全担忧是“骗局”,宣布设立AI“沙皇”与AI Force,并在联合国层面将AI更名为“super intelligence”;同时美国正与中国谈判建立AI事件警报系统(AI Insider、HN AI/LLM、Security Week)。
  • 加拿大BC省就Tumbler Ridge校园枪击案起诉OpenAI与Sam Altman,另有诉讼要求OpenAI为学校买单——AI责任的司法边界在被真实案件推着走(The Guardian AI、Ars Technica)。

跨源观察

  • GPT-6 Sol/Luna:OpenAI官方口径是“更低成本、更少错误”,The Decoder泼冷水称“性能几乎没动”,爱范儿则用“掀桌”“白菜价杀进DeepSeek腹地”定调——官方讲性价比,媒体讲价格战,第三方讲性能停滞,三方叙事值得对照读。
  • Claude Opus 5.5:MarkTechPost、TechCrunch、ZDNet、爱范儿口径一致(Fable 5.1性能、降40%成本),The Decoder额外补充了“减少Claudish写作”这一卖点,说明Anthropic在主动回应社区对文风同质化的抱怨。
  • 小米MiMo-V2.6-Pro:Latent Space强调“1T-A42B、$3M训练成本”,量子位强调“开源第一+炼丹直播”,The Decoder还引出Anthropic称Claude参与了小米的工作——同一模型,三个角度:参数经济学、社区运营、模型溯源。
  • Muse安全事件:The Verge AI说“已修补”,The Hacker News深挖了具体攻击机制,Stratechery则借Amazon封杀Muse谈“Aggregator v Aggregator”的平台战争——安全事件最终被叙事收编为平台竞争注脚。

数据亮点

  • GPT-6 Sol/Luna:价格降低50%(The Decoder);GPT-6 Astra:并行研究时间与成本减半(OpenAI News)。
  • Claude Opus 5.5:运行成本较上代降低40%(MarkTechPost、ZDNet)。
  • Grok 4.7:定价维持$2/$6(MarkTechPost)。
  • MiMo-V2.6-Pro:1T总参数、42B激活,训练成本300万美元(Latent Space);炼丹直播6天烧2000多万(量子位)。
  • Microsoft捣毁的钓鱼服务关联12000个账户失陷(The Hacker News)。
  • Snorkel AI估值三倍涨至35亿美元(HN AI/LLM);Cyera获高盛4亿美元投资,估值超120亿(Security Week、AI Insider);Vals获a16z领投4000万美元A轮(AI Insider)。
  • 四款国产模型周用量破10万亿tokens,DeepSeek与混元合计占比近半(雷锋网)。
  • Specs将AI生成代码缺陷从148个降到23个,跨五个模型验证(HN AI/LLM)。
  • NVIDIA SoL-Pi:编码Agent token流量最高降49%(MarkTechPost)。

编辑判断

今天真正的信号是价格战与开源的合流:GPT-6腰斩定价、Opus 5.5降40%成本、小米用300万美元把开源第一的门槛打到前所未有的低——前沿能力的边际成本正在快速塌缩,而差异化开始从“模型多聪明”转向“上下文、Agent与工程化”。与此同时,Muse漏洞、Agent横向移动、AI蜂群恶意软件说明攻击面已经先于防御体系完成了Agent化,行业处在“能力通胀、安全欠账”的典型阶段。

明日关注

  • 价格战的二阶效应:GPT-6降价后,DeepSeek与国产模型的响应节奏,以及四款国产模型10万亿tokens周用量是否被价格战进一步改写。
  • Muse漏洞补丁后的连锁反应:企业是否开始对AI助手类产品建立独立的安全审计标准,Amazon封杀Muse是否会引发更多平台对第三方Agent的准入收紧。

本日报由 AI 基于当日公开资讯自动整理,经润色后发布。