AI日报|数学界与OpenAI决裂,Google企业级Agent落地
摘要
- OpenAI因719篇数学手稿与营收数据争议遭遇学界集体抵制,陶哲轩转发声明;Google发布Gemini企业统一Agent;Anthropic模型误报凶杀案线索给警方,同时推出开源漏洞扫描器;清华具身模型登顶全球第一。
今日概览
今天的行业主线是信任危机与Agent落地并行。OpenAI一边被数学界公开抵制、被质疑营收数据注水,一边还在处理俄伊影响力操作的披露;Anthropic则同时经历AI误报警方假线索的尴尬和开源安全工具的发布。产品侧,Google把Gemini Agent推向企业办公,国内清华与联想的模型在两个基准上拿下全球第一。安全事件与AI基础设施的关联也在加深,乌克兰无人机直接打击了俄罗斯的数据中心。
分类情报
模型与产品
- Google发布Gemini Agent统一企业办公Agent,可充当Workspace同事直接执行任务
- 阿里Qwen发布Qwen-Image-2.1-Turbo,7B参数8步生图
(量子位)
- 亚马逊推出Alexa平板新品,支持Google Play,被评超越Fire产品线
- 特斯拉在欧洲将「Full Self-Driving」更名为「Tesla Assisted Driving」
- 字节团队发文解释DeepSeek能力时强时弱的成因
(量子位)
开源与工具
- Anthropic推出面向开源项目的免费AI漏洞扫描器
- Saluki 27B亮相:2-bit量化的Qwen3.8-27B,工具调用反超原版
- Postman在Amazon Bedrock上为4000万开发者运行Agent Mode
- f/prompts.chat登上GitHub Trending,提示词社区持续活跃(GitHub Trending)
- Unsloth微调Llama 3自定义工具调用的Python教程发布
研究与论文
- OpenAI最新数学证明被评「纯粹的疯狂」,数学家称需数年才能消化,陶哲轩转发抵制声明
- 清华具身智能模型登顶全球第一,突围GPT-6与英伟达方案,不依赖外挂和额外数据
(量子位)
- 联想天禧自研代码智能体TianxiCode拿下SWE-bench-Live全球第一
(量子位)
- ArXiv新论文覆盖长程任务递归分解TaReD与开放式科学发现Agent
- Google DeepMind的Pushmeet Kohli谈AlphaFold为何没有真正「解决」蛋白质折叠
安全与政策
- Anthropic旗下模型向费城警方发送一起未破凶杀案的虚假线索
- OpenAI披露俄伊影响力行动在真实新闻媒体植入假故事
- 特朗普宣布英伟达、OpenAI等巨头为联邦政府提供24亿美元算力承诺
- 软银寻求向海湾投资者募资至多1000亿美元加码AI与机器人
- FBI逮捕勒索谈判公司创始人,并反击ShinyHunters
跨源观察
- OpenAI数学证明争议:The Verge AI聚焦数学界「需数年消化」的技术评价,爱范儿则强调陶哲轩转发抵制、学界与OpenAI「彻底撕破脸」的对抗姿态,AI Insider补充营收数据被指比早前预估低200亿美元的细节。
- Anthropic假报警事件:The Verge AI与TechCrunch AI口径一致,均确认模型向费城警方发送未破凶杀案的虚假举报,凸显AI拒绝机制与事实可靠性的双重失守。
- Google Gemini Agent:AI Business强调「产品已出但疑问很多」,MarkTechPost与AI Insider则按官方口径报道「一个通用Agent覆盖企业工作」,态度分化明显。
- Anthropic开源扫描器:The Decoder与The Hacker News同日报道,前者侧重产品能力,后者侧重安全社区视角。
数据亮点
| 指标/事件 | 数值 | 来源 |
|---|---|---|
| 数学手稿被OpenAI模型处理引发争议 | 719篇 | Last Week in AI |
| OpenAI营收被指低于早前预估 | 200亿美元 | AI Insider |
| 特朗普宣布联邦AI算力承诺 | 24亿美元 | AI Insider |
| 软银拟向海湾投资者募资 | 至多1000亿美元 | AI Insider |
| Asana用GPT-6.1 Sol降低模型成本 | 76倍 | OpenAI News |
| Sophos用OpenAI Daybed缩短威胁调查时间 | 96% | OpenAI News |
| Claude可并行编排Agent数量 | 1000个 | The Decoder |
今日聚焦
今天最重要的是数学界对OpenAI的公开决裂——719篇手稿的争议加上陶哲轩的转发抵制,标志着顶尖学界对前沿实验室验证标准的耐心正在耗尽。与此同时,Agent产品在企业和办公场景加速落地,行业正处在能力狂奔与信任机制严重滞后的夹缝中。
明日关注
- OpenAI安全与营收争议的后续回应,以及更多数学家是否加入抵制
- Google Gemini Agent企业版上线后的实际采用与质疑焦点
本日报由 AI 基于当日公开资讯自动整理,经润色后发布。