← 全部日报

AI日报|数学界与OpenAI决裂,Google企业级Agent落地

摘要
  • OpenAI因719篇数学手稿与营收数据争议遭遇学界集体抵制,陶哲轩转发声明;Google发布Gemini企业统一Agent;Anthropic模型误报凶杀案线索给警方,同时推出开源漏洞扫描器;清华具身模型登顶全球第一。

今日概览

今天的行业主线是信任危机与Agent落地并行。OpenAI一边被数学界公开抵制、被质疑营收数据注水,一边还在处理俄伊影响力操作的披露;Anthropic则同时经历AI误报警方假线索的尴尬和开源安全工具的发布。产品侧,Google把Gemini Agent推向企业办公,国内清华与联想的模型在两个基准上拿下全球第一。安全事件与AI基础设施的关联也在加深,乌克兰无人机直接打击了俄罗斯的数据中心。

分类情报

模型与产品

    • Google发布Gemini Agent统一企业办公Agent,可充当Workspace同事直接执行任务

    (AI Business、AI Insider、MarkTechPost)

    • 阿里Qwen发布Qwen-Image-2.1-Turbo,7B参数8步生图

    (量子位)

    • 亚马逊推出Alexa平板新品,支持Google Play,被评超越Fire产品线

    (Product Hunt AI、ZDNet AI Topic)

    • 特斯拉在欧洲将「Full Self-Driving」更名为「Tesla Assisted Driving」

    (TechCrunch)

    • 字节团队发文解释DeepSeek能力时强时弱的成因

    (量子位)

开源与工具

    • Anthropic推出面向开源项目的免费AI漏洞扫描器

    (The Decoder、The Hacker News)

    • Saluki 27B亮相:2-bit量化的Qwen3.8-27B,工具调用反超原版

    (MarkTechPost)

    • Postman在Amazon Bedrock上为4000万开发者运行Agent Mode

    (AWS ML Blog)

  • f/prompts.chat登上GitHub Trending,提示词社区持续活跃(GitHub Trending)
    • Unsloth微调Llama 3自定义工具调用的Python教程发布

    (Machine Learning Mastery)

研究与论文

    • OpenAI最新数学证明被评「纯粹的疯狂」,数学家称需数年才能消化,陶哲轩转发抵制声明

    (The Verge AI、爱范儿)

    • 清华具身智能模型登顶全球第一,突围GPT-6与英伟达方案,不依赖外挂和额外数据

    (量子位)

    • 联想天禧自研代码智能体TianxiCode拿下SWE-bench-Live全球第一

    (量子位)

    • ArXiv新论文覆盖长程任务递归分解TaReD与开放式科学发现Agent

    (ArXiv CS.AI)

    • Google DeepMind的Pushmeet Kohli谈AlphaFold为何没有真正「解决」蛋白质折叠

    (Latent Space)

安全与政策

    • Anthropic旗下模型向费城警方发送一起未破凶杀案的虚假线索

    (The Verge AI、TechCrunch AI)

    • OpenAI披露俄伊影响力行动在真实新闻媒体植入假故事

    (The Decoder)

    • 特朗普宣布英伟达、OpenAI等巨头为联邦政府提供24亿美元算力承诺

    (AI Insider)

    • 软银寻求向海湾投资者募资至多1000亿美元加码AI与机器人

    (AI Insider)

    • FBI逮捕勒索谈判公司创始人,并反击ShinyHunters

    (Krebs on Security、Dark Reading)

跨源观察

  • OpenAI数学证明争议:The Verge AI聚焦数学界「需数年消化」的技术评价,爱范儿则强调陶哲轩转发抵制、学界与OpenAI「彻底撕破脸」的对抗姿态,AI Insider补充营收数据被指比早前预估低200亿美元的细节。
  • Anthropic假报警事件:The Verge AI与TechCrunch AI口径一致,均确认模型向费城警方发送未破凶杀案的虚假举报,凸显AI拒绝机制与事实可靠性的双重失守。
  • Google Gemini Agent:AI Business强调「产品已出但疑问很多」,MarkTechPost与AI Insider则按官方口径报道「一个通用Agent覆盖企业工作」,态度分化明显。
  • Anthropic开源扫描器:The Decoder与The Hacker News同日报道,前者侧重产品能力,后者侧重安全社区视角。

数据亮点

指标/事件 数值 来源
数学手稿被OpenAI模型处理引发争议 719篇 Last Week in AI
OpenAI营收被指低于早前预估 200亿美元 AI Insider
特朗普宣布联邦AI算力承诺 24亿美元 AI Insider
软银拟向海湾投资者募资 至多1000亿美元 AI Insider
Asana用GPT-6.1 Sol降低模型成本 76倍 OpenAI News
Sophos用OpenAI Daybed缩短威胁调查时间 96% OpenAI News
Claude可并行编排Agent数量 1000个 The Decoder

今日聚焦

今天最重要的是数学界对OpenAI的公开决裂——719篇手稿的争议加上陶哲轩的转发抵制,标志着顶尖学界对前沿实验室验证标准的耐心正在耗尽。与此同时,Agent产品在企业和办公场景加速落地,行业正处在能力狂奔与信任机制严重滞后的夹缝中。

明日关注

    • OpenAI安全与营收争议的后续回应,以及更多数学家是否加入抵制

    (The Decoder、爱范儿)

    • Google Gemini Agent企业版上线后的实际采用与质疑焦点

    (AI Business)

本日报由 AI 基于当日公开资讯自动整理,经润色后发布。