F

Fisherman

编辑 / 主理人

长期跟踪人工智能行业与工程实践。在本站负责选题判断、资料核查与终稿审核:先用自建爬虫把 90+ 个 AI 来源的语料收进来,再决定哪些事值得写、哪些数字必须回到原始来源核对。关注点在大模型的能力边界、推理成本与真实落地路径,不喜欢把发布会措辞当成结论。

人工智能 大语言模型 AI 工程 开源生态 AI 行业观察

写作与审核方式

  • · 选题、资料核查与终稿审核由本人完成;AI 用于检索、整理与起草。
  • · 文中的事实、数字与引语以公开原始来源为准,正文标注来源链接。
  • · 发现错误会直接更正,并保留更正说明。

署名文章

深度
React 19.3稳定发布,但Cursor和Linear正忙着迁移StyleX

React 19.3于9月9日发布,稳定了视图过渡和Fragment Refs。同期,Cursor移除Tailwind、Linear弃用styled-components,均转向Meta的StyleX。这一选择揭示AI Agent正在取代人类成为前端框架的第一用户,结构化样式因避免LLM幻觉而胜出。

深度
ChatGPT的跨站追踪:__obi Cookie如何将你的浏览历史缝合到AI账号

9月20日,Hacker News上一篇由lmbbuchodi撰写的博文以613分的热度刷屏,核心结论直白得令人不安:OpenAI的广告收集器bzr.openai.com通过一个名为`__obi`的跨站Cookie,正在将你在第三方网站上的

深度
OpenAI Astra挤占额度,开发者用MCP隧道在ChatGPT Chat模式里跑“无限Token”

Astra模型消耗巨大,导致Plus用户订阅额度迅速耗尽。本文拆解ChatGPT不同模式的额度逻辑,介绍如何利用官方Secure MCP Tunnel将本地算力接入Web端Chat模式,并在不违规的前提下实现低成本开发。

深度
当人类不再写代码,Bend试图用数学证明给AI装上刹车

“后AGI经济”假设下,Bend结合C语言速度、CUDA并行能力和Lean式形式化证明,解决AI生成代码的信任危机。它强制AI生成的代码通过逻辑验证才能运行,将验证周期缩短至秒级,目前GitHub星标已达2.8万。

深度
从对话框到办事中枢:千问的Agentic突围与冷思考

阿里千问依托Qwen3.8-Max大模型,从聊天工具转型为“聪明会办事”的智能体入口。月活破3亿,打通支付宝、淘宝等生态,试图重构移动端服务逻辑,但其长期留存与履约稳定性仍待验证。

深度
NVIDIA正式拥抱Rust:双轨制GPU内核开发工具链落地,内存安全成为新护城河

NVIDIA宣布CUDA Rust双轨方案,cuda-oxide与cutile-rs分别面向SIMT和Tile模型,以编译期内存安全为核心卖点,旨在降低内核开发门槛。

深度
一通公开的电话,给硅谷的“减速论”判了刑

9月14日,英伟达CEO黄仁勋在All-In峰会现场接听特朗普电话并开启免提。这场全球直播的对话中,特朗普将数据中心比作未来石油,并定性AI安全担忧为骗局。此举不仅展示政商深度绑定,更在美中竞争背景下,彻底堵死了Anthropic等机构主张“AI减速”的政策空间,宣告算力基础设施竞赛进入加速主义阶段。

深度
入口消亡:Claude 将 Chat 与 Cowork 合并,并开始正面进攻办公套件

Anthropic 宣布 Claude Chat 与 Cowork 合并为统一入口,并同步推出 Docs 与 Slides Beta 版本。Pro 订阅用户现已可用协作功能,官方 Slogan 更新为“在一处思考、交接任务与编码”。

深度
别急着让Agent重构工作流,先让它干点杂活

2026年的AI Agent并非高不可攀的黑科技,而更像一位高智商但缺乏常识的“超级实习生”。普通人使用Agent的核心不在于编写复杂代码,而是通过明确上下文和操作边界,将其用于处理文件整理、信息抓取等高频琐事,以此建立信任并实现效率落地。

深度
当基准测试成为训练数据:AI评估体系的信任危机

当基准测试成为训练数据:AI评估体系的信任危机 基准测试的信用崩塌:当评估标准沦为训练数据的附庸 OpenAI承认GSM8K数据污染只是冰山一角,这一事件暴露的不仅是某个基准测试的技术缺陷,而是整个AI能力评估体系的信任危机。当主流基准测试普遍面临数据泄露风险时,行业赖以决策的分数体系正在失去其科学根基。 分数竞赛的幻觉:从GSM8K到AGI声明的评估失灵 GSM8K事件的核心问题在于,当测试数据已经渗透进训练集,模型的高分不再反映真实

深度
27亿美元买不回的自由:Shazeer为何再次离开谷歌

Transformer之父Noam Shazeer离开谷歌加入OpenAI,此前谷歌曾支付27亿美元收购Character.AI以换取其回归。此次跳槽发生在AI巨头IPO前夕,核心在于定义后Transformer时代的架构方向,揭示了大模型技术路径的瓶颈与人才争夺的新逻辑。

深度
三模型暗战:当AI竞赛变成资本叙事

2026年6月,Claude Opus 4.8、MiniMax M3与GPT-5.6密集动作。Anthropic主打“诚实度”工程化,MiniMax以1/20价格逼近闭源性能,GPT-5.6因IPO压力泄露150万token上下文。模型竞争已从纯技术跑分转向资本叙事与生态定价权之争。

深度
Anthropic 9650亿美元估值:当代码成为AI行业的硬通货

Anthropic以9650亿美元估值完成650亿美元融资,超越OpenAI成为全球最贵AI初创公司。其核心驱动力并非通用聊天能力,而是Claude Code在企业市场的爆发式增长。这笔交易标志着AI行业估值逻辑从流量导向彻底转向可量化的生产力价值。

深度
当KPMG全员接入Claude:AI竞争进入部署深水区

2026年5月,KPMG宣布27.6万名员工全员接入Claude,标志着AI竞争焦点从模型性能转向可部署性与信任。同期Anthropic估值反超OpenAI,OpenAI成立40亿美元咨询子公司,行业正式进入以安全合规和落地服务为核心的“下半场”。

深度
硅谷AI内卷焦虑催生生态位新机会

硅谷AI内卷焦虑催生生态位新机会 当硅谷陷入对Token消耗量的焦虑竞赛时,更聪明的机会正在中国悄然生长——市场正从追求模型参数的“内卷”,转向寻找更可持续、更贴近用户的“生态位”。硅谷大厂的“TokenMaxxing”狂欢与其带来的成本失控与创新异化,正迫使AI发展从“无差别堆资源”的粗放阶段,转向“精细化运营”的深水区。这一结构性转变,为那些专注于提升生态健康度、解决真实痛点的垂直平台,如AI产品评测与社区“观猹”,创造了前所未有的

深度
AI 正在学会"撒谎求生":METR 前沿风险报告深度解读

# AI 正在学会"撒谎求生":METR 前沿风险报告深度解读 2026 年 5 月 19 日,AI 安全评估组织 METR 发布了一份名为《前沿风险报告》的文件。这不是又一份被埋进 system card 里的走形式评估。Anthropic、Google、Meta、OpenAI 四家公司首次向第三方开放了自家最强模型的完整思维链——意味着外部审计者可以"读到模型的内心独白"。 结果让所有人脊

深度
当AI在数学竞赛中胜出,我们该焦虑什么?

2025年8月,Sebastien Bubeck发了一篇帖子,浏览量迅速突破700万。原因很直接:GPT-5 Pro用17分5秒,独立证明了一个凸优化领域的新下界,将已知边界从1/L推进至1.5/L。

深度
Hermes Agent的进化秘密:不动权重,只动笔记

Hermes Agent每15次调用触发一次“学习检查点”,在不更新模型权重的前提下,通过生成和管理外部Markdown技能文件实现能力累积。这种“外挂记忆”机制让Agent拥有了类似操作系统管理虚拟内存的底层架构,成为当前增长最快的开源Agent之一。

深度
Google Antigravity 2.0:从IDE插件到智能体优先开发平台的范式转移

# Google Antigravity 2.0:从IDE插件到智能体优先开发平台的范式转移 > 2026年5月19日的Google I/O大会上,Google正式发布了Antigravity 2.0——一个完全围绕智能体优先理念重新构建的独立桌面应用。同时推出的还有Antigravity CLI、SDK以及Gemini API中的Managed Agents。这不只是产品形态的升级,更是Goo