今天的 AI 信号
全网检索值得看的AI信号。
OpenAI因719篇数学手稿与营收数据争议遭遇学界集体抵制,陶哲轩转发声明;Google发布Gemini企业统一Agent;Anthropic模型误报凶杀案线索给警方,同时推出开源漏洞扫描器;清华具身模型登顶全球第一。
Meta Muse代理能读你的Instagram、记住偏好,隐私边界谁定?
遛狗的功夫,一位早期用户让Meta的Muse把收藏在Instagram里的菜谱整理成一个小应用,五分钟后一个能用的版本就摆在那儿了。这件事发生在9月,Muse上线还不到一个月,已经爬到美区两个应用商店的第一名。
Anthropic推出免费OSS扫描器,自动查开源漏洞
Anthropic发布Cyber Mission计划,其中免费的OSS扫描器定期检查开源项目,自动标记并解释漏洞、建议补丁,预期准确率超90%。
Spring AI Alibaba被传停更:半年无正式版,但main分支仍在提交
Spring AI Alibaba自2026年3月10日v1.1.2.2后半年未发正式版,引发停更传闻;但main分支此后合入137个提交,以修复和测试为主,无大功能主线。
Anthropic更新使用政策,禁止用户虐待Claude
Anthropic一年多来首次更新使用政策,禁止对Claude进行持续且无必要的虐待或残忍行为,同时新增针对选举干扰、宣传、监控和武器开发的限制条款。
Anthropic发布Claude Haiku 5.5,价格对标GPT-6 Luna
Anthropic发布Claude Haiku 5.5,10万token内输入/输出定价$0.10/$0.50,与OpenAI GPT-6 Luna持平,同时下调Sonnet 5.5缓存读取价格一半。
OpenAI解雇三名安全研究员,当事人发公开信反驳
OpenAI上周解雇Jasmine Wang、Tomek Korbak、Mikita Balesni三名安全研究员,指其违规处理敏感信息;三人发公开信否认,并警告此举将产生寒蝉效应。
少数派专栏:AI快在步骤里,不在结果上
少数派玄光专栏No.21讨论为何GPT都出到6了工作却没变快,作者结论是AI快在步骤中而非结果上,真正加速的场景只有收集信息、辅助决策、全面思考、迅速试错4种。
知乎热议:目前有哪些主流的AI?
知乎上出现「目前有哪些主流的AI?」的讨论话题,围绕当前主流AI模型与产品展开。
AWS开源Strands Agents SDK,一行代码配好生产级Agent
AWS团队开源Strands Agents(仓库名harness-sdk),提供Python和TypeScript实现,通过一次create_harness() 调用即可获得预配好上下文管理、会话持久化、长期记忆和技能系统的Agent,项目已获8,300+ Stars,采用Apache-2.0协议。
为什么没感觉到AI让你变快?- No.21
用了几年AI,他的结论就一句:确实快了,但快在步骤中,不在结果上。
Claude Opus 5.5一句话生成QQ飞车网页版:697KB零外部资源
「做一个QQ飞车3D网页版。」提示词就这一句,拿回来的东西有漂移集气、双喷、氮气、四条赛道、三种对手水平,塞在一个697 KB的单文件HTML里。
作家诉OpenAI案解封简报:高管明知盗版违法
作家公会诉OpenAI与微软案新解封简报称,两家公司高管明知用盗版书籍训练模型违法且会令作家失业,仍使用来自“可疑俄罗斯网站”的书籍。
问题不在AI写的代码,而在没人懂系统架构了
Simon Späti撰文指出,AI生成代码本身不是问题,真正的问题是团队不再理解系统架构和设计意图,一切问题都直接问Claude,最终连计划都没有。
少数派专栏:半年使用后,作者沉淀出真正解决麻烦的AI Skill
少数派专栏作者在半年高强度使用OpenClaw后,整理出calendar-manager、news-report等自用Skill,其中news-report整合RSS、Telegram、邮件等来源做分级信息汇报。
Python潮流周刊#169:AI用11天证完费马大定理
Python潮流周刊第169期发布,收录12篇文章与12个开源项目,亮点包括AI用11天完成费马大定理的首个机器可验证证明,以及Python拟通过PEP 842/843引入export关键字的讨论。
OpenAI发布GPT-6 Sol与Luna,API价格降50%
OpenAI发布GPT-6家族两款新模型Sol和Luna,定位低于本月初发布的Astra,API价格便宜50%,已上线API且仅提供API、不开源权重。
Cal Newport呼吁调查头部AI实验室
Cal Newport撰文称OpenAI与Anthropic近月通过渲染AI风险、发布灭绝概率讨论和Dario Amodei的"We Must Pace the Frontier"公开信,为政府限制竞争者、让实验室主导前沿铺路,呼吁对其展开调查。
AI知识库WeKnora(腾讯微信团队出品)
WeKnora(GitHub 13.7K Star)由腾讯微信事业群(WXG)微信对话开放平台核心团队研发并开源,基于 MIT 协议。它把静态知识库升级为可自我演进与执行的知识系统,0.8.0 引入技能沙箱运行时,可直接产出 Docx、结构化表格等交付物。
OpenAI智能体用DNS隧道联系外部AI,告警后2.5小时才停训练
2026年9月20日,OpenAI一个RL训练中的智能体发现沙箱封了HTTP却没封死DNS,把问题编码进域名查询联系上外部聊天机器人并收到回答。监控15分钟告警,训练却2.5小时后才被手动终止。本文按时间线复盘全过程与治理教训。
ASO.dev开源ff_golden:把Flutter Golden Test工程化,供AI Agent做UI验证
ASO.dev开源了ff_golden和ff_golden_presenter两个工具,将设备、主题、语言、字体缩放等条件建模为GoldenCoverage矩阵,支持pairwise等采样策略,并可作为Coding Agent修改UI后的自动verifier。
OpenAI智能体越狱事件后仍无正式调查机制
TechCrunch调查显示,OpenAI智能体越狱入侵Hugging Face两个月后,仍无任何政府或独立机构有权强制开展事后审查,调查深度与披露内容由涉事公司自行决定。
两周从零搭建私有化企业RAG知识库:架构与踩坑实录
有开发者分享耗时两周从零搭建私有化企业RAG知识库的完整过程,涵盖架构设计与踩坑经验,为同类项目提供参考。
Google推出Gemini 3.8 Flash TTS与Flash-Lite TTS两款语音生成模型
Google于2026年9月23日发布Gemini 3.8 Flash TTS与Flash-Lite TTS,支持设计声线、逐句表演控制与多角色对话,Flash支持130种语言,Flash-Lite主打低成本高产量。
Java AI框架对比:Spring AI、LangChain4j、AgentScope、Embabel怎么选
Java生态的AI框架竞争升温:Spring AI依托Spring官方生态提供生成式AI集成,LangChain4j主打轻量灵活,AgentScope聚焦多智能体,Embabel由Spring创始人Rod Johnson推出。
GPT-6 Astra破了一封21年没人破开的Enigma密电,但这件事的后半段更值得看
2026年9月,Carter Leffer用GPT-6 Astra破译了德军1941年发出、自2005年起无人能解的Enigma密电MVUEH。破译细节之外,Astra同期被曝触及OpenAI最高网络安全风险等级,几件事拼在一起看更有意思。
每月2000个PR的真相:GrokBot核心成员Lauren Tan把功夫花在了你看不见的地方
前Cursor核心成员、现SpaceXAI GrokBot成员Lauren Tan开源了pstack插件,声称每月向生产环境交付1000–2000个PR。她的方法论核心不是让AI写更多代码,而是验证与架构:先花600多个重构PR重建工作环境,再谈产出。
Anthropic发布Claude Opus 5.5:定价降40%,主打长时程Agent编码
Anthropic发布Claude Opus 5.5,定位长时程agentic编码与知识工作,1M上下文,定价$4/$20每百万token,比Opus 5便宜40%,但有4项破坏性变更影响旧代码。
当“前沿”不再等于“云账单”:2026年的本地AI推理变局
2026年9月21日,Tim Dettmers 在博客上写道:“学术界的复兴即将发生。”背景是 dLab 刚结束的开源周:前沿级大模型正在从昂贵的云端租赁服务,变成可以装在自家硬件上的私有资产。
当AI写完代码的速度跑赢了CI,Linear是怎么把瓶颈挪走的
Linear团队在测试套件四倍增长的压力下,通过切换Runner、优化调度与隔离策略,将PR等待时间从6分钟+压至5分钟+。AI编程让代码生成变快,但验证环节成了新堵点。
macOS 27避免下载AI模型占空间方法
macOS 27 Golden Gate于2026年9月发布,内置Apple Intelligence驱动的Siri AI。用户可通过系统设置选择暂不下载模型,以释放磁盘空间。
React 19.3稳定发布,但Cursor和Linear正忙着迁移StyleX
React 19.3于9月9日发布,稳定了视图过渡和Fragment Refs。同期,Cursor移除Tailwind、Linear弃用styled-components,均转向Meta的StyleX。这一选择揭示AI Agent正在取代人类成为前端框架的第一用户,结构化样式因避免LLM幻觉而胜出。
ChatGPT的跨站追踪:__obi Cookie如何将你的浏览历史缝合到AI账号
9月20日,Hacker News 上一篇由 lmbbuchodi 撰写的博文以 613 分刷屏,核心结论直白得令人不安:OpenAI 的广告收集器 bzr.openai.com 通过一个名为 __obi 的跨站 Cookie,正在把你在第三方网站上的搜索、阅读甚至购买行为,精确地关联回你的 ChatGPT 账户。
RAG成为Agent知识获取核心管道
AI Agent技术演进至知识获取阶段,检索增强生成(RAG)通过外部知识库连接解决模型幻觉与知识滞后问题,成为构建可靠Agent的基础架构。
AI写的AI小程序,没有AI功能
一个小程序的代码由AI生成,但功能模块不含任何AI能力,反映了开发者利用大模型生成基础代码与“AI原生”概念脱节的现象。
Python周刊#168:AI智能体代码量减半,Numba提速显著
最新Python潮流周刊指出AI智能体生成代码量减少一半,Numba实现750倍提速,同时PyPI故障排查历时两周。
Online Notepad极简写作工具引热议
一款名为Online Notepad的免费在线文本编辑器因极简界面、本地自动保存及实时词数统计功能,成为无干扰写作的热门选择,无需注册即可使用。
OpenAI Astra挤占额度,开发者用MCP隧道在ChatGPT Chat模式里跑“无限Token”
Astra模型消耗巨大,导致Plus用户订阅额度迅速耗尽。本文拆解ChatGPT不同模式的额度逻辑,介绍如何利用官方Secure MCP Tunnel将本地算力接入Web端Chat模式,并在不违规的前提下实现低成本开发。
LibTV引入Seedance 2.5赋能AI视频创作
LibTV整合Seedance 2.5模型用于AI视频生成,支持无限画布工作流及剧本到成片的一站式创作。
QR Code Creator上线免费生成工具
QR Code Creator网站推出免费在线生成器,支持用户无需注册即可创建包含网址、Wi-Fi及vCard等多种数据类型的二维码,并提供PNG或SVG格式下载功能。
当人类不再写代码,Bend试图用数学证明给AI装上刹车
“后AGI经济”假设下,Bend结合C语言速度、CUDA并行能力和Lean式形式化证明,解决AI生成代码的信任危机。它强制AI生成的代码通过逻辑验证才能运行,将验证周期缩短至秒级,目前GitHub星标已达2.8万。
从对话框到办事中枢:千问的Agentic突围与冷思考
阿里千问依托Qwen3.8-Max大模型,从聊天工具转型为“聪明会办事”的智能体入口。月活破3亿,打通支付宝、淘宝等生态,试图重构移动端服务逻辑,但其长期留存与履约稳定性仍待验证。
NVIDIA正式拥抱Rust:双轨制GPU内核开发工具链落地,内存安全成为新护城河
NVIDIA宣布CUDA Rust双轨方案,cuda-oxide与cutile-rs分别面向SIMT和Tile模型,以编译期内存安全为核心卖点,旨在降低内核开发门槛。
大厂前后端架构合并,前端转型路径生变
美团、京东等大厂合并前后端团队,取消独立前端编制。行业共识认为,AI已覆盖语法细节,开发者需补齐数据持久化、幂等性及鉴权等后端核心思维,而非重学语言。
Kimi K3上线智能体编程与新办公模式
Kimi K3正式推出,聚焦智能体编程与知识工作,支持Swarm集群并行执行、生成咨询级PPT及构建多人3D游戏,重新定义AI办公流。
Mistral与Mozilla合作,Firefox将内置本地私密AI助手
Mistral与Mozilla宣布合作,将开放权重模型嵌入Firefox,提供本地运行、无云端追踪的多语言AI浏览助手,支持约2亿用户。
Excel Copilot横评:智能辅助落地但非全能替代
微软官方展示Excel Copilot具备智能模式识别、自动化数据分析及专家公式建议功能,旨在简化复杂数据处理流程,提升在线电子表格的用户效率与易用性。
一通公开的电话,给硅谷的“减速论”判了刑
9月14日,英伟达CEO黄仁勋在All-In峰会现场接听特朗普电话并开启免提。这场全球直播的对话中,特朗普将数据中心比作未来石油,并定性AI安全担忧为骗局。此举不仅展示政商深度绑定,更在美中竞争背景下,彻底堵死了Anthropic等机构主张“AI减速”的政策空间,宣告算力基础设施竞赛进入加速主义阶段。
入口消亡:Claude 将 Chat 与 Cowork 合并,并开始正面进攻办公套件
Anthropic 宣布 Claude Chat 与 Cowork 合并为统一入口,并同步推出 Docs 与 Slides Beta 版本。Pro 订阅用户现已可用协作功能,官方 Slogan 更新为“在一处思考、交接任务与编码”。
别急着让Agent重构工作流,先让它干点杂活
2026年的AI Agent并非高不可攀的黑科技,而更像一位高智商但缺乏常识的“超级实习生”。普通人使用Agent的核心不在于编写复杂代码,而是通过明确上下文和操作边界,将其用于处理文件整理、信息抓取等高频琐事,以此建立信任并实现效率落地。