1、AI开始自造AI,“AI教父”辛顿警告:最危险的阶段可能正在逼近
辛顿转发22位研究者论文并警告AI参与研发下一代AI可能引发智能爆炸;论文援引Anthropic数据称AI生成获批代码占比和Claude自主研发比例快速上升,极端情况下一年AI进步或缩至约5周。辛顿主张尽快建立类似FDA的监管机制并加大AI安全投入。
2、翻完OpenAI的722篇数学手稿,我们挑出了最重的30道名题
OpenAI将未发布内部模型产出的722篇数学手稿发布至GitHub,归入372个成果族,覆盖数论、几何、理论计算机等17个方向,涉及准黎曼猜想、BSD猜想、希尔伯特第十问题、霍奇猜想等。约50个成果族涉及证伪或反例,约六成附有Lean形式化,但绝大多数尚未经同行评审。
3、NeurIPS 2026 | 长推理为何总在中途走偏?SAGE用结构信号纠偏,AC实例验证通过率接近8倍
弗吉尼亚理工等团队提出SAGE,通过符号闭包分析解释长推理中的探索偏差与累积偏差,并用结构势函数在训练阶段纠偏。方法在12个基准、7个模型家族上总体优于SFT、GRPO等基线,在1190个Andrews–Curtis实例上,Qwen3的Lean验证通过率接近基础模型的8倍。
4、突发!Claude拿下概率论「圣杯」,AI跨过菲尔兹奖终点线
Anthropic工程师提交代码显示,未公开的超前代Claude模型自动生成并经Lean形式化验证,证明了渗流理论中的连续相变猜想。该猜想1957年提出,困扰数学界近70年,2022年菲尔兹奖得主Hugo Duminil-Copin多年攻关未果,数学家称若由人类证明或可获菲尔兹奖。
5、刚刚,Nano Banana 2.1发布!这一次杀向专业设计师
Google DeepMind发布图像生成与编辑模型Nano Banana 2.1,基于Gemini 3.6 Flash,已上线Gemini App、API、AI Studio等平台。升级聚焦视觉设计、蒙版编辑、主体一致性与自然度,支持1K/2K/4K输出及最多14张参考图;信息图设计、蒙版编辑和多角色一致性评测均高于前代。
6、刚刚,OpenAI四连更!API最高档付费砍半,Auto-review全面免费
OpenAI在连续更新计划中发布四项更新:Auto-review向ChatGPT登录用户免费开放;API付费等级简化为三档,最高档累计付费门槛从1000美元降至500美元;Meetings插件接入ChatGPT;Decisions API进入公测,由GPT-6 Luna驱动,决策速度最高约为Responses API调用同模型的10倍。
7、Mistral Large 4 发布:1T 参数、49B 激活,aka「大胖猫」
Mistral发布开源权重模型Mistral Large 4,总参数1.05T、每次激活49B,配1.6B视觉编码器,采用细粒度MoE,支持多模态与1M上下文。模型从零训练,耗时两个月,使用4000张英伟达Grace Blackwell,官方称其综合跑分为美欧最强开源权重模型,API已可用,权重10月27日放出。
8、突发!Claude中文版悄悄上线了
Claude网页端和桌面端上线简体中文界面,语言列表超30种,结账页账单国家可选China,20美元Pro与200美元Max均可选,但官方支持地区名单仍不含中国大陆及港澳。此举主要面向新加坡、马来西亚及在美英澳等地的中国留学生等海外华人;a16z消费AI百强中Claude收入列第二。
9、北大数院校友出手!ChatGPT代写,要「实名」了
OpenAI推出文本水印方案textGrain,通过密钥在模型逐词生成时植入偏好,肉眼不可见,检测器可识别文本是否出自其模型。误报率1%时,400个token的心理学类回答检出率超九成,效果追平或超过谷歌SynthID;GPT-6 Astra加入水印后8项基准基本持平。该方案由北大数院校友苏炜杰领衔,将开源。
10、4B模型下棋比肩大师、还会讲棋,陈丹琦团队怎么做到的?
普林斯顿大学陈丹琦团队发布约4B参数的QUEEN模型,将Lc0家族的BT5网络与SmolLM3-3B语言模型通过门控交叉注意力桥接,并用四阶段问答课程和迭代搜索蒸馏训练,使其既能下棋又能用自然语言解释着法。该模型Lichess等级分达2697,接近特级大师中位数2730,模型、代码与数据集已开源。
11、量化后画面闪烁?时序稳定的视频世界模型2-bit KV Cache压缩方案诞生
哈工大(深圳)与新加坡国立大学提出免训练2-bit KV Cache量化框架QuantWM,针对视频世界模型中量化导致画面闪烁、模糊的问题。研究发现评测分数接近BF16并不代表视觉质量不变,Key量化误差会改变注意力对历史时空位置的选择;QuantWM在五种模型上改善视频质量,最高实现6.20倍KV Cache压缩。
12、《怪物史莱克》编剧也来了!这家AI影视公司,视频模型全球第二!
独立评测机构Artificial Analysis发布文生视频榜单,阿里Wan 3.0居首,影视公司Utopai Studios的Utopai X以1150分获第二,仅差7分。Utopai X基于MiniMax开源模型H3后训练,在音频同步、运镜和物理等7项能力上较基座更接近顶尖。公司估值约10亿美元,计划2027年院线推出《Cortés》等片。
上一篇
【紧急加更】谷歌Bard中文版火爆上架,畅享中文对话,一键登录,告别ChatGPT封号困扰!
下一篇
10月06日AI资讯 | OpenAI GPT-6提速50%;陶哲轩呼吁AI减速;清华开源VeriLoop E2;xAI称数学英雄时代落幕
- 作者:AI学长小林
- 链接:https://ai.linbintalk.com//article/3f2629a6-152d-8111-a6f5-c504afbfad70
- 声明:本文采用 CC BY-NC-SA 4.0 许可协议,转载请注明出处。

