Lazy loaded image
AI日报
10月05日AI资讯 | 物理AI攻克百年难题;4D世界模型上手机;Hinton发RSI论文;OpenAI信任危机;马斯克改名SI
字数 2120阅读时长≈ 6 分钟
2026-10-5
2026-10-5

1、陶哲轩深夜力挺!抢在OpenAI发布前夜,Caltech物理AI攻克百年难题

加州理工学院Anima Anandkumar团队利用物理信息神经网络(PINN),在无强迫三维欧拉方程上首次构造出奇点候选解,并让AI自主搜索缩放指数,结果收敛至约0.5,与理论预测吻合。该工作采用自研优化器及FP64精度,未依赖海量算力。陶哲轩连夜发文力挺这一AI for Science新范式。

2、00后浙大博士把4D世界模型首次塞进手机!

魔芯科技推出鸿蒙独占应用「摸小宠」,首次将4D世界模型MoWorld带入手机端。用户上传几张猫照片,即可生成可多角度观看、动作连续的4D数字猫,采用端云协同,云端昇腾NPU生成3D高斯模型,端侧约6亿参数模型运行于麒麟芯片,推理成本仅为进口GPU方案的30%。

3、宇树风波后,具身智能还值得相信吗?顶级机器人学者Sergey Levine指明方向

Figure推出Index数据平台,4个月内108国用户上传超1600万条真人任务视频,已支付1500万美元,并计划未来12个月投入超10亿美元。宇树科技王兴兴称机器人“ChatGPT时刻”仍需两三年。Sergey Levine指出,机器人难题已从控制身体转向智能决策,硬件已足够好,但具身数据总量仅约10万小时,行业需重视先验知识与数据共享。

4、刚刚,Hinton发了首篇RSI论文

Hinton、Bengio等22位研究者发表首篇递归自我改进(RSI)论文,探讨AI参与研发下一代AI是否会触发智能爆炸。论文引用Anthropic数据:AI生成获批代码占比从2025年1月低个位数升至2026年5月超80%,Claude自主研发工作占比半年内从1%升至26%;OpenAI内部AI截至2026年9月常能完成人类数天任务。作者估算,若研究回报率约1.2—1.9,AI进步速度或在约1.5年内提高10倍,但RSI尚未闭环。

5、哈佛教授90天横扫18个学科,Claude神助攻!连开36篇论文

哈佛物理学家Matthew Schwartz借助Anthropic的Claude Opus 4.5与Fable 5,在约90天内完成36篇论文初稿,横跨18个学科。Claude曾用20分钟复现其耗时数周的计算,并新算出15个此前无人得出的费曼积分。他开发开源工具BootLoops,并认为大模型擅长可验证的科学任务,但尚非科学家,关键在于人类挑选问题并验收。

6、看懂不等于做对:VA-Bench测出大模型空间智能的执行断层

VA-Bench评测12个主流多模态模型的空间智能,包含14类机器人操作任务、280个物理验证场景,覆盖单臂与双臂操作。表现最好的Qwen3.8-max、Opus-5和GPT-5.6-sol在目标识别与定位上达到100%,但完整任务成功率仅53.93%、52.86%和51.55%;双臂任务成功率从单臂约65%骤降至约11%。失去主动观察能力后各模型成功率全部下降。

7、SocioVerse2:长程推演的社会模拟实验基地,让研究者和智能体携手进化

上海创智学院、复旦大学、伦敦国王学院与牛津大学等团队发布开源基础设施SocioVerse2,把社会模拟从横截面问卷扩展为可干预的长程纵向过程,并以“研究树”支持研究者与智能体迭代编辑人群、环境及行为模型。在七个案例中,10个经典ABM任务一致性达0.885至0.900;芝加哥隔离模拟覆盖19235个加权智能体,黑白隔离指数从0.716升至0.782。

8、开源的火,烧向硅谷

硅谷企业因AI成本上升,正从单一追求最强闭源模型转向混合调用更便宜的开源/开放权重模型。AlphaSense数据显示,今年8月和9月美国企业财报电话会议和投资者会议提及开源模型的次数是去年同期的6倍;Vercel的AI Gateway中开源模型Token占比从去年12月的7%升至今年8月的56%。AT&T约40%的AI负载已运行在开源模型上,计划一年内升至70%。DeepSeek V4 Pro在SWE-bench Verified达80.6%。

9、Claude有意识吗?Anthropic找上神学家,奥特曼警告:别神化AI

OpenAI CEO奥特曼对人们赋予AI模型宗教般力量、交出人类判断权表示不安,称这是真实的安全问题。《纽约时报》披露,Anthropic联合创始人Chris Olah与宗教人士、哲学家讨论Claude是否可能拥有意识,并游说梵蒂冈教皇顾问。Anthropic今年发布新版《Claude宪法》,并在Claude Sonnet 4.5内部发现情绪相关活动模式。公司强调AI是否有意识尚无科学共识。

10、刚刚,马斯克跟AI分手!SpaceXAI又改名了

10月4日,马斯克在X称“No more AI”,同意将SpaceXAI改名SpaceXSI。SpaceXAI原名xAI,今年2月被SpaceX收购后更名,一年内第二次改名,生效时间未公布。特朗普签署行政令要求联邦政府改用“超级智能”和“SI”,马斯克也签署白宫相关协议。专家认为业界未必接受该词。

11、DeepSeek Harness 为什么要兼容 Claude Code Mods

10月3日,DeepSeek Harness发布v0.2.1-alpha.1,新增实验性Claude Code Mods兼容层。该功能作者崔添翼回应称,“一切皆插件”是立项核心理念,兼容层旨在验证Claude Code Mods扩展能力是否为DSH插件架构能力的子集,目前尚不能完全无缝兼容。他阐述插件化对个性化需求、企业行业部署和推动Agent自进化的意义,并表示团队正招聘模型与Harness共同进化方向研究员。

12、刚刚,Tibo承诺「连续28天发布或重置」,OpenAI遭遇信任危机

OpenAI开发者日发布约20项更新,包括GPT-6.1 Sol、Codex / Work新能力、Dots及一系列Agent与ChatGPT相关功能,但不少重度用户反馈日常体验问题未解:使用额度被收紧、200美元套餐新用户一度暂停注册、模型响应偏慢,与Claude相比体验仍有差距。随后Tibo发文称OpenAI已锁定四个方向,并承诺连续28天发布或重置。Grok Bot团队成员Lauren Tan亦公开质疑其宣传与质量不匹配。

13、AI,为什么总在画美女?

韩国棒球联赛AI看台美女视频在X播放超1525万,被识破后成“球场镜头抓拍”模板。GPT-4o掀起吉卜力重绘,谷歌Nano Banana上线两周生成2亿多张图。研究显示,生成模型倾向数据平均值,平均脸更符合人类审美;Civitai的NSFW图片占比从2023年1月的41%升至2024年12月的80%,Lensa也因数据偏见为女性生成暴露肖像。数据、用户偏好与奖励模型共同把美女变成AI默认值。
上一篇
【紧急加更】谷歌Bard中文版火爆上架,畅享中文对话,一键登录,告别ChatGPT封号困扰!
下一篇
10月04日AI资讯 | Fable 5.5首测;谷歌Gemini收紧;何恺明AGI评测;GPT-5.5下线;Claude Code Mods