Lazy loaded image
AI日报
06月21日AI资讯 | GPT-5.6 Pro泄露;Anthropic联创称低估Scaling;英伟达成AI最大地主;谷歌承认落后;斯坦福报告中国AI人才崛起
字数 773阅读时长 2 分钟
2026-6-21
2026-6-21

GPT-5.6 Pro泄露!一句话,48分钟造出完整《模拟人生》

报道疑似GPT-5.6 Pro模型泄露事件,该模型展现出惊人能力,仅需一句话就能在48分钟内生成完整的《模拟人生》游戏,引发行业高度关注。

Fable 5准备复活?Anthropic联创:我们彻底低估了Scaling

Anthropic联合创始人反思行业对Scaling Law的认知,认为此前严重低估了规模扩展的潜力,并探讨这一认知对AI未来发展路径的影响。

5.4万亿!英伟达成AI最大地主,大模型巨头沦为算力佃农

分析指出英伟达凭借GPU算力垄断地位,市值达5.4万亿美元,成为AI时代最大的基础设施拥有者,而各大模型公司则像'佃农'一样依赖其算力。

强化学习之父Sutton联手毁灭战士之父Carmack:让机器人进入真实世界打游戏

强化学习之父Richard Sutton与id Software创始人John Carmack联手,探索让机器人在真实物理环境中通过打游戏来学习,融合RL与具身智能。

谷歌CEO罕见承认落后了!Gemini 3.5 Pro被曝难产

谷歌CEO皮查伊罕见公开承认在AI竞赛中落后,同时曝出下一代旗舰模型Gemini 3.5 Pro开发遇到困难,面临难产困境。

斯坦福报告:中国自主培养,顶尖AI人才崛起

斯坦福大学最新研究报告指出,中国在自主培养顶尖AI人才方面取得显著进展,在全球AI人才竞争中地位快速上升。

GRPO过时了吗?

深入探讨GRPO(Group Relative Policy Optimization)方法在强化学习中的现状,分析其在DeepSeek等模型中的应用效果,以及是否面临被新方法替代的可能。

深入理解 Claude Code:从 CLAUDE.md 到 Hooks、Skills、Subagents..

深度技术分析文章,全面解析Anthropic的Claude Code产品的架构设计,包括CLAUDE.md配置、Hooks机制、Skills技能系统和Subagents子代理等核心技术细节。

经典之作PPO算法:曾被NeurIPS拒了

回顾强化学习经典算法PPO(Proximal Policy Optimization)的发展历程,揭示这一奠定现代RL基础的算法曾遭NeurIPS会议拒稿的轶事。

OpenAI「最开放」一次,Codex不再独宠GPT

报道OpenAI在Codex产品上做出重大开放举措,不再仅限于GPT模型,允许接入其他第三方模型,标志着OpenAI开放策略的重大转变。
上一篇
06月22日AI资讯 | Claude Sonnet-5被曝下周上线;何恺明团队发布新文生图模型;清华空间模型打败Gemini;陶哲轩称AI突破数学形式化临界点
下一篇
AI资讯-06月20日