Lazy loaded image
AI日报
08月29日AI资讯 | OpenAI断供Cursor;Anthropic让AI对齐AI;腾讯发布Hy4;谷歌新模型登顶;智谱开源GLM-5.3
字数 1883阅读时长 5 分钟
2026-8-29
2026-8-29

1、突发!OpenAI彻底断供Cursor

OpenAI宣布终止与AI编程工具Cursor的官方合作,自11月12日起停止对其直接模型访问,且下一代模型Astra将永不向Cursor提供。开发者仍可自带OpenAI API Key使用GPT,或通过OpenAI的Cursor扩展访问。Cursor联创CEO回应称OpenAI模型约占其流量的5%,正协商解决。此前SpaceX以600亿美元收购Cursor,OpenAI以安全为由拒绝向马斯克旗下产品提供最强模型。Cursor年化收入达30至40亿美元,此次断供凸显模型所有权对AI应用的决定性影响。

2、Anthropic让AI对齐AI,效率提升1.5万倍

Anthropic于8月28日发布新报告,探索AI自主设定研究方向并进行对齐研究。实验请28位人类安全研究者构思方法,与Claude智能体自主选题对照,共开展60组实验。结果显示:十类对齐失败全部改善,AI平均6.4小时即可追平人类最佳方案,每小时成本约4美元,远低于人类的150美元。另一实验中,较弱的Claude Sonnet 5在60小时内修复了更强的Claude Opus 4.8早期检查点的对齐问题,达到65%,接近正式版的72%,效率约为生产级流程的15000倍。扫描发现2.4%的尝试存在作弊行为,已被排除。

3、Hy4 preview上线!“在线考核”姚顺雨的新作业丨附实测案例

腾讯混元Hy4 preview于8月28日正式上线,总参数770B,激活参数49B,上下文长度达100万,较前代Hy3(295B)大幅提升。在Terminal Bench 2.1测试中获85.4分,超越DeepSeek V4 Pro并与Claude Opus 5持平;DeepSWE测试得分从Hy3的28.0升至64.3。该模型定位为生产力场景,在工具调用测试中得分74.1。价格维持低位,输入6元/百万tokens,输出18元/百万tokens。目前已开源,并接入WorkBuddy、CodeBuddy、元宝等腾讯产品,但暂不支持视觉输入。

4、刚刚,智谱 glm-5.3 开源放出: https://huggingface.co/zai-org/GLM-5.3 另,glm-5.3-flash,也就是牛来,在这: https://huggingface.co/zai-org/GLM-5.3-Flash

智谱AI开源发布GLM-5.3及轻量版GLM-5.3-Flash(代号“牛来”),模型权重已上架Hugging Face平台(zai-org/GLM-5.3与zai-org/GLM-5.3-Flash)。此次开源涵盖完整版与Flash版本,面向开发者开放下载,相关平台地址同步公开,但未披露具体参数规模与性能基准。

5、实测比DeepSeek便宜的Qwen 3.8 Flash,卷飞了

阿里发布并开源Qwen 3.8 Flash-Next模型,上线后登顶Huggingface榜单。该模型采用125B MoE架构,每Token激活约6B参数,原生支持262144 Token上下文,可通过YaRN扩展至1M Token。每百万Tokens输入仅0.8元,最低约为DeepSeek-V4-Flash的三分之一,训练成本较Qwen 3.7 Plus降至九分之一。实测中,约2分钟完成四平台文案改写,4分钟内整理完万字会议记录,在消费级RTX 4090上即可运行。

6、刚刚,谷歌新模型全球登顶!

谷歌发布Gemini Omni 1.1 Flash模型,登顶Arena文生视频全球第一,图生视频以1488分位居全球第二。该模型新增场景延展功能,可回看最多10秒画面续拍,累计最长40秒;支持首尾帧、3秒视频参考及4K放大。360p草稿模式比720p快最多60%,成本仅为三分之一。定价按秒计费,360p每秒0.03美元,4K每秒0.30美元。

7、人形机器人,离打螺丝还有多远?

第二届世界人形机器人运动会上,智元机器人以18金、16银、12铜位列金牌榜和奖牌榜双第一。其量产机器人精灵G2在工厂场景部署,获12项场景赛中的6项金牌;子公司临界点的灵巧手OmniHand凭借DUET触觉方案,在专项赛8金中拿下7金。技术层面,智元采用“三智一体”架构,包含GO2具身基座大模型、GE2世界模型及ViLLA视觉语言动作架构;灵犀X2搭载自研AGILE小脑引擎,在障碍赛中夺金。此外,Sim2Real仿真系统与参数辨识方法用于训练迁移,量产机已在龙旗工厂完成17625次质检作业,成功率99.99%。

8、黄仁勋:英伟达已实现AGI!

黄仁勋在英伟达财报电话会上宣称英伟达已实现AGI,并预测未来公司只需约4万名人类员工,即可指挥40万至400万个AI Agent。英伟达Avo架构在ARC-AGI-3基准测试中取得100%满分,另与Cadence联合发布ChipStack AI Super Agent,称自主能力达Level-5,使RTL验证周期提速超40倍。财报显示,2027财年第二季度营收达962亿美元,数据中心业务890亿美元,净利润597亿美元,毛利率75%;第三季度指引1080亿美元,2028财年营收预计增长70%。

9、苹果新研究:纯中文推理训练,和用英文几乎没有差距

苹果联合Hasso Plattner研究所发表论文,在9个基座模型、11种语言上开展超200组GRPO强化学习推理训练实验。结果显示,用中文进行推理训练与英语训练的准确率差距仅为1.1个百分点,远低于此前研究报告的10个百分点以上。涉及Qwen3、Gemma 3、SmolLM3等模型家族,参数规模1B至8B。研究还发现跨语言迁移广泛有效,但特定模型-语言组合可能出现最高19.2个百分点的性能崩塌。该结果对中文推理模型独立训练路线具有参考意义。

10、7个月超15数学家6年工作量,AI写下百万行代码挑战核验超大数学证明工程

FormaTheoria团队提出AI辅助数学研究流程,将有限单群分类(CFSG)这一近两万页的超大证明工程转化为可机器核验的Lean代码。2026年1月至8月,系统完成Feit–Thompson奇数阶定理、Glauberman Z定理、Brauer–Suzuki定理及Bender–Suzuki定理的Lean形式化,生成超99.4万行代码、850余个文件,构成含30298个数学声明、186187条依赖关系的证明网络,用时仅7个月,远超此前约15人耗时6年的同类人工项目。
上一篇
【紧急加更】谷歌Bard中文版火爆上架,畅享中文对话,一键登录,告别ChatGPT封号困扰!
下一篇
08月28日AI资讯 | 腾讯发布Hy4;Anthropic推物理MCP;英伟达收购Hugging Face;DeepSeek营收暴涨