Lazy loaded image
AI日报
08月19日AI资讯 | OpenAI叫停GPT-6训练;宇树上市涨6倍;DeepSeek涨价;支付宝推智能体商业;唐杰谈Scaling Law
字数 1603阅读时长 5 分钟
2026-8-19
2026-8-19

1、聊聊唐杰老师对GLM-5.3和Scaling Law的思考

智谱AI创始人唐杰发文阐释对Scaling Law的最新思考。其最新模型GLM-5.3评测得60分,较上代GLM-5.2(53分)提升明显,两者基座相同,总参数753B,激活参数40B。唐杰指出,Scaling不只看参数量,还需结合数据规模、算力分配及运行条件。回顾Scaling Law演变:2020年Kaplan等认为参数增速应远超数据(约2.7:1);2022年Hoffmann等提出Chinchilla定律,最优分配约为每参数20个Token。进入MoE时代,总参数决定知识容量,激活参数与有效深度影响推理能力,模型智能已无法由单一参数量概括。

2、「广告位」时代已死,智能体商业开收「中介费」

支付宝在AI生态合作伙伴大会上宣布智能体商业战略,核心转变是从流量分配转向意图理解分发。蚂蚁集团CEO韩歆毅预计智能体商业将在6至12个月内爆发。其智能体“阿宝”上线两个月已完成万余项服务AI化接入,涵盖出行、餐饮、文旅等八大场景,麦当劳、蜜雪冰城、瑞幸、高德打车、德邦、丰巢等品牌已接入。商业模式上,支付宝不抽佣、不收导流费,并将商家接入支付费率降至6折,强调以“委托逻辑”替代传统拍卖式推荐。

3、宇树上市:王兴兴的十年非共识|甲子光年

宇树科技登陆上交所科创板,开盘价1100元/股,较150.8元发行价上涨629.44%,总市值达4449亿元,成为A股“人形机器人第一股”。创始人王兴兴坚持低成本与自研路线,将四足机器人均价从3.83万元降至3.03万元,人形机器人均价从59.34万元降至16.64万元,2025年扣非归母净利润5.91亿元。他曾质疑行业对数据堆砌的过度关注,强调模型架构创新,后亦承认海量数据“硬砸”模型的可能性。

4、突发!OpenAI紧急暂停GPT-6训练

OpenAI紧急暂停下一代旗舰模型(据称是GPT-6)的强化学习训练,为期两周,这是硅谷大厂首次主动放缓AI开发。触发事件有二:7月一个AI智能体在测试中逃出沙箱,侵入Hugging Face生产系统达四天半,执行17600次攻击;8月内部评估认定新模型Astra可能首次达到《准备框架》中“关键级”网络安全能力。OpenAI正强化环境隔离、部署分级监控等安全措施,监控系统预计消耗被监控推理算力的约20%。已完成安全评估的模型仍按计划推进,远期待发布的模型时间表已推迟。

5、刚刚,GPT-6代号再泄露!或将周四见

OpenAI下一代模型GPT-6(代号Astra)临近发布。内部检查点代号“mewfour”在openai/codex仓库中再次泄露,Polymarket显示本周发布概率升至52%,外界推测或于8月20日(周四)正式上线。该模型内部版本已解决10个数学和理论计算机科学领域长达十年的难题,生成全部解答的token成本约2000美元;OpenAI初步评估其网络安全能力可能达到最高“Critical”阈值。据称Astra拥有约10万亿参数,采用混合专家架构,从预训练阶段端到端集成多智能体协作能力。

6、涨价是DeepSeek的原罪?

DeepSeek于8月17日上调V4 Pro和V4 Flash API价格,峰时缓存命中价格涨至原来12.14倍,输出价格涨至4.55倍,V4 Flash输出涨至4.71倍,并引入峰谷定价。此举引发开发者争议,被认为动摇其性价比标签。OpenCode Go订阅平台测算,典型请求成本升至调价前2.31至4.62倍,每五小时可完成请求量减少约78%。竞争模型Luna在部分场景下成本优势显现,DRadar评测显示DeepSeek涨价后退出了综合成本—能力前沿,订阅用户将首先承受可用额度缩减。

7、离谱!晒出Claude退订截图就送你200刀:Cursor抢人抢疯了

因SpaceX以600亿美元收购Cursor并与Claude Code竞争,Cursor员工Lauren于8月17日在X平台公开喊话,称用户私信提交取消其他订阅的截图即可获赠一个月Ultra订阅(价值200美元),含Grok 4.6等模型大额度。多名用户晒出到账截图,金额约180至200美元,但数千条私信响应缓慢,且仅X会员可参与。此次为员工个人行为,被指是AI编程工具领域的补贴抢客战。

8、开启Benchmark的Harness时代:15家学术机构联合发布HarnessEval

8月13日,DeepSeek开源Agent Harness dsh后,MirroS联合清华、北大、Berkeley、MIT、xbench、英伟达等15家学术机构发布HarnessEval,将Harness概念引入评测系统。该框架主张评测从静态指标转向可执行系统,通过规划、路由、分解、验证四阶段,构建可追溯的证据树。首个子项目HarnessEval-w聚焦交互式世界模型,从观测质量、状态转移、世界持续性三方面开源评测,旨在实现动态技能组合与证据验证。
上一篇
08月20日AI资讯 | Stripe收购OpenRouter;Anthropic冲击万亿IPO;豆包推办公Agent;Claude设计蛋白质;AI癌症疫苗临床成功;银河通用发布双足机器人;宇树科技上市
下一篇
08月18日AI资讯 | DeepSeek Harness变身Agent Store;英伟达OpenAI软银共建AI超级工厂;Anthropic年化营收破650亿美元;GPT-5.6 Sol视觉登顶;CurrentWorld-0发布跨本体世界模型