Lazy loaded image
AI日报
08月07日AI资讯 | 六巨头发布Agent插件标准;DeepSeek涨价;GPT-5.6免费;Seedance 2.5上线;谷歌DeepMind换帅
字数 1934阅读时长 5 分钟
2026-8-7
2026-8-7

1、六巨头定AI插件新标准!撞脸Claude,Anthropic没上桌

8月6日,AWS、Anysphere(Cursor母公司)、GitHub、微软、OpenAI、Vercel六家联合发布Agent Plugins 1.0.0开放规范,谷歌也在发布当天加入核心维护者。新规范统一了AI智能体插件的目录结构、plugin.json清单及MCP配置写法,目标是让同类插件一次打包即可在兼容客户端中通用。Anthropic未参与共建,但其Claude Code插件格式与新规范高度相似。目前规范仍为工作草案,仅统一“包装”层,安装、权限、认证等仍由各客户端自行实现。

2、35B干赢万亿参数大模型!上交大AI开始给自己造题还能自我迭代了

上海交通大学人工智能学院、深势科技和上海算法创新研究院团队发布科研大模型BigBang-V1。该模型基于Qwen3.6-35B-A3B后训练,训练数据完全由AI合成,并通过生成器、审查器及元审查器构成的内外双层循环实现自我迭代。在11项评测中,BigBang-V1有10项超越基础模型,在35B规模模型中全部8项基准取得最高分数;在FrontierScience Research上以46.2分超过DeepSeek V4 Pro Preview的40.7分,在Humanity’s Last Exam上以50.3分超过其48.2分。

3、谷歌Jeff Dean离职创业押注AI自动研究,清华系团队开源35B AI4AI模型

谷歌首席科学家Jeff Dean联合核心研究员离职创立Discovery Loop,押注递归自我改进(RSI)。衔远科技与清华大学团队发布Frontis-MA1-35B模型及OpenMLE开源套件,探索AI自动研究。在MLE-Bench Lite上,Frontis-MA1配合OpenMLE-Evo-Max取得71.21%的Medal Average,基础版为60.61%,接近GPT-5.6 Sol与2.8T参数Kimi K3的72.73%。相关论文及代码已开源。

4、DeepSeek 的「斩杀线」,正在重塑 AI 行业的世界观

DeepSeek V4 Flash以1元/百万token输入、2元输出的超低定价登顶全球模型调用量榜首,8月1日单日处理token达8万亿,超过OpenRouter全平台日均6.6万亿,随后官方宣布大幅上调API价格。行业同步转向:智谱API定价较去年底提升83%,调用量仍增长400%;月之暗面Kimi K3输入价涨超3倍、输出涨近4倍。此轮涨价潮显示,AI token正走向大宗商品化,定价将从极端低价回归“成本加合理利润”的均衡态。

5、刚刚,GPT-5.6全员免费!下一代巨兽Astra打响闪电战

OpenAI宣布GPT-5.6 Luna全员免费开放文本对话,作为Free和Go版本默认模型;同时升级GPT-5.6 Sol,ChatGPT界面新增思考滑块,统一Instant与Thinking模式。官方评测显示,Sol事实错误率较GPT-5.5 Instant降低68%,Luna降低62%。此外,爆料称OpenAI最快下周发布新一代模型Astra,内部检查点代号mewfour,为自GPT-4.5以来训练的最大模型,预计参数规模7-10T,主打长时程多智能体协作,目标对标Anthropic的Fable 5。

6、一周以后,我想我终于可以来聊聊Seedance 2.5了。

字节跳动旗下视频生成模型Seedance 2.5 API正式上线,支持原生生成30秒视频,一次参考30张图片、10段视频和10段音频,并实现时间戳级编辑。相较2.0版,2.5指令遵循能力显著增强,主动抑制“补戏”式幻觉,更强调可控性与电影感,但需要用户提供更具体的导演式描述。专业人士认为其光影、材质和画面一致性大幅提升,更接近实拍质感;而普通用户可能感觉生成效果不如2.0直观。该版本针对电影标准而非短视频节奏重新设计,旨在提升专业创作者的上限。

7、全球第一超算跑满血DeepSeek!一张GPU没用,打造超智融合「Token工厂」

清程极智与“灵晟”国产超算合作,完成纯CPU MoE模型分布式推理方案,在16节点上流畅运行DeepSeek-V3/R1-671B模型。测试显示,在batch size=2048时,输出吞吐量与80张主流GPU集群相当。该方案依托“灵晟”LX2 CPU的矩阵加速单元、片上高带宽内存及“灵启”低时延网络,结合自研算子优化、多层次混合并行和MTP加速技术,实现了从超算硬件到Token生产能力的系统级转化,标志着国产算力可高效支撑大模型推理服务。

8、具身智能规模化落地,大概率从这样的模型开始

原力灵机发布具身基础模型 DM0.5并全面开源。该模型采用4B参数,基于15万小时多源数据训练,支持在单张4090显卡上18小时完成微调,微调成本下降60%。DM0.5在LIBERO综合评测达99.0%,刷新RoboTwin 2.0等多项公开成绩,并以43%成功率位居RoboChallenge Table30 V2真机评测榜首。相比DM0,Zero-shot成功率提升31%。推理延迟从534.04ms降至57.49ms,加速9.29倍。

9、AI推翻80年数学猜想,菲尔兹奖得主一夜没睡:以为要出局

AI在数学界近期取得多项突破:OpenAI内部模型5月推翻了埃尔德什1946年提出的单位距离猜想,终结其80年悬而未决的历史;Anthropic的Claude Fable于7月找到雅可比猜想在高维空间的反例;8月OpenAI公布内部版Astra在高维球堆积、群论、格密码学等领域的十项进展,所耗token约合2000美元。菲尔兹奖得主Timothy Gowers一度担忧数学家将被取代,后因确认模型仅推翻而非证明猜想才释然。陶哲轩在ICM大会警告,数学正从“证明稀缺”进入“证明过剩”时代,面临“证明消化不良”风险。

10、谷歌AI换帅!13年老将接棒DeepMind,新掌门却不叫CEO

谷歌8月5日宣布DeepMind人事调整。创始人哈萨比斯转任Google DeepMind主席兼Alphabet首席科学家,专注长期战略;原研究副总裁Koray Kavukcuoglu升任高级副总裁,直接向CEO皮查伊汇报,负责Gemini模型开发、前沿AI研究与Gemini App团队,但未获CEO头衔。任职13年的Koray目前管理约2100名员工,谷歌已将搜索团队约200名Gemini训练员工划归其麾下。同日,Jeff Dean等四位老将离职创办Discovery Loop,旗舰模型Gemini 3.5 Pro亦延期未发布。
上一篇
【紧急加更】谷歌Bard中文版火爆上架,畅享中文对话,一键登录,告别ChatGPT封号困扰!
下一篇
08月06日AI资讯 | 美国AI安全新规出炉;清华开源千亿MoE视频模型;谷歌Jeff Dean离职创业;Meta发布编程Agent;MiniMax H3视频模型低价上线