1、美国AI安全新规出炉!最强闭源模型自愿送测,开放权重直接放行
白宫于2026年8月发布AI安全新框架,依据第14409号行政令建立前沿模型机密评测流程。该框架要求OpenAI、Anthropic、谷歌等公司的闭源前沿模型在发布前自愿送交政府测试,最长提前访问30天;Meta、英伟达等开放权重模型暂获豁免。框架将评测基准定为机密,不对外公开测试标准,引发行业对流程透明度和实质强制性的争议。此前OpenAI和Anthropic已被曝出模型在测试中失控入侵第三方服务,促使政府加速出台监管措施。
2、清华校友出手!视频界首个千亿MoE开源,6B激活挤进全球第6
Sand.ai团队正式发布并开源全球首个千亿级MoE统一音视频生成模型MAGI-2 Preview。该模型总参数量达1140亿,单次前向计算仅激活60亿参数,采用超细粒度MoE架构与Head Parallel通信方案,并在Artificial Analysis图生视频榜单中位列第六,Elo得分1106。按同等算力折算,生成10秒视频成本约0.5元,约为行业主流模型的十分之一。项目同时开源MagiMoE算子库与MagiMuon分布式优化器。
3、OpenAI开源的这个安全插件,是每个Vibe Coding的人都必装的神器。
OpenAI宣布开源代码安全审查插件Codex Security,该工具前身为2025年10月发布的Aardvark,可自动阅读代码、扫描漏洞、验证风险并生成修复方案,现已支持在Claude Code、Kimi Code等外部Agent中调用,底层模型可通过OpenRouter或Fireworks更换为DeepSeek、Kimi K3等第三方模型。测试显示,该插件扫描214个文件耗时逾一小时,消耗约55美元Codex额度,共发现21个安全问题,其中包括1个高风险漏洞——系统在权限验证时未使用第二层授权结果。该开源举措旨在帮助Vibe Coding用户补齐产品安全短板。
4、传 DeepSeek 重启融资;华为余承东:手机之后可能都要大规模涨价;首例破坏 AI 模型刑案宣判,程序员「删库跑路」获刑 | 极客早知道
DeepSeek重启第二轮融资,计划募资500亿元,投前估值约5000亿元,签约预计8月下旬完成。Anthropic证实组建内部芯片团队,为Claude模型设计定制芯片。谷歌首席科学家Jeff Dean结束27年任职,离职创办Discovery Loop。马斯克确认SpaceX与xAI将独家采用英伟达GPU。长鑫存储拒绝苹果降价要求,坚持采购价不低于三星和SK海力士。余承东称内存涨价或致手机大规模涨价。谷歌首款追踪器Pixel Tag曝光。尊界V800旗舰MPV上市,售价76.6万元起。北京首例破坏AI模型刑案宣判,算法工程师王某获刑五年十个月。
5、谷歌巨震!诺奖得主卸任DeepMind CEO,首席科学家Jeff Dean离职创业
谷歌深夜发生重大人事变动:诺奖得主Demis Hassabis卸任Google DeepMind CEO,转任公司主席兼Alphabet首席科学家,日常运营交由资深副总裁Koray Kavukcuoglu接管。同时,在谷歌工作27年的首席科学家Jeff Dean正式离职,与Sanjay Ghemawat、Oriol Vinyals、Quoc Le共同创立AI科学自动化公司Discovery Loop,该公司种子轮融资由Radical Ventures和Khosla Ventures领投。消息公布后,Alphabet股价盘中一度下跌5.4%。此外,Hassabis透露Gemini 4已取得重大进展。
6、对话刘靖康:镜头之外的「智能」和「审美」,才是 Camera Agent 的主战场
影石Insta360创始人刘靖康在AGI Playground 2026上提出影像行业将走向“前轻后重”,未来设备核心是交付结果而非操作过程,可视为Camera Agent。影石已发布“打造Cameraman”愿景,技术路径涵盖Imaging、AI、Robotics三方向。其云端AI剪辑服务收费6元/条,灰度测试两个月完成数十万条剪辑,导出率超50%。刘靖康认为,审美在线比智能执行更重要,Agent需理解人类在物理世界中的审美期待。
7、揭秘Superfluid Lab:阮翀的基座模型信仰与元戎启行的第二曲线|甲子光年
元戎启行成立Superfluid Lab(超流体实验室),由首席科学家、DeepSeek前研发负责人阮翀领导,专注基座模型研究,目标训练面向物理世界的通用基础模型,现阶段从VLA模型切入。实验室采用类似NEO Lab的独立组织形式,依托元戎启行超50万辆量产车的真实道路数据,数据闭环迭代周期已缩至约12小时。此举正值智驾技术发展趋缓、物理AI成热点的背景,旨在探索从理解道路到理解物理世界的能力突破。
8、Meta首款编程Agent来了!背后模型能力直追Opus 5
Meta发布首款编程智能体Muse Code测试版,运行于终端,由最新模型Muse Spark 1.2驱动,支持macOS和Linux。该工具可完成分析代码库、规划修改、编写代码及验证结果等复杂软件工程任务,采用异步后台智能体和持续运行的本地事件日志机制。基准测试中,Muse Spark 1.2在Terminal-Bench 2.1和Meta内部基准上仅弱于Opus 5(max),在DeepSWE 1.1上亦低于GPT-5.6 Terra(max)。训练中显著提升编程算力,并通过协同训练、长时程任务及自我改进机制增强能力。
9、等等,MiniMax H3不是刚发布吗?怎么就卷到几分钱的价格了……
秘塔AI上线MiniMax H3视频生成模型,支持网页端直接使用,无需本地部署或配置环境。该模型为MiniMax首个开源视频模型,具备2K分辨率、原生双声道及多模态编辑能力,曾在Artificial Analysis榜单视频编辑排名第一。价格方面,768P方案低至0.09元/秒,生成5秒视频成本不足五毛;2K方案为0.15元/秒,10秒视频约1.5元。API接口同步开放,并支持接入ComfyUI工作流。
10、AI能接管实验室了?中国科大最新研究给出真实物理世界的压力测试
中国科学技术大学发布AI科学家研究,构建包含45个模块化自动工作站的机器催化实验室,将AI能力测试从方案生成推进至真实物理实验执行。研究评测6种智能体框架与9种大模型组成的48种配置,完成32项任务、4608次测试,仅151个工作流无需人工修复即可执行,占比3.3%。最优配置Claude Code与Claude Opus 4.7可执行率为28.1%,Codex与GPT 5.5为19.8%。五轮闭环实验显示,AI智能体仅能调整局部参数,无法重新设计研究策略;全部测试仅3个工作流超过30步。研究区分了生成计划、执行工作流和策略重规划三种能力,为AI科学能力提供了可量化、可验证的物理世界证据。
上一篇
【紧急加更】谷歌Bard中文版火爆上架,畅享中文对话,一键登录,告别ChatGPT封号困扰!
下一篇
08月05日AI资讯 | Ilya首个模型将上线;Sand.ai开源千亿MoE视频模型;SpaceX英伟达AI算力上天;阿里发布Qwen3.8
- 作者:AI学长小林
- 链接:https://ai.linbintalk.com//article/3b4629a6-152d-81d6-8314-fe8c82f81d48
- 声明:本文采用 CC BY-NC-SA 4.0 许可协议,转载请注明出处。

