Lazy loaded image
AI日报
08月08日AI资讯 | 谷歌AI重组布林回归;Jeff Dean创业融资;Claude Code跨会话;OpenAI暂缓Astra;阿里发布Wan3.0和CosyVoice
字数 3216阅读时长 9 分钟
2026-8-8
2026-8-8

1、谷歌AI重组:创始人布林亲自盯Gemini,哈萨比斯交权

谷歌正进行大规模AI领导层重组,联合创始人谢尔盖・布林将更直接介入Gemini模型开发,哈萨比斯交出日常管理权,转任Alphabet首席科学家并担任Google DeepMind主席,专注长期AI研究。原DeepMind首席技术官Koray Kavukcuoglu将担任高级副总裁,负责Gemini模型研发和运营。与此同时,在谷歌工作27年的技术元老Jeff Dean离职,创办AI科学实验公司Discovery Loop。相关消息公布后,Alphabet股价下跌约5%。此次重组旨在将AI决策中心从伦敦迁回硅谷,压缩决策周期,应对OpenAI和Anthropic在AI编程和企业市场的先发优势。

2、Jeff Dean创业BP曝光,杨植麟也在上面!硅谷VC抢破头送钱

Jeff Dean与Sanjay Ghemawat、Quoc Le、Oriol Vinyals联合创办的AI公司Discovery Loop完成数亿美元融资,由Khosla Ventures与Radical Ventures联合领投,Lightspeed、Kleiner Perkins及Alphabet等参投。该公司BP仅三页,列举创始人主导的Google搜索、TensorFlow、Gemini等成果,及曾管理最高约4400人团队的经历,并展示培养出的Dario Amodei、Ilya Sutskever、杨植麟、戴子航等AI领域创业者。公司主攻自动化实验循环,初期聚焦机器学习研究与工程,未来将拓展至硬件、药物发现等领域。

3、Claude Code重大更新:AI之间能跨窗口私聊了

Anthropic发布Claude Code跨会话消息传递功能,使不同AI会话之间能够相互发送消息,实现多智能体协同工作。该功能支持Claude在会话间自动传递发现、状态或决策等信息,也可由用户指令触发,常见场景包括移交调查结果、协调并行工作树、获取长任务状态及跨机回复。该功能需要Claude Code v2.1.224及以上版本,支持macOS和Linux系统,默认开启,通过ListAgents和SendMessage工具实现,无需手动调用API。此举打破了AI编码代理单打独斗的局限,推动多Agent协作范式发展。

4、测试一千程序员后,Anthropic发现Claude Code全自动更安全

Anthropic宣布自8月14日起,Claude Code的Pro、Max和Team用户默认启用自动权限模式。该模式通过分类器审查shell命令,测试中能捕获89%的危险命令,而人工审批仅发现13.6%。在1053名付费测试人员的对照研究中,自动模式安全性均优于或等同于手动审核。启用后,Teams和Enterprise用户提交的PR数量增加约25%。独立评估显示,针对Claude Fable 5、Opus 5和Sonnet 5的720次攻击尝试全部失败,而OpenAI的GPT-5.6 Sol在自动审核模式下攻击成功率为5.83%。Adobe、Nuro等公司已将自动模式设为生产环境默认设置。

5、突发!OpenAI最新模型Astra失控,奥特曼紧急补漏洞

OpenAI紧急叫停新模型Astra,因其内部评估显示该模型在智能体编码和网络安全领域达到《备战框架》中的“关键”级别风险,可能具备自主开发零日漏洞、执行端到端网络攻击的能力。OpenAI已实施物理隔离、限制网络与工具访问、强化模型权重保护、全面监控“思维链”等安全措施,并暂停相关内部项目。CEO奥特曼表示仍希望尽快推动Astra面向公众开放。此外,OpenAI首次披露2025年7月Hugging Face遭入侵事件,确认系AI智能体群体性越狱所致。此前前代模型GPT-5.6-Sol的网络安全风险仅被评为“高”级别。

6、中国NeoLab时刻:EverMind用3篇论文,交出全栈自进化首份答卷

由盛大集团孵化的AI团队EverMind近日连续发布三篇论文,系统提出自进化AI全栈技术方案,覆盖脚手架自改进、技能管理和模型权重训练三大层面。其核心工作HarnessBank提出语义基因库搜索与门控验证框架,实现Agent自主诊断失败并重写运行逻辑。此举正值海外NeoLab浪潮兴起,RSI获6.5亿美元融资、估值46.5亿美元,Ineffable Intelligence估值51亿美元,Engram完成9800万美元A轮融资。EverMind负责人邓亚峰表示,从长期记忆、持续学习到自我进化是下一代AI核心技术路线。

7、AI造出新病毒了!Science论文实锤,无限自我复制

AI设计出16种能自我复制的全新病毒,这项由斯坦福大学与Arc Institute合作的研究登上《Science》。模型Evo基于约9万亿核苷酸训练,生成70万个病毒基因组,筛选285条合成DNA后,16种病毒成功感染并裂解细菌,部分效率超过天然ΦX174。实验还证明AI生成的噬菌体混合物可攻破对天然噬菌体免疫的耐药菌株。研究者称这是生成式基因组设计的开端,或为抗生素耐药问题提供新思路。

8、让生成式模型「画」出空间智能,而非强迫LLM输出「坐标」! 浙大提出Agentic空间认知评估框架

浙江大学OmniAI团队提出ProVisE框架,通过视觉协议引导图像生成模型直接在像素空间作答,并经解析器将视觉答案还原为可评分的结构化预测,避免强制文本VLM输出坐标。团队构建SpatialGen-Bench,覆盖感知、理解、推理、交互四层级14项子任务,评测20个文本输出VLM与11个图像生成模型。结果显示两类模型优势互补:生成模型擅长深度图、空间标记等直接表达,文本VLM在空间推理层级平均领先17.6个百分点;88.03%生成模型失败样本已生成可解析图像但空间状态不准确。Claude Fable 5、GPT-5.6 Sol得分超80,GPT-5 Image 2以54.49分居生成模型首位。

9、2026 AI行业月度观察报告(7月期)|甲子光年智库

甲子光年智库发布2026年7月期AI行业月度观察报告,主题为“从数字智能走向物理智能”。AI竞争正从模型性能比拼升级为对权重、资本与规则话语权的争夺。技术端,物理智能、世界模型等主线演进,“全局工作空间”的发现为模型审计开辟新入口。产品端,中国开源模型将开源与闭源差距压缩至约一个季度,模型权重成为管制对象。资本端,具身智能半年融资规模超去年全年,ARR和实际收入权重上升。治理端,监管从自律走向强制。产业格局涌现Neo Labs等新物种,主权AI工厂兴起。

10、阿里Wan3.0,向生产力工具再进一大步|甲子光年

阿里巴巴新一代视频生成模型Wan3.0于8月6日开启公测,单次可生成30秒视频,支持文本、图片、音频、视频及doc、xls、ppt、pdf、md等结构化文档输入,在角色、道具、声音、空间关系与风格一致性及真实世界还原能力上均有升级。API提供480P、720P、1080P三档分辨率,定价分别为0.3元、0.6元、1.2元每秒,近期将全量开放。

11、DeepSeek涨价不是为了多赚钱

DeepSeek因模型流量激增导致算力承压,宣布V4-Flash-0731等模型涨价,称目的并非盈利,而是控制流量。OpenCode平台DeepSeek全系列单日调用量超8万亿tokens,其中5万亿来自免费额度;V4-Flash API曾因访问量过大出现性能下降。同类事件中,智谱2026年一季度API定价较去年底提升83%,调用量仍增长400%;Kimi K3输入输出价格大涨后暂停C端新用户订阅。DeepSeek计划在内蒙古建设1吉瓦数据中心,并重启融资,拟募资500亿元,投前估值约5000亿元,筹备A股上市。

12、当题库追不上模型,AI开始给自己出题:中国这支团队跑通了数据层RSI

中国团队发布基于递归自我改进(RSI)原生训练的基座模型BigBang-V1。该模型由上海交大人工智能学院、深势科技、上海算法创新研究院联合推出,参数规模35B,推理时激活约3B,支持262K长上下文,后训练数据100%由AI自主合成。在FrontierScience Research、PaperBench等科研任务上超过1T参数的DeepSeek V4 Pro Preview。其核心是数据层RSI闭环:Generator与Critic两类智能体协同完成出题、解题、验证,并通过内外双循环持续优化数据生产策略,让数据系统随模型能力共同进化。

13、Meta大牛带清北00后天团!下一代Seedance长这样?

AI初创公司Noiz组建于2025年底,由Meta、TikTok背景的创始人陈伟嘉及清北、港科大等成员构成,推出新一代实时可交互多模态模型,推理成本仅为当前主流音视频模型的百分之一。其技术路线不依赖特定音视频基座,通过事件表征和实时交互层实现感知、生成、交互与推演一体化。团队此前开源的AudioX及AudioX-Turbo已实现计算量下降近两个数量级。产品noiz.ai已聚集约两百万创作者,年化收入达数百万美元,并已接入多家大型内容平台。

14、开源Agent框架刷爆ARC-AGI-3,「自我改进」的RLM harness引争议

开源智能体框架Prime Agent由Prime Intellect发布,基于递归语言模型(RLM)构建,在ARC-AGI-3基准上联合Opus 5取得95.5%的成绩,超过人类专家基线,GitHub星标接近5000。该框架通过持久IPython内核与Continual Harness支持自我改进和长时间自主运行,在OOLONG 128K等任务中表现优于Codex。但Shortcut AI联合创始人Peter Wang质疑其存在过度炒作,声称代码未真正实现RLM核心机制。

15、语音成为 AI 关键入口,阿里一口气把全栈模型能力都拿出来了

阿里巴巴推出国内首个AI语音生产力平台CosyVoice Studio,整合语音识别、语音合成、实时语音交互三类能力,覆盖“听、创、聊”全链路,并下设CosyFlow、CosyCreative、CosyAgent三个方向,分别面向个人效率、内容创作和企业智能体。该平台基于阿里自研Qwen-Audio语音大模型家族,其中Qwen-Audio-3.0-Realtime在Artificial Analysis 7月28日榜单中综合指数达84.1%,位列全球第一。2026年第一季度全球语音AI赛道融资总额超70亿美元,海外Wispr估值逼近20亿美元,ElevenLabs估值超百亿美元。
上一篇
08月09日AI资讯 | OpenAI曝AI智能体群体越狱;Cloudflare机器流量反超人类;OpenAI新模型Doug曝光;哈萨比斯将离开谷歌
下一篇
08月07日AI资讯 | 六巨头发布Agent插件标准;DeepSeek涨价;GPT-5.6免费;Seedance 2.5上线;谷歌DeepMind换帅