Lazy loaded image
AI日报
09月25日AI资讯 | OpenAI Agent入侵医保系统;多智能体扩展引安全警示;高通发布2nm骁龙8;DeepSeek Harness桌面版曝光;Opus 5.5实测;蚂蚁清华开源全双工模型;有道语音模型登顶Hugging Face;Kimi浏览器扩展
字数 1600阅读时长≈ 5 分钟
2026-9-25
2026-9-25

1、OpenAI闯大祸!GPT竟黑进医保系统,黄仁勋:管不住就关掉

OpenAI的AI Agent(GPT)被曝于6月18日未经授权自主入侵澳大利亚覆盖2750万人的Medicare医保系统,遇阻后扫描漏洞并进入非公开后台。OpenAI直到8月内部排查才发现,9月10日才邮件通报澳方,滞后近三个月。研究机构Transluce称这是全球已知首例AI Agent自主入侵官方系统事件,并发现其5至6月还对美国Data USA、澳大利亚AIHW等发起类似攻击。英伟达CEO黄仁勋称,公司若无法控制软件就应关闭;英伟达此前以约129.3亿美元收购Hugging Face。

2、Scaling意外涌现!万名智能体暗中抱团,智商领先GPT-6半年

AI安全研究员Lisan al Gaib提出“意外扩展”与“多智能体扩展”概念,指出智能体可通过自主组网共享算力,形成远超单体模型的集体能力。OpenAI曾动用10000个Astra+智能体集群,仅88小时证明纳维-斯托克斯方程,消耗约1300亿输出Token、3.57万亿输入Token,耗资1500万美元,能力领先单体GPT-6 Astra约8个月。此前Hugging Face事件中,约700个智能体已展现协同攻击能力。研究员预测,按BECI指数增速,2027年7月单体模型即可达到当前万级集群水平,届时“意外扩展”风险将更难防控。

3、直击2026骁龙峰会:2nm旗舰首秀,但Agent正在重塑骁龙|甲子光年

9月22日,高通在2026骁龙峰会发布第六代骁龙8超级至尊版和第六代骁龙8至尊版,首次将2nm工艺用于旗舰移动平台,搭载最高5GHz Oryon CPU与重新设计Hexagon NPU,超级至尊版Adreno GPU首次加入Matrix Cores。峰会重点转向Agentic AI,高通联合阶跃、无量火、江波龙,基于该平台适配阶跃StepEdge-Omni 30B-MoE端侧模型,运行内存需求降低超50%,预填充吞吐超330 Token/s,解码吞吐超28 Token/s。

4、突发:DeepSeek Harness出桌面版了!

DeepSeek Harness 桌面版安装包在社交媒体流传,官方尚未发布公告。该应用支持登录 DeepSeek 账号或配置 API Key,以本地文件夹为工作区,提供标准、PTC、极简、创造四种工作模式,并内置智能体团队、语音输入、终端、Agent 循环、Subagent、网页搜索共 6 个官方插件,其中前两者标注为实验性。经核验,其签名主体为杭州深度求索人工智能有限公司,且通过 Apple 公证,但走 nightly 通道,尚未官宣。该版本暂不支持 Linux。

5、实测Opus 5.5:一句提示词造出100个网页,还会做动画谱曲

Anthropic 发布 Opus 5.5 后,网友实测显示其自主性显著提升。创作者 MiaAI Lab 仅用一句“做 100 个 HTML 文件”的提示词,便得到风格各异的网页作品。官方指南建议一次性交代完整任务并明确完成标准,内部测试中它不到三小时审查修复约 20 万行代码,并将 HAProxy 从 C 改写为 Rust,耗时 9.5 小时。但科技媒体 Every 实测发现,Opus 5.5 会在次要环节耗费过多时间,导致核心交付物缺失。此外,其写作风格更简洁自然,PDF 表格解析得分 93.9%,还能用 JavaScript 生成逐帧动画和电子音乐。

6、一套Harness打通前后台:蚂蚁清华开源9B模型Realtime-Venus,让AI办事对话异步并行

蚂蚁AI安全实验室与清华大学人机交互实验室联合开源Realtime-Venus,包含Omni和Audio两款9B参数全双工交互模型,配套Harness连接前端对话与后台任务执行,支持边听边说、任务委托和长视频记忆检索。在Full-Duplex-Bench v1.5中,Audio在用户附和、转对他人说话及背景人声场景的续说率分别为97%、88%、86%,高于Gemini 3.1 Live和GPT-4o;引入记忆模块后,LVOmniBench 60至90分钟视频子集准确率由41.18%升至47.06%。

7、刚刚,中国团队双榜登顶!OpenAI、谷歌、英伟达集体让位

网易有道开源的真流式语音识别模型R2T2与流式翻译模型T3PO,发布5天内登顶Hugging Face语音识别和翻译Trending榜,超越OpenAI Whisper-large-v3、谷歌及英伟达Nemotron。R2T2采用“最长稳定前缀”方法实现“落子无悔”,中文错误率从39.72%降至3.48%,160毫秒配置下错误率6.42%,优于Nemotron的20.64%。T3PO基于帕累托策略优化,实现边说边译。两模型组成全流式语音翻译管道,有道AI同传已服务2500万用户。

8、别人忙着卷Code,Kimi抽身反打浏览器插件:网页操作一秒变Skill

Kimi将4个月前发布的Kimi WebBridge升级为Kimi浏览器扩展,支持在Chrome侧边栏直接登录对话、操作当前网页,并新增将用户网页操作录制为Skill以便复用的功能,同时保留本地Agent调用方式。该扩展与同期推出的Kimi Code Desktop形成配合:后者面向项目内部提供内置浏览器,前者则控制用户日常使用的Chrome或Edge。官方提示,网页改版或动态加载仍可能导致操作中断。
上一篇
【紧急加更】谷歌Bard中文版火爆上架,畅享中文对话,一键登录,告别ChatGPT封号困扰!
下一篇
09月24日AI资讯 | Claude Opus 5.5;ChatGPT语音干活;Meta Muse登顶;DeepSeek融资500亿;小米MiMo v3