Lazy loaded image
08月17日AI资讯 | RoboScience发布轮式机器人REX G1;HiDream-O1-World登顶WBench;OpenRouter被Stripe收购;Claude水印被破解;Codex开放1M上下文
字数 4292阅读时长 11 分钟
2026-8-17

1、RoboScience机器科学发布轮式仿人形通用机器人REX G1,让机器人真正成为新一代具身生产力伙伴|甲子光年

RoboScience机器科学发布轮式仿人形通用操作机器人REX G1,定位“新一代具身智能生产力伙伴”。该机器人搭载自研VLOA架构的通用具身大模型Visics,面向物流、工厂、零售及家庭场景,实现从任务理解到执行的闭环。REX G1整机22个自由度,双臂抱持10kg,重复定位精度±0.1mm,宽度540mm,可进入0.75米窄通道,作业高度覆盖0.1-2.0米,端侧算力达2070 TFLOPS。单次续航最长4小时,支持热插拔换电,5秒恢复作业。

2、HiDream-O1-World拿下WBench第一,交互世界模型的格局被改写|甲子光年

智象未来发布交互式世界模型HiDream-O1-World,以平均分80.9登顶交互式视频世界模型评测基准WBench核心Navi分榜,物理一致性维度以73.3分位列第一,超越腾讯HY-World1.5与阿里HappyOyster。该模型支持文本、图像、交互等多模态输入,具备第一/第三人称漫游及实时编辑功能,采用原生全模态UiT架构与几何-外观解耦生成范式,兼顾时空一致性与物理规律。此次发布或重塑全球世界模型竞争格局。

3、Transformer祖传设计遭暴击,COLM顶会三篇论文发难

COLM 2026上,多篇论文同时质疑Transformer架构中长期被视为“标配”的设计。Ai2等机构训练26个7B-8B参数模型,发现QK归一化、GQA、滑动窗口注意力组合可致HELMET 32K评分最高差47%,QK归一化效果因模型而异。康奈尔大学研究显示,GPT-2、Llama 3、Qwen 3等模型中,输出投影层会丢弃95%-99%的梯度范数,余弦相似度仅0.1-0.2。图宾根大学发现,层剪枝虽保知识能力,但严重破坏s1.1-7B和Qwen3-8B的长链推理,剪两层后AIME24正确率接近零。

4、人形机器人开始打国球了!两台机器人完整打完11分制比赛

两台人形机器人自主完成一场11分制乒乓球对局,据称是人类史上首次。该机器人由港大超维战队研发,采用香港大学与超维动力团队自研的SMASH 2.0系统,可自主发球、感知轨迹并全身协调击球。这场表演将在8月22日至26日国家速滑馆举行的第二届世界人形机器人运动会上亮相,赛事吸引2000多台机器人参加,参赛平台为智元远征A3。

5、过去7个月,美国开源模型向中国“抄作业”

Hugging Face报告显示,2026年前七个月中国实验室开源模型在参数规模上持续领先美国,美国千亿级参数开源模型多数基于中国模型微调或适配。模型仓库从243万增至296万,但85.6%模型终身下载量不足200次,1B以下模型占历史下载量83%。阿里Qwen下载量达20.45亿次,衍生模型超15万个;英伟达和AMD成美国发布模型最多厂商。Meta推出Muse Glimmer、英伟达发布Nemotron 3.5 Lightning应对竞争,模型竞争正向生态延伸。

6、闭源RSI的严父来了:18个Agent自主科研,Kimi K3靠Harness逼近Opus 5

开源AI基础设施公司Prime Intellect提出借助多智能体Harness,将AI科研中的监控与实现环节交由更小的开源模型完成。在nanoGPT优化器速通实验中,18个前沿模型参与,开源权重模型Kimi K3搭配Prime Agent Harness跑出2930步的成绩,超过GPT-5.6 Sol的3042步,逼近Claude旗舰模型Opus 5的2920步。实验表明,开源模型与高效Harness组成的系统在AI自主科研中可达到接近顶级闭源模型的水平,科研能力愈发体现为试错吞吐量问题。

7、终于!世界模型进入“有声时代”:24FPS画面+48kHz立体声实时生成

量子位报道,Noiz AI联合香港科技大学、清华大学、CMU、Google DeepMind等机构发布实时可交互音视频世界模型HelixWorld 1.0。该模型支持24 FPS实时生成画面,同步输出48kHz双声道立体声音频,由原生Transformer架构统一生成视觉与声场,用户操作可同时影响两个模态。系统通过构建带空间与动作的音画数据、联合生成、因果化改造及蒸馏压缩,实现持续实时交互。模型权重与代码将在数周内完全开源。

8、70亿美元!全球最大「Token中转站」OpenRouter被收购

支付公司Stripe以超70亿美元收购AI模型路由平台OpenRouter,交易于8月16日敲定。OpenRouter成立于2023年,为全球超1000万开发者提供统一API接入400多个AI模型,涵盖GPT、Claude、Gemini、DeepSeek等。其周处理Token量已从2025年的5万亿升至55万亿,年化推理支出从1000万美元增至超1亿美元。OpenRouter今年5月B轮融资估值13亿美元,82天内估值涨约5倍。Stripe同时正以530亿美元竞购PayPal,意图整合AI调用计量与支付入口。

9、Fable 5夺冠!全球18大顶尖AI自主科研大赛,逼近人类极限

Prime Intellect公布迄今最大规模前沿AI自主科研实验,将18个顶尖大模型断网关入沙盒,进行153场完全自主的nanoGPT优化器速通挑战。最强模型Fable 5以2726步追平人类纪录82%,仅差126步,Opus 5达2920步,GPT-5.5垫底。实验发现,所有模型均未创造新方法,差距在于实验策略,如多人种验证、回头重测。OpenAI与Anthropic预测2028年实现AI自主研究。

10、OpenAI失去了「CUDA内核之神」

OpenAI 失去一位核心工程师:有“CUDA 内核之神”之称的 Scott Gray 已离职。他在 OpenAI 任职十年,曾参与 GPT-3、DALL·E、稀疏 Transformer 等关键项目,并开发块稀疏 GPU 内核。早年他在 Nervana Systems 手写汇编级内核,性能比 NVIDIA cuBLAS 快 4.8%。其社交简介已改为“Former GPU geek at OpenAI”,表示将独立探索神经科学启发的 AI 方法。这是 OpenAI 2026 年流失的又一位人才,据统计已有 12 位高级 leader 离职。

11、说一个反常识的真相,Agent如今在真实工作场景的成功率依然很低。

AIHOT排行榜制作中发现,大模型在真实工作场景任务成功率远低于编码领域。以阿里国际站开源的RealReplicaBench为例,107个电商任务中,Claude Opus 5通过率60.75%,Qwen 3.8 Max与DeepSeek V4 Pro均为49.53%;对比DeepSWE编码基准头部模型超70%。腾讯E-Bench测试11个模型,Kimi-K3平均分73.79%,但三次全对率仅58.82%。小红书VibeLifeBench中,Claude Opus 5平均分仅32.5%。

12、菲尔兹奖得主:AI现在主要靠「抬杠」突破重大数学猜想

菲尔兹奖得主Timothy Gowers分析近期AI数学突破,发现其擅长通过寻找反例而非正面证明来攻克猜想。OpenAI内部模型解决Erdős单位距离问题,通过构造复杂数域点集推翻流传数十年的判断;Claude协助数学家找到雅可比猜想反例。此外,AI构造出非sofic群,并在多色Ramsey数问题上取得进展。OpenAI公布的10项成果全部搜寻成本折合约数千美元。Gowers认为AI优势在于知识广度与低成本试错,但判断力不足,并预计一两年内模型会显著进步。

13、Codex正式开放1M上下文!解除GPT-5.6 Sol封印,三行配置搞定

OpenAI正式向ChatGPT和Codex用户开放GPT-5.6 Sol的1M上下文窗口,此前该功能仅限API使用。用户只需在Codex的config.toml文件开头添加三行配置,即可解除默认272k上下文的限制,模型会在约90万token时启动自动压缩。OpenAI研究员Tibo公布了该方法并提醒超长上下文会翻倍消耗token,默认设置经过成本与性能优化。官方评测显示,GPT-5.6 Sol在256K-512K区间MRCR v2得分为91.5%,512K-1M区间降至73.8%。此外,Tibo透露Codex将支持下一代模型Astra(GPT-6)。

14、20%的美国打工人把活儿甩给AI!被替代的是任务,不是岗位

美国Epoch AI联合民调机构Ipsos于8月6日发布调查报告,显示约20%的美国就业者已将至少一项原本交给同事或承包商的任务完全或大部分交由AI处理,其中分析数据以7.1%居首。调查于7月10日至19日进行,经筛选共1106名受访者。报告指出,AI替代的是具体任务而非完整岗位,在十项常见知识工作中,AI使用率从维护业务记录25%至软件设计57%不等,但能完成大部分或全部任务的比例均不高于10%。此外,66%的AI输出被原样或轻微修改后采用。

15、100%纯血国产AI反超Suno!一个下午做出百万预算主题曲

音潮大模型V4.0正式发布,采用底层架构重构,针对中文声调、语感与气声进行专项设计,在指令理解、情绪落地、曲风细分三方面实现跃迁。该模型基于壁仞国产GPU完成训练,实现算法与算力双重国产化。音潮团队已连续两年为WAIC世界人工智能大会打造官方主题曲,并于2026年以一个下午完成传统流程需两三个月、百万级预算的创作。目前其C端应用已积累百万用户,V4.0支持10语种及纯音乐生成。当前AI歌曲日增7.5万首,但播放占比仅1%-3%。

16、北大联合阶跃星辰提出TensorCast:统一可编程管理大模型张量,推理「首字延迟」最高降低93.2%

北京大学、阶跃星辰与北京邮电大学联合提出TensorCast,在大模型基础设施中引入统一可编程的张量生命周期管理抽象层,将模型权重、KV Cache等张量状态与计算引擎解耦,支持识别、放置、移动、转换和物化等操作。集成至vLLM和SGLang后,模型部署场景中实例启动速度最高提升228.6倍;在高并发多轮对话Agent负载下,结合可编程调度策略将中位数首字延迟最高降低93.2%,同时达到专业KV Cache系统Mooncake的同等性能。

17、刚刚,Claude水印一夜变废纸!

GitHub上一个名为watermarks-remover的开源项目迅速走红,获得超过11000颗星,采用MIT协议,可去除Anthropic旗下Claude的文本水印、谷歌SynthID-Text及OpenAI的隐形标记,并清理C2PA、EXIF等图像和PDF元数据。工具通过三层处理:清除隐形字符、调用Llama 3等非源头模型重写文本以破坏统计水印、剥离文件级鉴权数据,并集成MarkLLM框架验证清洗效果,被视为对抗大模型强制水印的集体反击。

18、ECCV 2026 | 智能助手何时该主动开口?Vinci2让第一视角AI助手从「有问必答」走向「主动服务」

大连理工大学、Alaya Lab 与东京大学团队提出 Vinci2,研究第一视角视频助手的主动服务能力,相关成果被 ECCV 2026 接收。Vinci2 包含首个主动服务评测基准 EgoServe 和免训练记忆增强智能体 EgoMemo。EgoServe 基于 EgoLife、HoloAssist 与 CaptainCook4D 构建,覆盖超 128 小时视频、3400 余个服务实例,将主动服务划分为 4 个层级、10 个子类别。EgoMemo 采用多尺度时序记忆、演化知识图谱和视觉嵌入档案,在 EgoServe 上超越 Qwen3-VL-Plus 和 GPT-5-mini,并在 OVO-Bench、EgoSchema 等基准取得领先结果。

19、李飞飞最新访谈:AI咋能代替人呢?

李飞飞在Huberman Lab访谈中表示,AI并非人类替代者,而是能力放大镜。她回顾了视觉启发AI的历史:5.4亿年前感光细胞催生寒武纪爆发,2006年发起ImageNet项目,2012年大数据、神经网络与GPU结合推动现代AI转折,2016年图像识别首次超越人类,2022年ChatGPT问世,2024年Sora发布。她指出AI缺乏私人情感与内在驱动力,强调不能让少数科技企业决定社会走向,需多方参与治理。

20、OpenAI研究员,曝光ASI降临时间线:大多数已成现实!

OpenAI前研究员发布的《AI 2027》预测文件,提出ASI或在2027年底前降临。独立追踪者从中提取53项可验证预测,51%已确认或提前实现,现实推进速度达预测的70%。其中AI网络攻防能力提前9个月兑现,Anthropic的Claude Mythos Preview自主发现数千个零日漏洞;五角大楼提前18个月与Anthropic、OpenAI、xAI和Google签署各2亿美元合同。但RSI反馈环尚未闭合,Claude已编写Anthropic超80%新代码,研究显示AI研发生产力增长约9%,低于自我维持所需的15%门槛。

21、Anthropic CEO辟谣!为亡父转AI,10年内灭癌症

Anthropic CEO Dario Amodei在IPO前夜罕见发文,回应硅谷对其“监管俘获”及权力集中倾向的质疑,并宣布加速押注生物医学AI。他预测5至10年内AI将治愈多数人类疾病,称未来几个月将公开早期研究进展,并以父亲死于丙肝的个人经历阐释动机。目前Anthropic估值或达2万亿美元,年化营收预计从10亿美元增至470亿美元,企业级API市场份额32%首次超越OpenAI。

22、奥特曼放话:半年内,GPT上下文覆盖你的一切

奥特曼在最新访谈中透露,预计未来六个月内,OpenAI下一代ChatGPT模型将能持续观察用户屏幕、记录会议与通话,并在获得授权后接入短信、邮件及办公软件,掌握完整生活与工作上下文。该模型将聚焦创业公司CEO群体,主动协助处理信息过载问题,如梳理用户反馈、提醒文档遗漏、补充战略思路,但不代替用户作决策。此设想引发关于隐私边界的广泛讨论。
上一篇
BingChat重磅升级:多模态聊天惊艳登场,企业版正式上线,数据更安全!
下一篇
OpenAI硬件陷抄袭门;中科院&字节Seed推出BridgeVLA;Thinking Machines获20亿美元种子轮;豆包卷AI编程;北大施柏鑫团队提出VIRES视频重绘方法 | 06月24日AI资讯
目录