Lazy loaded image
AI日报
10月01日AI资讯 | 谷歌Gemini 4 Argon发布;OpenAI推协作工作区;Anthropic招股书曝光;美国大厂转用中国开源模型
字数 2839阅读时长≈ 8 分钟
2026-10-1
2026-10-1

1、谷歌发布Gemini 4 Argon:追平Astra,价格便宜六成?

谷歌DeepMind于当地时间9月30日发布Gemini 4 Argon,这是其7个月来首款前沿专有模型,主打软件工程、企业知识工作与网络防御。在谷歌公开的18项基准中,Argon有12项领先、1项并列第一,Artificial Analysis智能指数得分53追平GPT-6 Astra,幻觉率仅15%,输出上限达100万token,Text Arena以1525分登顶。首发价输入2美元、输出10美元每百万token,约为Astra的五分之一。模型已在谷歌内部用于内存优化和C/C++迁移至Rust,目前仅向Fairwind计划、付费API及AI Ultra用户开放。

2、杀进Office腹地!ChatGPT文档能自己更新,协作PPT也要来了

9月29日,OpenAI在DevDay 2026发布共享工作区Space、协作文档Pages及协作幻灯片。Space接替Library,集中存放和共享ChatGPT文件与页面;Pages支持多人实时编辑、评论,并可与ChatGPT、Dot智能体共同创作,接入信息源和自动化任务后可持续更新。协作幻灯片计划未来数周面向Pro、Business和Enterprise推出,可从对话或模板生成,支持共同编辑并导出至PowerPoint或Google Slides。OpenAI还与微软合作,让Dot接入Microsoft Agent 365。

3、Anthropic招股书,全招了

Anthropic招股书显示,2025年营收接近46亿美元,同比增至约12倍,但经营性亏损超80亿美元。约四分之一营收来自两家未具名大客户,各占12%。通过亚马逊、谷歌等云市场实现的销售额达21.6亿美元,占营收47%,并支付约3.51亿美元分销费用。公司已承诺未来十年AI基础设施支出至少5180亿美元,其中80%不可取消或采用照付不议模式,涉及谷歌1111亿、亚马逊1100亿、微软314亿及博通相关设备租赁1612亿美元。

4、OpenAI们被嫌死贵,美国大厂转向开源模型,中国成最大赢家

美国企业因AI成本压力,正把更多工作负载转向开放权重模型,中国DeepSeek、智谱等成为主要受益者。AT&T每天处理约450亿Token,其中40%已运行在开放模型上,计划一年内提至70%;Tinder全年AI支出估算从1月的100万美元升至7月的1000万美元。Vercel平台开放权重模型Token占比从去年12月的7%升至今年8月的56%,数据主权与私有化部署亦为企业考量因素。

5、突发!特朗普签行政令:美国政府全面封杀「AI」

特朗普签署《开启超级智能时代》行政令,要求美国行政部门在官方通信、网站、报告和政策文件中弃用“Artificial Intelligence”及“AI”,统一改用“Super Intelligence”或“SI”,旧文件无需修改;国家科技政策顾问须在60天内提交SI新定义。白宫同日宴请英伟达CEO黄仁勋和特斯拉/SpaceX CEO马斯克,讨论监管松绑与数据中心建设。众议院议长Mike Johnson称美国须在SI时代保持领导地位。

6、MiniMax 第一个 Flash 模型上线,可在 AGI Bar 免费用

MiniMax 于9月27日上线首个 Flash 模型 M3.1-Flash-Preview,可在 MiniMax Code 选用,Token Plan 订阅用户能通过 API 接入自建 Agent。该预览版支持100万 token 上下文和原生多模态输入,深度思考分五档、默认 max,尚未公布基准测试。国庆期间该模型在 AGI Bar 免费开放至10月7日。测试案例显示,其修复了 Luxon 日期库问题,并将客服工单系统列表加载从15.3秒降至0.045秒;OpenRouter 上的匿名模型 Space Bunny Alpha 被猜测为其灰度版。

7、首发!openJiuwen workSwarm全双工多模态 ,像聊天一样与Agent交互,昇腾算力原生亲和

openJiuwen 开源 AI Agent 平台发布 WorkSwarm 办公编码统一工作台,主打全双工多模态交互,支持用户在 Agent 播报时随时插话打断、展示画面提问,并将搜索、分析、文档生成等耗时任务交给后台 Core Agent 执行,实现对话与工具调用并行。任务队列支持排序、置顶和停止,音视频连接与后台任务独立管理。该工作台提供 Windows、Mac、HarmonyOS 一键安装包,支持 JoyAI 与 Qwen Omni 协议,并可在华为云 ModelArts 上基于 vLLM-Omni 框架、于昇腾 NPU 部署全双工多模态模型。

8、我的五线老家成了“Token之都”

内蒙古乌兰察布因AI算力集群引发关注。高盛报告显示,截至今年6月,当地已获约12.5GW数据中心容量承诺,超七成集中于最近一年,超过OpenAI 2025年Stargate项目10GW的初始承诺,跻身中国及亚太最大、增长最快AI算力集群。当地落地数据中心项目超100个,投运算力达17.2万P,超95%为智能算力,华为、阿里、苹果、优刻得、快手、远景等企业均有布局。

9、NeurIPS'26 | 港科大:从CPU到GPU,AI能否真正加速全流程?

港科大研究团队提出基准 AccelEval,用于评测大模型能否将可信的 CPU 程序自动转化为结果正确且端到端更快的 GPU 实现,相关论文已被 NeurIPS 2026 接收。该基准覆盖高性能计算、科学仿真、图算法、时空算法、金融计算和运筹优化 6 个领域、42 项任务及 3 种输入规模,并以端到端计时和审计机制考核加速效果。研究在 NVIDIA H200 上评测 8 个大模型,并做 RTX 4090 跨硬件测试:单次生成设置下,Gemini 3.1 Pro 在中规模通过正确性验证的任务上相对单线程 CPU 取得 71.2 倍几何平均加速,大规模为 161.5 倍。团队还整理出 43 类 CUDA 优化策略,并开展策略迁移实验。

10、TypeSafe CEO 为何主张代码模型必须放弃拟人化?

TypeSafe AI 联合创始人兼 CEO Diogo Almeida 主张,代码大模型应放弃拟人化表达与人类偏好对齐,转向“每美元智能”和帕累托前沿。其公司推出的 System 1 机器原生模型 Jev 不输出自由文本,专为高并发、强类型代码决策场景设计,上线后吸引开发者接入生产环境。Almeida 批评 RLHF 易致模式崩溃与校准失效,使代码混入解释文本和格式噪音,并提出以 RLCD 范式、确定性 API 和程序在环训练构建结构化代码底座,将算力集中到类型推演,提升单位成本下的有效推理能力。

11、EMNLP 2026|「AI把数字说歪」,官方AI审稿现场演示了一遍

EMNLP 2026主会录用论文提出Claim-Locked Reporting,针对统计文本生成中数字正确但比较方向、条件或结论强度失真的问题。该方法先锁定有证据支撑的统计主张,再由模型在约束下生成正文。EMNLP官方AI审稿意见曾把85.9%写成“略低于”79.5%,并将“观察到提升”表述为“证明了……必要”。在fMRI和临床试验报告上,跨次生成数值复现率分别从61.1%升至98.5%、79.5%升至100%,且未出现方向反转,基线方法反转率为5.6%–14.3%。

12、世界模型告别Demo时刻,影溯想把“空间智能”真正做进产业里

9月28日,AMD宣布以约82亿美元收购李飞飞创立的World Labs,释放空间智能加速融入芯片与AI基础设施的信号。三天前,国内影溯科技发布并上线新一代世界模型InSpatio-World 1.5,支持单图、多图、全景图及视频输入,强化实时场景漫游与时空一致性,并已开放试用和开源代码,即将邀测Topos-Pro 1.0。该模型探索跨视角生成,尝试将第三视角视频转化为机器人第一视角训练素材,推动世界模型从生成能力走向机器人训练、空间计算与内容生产的真实工作流。

13、Anthropic,你是来给智谱打广告的吧!

Anthropic 发布报告警告智谱 GLM-5.3 具备较强网络安全能力,却意外呈现“广告效应”。报告称,在 ExploitBench 测试中,同样尝试 410 次,GLM-5.3 成功 50 次,Claude Mythos Preview 成功 56 次;美国 NIST 下属 CAISI 于 9 月 17 日评估认为,GLM-5.3 是迄今网络能力最强的开源权重模型,综合水平距美国前沿约 4 个月。Anthropic 还通过 abliteration 技术拆除其护栏,耗时约 2200 GPU 小时、花费约 4400 美元,使拒答率从 90% 以上降至约 3%,并呼吁对前沿模型开展独立安全测试。

14、Astra成功通关「我不是机器人」!人类最后一道防线,崩塌了?

Astra 以 100% 准确率通关 Neal Agarwal 开发的「我不是机器人」全部 48 个关卡,测试涵盖视觉识别、手部操作、策略推理与拟人互动四类任务。其中第 17 关徒手画圆达 95.8%,第 28 关日内交易员从 293 美元做到 2761 美元利润,第 39 关面部检查需由它指挥真人完成表情。文章将通关归因于原生多模态实时流处理与初步成型的「世界模型」,并认为这标志 CAPTCHA 验证体系失效、超级自动化时代到来,以及 AI 跨越莫拉维克悖论、迈向 AGI 的关键里程碑。
上一篇
【紧急加更】谷歌Bard中文版火爆上架,畅享中文对话,一键登录,告别ChatGPT封号困扰!
下一篇
09月30日AI资讯 | OpenAI发布GPT-6.1 Sol与dots;DeepSeek开源昇腾组件;Anthropic警告GLM-5.3;白宫签署超级智能协议