slug
summary
tags
icon
password
DeepSeek V4「满血版」曝光了!最快明天发布
据爆料,DeepSeek V4「满血版」即将发布,最快明天上线。作为中国AI领域备受关注的大模型,DeepSeek V4的发布被视为对现有AI模型格局的重要冲击,有望在性能和能力上带来重大提升。
ICML 2026 | 从"事实错误"到"世界模型失配":来自CMU、斯坦福等研究者提出大模型幻觉统一定义
来自CMU、斯坦福等顶尖机构的研究者在ICML 2026上提出大模型幻觉的统一定义框架,将幻觉问题从简单的"事实错误"重新定义为"世界模型失配",为AI领域的幻觉研究提供了理论基础和统一视角。
Claude杀入全美教室:一周干49小时的老师,终于等来免费AI助教
Anthropic旗下的Claude AI正式进入美国教育领域,为教师提供免费的AI助教服务。该应用旨在减轻教师每周49小时的工作负担,通过AI辅助教学、自动批改等功能提升教育效率。
港科大新发现:MoE路由很脆弱!重复token输入阻塞负载均衡 | ICML'26
香港科技大学研究团队在ICML 2026上发表研究成果,发现MoE(混合专家)模型的路由机制存在脆弱性——重复token输入会阻塞负载均衡,影响模型性能和稳定性。该发现对MoE架构的优化具有重要意义。
中国队交卷,盲测打爆Claude!科学多模态统一AI来了
中国AI团队推出科学多模态统一AI模型,在盲测中性能超越Claude。该模型实现了科学领域的多模态统一处理能力,代表了国产AI在多模态方向上的重大突破。
马斯克:Grok 4.6 下周完成训练,2 万亿参数;OpenRouter 估值超 13 亿美元;腾讯 WorkBuddy 上线安卓 / iOS / 鸿蒙
马斯克宣布xAI的Grok 4.6模型下周完成训练,参数规模达2万亿;AI模型路由平台OpenRouter估值超13亿美元;腾讯AI助手WorkBuddy正式上线安卓/iOS/鸿蒙多平台。多条重磅AI产品动态。
Groq创始人深度洞察 :推理越快=模型越聪明?
Groq创始人深入探讨推理速度与模型智能之间的关系,提出推理速度越快是否意味着模型越聪明的核心问题,分析了AI推理效率对模型能力的影响,为行业提供了重要洞察。
不换模型,效果提升104%!上海AI Lab让Harness也能自进化了
上海AI Lab研究团队提出让Harness(模型评测框架)实现自我进化的新方法,在不更换底层模型的情况下将效果提升104%。该研究为模型评测领域提供了全新思路。
- 作者:AI学长小林
- 链接:https://ai.linbintalk.com//article/3a2629a6-152d-81a1-b184-c749206b0130
- 声明:本文采用 CC BY-NC-SA 4.0 许可协议,转载请注明出处。

