AI早报|9.6:中国开源模型集体突围,Claude 拿下费马大定理
AI 每日早报
AI早报|9.6:中国开源模型集体突围,Claude 拿下费马大定理
2026年9月6日 · 每天3分钟,看懂今天AI发生了什么
① 小米开源通用表格数据大模型 Xiaomi-TabLDM,告别"一表一模型"
事件:9月5日,小米正式发布并开源通用表格数据基础大模型 Xiaomi-TabLDM,权重、代码与技术报告全部公开。该模型主打"一次预训练即可直接完成分类与回归预测",打破了长期以来"一表一模型"的定制范式,在 OpenML-CTR23、TALENT 等四大基准跻身第一梯队,训练时间较头部方案少 82%。

为什么值得关注:企业真实业务里 80% 以上的数据沉睡在 Excel 与数据库表格中,却长期被大模型"遗忘"。TabLDM 把结构化数据带入基础模型时代,意味着风控、营销、供应链预测等高频场景有望用统一模型替代大量定制开发,是 AI 从"对话"走向"生产系统"的关键一步。
② 微信开源多模态嵌入模型 WeMM-Embedding,9B 版本登顶 MMEB-v2
事件:9月4日,微信 AI 团队宣布开源通用多模态嵌入模型 WeMM-Embedding,提供 2B / 4B / 9B 三档规模,支持文本、图像、视频、视觉文档及任意交错输入。其中 9B 版本以 80.6 分登顶 MMEB-v2 榜单,并已每日承接十亿级线上调用,覆盖视频号、公众号、电商等场景。

为什么值得关注:"嵌入模型"是检索、推荐、多模态搜索的底层引擎。微信把内部亿级流量锤炼过的模型开源,直接拉高了中文多模态检索的天花板,也将为 RAG(检索增强生成)和企业知识库应用提供更强的"理解力"底座。
③ 腾讯混元 Hy4 preview 开源:770B 参数、1M 上下文
事件:9月5日,腾讯混元发布开源旗舰模型 Hy4 preview,总参数 770B、激活 49B、上下文长达 1M token,覆盖软件工程、办公分析与科研场景;163 名内部专家盲测均分优于 GLM-3 与 Kimi K3。模型已登陆 HuggingFace 与腾讯云 TokenHub,并配套 CodeBuddy 限免活动至 9月10日。
为什么值得关注:在 GPT-6 Astra、Claude 等闭源旗舰连发之际,国产开源阵营以"超大上下文 + 高激活效率"正面接战。1M 上下文意味着可一次性"吞下"整本书或整个代码库,对长文档分析、代码库级 Agent 意义重大,也延续了中国开源模型出海(如沙特 HUMAIN 基于 MiniMax)的势头。
④ Claude 用 11 天完成费马大定理首个端到端机器验证证明
事件:9月5日,Anthropic 宣布 Claude 在清华姚班出身的哥大助理教授彭天翼团队指挥下,用 11 天完成费马大定理首个端到端机器验证证明——共敲出 1300 万行代码、产出约 2.95 万条可验证定理,体量达 Mathlib 的 5 倍,标志 AI 数学形式化进入工程化落地阶段。

为什么值得关注:这是 AI 在"严格可验证推理"上的里程碑——不再只是生成看似正确的答案,而是产出机器可逐行核验的证明。它预示着数学、芯片验证、程序正确性证明等高可靠性领域,将出现"人机协同"的新型科研范式。
⑤ 七部门方案将存算一体写入国家级研发重点,算力转向"效率革命"
事件:9月4日,中央网信办等七部门印发《促进数字化绿色化协同转型发展实施方案(2026—2030)》,首次将存算一体、高性能存储、数据压缩、分布式训练框架、DB4AI 列为国家级研发重点。业界解读为算力竞争从"堆规模"转向"拼效率"的信号。

为什么值得关注:当算力供给受能耗与芯片制约见顶,"单位token能耗"成为新战场。存算一体等底层技术被写入国家方案,将引导产学研资源投向高能效架构,间接决定未来国产大模型与 AI 应用的成本竞争力。
信息综合自 封面新闻、IT时代网、量子位、新智元、上观新闻、巨丰投顾 等公开报道(截至 2026-09-05/06)。本文为每日 AI 动态精选,不构成投资建议。