← 文章 / AI技术
马洪基金会 7小时前 · 2026-09-18 19:35:52 · 1 阅读

智能经济30人论坛 | 国内外AI大模型周报(总第10期)

2026.08.24-2026.08.30|国内外大模型一周要闻

国际要闻

➢ 英伟达发布Vera Rubin NVL72首次实测结果:每兆瓦吞吐量最高达GB300 NVL72的30倍 

➢ Meta计划最早未来几周内推出消费者AI代理平台Hatch

➢ OpenAI公布自研推理芯片Jalapeño实测结果

➢ 英伟达二季度总营收962亿美元,同比增106%,数据中心业务营收890亿美元

➢ Claude内置浏览器上线,Claude in Chrome同日结束试点向全部付费套餐开放

➢ 谷歌发布Gemini 3.5 Transcribe语音转文本模型,可自动删除口头禅

➢ 英伟达被曝129亿美元收购Hugging Face,估值超130亿美元

➢ Anthropic发布模型硬件标准MHS,首款在物理世界运行的AI工具问世

➢ OpenAI被曝测试Codex“持久模式”:智能体持续工作直至手动休眠

国内要闻

➢ 字节跳动发布“豆包工作”,与飞书深度打通构建企业级Agent

➢ 工信部:我国智能算力规模达2185 EFLOPS,中国开源大模型全球下载量突破百亿次

➢ 腾讯混元端侧翻译模型Hy-MT2压缩至440MB,落地B站直播弹幕实时翻译

➢ 智谱上线并开源GLM-5.3-Flash,认领匿名模型Ox-Alpha

➢ 阿里通义开源Qwen3.8-Flash-Next:125B参数MoE模型,训练成本仅为前代1/9

➢ MiniMax披露中期业绩:8月ARR突破8亿美元,上半年营收同比增长283.1%

➢ 腾讯发布并开源Hy4 preview,盲测均分优于GLM-5.3和Kimi K3

➢ 智谱开源GLM-5.3模型权重,主打智能体编程与网络防御

国际要闻

Global

1

英伟达发布Vera Rubin NVL72首次实测结果:每兆瓦吞吐量最高达GB300 NVL72的30倍

8月24日|英伟达官方发布Vera Rubin NVL72与Blackwell在Agentic AI每瓦特性能方面的实测结果。在SemiAnalysis AgentX工作负载下,以每用户160 tokens/秒的交互性运行时,Vera Rubin NVL72的AI工厂每兆瓦吞吐量最高达GB300 NVL72的30倍。

2

Meta计划未来几周内推出消费者AI代理平台Hatch

8月25日|Meta Platforms计划在未来几周内推出面向消费者的OpenClaw AI助手,内部代号为Hatch,并计划于10月推出其最新AI模型“Watermelon”。Hatch旨在将公司巨额的AI投资变现,并拓展广告以外的多元化收入来源。

3

OpenAI公布自研推理芯片Jalapeño实测结果

8月25日|OpenAI在Hot Chips大会上公布了全新推理系统Jalapeño的更多细节,并首次披露基准测试成绩。在SemiAnalysis的InferenceX测试中,Jalapeño无论是单用户token处理量,还是每千瓦吞吐量,都超过目前市面上的顶尖推理处理器。Jalapeño由OpenAI与博通共同开发,OpenAI计划在今年年底前先“小规模”部署Jalapeño,2027年再逐步扩大部署量。

4

英伟达二季度总营收962亿美元同比增106%,数据中心业务营收890亿美元

8月26日|英伟达公布二季度总营收962亿美元,环比增长18%,同比大增106%;数据中心业务营收890亿美元,同比上涨117%,成为业绩核心驱动力。本季度通用会计准则与非通用会计准则毛利率均达75%,GAAP摊薄每股收益2.46美元,非GAAP摊薄每股收益2.22美元。英伟达给出三季度指引,预期营收1080亿美元(浮动±2%),该预期未计入中国区数据中心算力业务收入,毛利率预期74%。

5

Claude内置浏览器上线,Claude in Chrome同日结束试点向全部付费套餐开放

8月26日|Claude推出自己的内置浏览器,用户可在Cowork中交代任务,Claude能够在侧栏自动打开的浏览器窗口内浏览网页、点击链接、输入文字、填写表单,全程无需切换窗口,且不触碰用户日常使用的浏览器。同日,Claude in Chrome结束试点,向全部付费套餐正式开放,并同时获得自主执行动作的权限,由安全分类器逐条校验之后再放行,这套自动批准的机制与Claude Code中的auto mode是相同的。

6

谷歌发布Gemini 3.5 Transcribe语音转文本模型,可自动删除口头禅

8月27日|谷歌发布Gemini 3.5 Transcribe语音转文本模型。该模型旨在优化语音输入体验,能够自动删除语音中的“嗯”“呃”等口头禅以及说错后自行纠正的内容,最终生成更加通顺、整洁的文本。

7

英伟达被曝129亿美元收购Hugging Face,估值超130亿美元

8月27日|知情人士透露,英伟达已同意出价129亿美元收购Hugging Face,此次收购对Hugging Face的估值将超过130亿美元。另有知情人士称,微软也与Hugging Face方面进行了会面,但谈判并未继续进行。Hugging Face于2016年在纽约创立,目前被视为“AI界的GitHub”,平台托管超过300万个公开模型,数据集数量超过100万个。

8

Anthropic发布模型硬件标准MHS,首款在物理世界运行的AI工具问世

8月27日|Anthropic发布最新公告,推出一套名为“模型硬件标准”(MHS,Model Hardware Standard)的研究系统,让AI智能体能够自主操作各种可通过计算机代码编程的设备,范围包括显微镜、液体处理仪、激光器和机械臂等,这标志着Anthropic首款专为在物理世界中运行而设计的AI工具问世。Anthropic表示,公司最终计划将这项新技术开源,但前提是必须先做好充分的防护措施。

9

OpenAI被曝测试Codex“持久模式”:智能体持续工作直至手动休眠

8月28日|OpenAI正在为其旗舰AI智能体Codex开发一个具有主动性且高度持久性的版本,启用“持久模式”后,Codex将持续工作,直到被置于休眠状态。该功能位于Codex的共享核心代码中,意味着未来可能推广至桌面应用等更多产品。OpenAI发言人证实公司正在测试这一功能,但目前没有立即发布的计划。

国内要闻

China

10

字节跳动发布“豆包工作”,与飞书深度打通构建企业级Agent

8月25日|豆包面向生产力场景推出“豆包工作”,能围绕用户目标自主拆解任务、调用工具、持续推进复杂工作流程,并与飞书深度打通,让Agent基于企业上下文更准确地完成工作。针对日常办公场景,豆包工作提供内容生成和编辑能力,支持写方案、整理会议纪要、起草报告、做调研总结、做表格、分析数据,还能生成和编辑图片、视频、网页甚至应用。

11

工信部:我国智能算力规模达2185 EFLOPS,国产开源大模型全球下载量突破百亿次

8月26日|工业和信息化部在国务院新闻办公室发布会上介绍,截至2026年6月底,我国智能算力规模达到2185 EFLOPS;规模以上制造业企业人工智能技术应用普及率超过三成,已研制近200项人工智能关键标准。据工信部此前公开资料,国家级人工智能开源社区已汇聚用户1100余万,国产开源大模型全球累计下载量突破100亿次;在首批领航级智能工厂中,人工智能已覆盖70%以上的业务场景,沉淀超过6000个垂直领域模型。

12

腾讯混元端侧翻译模型Hy-MT2压缩至440MB,落地B站直播弹幕实时翻译

8月26日|腾讯混元团队公布一项最新技术成果,成功将旗下主打端侧的Hy-MT2-1.8B翻译模型压缩至几百兆大小,翻译质量几乎没有损失,并已成功落地哔哩哔哩(B站)的直播弹幕实时翻译中。Hy-MT2-1.8B模型原生支持33个语种互译,在FLORES-200通用翻译评测上,其整体翻译质量已优于多款商业翻译API。


13

智谱上线并开源GLM-5.3-Flash,认领匿名模型Ox-Alpha

8月26日|智谱宣布上线并开源GLM-5.3-Flash,并确认该模型正是过去一周在海外开发者社区引发热议的匿名模型Ox-Alpha,中文开发者社区将其称为“牛来”。作为GLM-5系列的首个原生多模态模型,GLM-5.3-Flash采用MIT协议开放权重,上线即登陆Hugging Face平台。根据Artificial Analysis Intelligence Index评测结果,该模型与Anthropic旗舰模型Claude Opus 4.8得分持平。定价策略上,GLM-5.3-Flash完成同一任务的成本约为GLM-5.3的十分之一,约为Claude Opus 4.8的四十分之一。

14

阿里通义开源Qwen3.8-Flash-Next:125B参数MoE模型,训练成本仅为前代1/9

8月26日|阿里通义千问团队正式发布Qwen3.8-Flash,并同步发布Qwen3.8-Flash-Next的开源权重,Next新架构将是全新一代Qwen4系列模型的雏形。这是一个多模态MoE模型,主模型参数量为125B,额外配备51B的N-gram Embedding,每token激活6B参数;原生支持262144个token的上下文,并可通过YaRN扩展至100万个token。相比Qwen3.7-Plus,Qwen3.8-Flash的训练成本仅约为前者的九分之一,但在编码和办公任务上具备更强能力。


15

MiniMax披露中期业绩:8月ARR突破8亿美元,上半年营收同比增长283.1%

8月26日|MiniMax披露2026年中期财报。上半年公司实现营业收入约1.17亿美元,同比增长283.1%,仅半年创收便达到2025年全年的1.5倍;其中第二季度收入环比第一季度增长81.8%。上半年,MiniMax开放平台及其他企业级AI服务收入达到7390万美元,同比暴增703.1%,在总营收中的占比由上年同期的30.3%跃升至63.4%;从8月最新的ARR结构看,ToB业务的比重已攀升至约80%,扭转了去年同期ToB仅占30%、ToC占70%的旧格局。


16

腾讯发布并开源Hy4 preview,盲测均分优于GLM-5.3和Kimi K3

8月28日|腾讯发布并开源新一代大模型Hy4 preview。Hy4 preview采用MoE架构,总参数量770B,激活参数量49B,支持100万个token的上下文窗口。在腾讯内部163位专家参与的203项任务盲测中,Hy4 preview综合均分2.99(满分4分),优于GLM-5.3的2.92分和Kimi K3的2.94分。Hy4 preview已在腾讯旗下WorkBuddy、CodeBuddy、元宝和ima等产品中首发上线,开发者可通过腾讯云TokenHub和OpenRouter调用其API,并限时提供2周免费使用。


17

智谱开源GLM-5.3模型权重,主打智能体编程与网络防御

8月28日|智谱官方宣布开源GLM-5.3模型权重,已正式开放下载,支持本地运行与个性化定制。智谱Z.ai负责人李子玄表示,该模型使用需要遵循GLM-5.3许可协议,支持本地部署、模型微调及商业化使用;仅当年营业额超过100亿美元的机构拟将GLM-5.3作为外部模型服务对外提供时,才必须进行安全审查。鉴于该模型在网络安全方面具备先进能力,智谱在公开发布模型权重之前,专门追加了两周全面的安全评估。



信息来源

REFERENCES

来源 1|NVIDIA Vera Rubin and Blackwell Set a New Standard for Agentic AI Performance per Watt
https://developer.nvidia.com/blog/nvidia-vera-rubin-and-blackwell-set-a-new-standard-for-agentic-ai-performance-per-watt/

来源 2|Meta计划在未来几周推出“HATCH”AI代理平台
https://baijiahao.baidu.com/s?id=1874449679112841720

来源 3|OpenAI秀肌肉,与博通共研的Jalapeño芯片向英伟达GB300发起挑战
https://baijiahao.baidu.com/s?id=1874507423428986608

来源 4|英伟达二季度总营收同比增加106%至962亿美元,数据中心业务营收890亿美元
https://baijiahao.baidu.com/s?id=1874630967301754219

来源 5|Claude自己长出浏览器!填表拉数,你的AI打工人有工位了
https://baijiahao.baidu.com/s?id=1874689391400122418

来源 6|谷歌Gemini 3.5 Transcribe语音转文本模型能自动删除口头禅
https://baijiahao.baidu.com/s?id=1874651637435582414

来源 7|英伟达被曝129亿美元收购Hugging Face:抢开源系统客户,重返云计算市场
https://www.thepaper.cn/newsDetail_forward_33960493

来源 8|Claude闯入现实!Anthropic首款在物理世界运行的AI工具问世了
https://baijiahao.baidu.com/s?id=1874747550011839630

来源 9|AI开始自己“找活干”?OpenAI测试持久在线智能体
https://finance.jrj.com.cn/2026/08/28093958259058.shtml

来源 10|字节跳动发布豆包工作,与飞书深度打通构建企业级Agent
https://baijiahao.baidu.com/s?id=1874463584746520733

来源 11|强基础、拓应用,人工智能如何打开发展新空间
https://baijiahao.baidu.com/s?id=1874589885967795759

来源 12|从3.3GB压缩到440MB!腾讯混元极低bit翻译模型如何做到几乎零损失?
https://baijiahao.baidu.com/s?id=1874663483411783910

来源 13|10万张国产芯片支撑,智谱认领匿名Ox-Alpha模型并开源
https://baijiahao.baidu.com/s?id=1874664123400766683

来源 14|阿里通义 Qwen3.8-Flash 发布开源:125B 参数 MoE 模型,训练成本仅为前代 1/9
https://baijiahao.baidu.com/s?id=1874617973520492571

来源 15|ARR破8亿美元后,MiniMax造血逻辑生变
https://baijiahao.baidu.com/s?id=1874754566565530829

来源 16|腾讯发布并开源Hy4 preview
https://www.tencent.com/zh-cn/tencent-releases-and-open-sources-tencent-hy4-preview/

来源 17|智谱开源 GLM-5.3 模型权重,主打智能体编程与网络防御
https://www.ithome.com/0/995/896.htm

原始来源: 马洪基金会

评论 (0)