← 文章 / AI技术
模达科技-AI绘未来 4小时前 · 2026-10-04 12:46:22 · 22 阅读

AI大模型产业最新动态:十大热点新闻与解读 -2026年10月4日

,

“ 模达卓越,智启未来”

www.modatech.com.cn / www.modatech.cn


“ 模达卓越,智启未来”

   模达科技       

www.modatech.com.cn / www.modatech.cn

国内外大模型发展如火如荼,近期有哪些值得关注的新闻?一起看看吧!

国际篇

INTERNATIONAL NEWS

  • 英伟达发布1亿参数免费模型Nemotron 3,支持8人实时语音分割识别

英伟达发布了拥有约1亿参数的免费人工智能模型Nemotron 3 Diarization,专注于语音分割聚类任务。该模型在VoiceArena语音分割基准测试中以14.72%的错误率登顶榜首,显著优于排名第二的系统。新模型支持从0.32秒至30.4秒的四级动态音频缓冲区设置,能够精准识别对话中任意时刻的说话者,适用于多种应用场景。

图源:网络
  • 微软亮出生物学"世界模型"Project Quine:一个周末筛出抗癌候选物

微软研究院当地时间29日抛出一套实验性多模态AI研究系统Project Quine。它本质上是一套面向生物学的"世界模型",意在把计算机里的生物学建模与实验室的真实操作衔接起来。这套系统由微软联合哈佛大学及麻省理工学院博德研究所共同打造,将基因组学、蛋白质、化学、细胞状态与生物成像整合进同一个联合表征框架,再配上交互式推理能力,从而同时消化多个领域的信息并做跨模型综合分析。

为了让学者尽早上手,微软已开放首届Quine Fellows项目申请,后续还会通过Microsoft Discovery等产品逐步铺开商业化,提供更多面向产业界的工具。

潜力与红线并存

传统药物研发最卡脖子的是资源有限、周期漫长。Project Quine的切入点是先用算法预筛候选分子并排定优先级,再把宝贵的实验资源砸向最值得验证的对象。微软近期用它测试胰腺导管腺癌细胞系,仅一个周末就挑出了能推动细胞状态由经典型转向基底样型的化合物,还逮到一些意料之外的表型反应。公司估计,这类工具有望砍掉数年时间与数百万美元开销,甚至挖出此前没人想到的治疗路线。

不过微软划下了清晰边界:系统目前仅供科研、绝不进入临床,任何输出都必须经严格人工复核——毕竟AI仍会犯错。

图源:网络


  • OpenAI发布自主智能体“Dots”与企业应用市场

9月29日,OpenAI在开发者日上宣布推出全新大模型及自主AI智能体“Dots”。该公司正通过一系列底层组件升级,将其拥有12亿周活跃用户的ChatGPT重塑为集软件发现、调用与运行于一体的综合分发平台,直接挑战传统应用商店模式。

通过扩展支持插件的架构,ChatGPT现可在对话中精准识别用户需求,并自动唤出Figma、Adobe等第三方应用的交互面板,实现无缝内嵌操作。配合新推出的“使用ChatGPT登录”身份认证系统,用户可跨应用携带其现有AI配额,目前已首批接入Devin、Notion、Vercel等16家平台。此外,用户可通过ChatGPT生成的轻量级网页,向团队共享带有独立权限与个性化体验的工作流。

在生态建设方面,OpenAI正式上线企业应用市场,汇聚Salesforce、HubSpot、CrowdStrike等30余家头部企业合作伙伴,并允许符合条件的客户使用OpenAI额度抵扣合作软件费用。同时,平台大幅升级了应用审核机制,支持开发者实时追踪进度、请求人工介入及提交局部更新,进一步完善了开发者服务的基础设施。

此次发布的核心技术突破在于自主智能体“Dots”。该智能体配备专属云端计算机与浏览器,已打通逾4000个应用生态。在获用户授权的只读模式下,Dots不仅能根据自然语言指令跨应用代为执行建站、排会等复杂操作,更能主动进行项目研究、推进与Bug修复,彻底颠覆了“搜索-下载-使用”的传统应用交互逻辑。

尽管OpenAI尚未公布类似传统应用商店的收益分成或计费标准,但其通过统一身份层、重构软件发现机制及引入自主智能体,已实质性搭建起绕开苹果与谷歌体系的AI原生应用分发网络。这一战略动作标志着软件交互范式正从“图形界面主导”向大模型底座的“意图驱动”深度演进。

图源:网络

  • 谷歌宣布向免费用户全面开放Gemini Skills,Gems功能将自动整合

人工智能个性化工具的体验门槛正在迎来大幅降低。谷歌近日正式对外宣布,决定将此前仅限Pro和Ultra付费订阅用户使用的Gemini Skills自定义指令服务,全面向所有免费账户用户开放,让更多大众用户能够享受到定制化AI带来的便利。

在功能调整与平稳过渡方面,伴随着Skills的全面普及,原有的Gems功能已确定将于2026年11月17日自动过渡整合至全新升级的Skills系统中。升级后的Skills不仅完整保留了以往灵活强大的自定义配置能力,还对底层的交互逻辑进行了深度优化。用户未来在主聊天框中只需输入斜杠(/)加上对应的指令,便能瞬间唤醒特定的AI技能,让操作变得更加直观高效。

对于广大免费用户而言,此次系统迭代兼顾了便利性与平稳性。不仅可以完整保留此前已经创建的自定义配置,还可以通过专属链接便捷地创建全新的Skills,从而在系统迁移期间实现无缝过渡。行业分析普遍认为,谷歌此举通过降低个性化AI的使用门槛,将进一步提升Gemini在大众消费市场中的用户粘性与整体平台竞争力。

图源:网络

  • AMD82亿美元全股票吞下World Labs,李飞飞挂帅执行副总裁

AMD在9月28日甩出一桩让芯片圈和AI圈同时侧目的收购:它以全股票交易拿下旧金山初创公司World Labs,交易价值约82亿美元,按当前汇率约合551亿元人民币。更吸睛的是人——World Labs联合创始人、有着AI教母之称的李飞飞,将加入AMD出任执行副总裁兼首席科学家,直接向苏姿丰汇报。

World Labs是李飞飞等人于2024年联合创办的,主攻的方向叫世界模型:让AI根据文本、图像和视频,生成或重建出能够交互的3D环境。这套能力不只是炫技,未来能直接喂给机器人训练、工厂模拟和科学研究——换句话说,它要造的不是一张图,而是一个可被走进去、被操作的数字世界。

李飞飞之所以被叫作AI教母,源于她一手创建的大型标注图像数据库 ImageNet,那次实践用实打实的证据证明了更大的数据规模能显著拉高计算机视觉的天花板。她后来出任谷歌云AI与机器学习首席科学家,也是斯坦福大学以人为本AI研究院的创始联席主任。这样一个站在学术与产业交叉点的人,如今被AMD收编进核心研发层,分量不言而喻。

就在本月早些时候,World Labs还端出了新模型Atlas,它只需少量2D图像,就能预测出同一个场景换一个摄像机角度后会呈现什么画面。World Labs自己打了个比方:这种工作方式就像大语言模型预测一句话里的下一个词——只不过大模型在词序列里猜下一个字,Atlas在视觉几何里猜下一帧视角。

苏姿丰在新闻稿里把这笔账算得很清楚:收购World Labs,是为了让AMD更深地看清尖端AI模型往哪儿演进,从而倒推回去,造出运行这些模型真正需要的芯片和计算系统。当一家以卖芯片为根基的公司,把世界模型的缔造者请进副总裁办公室,它要的显然不只是技术,更是下一代AI计算版图的入场导航。

图源:网络

国内篇

DOMESTIC NEWS

  • 小米MiMo-V2.6-Pro强势杀回Code Arena前十

小米全新全模态旗舰大模型MiMo-V2.6-Pro 在Code Arena: WebDev测试场中表现亮眼,首次亮相便成功重返前十,并在采用MIT许可证的开源权重模型中高居前三。

图源:网络
  • 腾讯秘密布局数字人游戏搭子“鹅次元”:聚焦情绪陪伴而非技术代飞

腾讯正在内测名为“鹅次元”的AI数字人游戏陪伴产品,通过整合实时画面识别、语音双向通话与文本交互能力,探索以虚拟人承接玩家游戏社交与情绪陪伴的新形态。该产品定位为“重陪伴、轻带飞”,旨在解决真人陪玩赛道中人力成本高、管理难度大及合规风险等问题。

图源:网络

  • Kling4.0即将上线:支持8000Token与立体声唇形同步

Kling4.0的全面升级为创作者提供了更强大的功能,包括画面真实感、创意可控性及叙事完整度的提升。新版本支持多模态控制、长镜头叙事和多种语言输入,同时优化了交互体验。

图源:网络
  • 腾讯入局Personal Agent赛道:代号"Handy Bot",已在微信低调内测

据《读佳》报道,腾讯正在秘密开发一款Personal Agent(个人智能体)产品,内部代号"Handy Bot",并计划推出独立App。目前该产品已在微信端低调上线服务号,简介写着"Your Personal AI Agent"。

Handy Bot的定位与传统聊天机器人截然不同。传统Chatbot是一问一答、会话结束即终止任务,而Personal Agent追求的是"常驻后台"——用户只需给出一个宏观目标,AI就能在云端持续推进任务,不再依赖人类逐条下发指令。

Meta近期推出的Muse正是这一方向的标志性产品,其核心设计是为每位用户分配一台独立的安全虚拟机,用于完成比价购物、邮件处理、行程盯守等生活琐事。

腾讯并非唯一入局者。阿里正将千问向"我的千问"方向演进,强调构建个人上下文记忆;字节旗下豆包也被曝出正在开发代号"Spell"的个人助理产品。行业共识是,Personal Agent要真正落地,还需平衡模型任务规划能力、生态工具开放度和合规隐私边界三者之间的关系。目前Handy Bot仍处于内部测试阶段,产品细节尚未最终确定。

图源:网络
  • 豆包AI个人助手独立App实锤:定名“小豆”剑指全场景智能生态

字节跳动旗下豆包在人工智能领域的布局正在迎来新的里程碑。据最新消息显示,豆包此前在个人助理方向推进的探索项目(代号“Spell”)已正式定名为“小豆”,并且计划推出独立的App版本。

这一名称早在今年暑期就已经敲定。目前,该产品正处于紧锣密鼓的内部测试阶段,未来面向大众的最终对外版本可能会根据实际测试情况进行调整,官方尚未公布确切的上线时间。

回顾豆包在个人助理领域的探索轨迹,其技术演进有着清晰的脉络。早在2025年12月,豆包手机助手技术预览版首次亮相,并首发搭载于中兴合作的努比亚工程样机中。随后在2026年9月,豆包手机助手消费者版本正式发布,率先落地在努比亚NaviX Ultra机型上。

业内人士分析指出,即将推出的小豆独立App,可以被视为豆包将此前在手机端积累的Personal Agent(个人助理)核心能力,向更广泛的独立应用形态进行的一次深度延伸。这意味着,未来用户或许无需受限于特定的手机厂商或系统深度集成,就能在独立的应用程序中体验到更加便捷、全面的AI个人助理服务。

评论 (0)