← 文章 / AI技术
ElephantMind.AIGC 1小时前 · 2026-09-21 17:14:10 · 0 阅读

AI大模型热点|Qwen-Image-2.1开源,字节与清华公开DAPO强化学习系统

◆Qwen-Image-2.1把生成与编辑放进同一个检查点

阿里通义千问开源Qwen-Image-2.1,视觉生成组件约7B参数,由32层单流DiT组成,使用Qwen3-VL-8B进行条件编码。模型支持文本生图、单图和多图编辑、原生透明RGBA输出以及最多10张参考图,官方同时给出原生2K尺寸与40步推理示例。

这次发布的工程信息也比较完整:Diffusers、ComfyUI、vLLM-Omni、SGLang和LightX2V在发布当天提供接入,架构中还公开了混合粒度注意力和跨去噪步骤的Prefix KV Cache复用。公开资料暂未给出统一硬件上的吞吐、显存峰值和第三方质量榜单,实际部署仍要按连续编辑一致性、文字准确率、P95延迟和每个成功任务成本复测。

Qwen-Image-2.1使用Qwen Research License,开源权重不等于任意商业使用。模型、提示词重写检查点、工作流节点和加速框架还要分别核对许可证。

◆DAPO把大模型强化学习训练链路公开

字节跳动Seed团队与清华大学智能产业研究院联合开源DAPO,一个面向大语言模型大规模强化学习的完整系统。官方仓库同时提供DAPO算法、训练代码、数据集和基础设施,目标是让研究者可以从训练配方开始复现实验,而不是只拿到一个训练后的模型。

DAPO的全称是Decoupled Clip and Dynamic Sampling Policy Optimization,论文提出四项关键技术:Clip-Higher、Dynamic Sampling、Token-Level Policy Gradient Loss和Overlong Reward Shaping。官方公开的训练数据集为DAPO-Math-17k,验证集使用AIME 2024;仓库记录显示,完整DAPO实验使用Qwen2.5-32B基座模型,在AIME 2024上达到50分,去掉部分技术的早期版本达到44分。

这些数字是团队公开的实验结果,不能直接理解为所有模型、所有数学题或所有强化学习任务都会获得相同比例的提升。DAPO的价值在于把采样、裁剪、长答案奖励和token级优化拆成可检查的组件,研究者可以分别替换数据、基座模型和奖励函数。复现时还要记录采样数量、硬件、训练步数、评测脚本和随机种子,否则同一个“50分”很难与其他结果公平比较。

◆开放数学模型计划把重点放在公共基础设施

陶哲轩代表SAIR Foundation宣布启动开放数学模型计划,目标是建设面向数学研究的开放、可负担和持续迭代的模型与算力基础。公开介绍强调,项目希望让研究人员能够使用模型进行猜想探索、形式化证明、文献整理和协作研究,同时保留第三方复现和评估的空间。

目前公开材料更多是计划目标,尚未披露最终模型规模、训练数据清单、发布时间表或统一Benchmark。对于数学模型,单一竞赛分数不能覆盖证明搜索、反例发现、形式化语言转换和人类研究者协作等任务,后续更值得关注的是模型输出是否可验证、推理过程能否复现,以及算力和许可是否允许研究社区长期使用。

Qwen-Image-2.1、DAPO与开放数学模型计划放在一起看,分别覆盖模型发布、训练系统和研究基础设施三层。它们能否形成真正的公共资源,最终取决于代码可复现、数据可追溯、模型许可和独立评测是否同时跟上。

◆参考来源

  • ByteDance Seed与清华AIR官方GitHub:《DAPO: An Open-source RL System from ByteDance Seed and Tsinghua AIR》:https://github.com/BytedTsinghua-SIA/DAPO
  • QwenLM官方GitHub:《Qwen-Image-2.1》:https://github.com/QwenLM/Qwen-Image-2.1
  • DAPO论文:《DAPO: An Open-Source LLM Reinforcement Learning System at Scale》:https://arxiv.org/abs/2503.14476
  • 清华大学智能产业研究院:《LLM RL最强算法,清华AIR-字节跳动SIA-Lab联合发布》:https://air.tsinghua.edu.cn/info/1007/2401.htm
  • SAIR Foundation计划报道:《陶哲轩代表SAIR Foundation宣布正式启动“开放数学模型计划”》:https://www.qbitai.com/2026/09/492467.html
原始来源: ElephantMind.AIGC

评论 (0)