The Decoder 2小时前 · 2026-09-20 00:34:33 · 2 阅读
Qwen3.8-Omni-Flash:性能对标 Gemini Flash,价格更具优势
Qwen3.8-Omni-Flash 是 Qwen 首款面向 AI 智能体的多模态模型。它能同时处理音频和视频,进行推理总结,还能自主调用工具来剪辑 vlog、翻译短视频或生成电影摘要。上下文窗口达一百万 token。Qwen 表示,在音视频任务上它的表现已接近 Gemini 3.8 Flash。

API 定价为每百万输入 token 0.15 美元、每百万输出 token 0.47 美元。Qwen 估算,音频输入每小时不到 0.01 美元;带音频的 720p 视频按每秒一帧处理,成本约 0.20 美元(不含响应费用)。相比之下,Gemini 3.8 Flash 的首发价为每百万 token 输入 0.75 美元、输出 3.75 美元,且 2027 年 1 月 1 日起价格将翻倍。
该模型可通过 Qwen Studio、Qwen Cloud 和 API 使用。开源的 Qwen-MM-Plugins 为 Claude Code、Gemini CLI、Qwen Code 等智能体提供视频剪辑、说话人识别、PDF 视频笔记和可复用工作流等功能。Qwen-Live Harness 则支持借助摄像头和麦克风进行实时交互。
原始来源: The Decoder