Gemma
SaaS/在线服务谷歌基于 Gemini 同源技术推出的轻量级开源大模型系列,覆盖文本与多模态,主打端侧部署与开发者友好。
搭配玩法
2Gemma + Mac+ Kubernetes集群或虚拟机+ OpenRL
在Mac上运行RL循环,指向集群训练API进行LLM后训练微调
Mac负责RL循环开发,Kubernetes集群或虚拟机负责执行训练,基础设施与AI研究分离
分块采样+导演模型,12GB显存直出无限时长1080p长视频
H3生成长视频显存不足,分块生成降低显存需求;导演模型规划镜头保持块间连贯;串行卸载释放显存
✓ 最低12GB显存即可运行✓ 可直出无限时长1080p视频 ✕ 生成30秒1080p约需2小时✕ Gemma4导演12GB显存无法使用
产品简介
谷歌基于 Gemini 同源技术推出的轻量级开源大模型系列,覆盖文本与多模态,主打端侧部署与开发者友好。