LongCat-Image 是美团 2025 年 12 月开源的 6B 参数文生图模型,以远小于同行的参数量做到了两件事:照片级写实和准确的中英双语文字渲染——后者正是大多数图像模型至今做不好的地方。
模型权重在 HuggingFace 和 GitHub 上开放,你完全可以自己部署——但需要足够显存的 GPU、Python 环境和折腾的耐心。如果你只是想生成图片,最快的路径是在线用。本文两条路都讲,先讲零安装的。
方式一:在线使用(最快)
Longcat Image 把模型跑在云端,一切都在浏览器里完成。
第 1 步 — 注册并领取免费额度
在 longcat-image.org 创建账号——邮箱或 Google 一键登录。新账号有免费初始额度,足够在付费前完整体验生成和编辑功能。注册无需信用卡。
实话实说:生成需要登录账号,没有匿名/无限免费档——云端 GPU 是真金白银。免费额度的定位是让你判断模型是否符合需求。
第 2 步 — 打开 AI 图像生成器并选择模型
进入 AI 图像生成器,在模型选择器中选 LongCat-Image。(生成器同时提供 FLUX 2、Seedream 4、Z-Image Turbo、Nano Banana Pro 等模型,方便用同一条提示词横向对比效果。)
第 3 步 — 写提示词,生成
输入描述,点击生成,通常几秒出图。针对 LongCat-Image 的提示词技巧:
- 想渲染的文字用引号括起来:
霓虹灯招牌,写着"深夜食堂 Midnight Diner",中英文都能准确渲染。 - 描述文字的位置和样式:"店招横幅上的粗体白字"比放任模型自由发挥可靠得多。
- 发挥写实优势:LongCat-Image 为写实图像调优——产品图、街景、人像。像摄影师一样写提示词:镜头、光线、时间。
- 中文提示词原生支持:可以全程用中文描述,模型是双语训练的。
加餐 — 编辑现有图片
生成器带图生图 tab:上传参考图、描述修改内容,LongCat-Image-Edit 模型执行——换风格、改物体、替换招牌文字等。编辑管线更重,消耗额度高于生成。当前限制:单次只支持一张参考图(暂不支持多图融合)。
方式二:其他访问途径
| 途径 | 适合谁 | 代价 |
|---|---|---|
| longcat-image.org | 想立刻出图的人 | 免费额度用完后按次计费 |
| HuggingFace 演示 Space | 一次性快速尝试 | 排队、限流 |
| fal.ai API | 集成进应用的开发者 | 按百万像素计费,需写代码 |
| 本地部署(ComfyUI / diffusers) | 要完全掌控、不想按次付费 | GPU + 显存 + 配置时间 |
如果你在考虑本地部署,我们写了专门指南:LongCat-Image ComfyUI 工作流与本地部署——含显存需求,以及"把 LongCat-Video 教程当成 Image 教程"这个最常见的坑。
常见问题
LongCat-Image 免费吗? 模型本身开源,但推理消耗算力:在线服务(包括我们)用额度制,本地部署则用配置成本和 GPU 换钱。longcat-image.org 注册送免费额度,付费包为一次性购买——见定价。
生成的图片能商用吗? 以官方 GitHub 仓库的 license 条款为准。
为什么选 LongCat-Image 而不是 FLUX 或 Midjourney? 如果你的图需要清晰可读的文字——尤其是中文,LongCat-Image 是目前最强的选项之一。纯艺术风格化场景其他模型可能更合适——所以我们的生成器支持按提示词随时切换模型。
现在就试试?免费生成你的第一张图 →
