Kolors 可图:快手开源文生图模型,写实人像 + 中英双语文字一次到位

Kolors 可图

官方背景

Kolors 可图是快手推出的开源文生图大模型,目前迭代到 Kolors 2.1。它在架构上以 SDXL 为骨干,把文本编码器换成 ChatGLM,从而获得原生的中文语义理解能力——这也是它区别于绝大多数海外开源文生图模型的关键。Kolors 与快手的视频模型 Kling AI(可灵)同属一套视觉生成体系,是快手在图像侧对外开放的主力模型。

核心能力

写实人像表现突出,皮肤质感、光影与五官结构在开源模型中处于第一梯队;② 依托 ChatGLM 文本编码器,支持 256 token 的中文长提示词,复杂场景描述不易丢信息;③ 中英双语文字渲染,海报与封面上的中文字体不再糊成乱码;④ 推理显存约 19GB,24G 消费级显卡即可本地跑;⑤ 生态兼容性好,原生支持 ComfyUI、Diffusers、ControlNet、LoRA、IP-Adapter;⑥ 可与可灵视频模型串联,先出图再转视频。

应用场景

电商团队用它批量生成模特图与商品海报,中文标题直接渲染进画面省掉后期排版;自媒体作者做公众号封面与短视频缩略图;游戏与动漫工作室拿 LoRA 微调锁画风、量产概念图;对数据敏感的企业则直接本地部署,素材不出内网。写实人像 + 中文文字这两点,让它在国内商用场景里比不少海外开源模型更顺手。

定价与可及性

Kolors 权重以 Apache 2.0 协议开放(商用需按官方要求完成登记注册),自托管完全免费;若不想折腾环境,可通过快手 Kling AI 平台在线调用,单张图成本约 0.01 美元。权重托管在 Hugging Face 与魔搭社区,ComfyUI 工作流社区已有大量现成模板可直接复用。

立即体验 Kolors 可图 →

Kolors 可图 · Kolors 可图是快手推出的开源文生图大模型,目前迭代到 Kolors 2.1。它在架构上以 SD…

© 版权声明
THE END
喜欢就支持一下吧
点赞81 分享
评论 抢沙发

请登录后发表评论

    暂无评论内容