8月3日,商汤科技开源了轻量级统一多模态模型 SenseNova U1.5-Lite-Preview。这个模型只有80亿参数(8B-MoT),但能做到原生4K高清图像生成、中英文文字渲染、自然语言图像编辑——而且完全免费开源。对普通人来说,这是又一个可以白嫖的高质量AI生图工具。
核心能力一览
先说结论:SenseNova U1.5 最让人眼前一亮的不是单个功能,而是它把图像生成、图像编辑、文字渲染、视觉理解四件事放在一个8B的小模型里全做了。
| 能力 | 表现 | 对普通人的价值 |
|---|---|---|
| 4K原生生成 | 直接输出3840×2160分辨率,细节经得起放大 | 做海报、壁纸不用再二次放大 |
| 中英文文字渲染 | 准确渲染复杂版式中的中英文文本 | 终于不用P图加字了 |
| 自然语言图像编辑 | 上传图片后用一句话改局部 | “把外套换成蓝色”就行 |
| PromptEnhance | 自动把简短需求扩展为完整创作方案 | 不会写复杂提示词也能出好图 |
和同类模型对比
| 维度 | SenseNova U1.5 | Emu3(智源) | FLUX(Black Forest) |
|---|---|---|---|
| 参数量 | 8B-MoT | 8B+ | 12B |
| 最大分辨率 | 原生4K | 常规尺寸 | 最高2K |
| 图像编辑 | 支持(局部/全局/风格) | 有限 | 不支持 |
| 中文文字 | 专项优化 | 较弱 | 不支持 |
| 开源协议 | 开源(预览版) | 开源 | 非商业开源 |
SenseNova U1.5 最大的差异化优势是中文文字渲染 + 图像编辑。市面上大部分AI生图模型在生成中文文字时都会”鬼画符”,而U1.5在信息图、海报等场景下能做到准确的中英文排版。
5个实用场景评测
场景1:商业海报设计
输入一段包含主体描述、品牌风格、文字内容的提示词,U1.5能直接生成一张带准确文字的海报。实测中,产品名称、价格信息、广告语等文字都能正确渲染,不像某些模型那样”文字像蝌蚪”。
适合人群:小商家、自媒体运营者、需要快速出活动海报的人。
场景2:信息图/数据可视化
U1.5有一个专门的Infographic模型系列(此前的V3版本),擅长生成信息密集的图表式图片。比如”2026年上半年AI行业融资汇总”这样的主题,它能生成一张带分区标题、数据标注、配色统一的完整信息图。
适合人群:做内容运营、公众号排版、汇报材料的人。