Java基础、中级、高级、架构面试资料

千问发布 Qwen-Image-3.0 图像生成,进步明显!

业余杂谈 herman 23浏览
公告:“业余草”微信公众号 AI 中转站提供免费体验,点击链接 https://unity2.ai/register?ref=3XTnndN2 进行访问,支持 Claude、ChatGPT、Gemini 等最新模型!关注业余草微信公众号,添加作者微信:xttblog2!
本博客日IP超过2000,PV 3000 左右,急需赞助商。
极客时间所有课程通过我的二维码购买后返现24元微信红包,请加博主新的微信号:xttblog2,之前的微信号好友位已满,备注:返现
受密码保护的文章请关注“业余草”公众号,回复关键字“0”获得密码
所有面试题(java、前端、数据库、springboot等)一网打尽,请关注文末小程序
视频教程免费领
【腾讯云】1核2G5M轻量应用服务器50元首年,高性价比,助您轻松上云

千问发布 Qwen-Image-3.0 图像生成,进步明显!

千问 Qwen 是国内少有的多模态比较齐全的模型厂商了,像 DeepSeek、Kimi 等模型,多模态要不是没有,在不是就比较弱,也或者是在路上。

于是,我有时候处理图片就在元宝、豆包、千问之间做选择。如果是公众号里的文字配图,我可能会用 OpenAI 的 gpt-image-2 模型生成,效果更好看一些。

但是,千问最近迎来了一波大更新。首先是 Qwen 3.8 预览版亮相,思考是真的长,10 分钟起步。接着是今天发布的 Qwen-Image-3.0,比 2.0 来说,进步明显。

具体的效果参见我的公众号配图:https://mp.weixin.qq.com/s/GOOweufBB-Q569BHJXm_iQ

如果是之前的 2.x 的模型,效果差强人意不说,还可能会出现乱码。

怎么说呢,甚至有时候我的中文全变英文了。我估计是画出来后发现有乱码,不如直接画英文的。

虽说比顶尖的过来模型还有差距,但有进步就有追赶上的那天。

Qwen-Image-3.0 这个版本主要围绕“内容丰实”、“细节真实”和“知识厚实”三大能力进行了升级。

支持理解超长指令,生成复杂图文。4.5 倍 Token 输入提升。尤其是相比前代,新模型将可接受的指令长度提升至4.5k Token,是上一代的 4.5 倍。同时,新模型还能一次性生成包含 9 种不同领域知识的“九宫格”图解,每个格子都可能是包含数学公式、物理图解或古文分析的复杂信息图。

在细节方面也更真实了,小字清晰可辨,质感逼近摄影。Qwen-Image-3.0 能够清晰渲染小至 10 像素的文字,即使是学术论文里复杂的 LaTeX 公式、报纸上的密集信息,也能做到字字清晰可读。

Qwen-Image-3.0 继续提升了多语言支持,商业场景更广。新模型原生支持12 国语言20 多款字体的渲染。这能大幅降低为不同地区制作产品海报、影视分镜等商业素材的生产成本。

这次 Qwen-Image-3.0 发布后,比不上 gpt-image-2,也差距不会太大吧。

总之,感兴趣的可以多去试试,后面我可能也会多用它了。

业余草公众号

最后,欢迎关注我的个人微信公众号:业余草(yyucao)!可加作者微信号:xttblog2。备注:“1”,添加博主微信拉你进微信群。备注错误不会同意好友申请。再次感谢您的关注!后续有精彩内容会第一时间发给您!原创文章投稿请发送至532009913@qq.com邮箱。商务合作也可添加作者微信进行联系!

本文原文出处:业余草: » 千问发布 Qwen-Image-3.0 图像生成,进步明显!