阿里发布Qwen-Image-3.0
7月21日,Qwen发布第三代图像生成基础模型。最长4.5k token指令、10px小字渲染、12种语言,还展示了九宫格信息图、数学PPT、论文页面、报纸和复杂UI。
这说明图像模型正在变成“视觉文档引擎”。它处理的不再只是人物、风景和海报,还开始生成公式、说明、界面、商品图和研究配图。能力越实用,错误也越容易披上专业外观。
第一,文字和排版越准确,用户越可能把画面当作信息来源。一张结构完整的医学图解或研究配图,即使只有一处事实错误,也比一张明显失真的AI图片更难识别。
第二,细节越真实,商业激励越会影响结果。虚拟试衣可以帮助消费者,也可以让衣服永远更合身;房产和家具图片可以改善展示,也可以悄悄改变空间比例。模型没有销售目标,调用模型的平台和商家有。
第三,生成内容越接近真实文档,来源记录就越重要。美国联邦贸易委员会的广告规则要求内容真实、不误导,并有证据支持;C2PA也在用Content Credentials记录数字内容的来源和修改历史。这些验证机制正在变成新的基础设施。
对模型公司和平台来说,下一轮竞争不只有分辨率、文字准确率和生成速度,还包括水印、溯源、审计记录、引用来源以及商品素材的证据规则。
图像模型越好用,可信内容就越稀缺。真正成熟的产品,既要帮人生成,也要帮人证明。
