
新浪科技讯 7月21日下午消息,阿里发布最新图像生成基础模型Qwen-Image-3.0。该模型支持最大4.5k token超长输入,可一次生成涵盖公式符号、几何图形、逻辑推导步骤等多元素融合的知识图解、复杂UI界面,同时支持12国语言和20多款字体原生渲染,大幅降低了多语言产品海报、影视/漫画分镜等“可读可用”商业素材的生产成本。
Qwen-Image-3.0是千问图像生成和编辑模型系列的第三代基础模型,对于GPT-Image-2擅长的直播间页面,Qwen-Image-3.0也能轻松生成,人像摄影、数学试卷、古碑拓片,千问生成的图片细节满满,栩栩如生。
Qwen-Image-3.0着重提升了模型对于复杂信息的承载能力,较前代在文本输入长度上实现了4.5倍的跃升。这意味着,在影视短剧分镜、复杂信息图、产品说明页等需要超长提示词输入的场景中,用户不再需要将需求压缩成一句话,而是可以像给设计师撰写需求文档一样,完整描述画面结构、文字内容、视觉风格和排版细节,从而让模型更精准地生成图文内容,减少反复生成和人工调试成本。凭借Qwen-Image-3.0对语义并置和空间控制能力的极致把握,新模型可一次性生成涵盖9种不同领域的9宫格知识图解,字字清晰,幅幅准确。
排名前五配资公司此外,Qwen-Image-3.0还能轻松理解复杂指令和画面的逻辑嵌套关系,可根据一条指令在同一幅图中生成网页、软件界面、聊天窗口、海报等多类视觉内容的组合式表达。比如,当用户输入“在 VSCode 编程界面中,通过千问App生成一张发布在聊天界面里的手冲咖啡海报”时,模型能够准确理解其中的多层UI嵌套关系,并依次生成VSCode编程界面、千问App界面、社交媒体聊天界面和咖啡海报,在保持各层界面结构、风格准确的同时,甚至连手机截图里的时间数字,低至10像素的小字,都清晰可辨。(文猛)
元股证券:ygzq.hk
海量资讯、精准解读,尽在新浪财经APP
责任编辑:郝欣煜 早盘买股票

新浪科技讯 7月21日下午消息,阿里发布最新图像生成基础模型Qwen-Image-3.0。该模型支持最大4.5k tok
2026-07-22
快科技7月21日消息,据博主“智慧皮卡丘”透露,华为Mate XT2将升级为韬定律麒麟芯片尾盘买股票,性能将大幅增强。
2026-07-22
“我每天清晨沿江岸散步锻炼,结束后乘坐861路回家,每次我上车,师傅总是耐心等待,从不催促,没有华丽的言语,只有实在的暖
2026-07-21
美国财政部长斯科特贝森特于周二表示,特朗普政府将对中国的人工智能模型是否通过蒸馏技术从美国模型中获取成果展开调查,并强调
2026-07-22
信息来源:https://www.nature.com/articles/d41586-026-02218-9 《自然》
2026-07-22