阿里千问发布 Qwen-Image-3.0,图像生成再升级

7小时前更新 kw178
1 0 0

阿里千问大模型正式发布 Qwen-Image-3.0,作为 Qwen-Image 系列的第三代图像生成基础模型,新版本进一步强化了图像生成能力与文本呈现效果。

据介绍,Qwen-Image-3.0 支持最高 4.5k token 输入,可实现 10px 小字的精准渲染,并支持 12 种语言的原生渲染。

阿里千问发布 Qwen-Image-3.0,图像生成再升级的封面图

相关快讯

阿里千问将接入苹果智能,成为AI能力集成方案

阿里千问将接入Apple智能,为中国地区的iOS、iPadOS、macOS和visionOS用户提供AI体验。用户无需切换应用,即可在Apple设备上直接使用千问的文本与图像理解、内容生成等能力,提升使用便捷性与智能化体验。

字节最强图像模型回归:17个案例深度实测Seedream 5.0 Pro

字节跳动Seed团队正式发布多模态图像创作模型Seedream 5.0 Pro,距5.0预览版上线约5个月。新版本在图文匹配、结构合理性、文字渲染和画面美感等基础能力上升级,并重点增强复杂信息可视化、交互式精准编辑、真实影像与人像质感以及原生多语种输入与生成能力。API按输入图和输出图计费,输出图不超过236万像素时,首张输入图免费,后续输入图0.02元/张,输出图0.3元/张。

Meta首个Agent生图模型Muse Image登场,竞技场首秀拿下第二

Meta Superintelligence Labs 发布了图像生成模型 Muse Image,并预览了 Muse Video。Muse Image 已接入 Meta AI 应用、网页端及部分地区社交平台,Muse Video 也将开放给创作者。其亮点是引入智能体机制,能在强化学习中自主发现并修正错误,并支持推理阶段算力扩展,体现出“想得越久,画得越好”的能力。

阿里千问升级 Fun-ASR-Realtime:单模型支持30种语言和16种方言

阿里千问升级实时语音识别大模型 Fun-ASR-Realtime,单模型可支持16种方言和30种语言,API已上线阿里云百炼。官方称其方言识别字符准确率均值达88.62%,在12类方言上领先竞品,首字延迟为百毫秒级,流式识别接近离线效果,并对泰语等东南亚多语言场景做了优化,适合出海客服和国际会议。

一句话生图要退场了?开源图像生成 Agent 进化出「工具编排」

研究团队提出 GenEvolve 自我进化智能体框架,用于开放图像生成。它将生成过程建模为工具编排轨迹:先理解需求,再调用搜索、图像检索和生成知识工具,整合证据、视觉参考与约束,形成 prompt-reference program 并交给底层生成器渲染。同时构建了 GenEvolve-Data 和 GenEvolve-Bench,用于训练与评测。

微信支付推出AI接入工具箱2.0,Token消耗减半!

今年4月,微信支付发布了面向AI的支付接入工具箱2.0,包含技能包、友好文档和API。此次升级重点围绕“安全、高效、原生流畅”,更新了五大内容。新版本全面支持中文、英语、日语、韩语、法语、俄语、葡萄牙语、西班牙语和阿拉伯语,方便全球开发者以母语接入微信支付。此外,工具箱的功能从1.0版本的“支付”和“券”扩展至涵盖所有微信支付产品的知识,提供更全面的支持。

暂无评论

暂无评论...