图像生成
7 published articles
AI 图像生成
Reve 2.1 以十分之一算力位居 Arena 第二
Reve 2.1 声称在 Arena 排行榜上整体排名第二,而训练算力不到周围实验室的十分之一。该公司还详细介绍了 4K 输出、可寻址区域和多语言文本渲染。
2026-08-05
AI战略
微软内部AI模型在生产中削减成本高达89%
微软自研的MAI模型已投入生产,在多个产品中实现了显著的成本节约。这些数据表明了一个战略转变:该公司现在不仅比拼模型质量,更在推理效率上展开竞争。
2026-07-29
人工智能
微软40亿参数图像模型可在单块A100上运行,挑战300亿参数系统
微软Mage-Flow是一款紧凑的40亿参数图像生成与编辑模型,在单块A100 GPU上以交互速度运行时,其性能可与Qwen-Image和FLUX.2等更大的开源系统相媲美。其关键创新在于一个轻量级分词器,将编码成本降低了12倍。
2026-07-26
成本分析
微软自研AI模型在生产中最高降低GPU成本89%
微软报告称,其MAI-2.5和MAI-Voice-2-Flash模型现已投入Bing、PowerPoint和Dynamics 365的生产环境,图像生成GPU成本降低84%,语音任务降低89%。自研模型战略正在带来相较于第三方替代方案可衡量的成本优势。
2026-07-24
图像生成
阿里通义千问Qwen-Image-3.0:将文本渲染转化为生产力论据
阿里巴巴通义千问团队发布了第三代图像生成模型Qwen-Image-3.0,该模型优先考虑密集内容和实用可用性,而非审美上的精雕细琢。该模型可处理4500个token的提示词,清晰渲染10像素大小的文本,并能一次性生成完整的报纸版面或多格信息图。
2026-07-23
AI 研究
图像生成的强化学习:Qwen-Image-2.0-RL 获得复合奖励系统
Qwen-Image-2.0-RL 报告详细描述了一条结合 RLHF、同策略蒸馏和复合奖励模型的后训练管道,用于提升文本到图像和图像编辑质量。该方法在审美质量、指令遵循和人脸身份保留方面均可衡量地改进。
2026-07-20
产品组合策略
阿里Qwen正在为每一项AI任务构建专属模型,而非一统天下
阿里云Qwen团队悄然发布了一个35B MoE智能体世界模型、三个新的ASR模型以及一份图像生成强化学习报告,显示出在AI模型竞赛中以广度而非奇观为核心的战略押注。
2026-07-09