SevenTnewS

图像生成

7 published articles

视觉与扩散Featured3 min read

AI 图像生成

Reve 2.1 以十分之一算力位居 Arena 第二

Reve 2.1 声称在 Arena 排行榜上整体排名第二,而训练算力不到周围实验室的十分之一。该公司还详细介绍了 4K 输出、可寻址区域和多语言文本渲染。

2026-08-05

人工智能Featured2 min read

AI战略

微软内部AI模型在生产中削减成本高达89%

微软自研的MAI模型已投入生产,在多个产品中实现了显著的成本节约。这些数据表明了一个战略转变:该公司现在不仅比拼模型质量,更在推理效率上展开竞争。

2026-07-29

人工智能4 min read

人工智能

微软40亿参数图像模型可在单块A100上运行,挑战300亿参数系统

微软Mage-Flow是一款紧凑的40亿参数图像生成与编辑模型,在单块A100 GPU上以交互速度运行时,其性能可与Qwen-Image和FLUX.2等更大的开源系统相媲美。其关键创新在于一个轻量级分词器,将编码成本降低了12倍。

2026-07-26

人工智能3 min read

成本分析

微软自研AI模型在生产中最高降低GPU成本89%

微软报告称,其MAI-2.5和MAI-Voice-2-Flash模型现已投入Bing、PowerPoint和Dynamics 365的生产环境,图像生成GPU成本降低84%,语音任务降低89%。自研模型战略正在带来相较于第三方替代方案可衡量的成本优势。

2026-07-24

工具与框架Featured3 min read

图像生成

阿里通义千问Qwen-Image-3.0:将文本渲染转化为生产力论据

阿里巴巴通义千问团队发布了第三代图像生成模型Qwen-Image-3.0,该模型优先考虑密集内容和实用可用性,而非审美上的精雕细琢。该模型可处理4500个token的提示词,清晰渲染10像素大小的文本,并能一次性生成完整的报纸版面或多格信息图。

2026-07-23

大语言模型与模型Featured5 min read

AI 研究

图像生成的强化学习:Qwen-Image-2.0-RL 获得复合奖励系统

Qwen-Image-2.0-RL 报告详细描述了一条结合 RLHF、同策略蒸馏和复合奖励模型的后训练管道,用于提升文本到图像和图像编辑质量。该方法在审美质量、指令遵循和人脸身份保留方面均可衡量地改进。

2026-07-20

Qwen / 阿里巴巴Featured5 min read

产品组合策略

阿里Qwen正在为每一项AI任务构建专属模型,而非一统天下

阿里云Qwen团队悄然发布了一个35B MoE智能体世界模型、三个新的ASR模型以及一份图像生成强化学习报告,显示出在AI模型竞赛中以广度而非奇观为核心的战略押注。

2026-07-09