SevenTnewS

Qwen

22 published articles

大语言模型与模型4 min read

AI 音乐生成

Music 3.0 用时间线取代单标签提示,让 AI 歌曲始终不跑偏

AI 曲目在展开过程中容易偏离提示:乐器退出、情绪平淡、人声风格时有时无。Music 3.0 用按时间顺序的 Structured Caption 取代单标签描述,并由 8B/0.6B Hybrid-LM 将结构与细节分开处理。

2026-08-21

人工智能4 min read

多模态 / 开源

Qwen 插件包为你的编码代理装上眼睛、双手和视频记忆

阿里巴巴 Qwen 团队发布了 Qwen-MM-Plugins,这是一个 Apache-2.0 工具包,为编码代理提供原生多模态技能:动态分辨率图像和视频读取、OCR、grounding、ASR、长视频记忆、视频生成,以及通过瘦客户端控制 Blender 和 FreeCAD。一个脚本即可在 Claude Code、Codex、Qoder、OpenClaw、Qwen Code 和 Gemini CLI 中完成安装。

2026-08-15

Qwen / 阿里巴巴4 min read

AI经济学

阿里巴巴18美元套餐在Claude Code中运行Qwen与DeepSeek

阿里云的Token Plan Individual将Qwen及DeepSeek等第三方模型打包进单一积分池,月费6美元起,可在Claude Code和Cursor中使用。该公司声称较按量付费节省约40%,但该计划仅在新加坡可用,且仅限经批准的工具内使用。

2026-08-14

人工智能6 min read

云与LLM安全

阿里云AI网关以HTTP 200而非403阻断提示词攻击

阿里云AI网关的实操演练展示了认证、护栏和PII脱敏如何作为一个流水线协同工作。需要注意的坑:阻断返回HTTP 200,密钥强制校验需要手动开关,恢复的数据可能最终出现在日志中。

2026-08-09

人工智能3 min read

AI音乐

让Qwen-Music在13项指标上击败Suno的旋律先行技巧

Qwen-Music通过Melody-CoT将旋律规划与完整歌曲生成分离。这款30亿参数的模型,基于500多万小时的多语言数据训练,在客观指标和人类偏好方面均取得了优于Suno V5和MiniMax Music 2.6的最先进结果。

2026-07-31

AI代理3 min read

GUI智能体

阿里巴巴的Qwen-UI-Agent在真实手机上的得分高于沙盒环境

阿里巴巴通义实验室的Qwen-UI-Agent声称取得了最先进的移动端得分(AndroidDaily上97.5%),并在计算机使用结果上与Opus 4.8、Gemini 3.1 Pro和GPT-5.6 Sol相比具备竞争力。其在真实设备基准上的得分高于沙盒得分,而OSWorld-v2上40%的部分进展则是其诚实的极限。

2026-07-31

Qwen / 阿里巴巴2 min read

Qwen / 阿里巴巴

Qwen3-2507 发布:思维模型与指令模型分道扬镳,回归专门化路线

阿里巴巴 Qwen 团队发布 Qwen3-2507,将模型系列拆分为专门的指令变体和思维变体。此次更新在推理、指令遵循以及 256K 上下文支持(可扩展至 1M tokens)方面带来了实质性改进。

2026-07-29

实验室与研究1 min read

分析

基准测试,而非廉价:中国AI实验室达到与西方同等水平

中国AI实验室Qwen、DeepSeek、MiniMax和Kimi在推理、编码和文档解析基准测试中已赶上或超越美国前沿模型。通过激进定价和开放权重策略,它们不再只是廉价替代品,而是真正的竞争者。

2026-07-27

人工智能Featured4 min read

世界模型

阿里巴巴的HappyOyster让你在沙漠中驾驶并随时改写剧情

HappyOyster 1.0能从文本或图像生成交互式开放世界,支持自由移动、剧情控制和实时反馈。现已灰度测试,提供Android、iOS和Web SDK。

2026-07-25

大语言模型与模型4 min read

阿里云

终于记住你上周说过的话:阿里云AI编码伙伴获长期记忆

阿里云推出的新框架赋予AI编码助手长期记忆能力,使其能在多次对话中记住用户偏好、历史记录和项目知识,从此无需每次重新开始。

2026-07-24

工具与框架Featured3 min read

图像生成

阿里通义千问Qwen-Image-3.0:将文本渲染转化为生产力论据

阿里巴巴通义千问团队发布了第三代图像生成模型Qwen-Image-3.0,该模型优先考虑密集内容和实用可用性,而非审美上的精雕细琢。该模型可处理4500个token的提示词,清晰渲染10像素大小的文本,并能一次性生成完整的报纸版面或多格信息图。

2026-07-23

基准与测试2 min read

智能体评估

你的AI智能体总失败?问题可能出在“绑定“而非“大脑”

PawBench 是 AgentScope 团队推出的开源基准测试,系统性地同时评估模型和智能体绑定。结果显示,对于较小模型,绑定设计可使得分波动超过 11 分,暴露了当前 AI 智能体评判中的一个盲点。

2026-07-22

← PreviousPage 1 / 2 · 22 articlesNext →