推理
3 published articles
Qwen / 阿里巴巴2 min read
Qwen / 阿里巴巴
Qwen3-2507 发布:思维模型与指令模型分道扬镳,回归专门化路线
阿里巴巴 Qwen 团队发布 Qwen3-2507,将模型系列拆分为专门的指令变体和思维变体。此次更新在推理、指令遵循以及 256K 上下文支持(可扩展至 1M tokens)方面带来了实质性改进。
2026-07-29
人工智能Featured5 min read
AI研究
制约AI智能体的瓶颈不是探索,而是评估
Hugging Face的两篇新论文从相反的方向着手解决同一个核心问题:如何让AI智能体可靠地评估自身行为。AJ-Bench构建了一个针对环境感知型评判智能体的基准测试,而HeavySkill则认为最好的评判者存在于模型参数内部。
2026-07-17
Phi-42 min read
人工智能
微软Phi-4模型在突破性研究中重新定义效率
微软Phi-4模型实现了最先进的效率,在推理任务中以显著更少的参数追平了更大模型的表现。这篇于2025年5月15日发布的研究论文重新审视了AI扩展定律的假设。
2026-07-03