1 published article
AI 研究 · 结构化输出基准测试
一次 100 步的 GRPO 训练将 LFM2.5-350M 在 IFStruct schema 基准上的成绩从 22.6% 提升至 29.7%。JSON 提升 14 个百分点,YAML 提升 0.3 个百分点,而最主要的失败模式几乎没有变化。
2026-09-17