SevenTnewS

大语言模型与模型

大型语言模型:GPT、Claude、Gemini、Mistral 及开源权重模型

93 published articles

4 min read

AI 音乐生成

Music 3.0 用时间线取代单标签提示,让 AI 歌曲始终不跑偏

AI 曲目在展开过程中容易偏离提示:乐器退出、情绪平淡、人声风格时有时无。Music 3.0 用按时间顺序的 Structured Caption 取代单标签描述,并由 8B/0.6B Hybrid-LM 将结构与细节分开处理。

2026-08-21

5 min read

开放权重 AI

小红书 dots3-note:280B 开源 MoE,仅激活 16B

小红书的 dots studio 发布了其首个开放权重模型 dots3-note preview:一个多模态 MoE,拥有 280B 参数、16B 激活参数和 512K 上下文窗口。这种稀疏设计旨在降低单台 8-GPU 节点上的服务成本,但模型卡尚未公布基准测试数字。

2026-08-20

3 min read

开源 AI

Boris-2 为其 125M 模型投入 900亿 tokens,250M 模型仅 600亿

Boris-2 预先宣布三个 token 预算不均的小模型:125M 获得 900亿 tokens,250M 仅有 600亿。训练从 8 月 12 日持续到 9 月 10 日,没有分享任何基准,只表达了达到 SmolLM2-135M 实力的野心。

2026-08-16

4 min read

AI 视频生成

阿里巴巴 Wan3.0 按秒出售视频:30秒片段6美元

Wan3.0 可以将 PDF 或品牌演示文稿在一次生成中变成 30 秒视频,API 按秒计费,1080P 最高每秒 0.20 美元。我们拆解了每段视频的成本,以及阿里巴巴在自测中承认的不足。

2026-08-16

4 min read

开放权重 TTS

Magpie TTS 在你的语音智能体延迟预算中占用了 32ms

Magpie TTS 报告在 NVIDIA B200 上的首音频时间为 32ms,并新增阿拉伯语、韩语和巴西葡萄牙语,使其语言列表达到 12 种。开放权重的卖点:自托管语音合成不再输掉延迟之争。

2026-08-16

4 min read

端侧 AI 智能体

LFM2.5-2.6B:性能超越四倍于自身规模模型的微型智能体

Liquid AI 的 LFM2.5-2.6B 将智能体模型压缩到 2.6B 参数、内存占用低于 2.5 GB,并在所有测试过的指令跟随基准上位居榜首。它在笔记本电脑上运行速度为 220 tokens/秒;编码是唯一明显的短板。

2026-08-12

5 min read

AI价格战

一条回复声称,智谱GLM-5.2走红的0.07美元定价已上涨约10倍

智谱GLM-5.2以每百万token 0.07美元的价格走红,发帖者称这一95%的降幅"几乎等于免费。"一条回复称,价格回升10倍是博眼球的花招。从业者补充说,GLM-5.2从未达到前沿水平。

2026-08-10

3 min read

研究

你使用工具的AI模型正在让简单问题变得更难

KlingTeam的一篇新论文衡量了多模态模型何时真正需要工具、何时工具反而造成损害。所提出的Beacon模型通过必要性感知奖励训练,在提高准确率的同时改善了工具使用纪律。

2026-08-09

5 min read

视频生成

MiniMax 放弃其成熟架构,让 H3 包揽一切

MiniMax 表示,H3 将文本、图像、视频和音频生成统一到一个模型中,2K 输出的定价低于主流模型的三分之一,并计划在数日内开放权重。细则才是真正的故事:该公司为了达到这一目标,放弃了自己曾占据优势的架构。

2026-08-07

4 min read

小型模型竞赛

BananaMind 2 Micro:2.9M参数、75B Token,和一场极端的过度训练豪赌

BananaMind 2 Micro 将拥有2.9M参数,并在75B Token上进行训练,相当于每个参数约25,900个Token。训练将于8月3日开始,发布日期预计为8月4日至6日,BananaMind 2 Pro 的公开预览将在同一天上线。目前尚未分享任何基准测试结果。

2026-08-06

Featured4 min read

AI安全

Shieldstral:3B参数分类器,胜过规模七倍于己的模型

据2026年7月的一篇arXiv论文,一款3B安全分类器匹敌了体积接近其七倍的文本模型,并在多模态审核上确立了新的最先进水平。诀窍:将审核重新定义为二元问答,基于约5410万个样本进行训练。

2026-08-05

5 min read

人工智能

LFM2.5-Encoders 为小模型提供了有力论据:CPU 上比 ModernBERT 快 3.7 倍

Liquid AI 的开放权重 LFM2.5-Encoders 证明了生产环境 NLP 应属于小型模型。230M 编码器在基准测试上胜过 ModernBERT-base,在笔记本电脑 CPU 上约 28 秒扫描完整文档,速度大约快 3.7 倍。

2026-08-05

← PreviousPage 1 / 8 · 93 articlesNext →