SevenTnewS

开源人工智能

11 published articles

开源5 min read

开源

低于2亿参数的模型蓬勃发展,而前沿模型动辄投入数十亿

Hugging Face 发布了一封感谢信,感谢修补匠们推动了低于2亿参数模型的微调和预训练爆炸式增长。没有基准测试,没有发布,仅仅是一个信号:开源AI的重心正在转移。

2026-08-18

大语言模型与模型3 min read

开源 AI

Boris-2 为其 125M 模型投入 900亿 tokens,250M 模型仅 600亿

Boris-2 预先宣布三个 token 预算不均的小模型:125M 获得 900亿 tokens,250M 仅有 600亿。训练从 8 月 12 日持续到 9 月 10 日,没有分享任何基准,只表达了达到 SmolLM2-135M 实力的野心。

2026-08-16

Qwen / 阿里巴巴5 min read

开源AI:阿里巴巴开放Max层级

Qwen 3.8-Max:阿里巴巴最强大模型现已开放免费下载

阿里巴巴正在开源其有史以来最强大的模型Qwen 3.8-Max:一款2.4T参数的MoE模型,在SWE-bench Pro、PaperBench和IFBench上超越GPT-5.6 Sol。我们解析了基准测试的注意事项,以及95B活跃参数的开源旗舰对开发者意味着什么。

2026-08-16

Qwen / 阿里巴巴Featured5 min read

开源AI

Qwen3.8-Max 在24小时内独自击败458支人类团队

Qwen3.8-Max在24小时竞赛中独自击败了526支人类团队中的458支,阿里巴巴将于下周开源其权重。到目前为止,每一个数字都是自我报告的,这正是自主性主张值得审视的原因。

2026-08-03

人工智能Featured3 min read

开发者资源

驱动AI栈的30个GitHub仓库:从智能体到本地推理

一份实用的总结,列出了30个对AI开发者至关重要的GitHub仓库,按用例分组并按社区采用率排序。

2026-07-30

大语言模型与模型4 min read

开源AI

英伟达AV-Flamingo:攻克长视频理解,碾压多数模型

英伟达发布AV-Flamingo,一款专为长视频、复杂视频理解设计的开源音视频大语言模型。它采用三阶段课程学习法和带时间戳的思维链框架,能够处理许多模型难以应对的时间推理与跨模态推理任务。

2026-07-28

大语言模型与模型Featured3 min read

开源AI

Kimi K3 是有史以来最大的开放模型,但仍不是最好的。

Kimi K3是最大的开源模型,拥有2.8T参数,但在整体基准测试中未能击败最好的专有模型。尽管它在特定编码和智能体任务上表现出色,但与Claude Fable 5和GPT 5.6 Sol等前沿领先者的差距暴露了没有架构和数据突破的规模扩展的局限性。

2026-07-27

新闻4 min read

基础设施与融资

Together AI 8亿美元押注开放推理数学

Together AI 以 83 亿美元估值筹集 8 亿美元,由 Aramco Ventures、NVIDIA 等支持。该公司声称上一季度年化预订额超过 11.5 亿美元,得益于 Decagon、Eleven Labs 和 Cursor 等客户转向开放推理后实现 6 到 20 倍的成本降低。

2026-07-27

开源5 min read

AI开源

两大AI实验室证明:开放模型为何在受监管行业中胜出

Domyn和AISquared利用Ai2开源的Olmo系列及Dolma/Dolci数据集,为受监管行业构建模型。完全透明的架构和训练数据帮助他们满足合规要求,并将基础设施成本削减约50%。

2026-07-11

融资Featured4 min read

融资轮

Ollama 融资8800万美元,将开源AI带入财富500强

Ollama 从 Benchmark 和 Docker 创始人 Solomon Hykes 处融资8800万美元,以扩展其开放模型平台。该平台目前被890万开发者以及85%的财富500强公司使用,旨在让本地AI所有权成为默认选择。

2026-07-09

人工智能4 min read

开放的 AI 基础设施

NSF OMAI 上线:Ai2 的全开放 AI 集群是对封闭研究的挑战

Ai2 刚刚在 NSF OMAI 项目下启动了一个新的 AI 集群,该集群使模型、工具和流程完全开放。当每个 GPU 小时用于推动语言、多模态和科学领域的研究时,其价值更高。

2026-07-06