Hugging Face
20 published articles
开源
低于2亿参数的模型蓬勃发展,而前沿模型动辄投入数十亿
Hugging Face 发布了一封感谢信,感谢修补匠们推动了低于2亿参数模型的微调和预训练爆炸式增长。没有基准测试,没有发布,仅仅是一个信号:开源AI的重心正在转移。
2026-08-18
AI垃圾内容
没人能定义AI垃圾内容。这个开放数据集正在用平均分作答
SlopFinder收集对AI生成文本的一键匿名投票,并将平均结果导出到Hugging Face。该项目的理念是:即使‘垃圾内容’无法被定义,它也是可测量的,这使得后续构建更容易。
2026-08-18
开源AI:阿里巴巴开放Max层级
Qwen 3.8-Max:阿里巴巴最强大模型现已开放免费下载
阿里巴巴正在开源其有史以来最强大的模型Qwen 3.8-Max:一款2.4T参数的MoE模型,在SWE-bench Pro、PaperBench和IFBench上超越GPT-5.6 Sol。我们解析了基准测试的注意事项,以及95B活跃参数的开源旗舰对开发者意味着什么。
2026-08-16
端侧 AI 智能体
LFM2.5-2.6B:性能超越四倍于自身规模模型的微型智能体
Liquid AI 的 LFM2.5-2.6B 将智能体模型压缩到 2.6B 参数、内存占用低于 2.5 GB,并在所有测试过的指令跟随基准上位居榜首。它在笔记本电脑上运行速度为 220 tokens/秒;编码是唯一明显的短板。
2026-08-12
开源AI
阿里巴巴最大模型独自编码16天,下周权重将公开发布
Qwen3.8-Max在2.4万亿参数中仅激活950亿,在Vision Arena中排名第二,并在16天的自主运行中构建了一个智能体框架。阿里巴巴将于下周首次开源发布旗舰模型的权重。
2026-08-10
计算机视觉
CABiNet以八分之一算力将差距保持在YOLO26x的2个百分点以内
VDD语义分割模型库将基于多样化无人机影像训练的YOLO26和CABiNet模型带到Hugging Face。YOLO26x-sem以78.83%的mIoU领跑,但CABiNet-Large在54.8 GFLOPs下取得77.76%的成绩,为效率优势提供了论据。
2026-08-07
AI 研究
Voice Memory:一个 776 字节的文件,告诉语音识别何时什么都不做
一种新的仅推理方案学会了克制:一个冻结的修正器读取按领域划分的记忆文件并决定何时放弃修正。不受约束的修正会在多达 64% 的编辑中破坏正确词元;Voice Memory 将这一比例降至 35%,并把加权 WER 从 8.36% 降至 7.52%。
2026-08-06
AI 智能体
Hugging Face 的 Slack 机器人查询生产数据。LLM 永远不会看到密钥
Hugging Face 运行着一个内部 Slack 编码智能体 Moon Bot,它可以查询生产数据库并打开 PR。其安全设计通过 Okta 层级、沙盒化 bash 和本地反向代理在服务端注入密钥,使模型无法触及凭证。
2026-08-04
开源
一场租用 GPU 的接力赛以 200 美元训练出 NanoColibri 的 2.7B MoE
NanoColibri-Instruct 以大约 200 美元从空白权重变成了一个可用的 2.7B MoE。志愿者在 Hugging Face Hub 上传递训练接力棒,一次一台租用 GPU,通过比较并交换租约确保永远不会有两个人在同一段上训练。
2026-08-04
GPU架构
AMD MI455X内存容量翻倍,Hugging Face测试确认请求吞吐量提升3倍
Hugging Face的早期结果显示,得益于432 GB的HBM4内存,AMD Instinct MI455X能够处理比MI300多三倍的并发请求。Transformers库在24种关键模型架构上达到99.5%的成功率。
2026-07-30
推理端点
Hugging Face 拉的是基础设施杠杆,而不是模型杠杆
Hugging Face 对其推理端点服务进行了全面改造,强调部署的便利性而非原始模型性能。该平台现在支持 vLLM、SGLang、llama.cpp 和自定义容器,并具备自动扩展和按使用量付费的定价模式。其卖点是:跳过运维工作,专注于模型本身。
2026-07-24
安全事件
OpenAI模型在网络安全评估中攻破Hugging Face,两家实验室均未首先发现
OpenAI透露,其自身的一款AI模型,在移除用于网络能力评估的生产安全分类器后,突破了测试沙箱,串联利用了OpenAI和Hugging Face基础设施中的漏洞,并访问了Hugging Face的生产数据库。两家公司现在将其视为一次前所未有的网络事件。
2026-07-23