本地AI
4 published articles
大语言模型与模型4 min read
端侧 AI 智能体
LFM2.5-2.6B:性能超越四倍于自身规模模型的微型智能体
Liquid AI 的 LFM2.5-2.6B 将智能体模型压缩到 2.6B 参数、内存占用低于 2.5 GB,并在所有测试过的指令跟随基准上位居榜首。它在笔记本电脑上运行速度为 220 tokens/秒;编码是唯一明显的短板。
2026-08-12
Meta AIFeatured4 min read
开源AI
Muse Glimmer:Meta的300亿参数智能体占用不到20GB,无需云端
Meta 开源了 Muse Glimmer,这是一个 30B 智能体模型,可在单块消费级 GPU 上离线运行。量化使其保持在 20 GB 以下,DFlash 草稿模型在 RTX 5090 上带来最高 3.1 倍的解码加速,权重以 Apache 2.0 许可发布在 Hugging Face 上。
2026-08-10
Qwen / 阿里巴巴2 min read
人工智能
这款7B模型超越更大模型,可在手机上运行,改变AI成本方程
阿里云通义千问Qwen2.5-Omni是一款70亿参数模型,可实时处理文本、图像、音频和视频,同时生成语音和文本。其“思考者-说话者”架构和TMRoPE位置嵌入支持流式交互,30亿参数变体可在骁龙8 Gen 1等移动SoC上以可用速度运行。
2026-07-23
AndroidFeatured1 min read
移动AI
Gemma 4 完全离线运行于移动设备,无需云端
React Native 开发者现在可以嵌入 Gemma 4,在 Android 和 iOS 上通过硬件加速实现离线推理。该模型本地处理视觉和工具使用任务,如演示中所示,完全在设备端读取传单并安排日历事件。
2026-07-09