Inkling
2 published articles
开源3 min read
模型量化
Unsloth 将 9750 亿参数 Inkling 模型压缩至 270 GB,准确率保留 74%
Unsloth 的动态 GGUF 量化将 9750 亿参数的开放模型 Inkling 从 1.9 TB 压缩至 1 位下的 270 GB,准确率保留 74.2%。该方法有选择性地保留高精度层,从而实现在配备 290 GB 以上 RAM+VRAM 的机器上进行本地推理。
2026-07-16
大语言模型与模型7 min read
人工智能
Inkling揭示了开源模型市场的新分界线
Inkling是首个公开可用的近万亿参数模型,原生支持音频、图像和文本输入,同时拥有100万token的上下文窗口以及NVFP4量化版本。原始基准测试分数很强,但更具启示性的故事在于,开源生态系统如何从追赶者转变为在技术前沿的积极竞争者,以及Inkling在这一新版图中的位置。
2026-07-15