微调
3 published articles
网络安全4 min read
网络安全
谷歌网络微调模型发现Claude Opus 4.6遗漏的漏洞
谷歌的Gemini 3.5 Flash Cyber微调模型在漏洞发现方面超越Claude Opus 4.6,在V8引擎中发现了55个 vs 36个独特问题。该轻量级模型通过有限访问试点计划仅向政府和可信合作伙伴开放。
2026-07-24
实验室Featured3 min read
NVIDIA
Nvidia和Hugging Face联手,让分布式扩散训练变得轻松简单
Nvidia的NeMo Automodel现已直接集成Hugging Face Diffusers,为FLUX、Wan 2.1和HunyuanVideo等模型提供生产级分布式训练。这个基于Apache 2.0许可的库将并行性作为配置开关处理,并让微调后的检查点可直接加载回推理管线。
2026-07-19
人工智能Featured3 min read
训练优化
Unsloth 声称新 Triton 内核与自动打包技术实现 5 倍 LLM 训练加速
Unsloth 最新更新引入了融合 QK RoPE Triton 内核,实现 2.3 倍旋转嵌入加速;int64 索引支持长上下文;以及自动免填充打包。基准测试显示,Qwen3-32B 模型吞吐量提升 1.7-3 倍,且准确率无损失。
2026-07-16