模型部署
2 published articles
人工智能5 min read
推理端点
Hugging Face 拉的是基础设施杠杆,而不是模型杠杆
Hugging Face 对其推理端点服务进行了全面改造,强调部署的便利性而非原始模型性能。该平台现在支持 vLLM、SGLang、llama.cpp 和自定义容器,并具备自动扩展和按使用量付费的定价模式。其卖点是:跳过运维工作,专注于模型本身。
2026-07-24
新闻2 min read
AWS集成
AWS与Hugging Face一键消除AI模型部署最棘手的环节
AWS与Hugging Face推出一键集成功能,开发者从模型页面可直接跳转至SageMaker Studio,且权限与GPU配额已预设。这意味着无需再配置IAM、申请配额或在多个仪表盘间切换。
2026-07-14