标签
标签: 本地
-
vLLM v0.28.0 上手指南:从 pip install 到 60% 提速,一篇说清 Kimi-K3、DeepSeek V4 与 7 项 Breaking Changes
vLLM v0.28.0(8 月 26 日发布):584 commit、Kimi-K3 TTFT 升 60%、每 GPU 省 17 GiB、DeepSeek V4 sparse MLA 端到端。本文实…
-
本地部署大模型完全指南(2026版):Ollama 与 LM Studio 实战对比
前言 曾经,运行大语言模型(LLM)是只有拥有高端显卡和专业服务器的少数人才能做的事。但到了2026年,一切都变了。 随着模型量化技术的成熟和轻量化工具的普及,普通电脑也能本地运行强大的AI模型。无论…