分类目录
分类: 技术
-
NVIDIA PAIR 上手指南:把家里 RTX 和 Mac 拼成局域网 AI 推理集群,多 Agent 任务提速 2 倍
NVIDIA 9 月 3 日开源的 PAIR 让你不动 Ollama / LM Studio 接口就能把家里几台电脑拼成局域网 AI 推理集群,5 个 subagent 任务从 18 分钟压到 8 分…
-
Claude Fable 5.1 发布:8 项基准屠榜、缓存降价 75%,但升级前先改这三处代码
Claude Fable 5.1 发布:8 项基准屠榜,缓存读取直降 75%,但升级前必须改三处代码——tool_choice 返回 400、thinking blocks 跨模型失效、编辑 syst…
-
腾讯混元 Hy4 preview 开源上手:770B/49B MoE、1M 上下文,5 行代码跑通 API 调用与编程实测
腾讯混元 Hy4 preview 开源:770B/49B MoE,1M 上下文,Apache 2.0。教你用 5 行 Python 通过 OpenRouter 调用 API,用 reasoning_e…
-
vLLM v0.28.0 上手指南:从 pip install 到 60% 提速,一篇说清 Kimi-K3、DeepSeek V4 与 7 项 Breaking Changes
vLLM v0.28.0(8 月 26 日发布):584 commit、Kimi-K3 TTFT 升 60%、每 GPU 省 17 GiB、DeepSeek V4 sparse MLA 端到端。本文实…
-
「牛来」身份揭晓:智谱 GLM-5.3-Flash 开源上手——从 API 调用到 Claude Code 替换实战
智谱正式认领匿名模型 Ox Alpha,GLM-5.3-Flash 以 MIT 协议开源。320B/18B MoE 原生多模态模型,AA 智能指数 57 分追平 Claude Opus 4.8,价格仅…
-
Perplexity × NVIDIA Portable Computer 上手指南:本地跑 AI Agent 的「零 Token 成本」到底是真省还是宣传话术(含 Ollama 复刻教程)
Perplexity 联合 NVIDIA 推出 Portable Computer,把 AI Agent 整套 harness 搬到本地运行,本地任务不消耗云端 Credits。本文拆解「零 Toke…
-
OpenAI 把 Codex 的”大脑”开源了:Codex Harness 上手指南,三层接口从 CI 到产品全打通
OpenAI 开源 Codex Harness 底层执行框架,不是模型而是模型的’外骨骼’。同一 GPT-5.6 Sol 仅靠 Harness 优化,ARC-AGI-3 得分从 13.3% 涨到 38…
-
OpenRouter 上冒出一个不署名的前沿模型:Ox Alpha 免费试,三步跑通 API 调用
OpenRouter 上出现了一个匿名模型 Ox Alpha,1M 上下文、支持图文视频多模态输入、编程跑分超过 GPT-5.6。本文教你用 curl 和 Python 三步跑通 API 调用,附隐私…
-
Claude 现在能替你发邮件、管 Drive 了:Google Workspace 连接器实测与上手
Claude 的 Google Workspace 连接器升级后,能直接发送 Gmail、回复邮件、管理 Drive 文件。本文实测开通流程、权限边界与 3 个真实办公场景,并提醒哪些操作不建议交给 …
-
企业微信终于对 AI Agent 敞开大门了:CLI + MCP 全面开放,14 个办公模块一条命令调用
企业微信 5.0.10 全面开放 CLI 和 MCP,WorkBuddy、DeepSeek Harness 等 AI Agent 可直接调用文档、表格、邮件、会议等 14 个办公模块。我实测安装了 @…