标签
标签: AI编程
-
Perplexity × NVIDIA Portable Computer 上手指南:本地跑 AI Agent 的「零 Token 成本」到底是真省还是宣传话术(含 Ollama 复刻教程)
Perplexity 联合 NVIDIA 推出 Portable Computer,把 AI Agent 整套 harness 搬到本地运行,本地任务不消耗云端 Credits。本文拆解「零 Toke…
-
OpenAI 把 Codex 的”大脑”开源了:Codex Harness 上手指南,三层接口从 CI 到产品全打通
OpenAI 开源 Codex Harness 底层执行框架,不是模型而是模型的’外骨骼’。同一 GPT-5.6 Sol 仅靠 Harness 优化,ARC-AGI-3 得分从 13.3% 涨到 38…
-
DeepSeek 不只造模型了:开源 Agent 框架 Harness 上手,一行命令拉起 AI 编程工作台
DeepSeek 8月13日开源 Agent 框架 Harness(dsh),MIT 协议,一切皆插件架构,一行 npx 命令启动本地 Web UI。本文实测安装启动流程,教你配置模型、选择四种运行模…
-
NVIDIA 终于下场做模型了:Nemotron 3.5 Lightning + NeMo Switchyard,Agent 账单砍掉七成怎么做到的
NVIDIA 发布开源 Agent 模型 Nemotron 3.5 Lightning(30B MoE,3B 激活,OpenRouter 有免费层)和模型路由库 NeMo Switchyard(Apa…
-
Claude Code 的多个终端终于能互相发消息了:跨会话消息上手指南
Claude Code v2.1.224 在 macOS 与 Linux 上新增跨会话消息:多个独立终端里的 Agent 可以互相发现、发送文本。本文带你升级 CLI、用 /list-agents 查…
-
蚂蚁百灵 Ling-3.0-flash 开源了:124B/5.1B MoE,单台 DGX Spark 能跑,开发者怎么接?
如果你最近已经被国产大模型的“八周五连发”轰炸得有点麻木,那蚂蚁集团 8 月 7 日这条消息还是值得单独拎出来说:旗下百灵大模型团队把新一代原生混合推理模型 Ling-3.0-flash 的权重正式放…
-
阿里 Qwen 3.8 来了:2.4 万亿参数、能自己跑 16 天项目,开发者现在该怎么用?
8 月 3 日,阿里云正式发布了新一代基座大模型 Qwen 3.8。这不是一次常规的版本迭代,而是直接把千问家族的参数规模推到了 2.4 万亿(激活参数 95B),上下文拉到 100 万 Tokens…
-
DeepSeek V4-Flash 正式版来了:Agent 能力暴涨 6 倍,价格只要 Claude 的 1/90
DeepSeek V4-Flash 正式版来了:Agent 能力暴涨 6 倍,价格只要 Claude 的 1/90 7 月 31 日下午,DeepSeek 悄悄干了一件大事——V4-Flash 正式版…
-
OpenAI 也终于开源了:gpt-oss-120b 和 gpt-oss-20b 上手指南,从下载到本地部署一篇讲清楚
7 月 29 日凌晨,OpenAI 把两枚模型权重扔到了 Hugging Face 上:gpt-oss-120b 和 gpt-oss-20b。Apache 2.0 协议,可商用、可改、可再分发。这是 …