标签: 人工智能
-
Jev 决策模型上手:不生成文字的 AI、输出还免费,上线 48 小时被开源圈复刻了 6 次
TypeSafe AI 的 Jev 不生成任何文字,只返回带概率的结构化判断:输入 $0.042/百万 token、输出免费、P50 延迟 0.23 秒。本文讲清它与 LLM 的区别、OpenRout…
-
Qwen3.8-Omni-Flash 上手指南:音频输入降到 8 毛一百万 token,1 小时录音视频直接扔给 API
阿里千问发布全模态模型 Qwen3.8-Omni-Flash:文本、图片、音频、视频四输入,1M 上下文,一小时连续音视频直接进 API,音频输入从每百万 token 18 元降到 0.8 元。本教程…
-
Gemini 3.8 Live 上手:语音 Agent 能边聊边干活,还比 GPT-Live-1 便宜 40%
Gemini 3.8 Live 与 Extended Thinking 已上线 Gemini API 和 AI Studio,语音模型能边说话边后台执行工具,基准超 GPT-Live-1 且每小时 3…
-
OpenAI Agents API 公测上手:把 Codex 底层框架变成 10 行代码就能跑的云 Agent
OpenAI 9 月 10 日开放 Agents API 公测,把 Codex 底层 agent 框架(会话持久化、上下文压缩、子代理并行、MCP 工具)做成托管 API,无平台费。本文带你 5 分钟…
-
GPT-Image-2.5 API 上手指南:Flare 与 Sunburst 双模型怎么选,图像生成定价翻倍的性价比真相
OpenAI GPT-Image-2.5 图像生成 API 上手指南:Flare 速度型与 Sunburst 精度型双模型怎么选、六档质量参数如何影响成本、定价较上代翻倍后还值不值得用。整理 Pyth…
-
DeepSeek V4.1-Flash 上手:CED 架构 + 1M 上下文 + V4 Pro 自动退市,9 月 14 日前该做什么
DeepSeek 9 月 10 日推送 V4.1-Flash 正式版:全新 Causal Encoder-Decoder 架构把 552B 主干压到 prefill 仅激活 8B,配 1M 上下文、M…
-
MiniCPM5-2B 开源上手:2B 参数端侧 Agent 部署指南,1.2GB 量化版跑在旧笔记本上是什么体验
面壁智能开源 MiniCPM5-2B:2B 参数、Apache 2.0、AA 榜单 4B 以下第一,Agentic 指标同级 10 倍。INT4 量化仅 1.2GB,原生支持工具调用、深度搜索与代码生…
-
Claude Fable 5.1 发布:8 项基准屠榜、缓存降价 75%,但升级前先改这三处代码
Claude Fable 5.1 发布:8 项基准屠榜,缓存读取直降 75%,但升级前必须改三处代码——tool_choice 返回 400、thinking blocks 跨模型失效、编辑 syst…
-
腾讯混元 Hy4 preview 开源上手:770B/49B MoE、1M 上下文,5 行代码跑通 API 调用与编程实测
腾讯混元 Hy4 preview 开源:770B/49B MoE,1M 上下文,Apache 2.0。教你用 5 行 Python 通过 OpenRouter 调用 API,用 reasoning_e…
-
vLLM v0.28.0 上手指南:从 pip install 到 60% 提速,一篇说清 Kimi-K3、DeepSeek V4 与 7 项 Breaking Changes
vLLM v0.28.0(8 月 26 日发布):584 commit、Kimi-K3 TTFT 升 60%、每 GPU 省 17 GiB、DeepSeek V4 sparse MLA 端到端。本文实…

广告
