标签
大模型
-

豆包现在能看着你的屏幕跟你聊天了:SeedRealtime 全双工视频通话上手指南
你用过对讲机吗?按住说话,松手收听,中间永远有一道「你的回合/我的回合」的裂缝。过去我们和 AI 视频聊天,本质上就是这个模式——你说完,它才听;它听完,才想;想完,才说。哪怕延迟只有一秒,那股「跟机…
-

阿里 Qwen 3.8 来了:2.4 万亿参数、能自己跑 16 天项目,开发者现在该怎么用?
8 月 3 日,阿里云正式发布了新一代基座大模型 Qwen 3.8。这不是一次常规的版本迭代,而是直接把千问家族的参数规模推到了 2.4 万亿(激活参数 95B),上下文拉到 100 万 Tokens…
-

全球开发者调用量前五,全是中国大模型了——OpenRouter 怎么用、选哪个,这篇讲清楚
8 月 2 日,央视新闻发了一条不算轰动但很有意思的消息:全球多模型聚合平台 OpenRouter 发布了最新一周 AI 大模型调用量榜单,前五名全是中国的。 排第一的是小米 MiMo-V2.5,单周…
-

DeepSeek V4-Flash 正式版来了:Agent 能力暴涨 6 倍,价格只要 Claude 的 1/90
DeepSeek V4-Flash 正式版来了:Agent 能力暴涨 6 倍,价格只要 Claude 的 1/90 7 月 31 日下午,DeepSeek 悄悄干了一件大事——V4-Flash 正式版…
-

把大模型推理速度翻倍:腾讯混元开源 AngelSpec,教你部署投机解码
大模型推理贵、慢、卡,这件事困扰整个行业太久了。 7 月 30 日,腾讯混元团队甩出一个新开源项目:AngelSpec。这是一个端到端的投机解码(Speculative Decoding)训练与部署框…
-

OpenAI 也终于开源了:gpt-oss-120b 和 gpt-oss-20b 上手指南,从下载到本地部署一篇讲清楚
7 月 29 日凌晨,OpenAI 把两枚模型权重扔到了 Hugging Face 上:gpt-oss-120b 和 gpt-oss-20b。Apache 2.0 协议,可商用、可改、可再分发。这是 …
-

Kimi K3 权重真的开源了:2.8T 模型怎么下载、部署和接入,一篇讲清楚
7 月 27 日深夜,月之暗面把 Kimi K3 的模型权重、技术报告,以及支撑它训练的三项 Infra——MoonEP、FlashKDA、AgentEnv——一次性全扔了出来。 这不是那种「只发论文…
-

别在十几个平台之间切来切去了:阿里千问AI平台上线,一个Key管所有模型
如果你跟我一样,过去半年在 AI 工具上花的钱比外卖还多,那你大概率也有这种体验—— 写代码用 Claude,做图切到 Midjourney,剪视频打开即梦,查资料又得打开 Kimi。每个平台一个账号…
-

Claude Opus 5 来了:性能逼近 Fable 5,价格只要一半,你的默认模型该升级了
7 月 24 日,Anthropic 把 Claude Opus 5 放出来了。不是小修小补的迭代,而是一次挺关键的定位调整——它几乎做到了 Fable 5 的水平,但价格保持在 Opus 的老价位,…
-

Gemini 3.6 Flash 来了:输出 token 直降 17%,还能操控电脑,开发者现在该怎么接?
Google 在 7 月 21 日连发三款 Gemini 新模型:Gemini 3.6 Flash、Gemini 3.5 Flash-Lite,以及面向网络安全的 Gemini 3.5 Flash C…