标签

标签: 大模型

  • 全球开发者调用量前五,全是中国大模型了——OpenRouter 怎么用、选哪个,这篇讲清楚

    8 月 2 日,央视新闻发了一条不算轰动但很有意思的消息:全球多模型聚合平台 OpenRouter 发布了最新一周 AI 大模型调用量榜单,前五名全是中国的。 排第一的是小米 MiMo-V2.5,单周…

  • DeepSeek V4-Flash 正式版来了:Agent 能力暴涨 6 倍,价格只要 Claude 的 1/90

    DeepSeek V4-Flash 正式版来了:Agent 能力暴涨 6 倍,价格只要 Claude 的 1/90 7 月 31 日下午,DeepSeek 悄悄干了一件大事——V4-Flash 正式版…

  • 把大模型推理速度翻倍:腾讯混元开源 AngelSpec,教你部署投机解码

    大模型推理贵、慢、卡,这件事困扰整个行业太久了。 7 月 30 日,腾讯混元团队甩出一个新开源项目:AngelSpec。这是一个端到端的投机解码(Speculative Decoding)训练与部署框…

  • OpenAI 也终于开源了:gpt-oss-120b 和 gpt-oss-20b 上手指南,从下载到本地部署一篇讲清楚

    7 月 29 日凌晨,OpenAI 把两枚模型权重扔到了 Hugging Face 上:gpt-oss-120b 和 gpt-oss-20b。Apache 2.0 协议,可商用、可改、可再分发。这是 …

  • Kimi K3 权重真的开源了:2.8T 模型怎么下载、部署和接入,一篇讲清楚

    7 月 27 日深夜,月之暗面把 Kimi K3 的模型权重、技术报告,以及支撑它训练的三项 Infra——MoonEP、FlashKDA、AgentEnv——一次性全扔了出来。 这不是那种「只发论文…

  • 别在十几个平台之间切来切去了:阿里千问AI平台上线,一个Key管所有模型

    如果你跟我一样,过去半年在 AI 工具上花的钱比外卖还多,那你大概率也有这种体验—— 写代码用 Claude,做图切到 Midjourney,剪视频打开即梦,查资料又得打开 Kimi。每个平台一个账号…

  • Claude Opus 5 来了:性能逼近 Fable 5,价格只要一半,你的默认模型该升级了

    7 月 24 日,Anthropic 把 Claude Opus 5 放出来了。不是小修小补的迭代,而是一次挺关键的定位调整——它几乎做到了 Fable 5 的水平,但价格保持在 Opus 的老价位,…

  • Gemini 3.6 Flash 来了:输出 token 直降 17%,还能操控电脑,开发者现在该怎么接?

    Google 在 7 月 21 日连发三款 Gemini 新模型:Gemini 3.6 Flash、Gemini 3.5 Flash-Lite,以及面向网络安全的 Gemini 3.5 Flash C…

  • 2.8 万亿参数开源模型来了:Kimi K3 上手指南,从网页到 API 一篇讲清楚

    7 月 16 日,月之暗面在 2026 世界人工智能大会开幕前夜扔了一颗炸弹:Kimi K3。 2.8 万亿参数,100 万 token 上下文,原生视觉理解,官方说它是目前全球最大的开源模型。重点是…

  • 等了两年,国行 Apple Intelligence 终于过审了:千问接棒,你的 iPhone 马上要变聪明了

    等了两年,国行 Apple Intelligence 终于过审了:千问接棒,你的 iPhone 马上要变聪明了 如果你用的是国行 iPhone,过去两年大概有一种感觉:别人家的 Siri 已经能写邮件…