标签

开源模型

  • 全球开发者调用量前五,全是中国大模型了——OpenRouter 怎么用、选哪个,这篇讲清楚

    8 月 2 日,央视新闻发了一条不算轰动但很有意思的消息:全球多模型聚合平台 OpenRouter 发布了最新一周 AI 大模型调用量榜单,前五名全是中国的。 排第一的是小米 MiMo-V2.5,单周…

  • 国产开源视频模型终于能用了:MiniMax H3 上手指南,8 月 3 日开源,2K 直出 0.8 元/秒

    如果你最近刷到任何关于 AI 视频的新闻,八成会看到”价格又创新低”或者”开源阵营又添一员”这两条主线。7 月 31 日,这两条主线同时被一款叫 Min…

  • 把大模型推理速度翻倍:腾讯混元开源 AngelSpec,教你部署投机解码

    大模型推理贵、慢、卡,这件事困扰整个行业太久了。 7 月 30 日,腾讯混元团队甩出一个新开源项目:AngelSpec。这是一个端到端的投机解码(Speculative Decoding)训练与部署框…

  • OpenAI 也终于开源了:gpt-oss-120b 和 gpt-oss-20b 上手指南,从下载到本地部署一篇讲清楚

    7 月 29 日凌晨,OpenAI 把两枚模型权重扔到了 Hugging Face 上:gpt-oss-120b 和 gpt-oss-20b。Apache 2.0 协议,可商用、可改、可再分发。这是 …

  • Kimi K3 权重真的开源了:2.8T 模型怎么下载、部署和接入,一篇讲清楚

    7 月 27 日深夜,月之暗面把 Kimi K3 的模型权重、技术报告,以及支撑它训练的三项 Infra——MoonEP、FlashKDA、AgentEnv——一次性全扔了出来。 这不是那种「只发论文…

  • 2.8 万亿参数开源模型来了:Kimi K3 上手指南,从网页到 API 一篇讲清楚

    7 月 16 日,月之暗面在 2026 世界人工智能大会开幕前夜扔了一颗炸弹:Kimi K3。 2.8 万亿参数,100 万 token 上下文,原生视觉理解,官方说它是目前全球最大的开源模型。重点是…

  • OCR 终于不用搭流水线了:腾讯混元 HyOCR-1.5 开源,1B 参数笔记本就能跑

    OCR 终于不用搭流水线了:腾讯混元 HyOCR-1.5 开源,1B 参数笔记本就能跑 做 OCR 这件事,过去几年一直挺折腾的。传统方案是流水线模式:先用检测模型找到文字位置,再用识别模型把文字读出…

  • DeepSeek 联合北大放出 DSpark:单用户生成速度最高提 85%,一份能从零跑起来的实操指南

    6 月 27 日,DeepSeek 在 GitHub 低调推了一篇新论文,署名里有创始人梁文锋和北京大学团队。论文介绍的是一套推测解码(Speculative Decoding)框架,名字叫 DSpa…

  • 没发布会、没大厂背书:一条推文扔出来的开源编程模型,35B击败十倍大模型

    6月26日,X上一位叫 Berry Xia 的用户发了一条推文。没有发布会直播,没有CEO站台,没有精心剪辑的宣传片。推文里就一个名字:Ornith-1.0。四个模型,从小到大排列整齐,全部MIT协议…

  • 同日交手:DeepSeek V4 开源 vs GPT-5.5 发布,这次谁赢了?

    2026年4月24日,AI圈的战鼓同时从两个方向敲响。 北京时间上午,DeepSeek 宣布 V4 正式发布并完全开源——1.6万亿参数,MIT 协议,直接放到 HuggingFace 上随便下。几乎…

暗夜独行