标签
大模型
-

Mistral OCR 4.1 上手指南:把扫描件变成带坐标、带置信度的结构化文档
Mistral OCR 4.1 上手指南:不只把扫描件转成文字,还能返回段落坐标、结构标签与块级置信度。附可直接运行的 Python 代码、RAG/发票/合同三大真实场景用法,以及与腾讯 HyOCR、…
-

DeepSeek 不只造模型了:开源 Agent 框架 Harness 上手,一行命令拉起 AI 编程工作台
DeepSeek 8月13日开源 Agent 框架 Harness(dsh),MIT 协议,一切皆插件架构,一行 npx 命令启动本地 Web UI。本文实测安装启动流程,教你配置模型、选择四种运行模…
-

NVIDIA 终于下场做模型了:Nemotron 3.5 Lightning + NeMo Switchyard,Agent 账单砍掉七成怎么做到的
NVIDIA 发布开源 Agent 模型 Nemotron 3.5 Lightning(30B MoE,3B 激活,OpenRouter 有免费层)和模型路由库 NeMo Switchyard(Apa…
-

蚂蚁百灵 Ling-3.0-flash 开源了:124B/5.1B MoE,单台 DGX Spark 能跑,开发者怎么接?
如果你最近已经被国产大模型的“八周五连发”轰炸得有点麻木,那蚂蚁集团 8 月 7 日这条消息还是值得单独拎出来说:旗下百灵大模型团队把新一代原生混合推理模型 Ling-3.0-flash 的权重正式放…
-

ChatGPT 免费版终于「解禁」了:无限对话 + GPT-5.6 Luna + 思考按钮,一文看懂怎么用
如果你用 ChatGPT 的免费版,大概率遇到过这种情况:聊到一半,屏幕突然弹出一行灰字——”您已达到使用上限”。那种被硬生生打断思路的感觉,跟看电影看到高潮突然插播广告差不多…
-

豆包现在能看着你的屏幕跟你聊天了:SeedRealtime 全双工视频通话上手指南
你用过对讲机吗?按住说话,松手收听,中间永远有一道「你的回合/我的回合」的裂缝。过去我们和 AI 视频聊天,本质上就是这个模式——你说完,它才听;它听完,才想;想完,才说。哪怕延迟只有一秒,那股「跟机…
-

阿里 Qwen 3.8 来了:2.4 万亿参数、能自己跑 16 天项目,开发者现在该怎么用?
8 月 3 日,阿里云正式发布了新一代基座大模型 Qwen 3.8。这不是一次常规的版本迭代,而是直接把千问家族的参数规模推到了 2.4 万亿(激活参数 95B),上下文拉到 100 万 Tokens…
-

全球开发者调用量前五,全是中国大模型了——OpenRouter 怎么用、选哪个,这篇讲清楚
8 月 2 日,央视新闻发了一条不算轰动但很有意思的消息:全球多模型聚合平台 OpenRouter 发布了最新一周 AI 大模型调用量榜单,前五名全是中国的。 排第一的是小米 MiMo-V2.5,单周…
-

DeepSeek V4-Flash 正式版来了:Agent 能力暴涨 6 倍,价格只要 Claude 的 1/90
DeepSeek V4-Flash 正式版来了:Agent 能力暴涨 6 倍,价格只要 Claude 的 1/90 7 月 31 日下午,DeepSeek 悄悄干了一件大事——V4-Flash 正式版…
