标签

大模型

  • 2.8 万亿参数开源模型来了:Kimi K3 上手指南,从网页到 API 一篇讲清楚

    7 月 16 日,月之暗面在 2026 世界人工智能大会开幕前夜扔了一颗炸弹:Kimi K3。 2.8 万亿参数,100 万 token 上下文,原生视觉理解,官方说它是目前全球最大的开源模型。重点是…

  • 等了两年,国行 Apple Intelligence 终于过审了:千问接棒,你的 iPhone 马上要变聪明了

    等了两年,国行 Apple Intelligence 终于过审了:千问接棒,你的 iPhone 马上要变聪明了 如果你用的是国行 iPhone,过去两年大概有一种感觉:别人家的 Siri 已经能写邮件…

  • OCR 终于不用搭流水线了:腾讯混元 HyOCR-1.5 开源,1B 参数笔记本就能跑

    OCR 终于不用搭流水线了:腾讯混元 HyOCR-1.5 开源,1B 参数笔记本就能跑 做 OCR 这件事,过去几年一直挺折腾的。传统方案是流水线模式:先用检测模型找到文字位置,再用识别模型把文字读出…

  • 等了两个月,Google 把 Gemini 3.5 Pro 推倒重训了:上线倒计时,先做这四件事

    等了两个月,Google 把 Gemini 3.5 Pro 推倒重训了:上线倒计时,先做这四件事 6月没来,7月终于定档。Gemini 3.5 Pro 不是在旧模型上缝缝补补,Google 直接把底层…

  • 你的手机马上要有自己的 AI 大脑了:阶跃星辰 Step Edge 端侧模型上手指南

    你有没有发现一个很别扭的事——现在的 AI 助手,几乎全部活在云端。 你对着手机说句话,语音先上云、模型跑一遍、结果再下云,中间但凡网不好,它就卡在那儿转圈。更别说那些在飞机上、地下车库、或者移动信号…

  • 扎克伯格三年首发推就为了它:Muse Spark 1.1 实操指南,Meta的编程Agent模型到底行不行

    扎克伯格三年没发过推,昨天突然冒出来发了一条——就为了这事。 7月9日,Meta Superintelligence Labs 发布了 Muse Spark 1.1,一个主打编程和 Agent 能力的…

  • GPT-5.6 终于对所有人开放了:Sol、Terra、Luna 三档模型怎么选,一篇讲透

    今天(7月9日)是 AI 行业一个标志性日子:OpenAI 的 GPT-5.6 系列终于全量上线,不再只是少数企业客户的专属玩具。旗舰 Sol、均衡 Terra、轻量 Luna 三档模型,今天起对全球…

  • Claude Sonnet 5 来了,免费用户直接用:百万上下文、编程能力暴涨,Anthropic 把看家本领塞进了中杯

    6 月 30 号晚上,Anthropic 悄悄上线了 Claude Sonnet 5。 没开发布会,没预热,连个倒计时页面都没有。就这么直接把新模型设成了 Free 和 Pro 用户的默认选项,顺手把…

  • DeepSeek 联合北大放出 DSpark:单用户生成速度最高提 85%,一份能从零跑起来的实操指南

    6 月 27 日,DeepSeek 在 GitHub 低调推了一篇新论文,署名里有创始人梁文锋和北京大学团队。论文介绍的是一套推测解码(Speculative Decoding)框架,名字叫 DSpa…

  • 没发布会、没大厂背书:一条推文扔出来的开源编程模型,35B击败十倍大模型

    6月26日,X上一位叫 Berry Xia 的用户发了一条推文。没有发布会直播,没有CEO站台,没有精心剪辑的宣传片。推文里就一个名字:Ornith-1.0。四个模型,从小到大排列整齐,全部MIT协议…

暗夜独行