分类目录

博客文章

  • 别在十几个平台之间切来切去了:阿里千问AI平台上线,一个Key管所有模型

    如果你跟我一样,过去半年在 AI 工具上花的钱比外卖还多,那你大概率也有这种体验—— 写代码用 Claude,做图切到 Midjourney,剪视频打开即梦,查资料又得打开 Kimi。每个平台一个账号…

  • 吴恩达开源了一个能替你干活的桌面 Agent:OpenWorker 上手指南

    一句话总结:DeepLearning.AI 创始人吴恩达在 GitHub 扔了一个开源项目,让你的 Mac 桌面上多了一个能连接 Slack、Jira、GitHub、日历的真正干活的 AI 同事。不是…

  • Claude Opus 5 来了:性能逼近 Fable 5,价格只要一半,你的默认模型该升级了

    7 月 24 日,Anthropic 把 Claude Opus 5 放出来了。不是小修小补的迭代,而是一次挺关键的定位调整——它几乎做到了 Fable 5 的水平,但价格保持在 Opus 的老价位,…

  • Claude Agent 一夜塞进 500 个技能:Anthropic CMA 六大更新实操指南

    如果你过去一个半月没怎么关注 Anthropic 的动静,我来帮你补补课:Fable 5 和 Mythos 5 落了地,Sonnet 5 降了价,Claude Code 每天都有新版本。7 月 22 …

  • Gemini 3.6 Flash 来了:输出 token 直降 17%,还能操控电脑,开发者现在该怎么接?

    Google 在 7 月 21 日连发三款 Gemini 新模型:Gemini 3.6 Flash、Gemini 3.5 Flash-Lite,以及面向网络安全的 Gemini 3.5 Flash C…

  • 阿里通义千问终于出了个能干正事的 AI 画图工具:Qwen-Image-3.0 上手指南

    这几个月 AI 画图工具一个接一个地出——ChatGPT Images 2.0 学会了推理构图,Meta Muse Image 直接塞进了 Instagram,Seedance 2.5 一次能生成 3…

  • Adobe Project Indigo 1.1 使用指南:在相机 App 里用 AI 一键修图

    7 月 21 日,Adobe 给实验性相机应用 Project Indigo 推送了 1.1 版本。这次更新不是加滤镜、调参数那么简单,而是直接塞进去了一套生成式 AI 照片编辑工具——AI Play…

  • 别只刷 AI 视频了,现在你可以走进画面里:阿里 HappyOyster 1.0 上手指南

    WAIC 2026 的余热还没散,阿里又放出一个新东西。 7 月 19 日,阿里云百炼正式上线 HappyOyster 1.0(中文名“快乐生蚝”),不是文生图,也不是文生视频,而是“世界模型”——你…

  • 腾讯 WorkBuddy 独立 App 上线:手机里终于有了一个能替你干活的 AI 助手

    WAIC 2026 第二天,腾讯扔了个不算性感但很”实用”的东西。 7 月 18 日,腾讯自研的效率智能体 WorkBuddy 正式发布独立 App,iOS、Android、鸿…

  • AI 能帮你花钱了:腾讯 SkillPay 上线,你的 Agent 现在真能替你办事

    7 月 16 日,腾讯 SkillHub 悄悄上线了一个叫 SkillPay 的东西。 说”悄悄”可能不太准确——央广网、21 世纪经济报道、蓝鲸财经都发了稿。我是在刷 WAI…

  • 2.8 万亿参数开源模型来了:Kimi K3 上手指南,从网页到 API 一篇讲清楚

    7 月 16 日,月之暗面在 2026 世界人工智能大会开幕前夜扔了一颗炸弹:Kimi K3。 2.8 万亿参数,100 万 token 上下文,原生视觉理解,官方说它是目前全球最大的开源模型。重点是…

  • 等了两年,国行 Apple Intelligence 终于过审了:千问接棒,你的 iPhone 马上要变聪明了

    等了两年,国行 Apple Intelligence 终于过审了:千问接棒,你的 iPhone 马上要变聪明了 如果你用的是国行 iPhone,过去两年大概有一种感觉:别人家的 Siri 已经能写邮件…

  • OCR 终于不用搭流水线了:腾讯混元 HyOCR-1.5 开源,1B 参数笔记本就能跑

    OCR 终于不用搭流水线了:腾讯混元 HyOCR-1.5 开源,1B 参数笔记本就能跑 做 OCR 这件事,过去几年一直挺折腾的。传统方案是流水线模式:先用检测模型找到文字位置,再用识别模型把文字读出…

  • 等了两个月,Google 把 Gemini 3.5 Pro 推倒重训了:上线倒计时,先做这四件事

    等了两个月,Google 把 Gemini 3.5 Pro 推倒重训了:上线倒计时,先做这四件事 6月没来,7月终于定档。Gemini 3.5 Pro 不是在旧模型上缝缝补补,Google 直接把底层…

  • 你的手机马上要有自己的 AI 大脑了:阶跃星辰 Step Edge 端侧模型上手指南

    你有没有发现一个很别扭的事——现在的 AI 助手,几乎全部活在云端。 你对着手机说句话,语音先上云、模型跑一遍、结果再下云,中间但凡网不好,它就卡在那儿转圈。更别说那些在飞机上、地下车库、或者移动信号…

  • ChatGPT 不只是聊天了:Work 智能体来了,替你做完那些重复的活

    上周 OpenAI 干了一件挺大的事——把 ChatGPT 从”你问我答”的聊天框,变成了一个能自己干活、跨应用跑任务、甚至帮你建网站的智能体。 这个新东西叫 ChatGPT …

  • 跟 ChatGPT 打电话不用再等它说完:GPT-Live 实时语音上手指南,免费用户也能用

    7 月 9 日,OpenAI 把 ChatGPT 的语音模式彻底换了个底层。不是加了个新声音,也不是调了调语速——而是把「你一句我一句」的回合制,改成了「边说边听」的全双工。打断它、等它、让它安静,它…

  • 扎克伯格三年首发推就为了它:Muse Spark 1.1 实操指南,Meta的编程Agent模型到底行不行

    扎克伯格三年没发过推,昨天突然冒出来发了一条——就为了这事。 7月9日,Meta Superintelligence Labs 发布了 Muse Spark 1.1,一个主打编程和 Agent 能力的…

  • GPT-5.6 终于对所有人开放了:Sol、Terra、Luna 三档模型怎么选,一篇讲透

    今天(7月9日)是 AI 行业一个标志性日子:OpenAI 的 GPT-5.6 系列终于全量上线,不再只是少数企业客户的专属玩具。旗舰 Sol、均衡 Terra、轻量 Luna 三档模型,今天起对全球…

  • Meta 终于出了自己的 AI 画图工具:Muse Image 上手指南

    7月7日,Meta 正式发布了 Muse Image——这是 Meta Superintelligence Labs(MSL)成立以来推出的第一个图像生成模型,内部代号 Mango。跟之前的 Emu …

  • 字节的AI视频模型憋了个大招:Seedance 2.5 一次生成30秒,还能只改视频里的一小块

    以前用AI做视频,像在玩”抽卡”:5秒一抽,抽到脸不崩的赶紧拼起来。现在字节把这个流程直接改了。 做短视频、短剧或者电商广告的人,大概率都经历过这种痛苦: 想做一个15秒的产品…

  • 别再手动复制报错了:Chrome DevTools MCP 让 AI 自己看浏览器,前端调试效率翻倍

    你还在把控制台报错一行行复制给 Claude?这个 Google 官方出的工具,让 AI 直接”看”到你的浏览器里发生了什么。 做前端开发的都经历过这种死循环: 代码写完 → …

  • 把文字塞进图片里,Claude Code 的账单直接砍七成:pxpipe 上手指南

    Anthropic 的图片定价有个”漏洞”:一张图片的 token 费用只看像素尺寸,不管里面塞了多少字。pxpipe 正是利用这一点,把你的系统提示词、工具文档、旧聊天记录这…

  • Gemini Spark 终于上了 Mac:Google 的桌面 AI 智能体,到底能干点啥?

    7 月 1 号,Google 悄悄把 Gemini Spark 搬上了 Mac。 说”悄悄”是因为没开发布会,只是在官方博客上更新了一篇文章。但这事儿其实不小——这是 Goog…

标签