8 月 13 日,AI 圈一口气放出了四样东西:谷歌的 Gemini 3.7 Flash、DeepSeek 开源的 Harness 框架、OpenAI 与 Cerebras 合作的 GPT-5.6 Sol Ultrafast 模式,还有 Mistral 的 OCR 4.1。前三样在 Hacker News 上热度都过了 500,值得单独记一笔。

Gemini 3.7 Flash:更聪明的"工作马"

距离 3.6 Flash 发布才三周,谷歌就端出了 3.7 Flash,官方定位是"最聪明的全能型模型",主攻编码和 Agent 场景。这一代的提升看得见摸得着:FrontierCode 1.1 Main 从 34.4% 涨到 43.6%,DeepSWE v1.1 从 49.0% 涨到 65.3%,WebDev Arena 的 Elo 从 1538 提到 1588。处理复杂文档的 GDP.pdf 基准从 22.0% 跳到 34.0%,衡量真实业务流程完成度的 AutomationBench 从 17.0% 提到 30.4%。

价格是这轮最直接的变化。到 2026 年底为止,输入 $0.75/百万 token(约合 ¥5.5)、输出 $3.75/百万 token(约合 ¥27),是 3.6 Flash 原始定价的一半。2027 年 1 月 1 日起恢复 $1.50/$7.50。Artificial Analysis 给它的智能指数是 56,高于 3.6 Flash 的 52,不过它每次任务消耗的输出 token 也从 26k 涨到了 37k。单价砍半之后,单任务成本还是更低的。

上线渠道包括 Gemini API、AI Studio、Android Studio、Google Antigravity 和 Gemini Enterprise。个人用户这边,AI Pro/Ultra 订阅里的 Gemini Spark 今天起也换上了 3.7 Flash。HN 评论区有人拿它对比 Claude Sonnet 5 和 GPT-5.6 Terra,也有用户抱怨 Pro 系旗舰迟迟不更新。Flash 系列更新越勤,旗舰的空窗期就越扎眼。

DeepSeek Harness:开源 Agent 框架,一切皆插件

同一天,DeepSeek 开源了 Agent 框架 DeepSeek Harness 的开发者预览版,GitHub 仓库 deepseek-ai/deepseek-harness 一天之内接近 7 万 star,MIT 许可证。设计理念一句话:一切皆插件。模型、工具、Skills、会话、沙箱、存储、运行循环、调度、UI,全部可以替换和重组。

它跑在 Cordis 内核上,官方公式是 AGENT = MODEL + HARNESS。模型是 Agent 的灵魂,Harness 让它在真实环境里持续干活。每次运行的完整轨迹写进 append-only 会话日志:系统提示词、推理过程、工具调用、子 Agent 调度都能回放、续跑、分叉,Trajectory 视图按来源逐项检查。预置了 Standard、Code、Minimal、Creator 四种运行模式,社区已经有人在上面做插件索引和版本管理工具。

同日 DeepSeek 还宣布 V4 Pro 正式版(DeepSeek-V4-Pro-0813)转 GA,并调整 API 定价:引入峰谷计价,谷时比峰时低 50%,新价格 8 月 16 日 16:00 UTC 生效。社区对涨幅讨论不少,有说法称部分档位涨了近 10 倍,这个数字官方口径里没有,先存疑。

GPT-5.6 Sol Ultrafast:Cerebras 把输出拉到 750 tokens/s

OpenAI 和 Cerebras 放出了 Ultrafast Mode 的早期预览:GPT-5.6 Sol 的新服务层级,由 Cerebras 晶圆级引擎(Wafer-Scale Engine)驱动,输出速度最高 750 tokens/s,官方称质量不打折。Cerebras 实测 Humanity's Last Exam:2500 道题跑了 11 小时 11 分钟,Claude Fable 5 跑同一套题用了 78 小时 27 分钟。在 GDP-Val 这类高价值知识工作上,端到端提速 5.6 倍。OpenAI 自己的口径是最高 14 倍速。

原理不算复杂:44GB SRAM 全堆在晶圆上,模型权重不用反复从片外搬,token 顺着流水线流过去就行。目前只对少数受邀客户开放,没公布定价。HN 上有人问 GPT-5.6 Luna Ultrafast 什么时候来,也有人提醒:速度数字很漂亮,定价没出来之前别急着算账。

Mistral OCR 4.1:文档智能更新

Mistral 把 OCR 服务更新到 4.1,主打 Document AI:支持段落级边界框提取、结构块标签、块级置信度。定价 €3.5/千页(约合 ¥30),带标注的 €4.38/千页。HN 评论区普遍反应是"贵",有人拿自建管线对比,说租 GPU 跑 1000 页成本不到 $0.1;也有用户表示 Mistral OCR 在内部基准里比同类 API 明显更快。