Kimi K3 与 GPT-5.5、Opus 4.8 性能实测:低成本方案能否匹敌顶级模型

7 月 19 日
阅读 10 分钟
225
TL;DR。 Artificial Analysis 把 Kimi K3 的综合智能水平与 GPT-5.5 和 Claude Opus 4.8 放在同一档,而在它的 GDPval v2 智能体评测上,K3(1668 Elo)实际得分高于 Opus 4.8(1600)和 GPT-5.5(1494)。只有 Claude Fable 5 和 GPT-5.6 Sol 明显位居其上。K3 做到这一点还更便宜:moonshotai/kimi-k3 在 ofox 上每百...
封面图

GPT-5.6 Sol/Terra/Luna 三档模型定位解析与 API 接入实战指南(2026)

7 月 16 日
阅读 9 分钟
458
三档模型,同一代际。 GPT-5.6 以 Sol、Terra、Luna 三档发布:相同的 1M 上下文、相同的 128K 输出上限,在价格和能力曲线上占据三个不同的位置。Sol 是旗舰,每百万 token $5/$30;Terra 是均衡的中间档,价格正好是一半($2.50/$15);Luna 是廉价的主力,$1/$6。难点不在于怎么把它跑起来,难点在于为每种任务挑对档...
封面图

GPT-5.6 调用失败的 6 个常见原因与解决方案(2026 排查指南)

7 月 16 日
阅读 11 分钟
465
GPT-5.6 已经上线,所以“模型不可用”几乎从来不代表模型没了。** 它意味着在你的请求和 OpenAI 路由之间,出了六种具体错误中的一种,其中五种能在一分钟内修好。最常见的那种原因跟访问权限毫无关系:你在一个需要显式层级的网关上调用了裸写的 gpt-5.6 ID。
封面图

GPT-5.6 Terra 与 GPT-5.5 性能实测:成本减半后的跑分对比与迁移实践指南

7 月 14 日
阅读 11 分钟
387
GPT-5.6 Terra($2.50/$15)恰好是 GPT-5.5($5/$30)的一半。按 10K/100K/1M req/day 算账、诚实解读基准,还可通过 ofox 双跑对比。
封面图

Claude Code 多层 sub-agent 嵌套实践:5 层调用的 token 计算与 3 个常见踩坑总结

7 月 8 日
阅读 8 分钟
441
2026 年大半年里,“sub-agent 不能再 spawn sub-agent”一直是 Claude Code 文档里的硬规则——专门为了防止无限递归留的栏杆。6 月 10 日 v2.1.172 上线,这条规则被一行 changelog 悄悄打破:sub-agent 可以嵌套了,最深 5 层。
封面图

Gemini CLI 免费配额缩减后的 6 种有效应对方案(2026)

7 月 8 日
阅读 11 分钟
539
****`` 太长不看。 2026 年 6 月 18 日,Gemini CLI 停止为免费的『用 Google 账号登录』通道处理请求,AI Pro 和 Ultra 登录也一并停掉。这个二进制没死:它仍是 Apache-2.0,仍在维护(v0.49.0),配上 API key 照样能跑。如果你正盯着『This client is no longer supported for Gemini Code Assist for individuals』...
封面图

Cline 配置 Claude Sonnet 5 实战:思考深度调优与切换 Fable 5 的时机判断

7 月 6 日
阅读 9 分钟
515
Cline 很吃 token。每一轮它都会重发你的文件树、打开的缓冲区和正在跑的任务上下文,所以你选的模型很快就会体现在账单上。Claude Sonnet 5 就是那个能让这个循环负担得起、又不至于掉到弱模型的选择,本文大约五分钟带你配好。
封面图

Codex Desktop 无法识别自定义模型的 5 种排查与修复方法

7 月 6 日
阅读 10 分钟
802
你接好了一个自定义 provider,codex 在终端里跑得好好的,但桌面版的模型选择器却像你的模型根本不存在一样。 这种落差几乎从来不是你的 API 密钥或配置语法出了问题,而是桌面版客户端悄悄过滤掉了后端已经加载好的模型。
封面图

Claude Code 转向 Codex 实战指南:12 项关键配置与 1 个踩坑记录

7 月 3 日
阅读 10 分钟
462
从 Claude Code 迁移到 Codex,基本上就是一场重命名加重排格式的活儿,而 Codex 如今还自带一条单命令导入器,帮你完成其中大部分工作。真正的麻烦藏在它遗留下来的东西里,而其中一项根本就不是配置文件。
封面图

Claude Fable 5 与 Sonnet 5 成本差异分析:高价模型的投入回报临界点在哪

7 月 3 日
阅读 10 分钟
584
一句话总结 Fable 5 是 Anthropic 的能力天花板,Sonnet 5 是它的价值地板,而这是头一回两者能挂在同一个 endpoint 后面。Fable 5 标价 每百万 token $10/$50,正好是 Sonnet 5 引入期 $2/$10 的 5 倍(8 月 31 日后是 3.3 倍)。它靠数字撑起这个溢价:SWE-bench Pro 80.3% 对 Sonnet 5 的 63.2%,Every 的 Senior Eng...
封面图

按任务场景选择AI大模型才是正解:实用选型策略与免费工具推荐

7 月 2 日
阅读 2 分钟
547
这几乎是本能:既然 Opus 比 Haiku 强,那当然用 Opus。但这个逻辑在真实项目里经常是反的。更大的模型意味着更贵、更慢,而且最反直觉的一点是,它面对简单任务时会过度思考,把”帮我把这段话改通顺”这种活,做成一份带三个备选方案的小作文。

Claude Code token 消耗过快的原因分析与 7 个实用省量技巧

6 月 30 日
阅读 9 分钟
606
你早上 9 点打开 Claude Code,丢给它一个重构任务,到中午它就告诉你用量已经超限了。而你用的是付费套餐。这是眼下 Claude Code issue 区里最常见的抱怨之一,而原因几乎从来不是计费 bug,而是配额本身的结构,再加上几个默认行为在悄悄烧。

GLM 5.2 本地部署实践:2-bit 量化适配 256GB Mac 或单卡 4090 主机方案

6 月 30 日
阅读 7 分钟
977
智谱把 GLM 5.2 权重以 MIT 许可放上了 HuggingFace,于是问题不再是「能不能下到一个前沿级 coding 模型」,而变成了「它能不能在我手头这台机器上跑起来」。对一台 Mac Studio,或一台单 GPU 加大内存的台式机来说,答案是「有条件的能」。条件就是量化档。
封面图

Codex「command failed; retry without sandbox」:6 个修复方案(2026)

6 月 30 日
阅读 9 分钟
542
这篇讲的是运行时的执行和沙箱/审批错误:command failed; retry without sandbox 提示,以及「每条命令都要审批」的死循环。如果你的问题是装完就 codex: command not found,那是 PATH 问题,不是沙箱问题,看 codex: command not found?npm install 的 7 个修复。这篇碰到的全部 config.toml 键,参考 Codex CLI con...
封面图

Claude Code safe-mode 使用指南:一键禁用五层安全防线,快速上手实操

6 月 26 日
阅读 8 分钟
481
升级到 Claude Code v2.1.169,第一感觉是老反射 /clear 不灵了。CLAUDE.md 过时、某个插件遮住了内置命令、MCP server 不响应、hook 在背后悄悄改 diff——这些场景下 /clear 只清会话,问题还在 config 里坐着。--safe-mode 就是为这种情况准备的 kill switch。

Claude Code 遭遇 429 速率限制的常见原因与六种实用解决方案

6 月 26 日
阅读 9 分钟
562
如果 Claude Code 说「Rate limit reached」,是 API 在告诉你:你花光了每分钟的 token 或请求预算,不是 Anthropic 宕机了。修法就是读一个头、然后给对的那个维度减速。

Slack 集成 Claude Tag 实操指南:四步配置 ambient 模式及 2026 年 8 月迁移时间节点

6 月 26 日
阅读 7 分钟
525
Anthropic 在 2026 年 6 月 23 日上线了 Claude Tag:一个住在你 Slack 频道里、跑在 Opus 4.8 上的共享 @Claude 队友,它会在话题里持续干活,而你可以去忙别的。它取代了更早的 “Claude in Slack” 应用,旧应用将于 2026 年 8 月 3 日退役。如果你的团队用的是 Claude Enterprise 或 Team,你有 30 天的时间来完成迁移。
封面图

Codex 周限额用完后的应对策略:限额机制解析与7种替代API方案

6 月 23 日
阅读 10 分钟
1.1k
$20 Plus 套餐的 Codex 周限额,被一次长重构就可以在三小时内打空;OpenAI 唯一一次团队级重置发生在 2026 年 6 月 11 日。
封面图

在 AI API 聚合平台配置 DeepSeek V3.2 提示词缓存:10 分钟接入,费用直降 80%

6 月 23 日
阅读 9 分钟
702
每个 DeepSeek 缓存命中请求和未命中请求之间,横着一道 4.8 倍的价差——而在典型的 agent 循环里,命中还是未命中的差别,就在于你有没有把时间戳塞到提示词末尾。
封面图

GLM 5.2 使用教程:API 接入配置、价格说明及 MIT 开源权重发布计划

6 月 18 日
阅读 12 分钟
2.6k
智谱一次宣布里塞下了三件事:1M token 上下文窗口、MIT 许可的开源权重、$10/月起价 —— 而且模型本身是前沿级 coding 模型。Z.ai Coding Plan API 和 MIT 权重都在 2026 年 6 月 22 日那周开放。如果你一直在等一个真能 fork 的开源权重 Claude Code 替代品,接下来这七天就是读完本文、敲定档位、预先 stage 客户端配...

GLM 5.2 快速接入教程:API 调用与 MIT 开源权重部署,百万上下文实测配置详解

6 月 17 日
阅读 6 分钟
3.8k
智谱的 GLM 5.2 已经正式开放:Z.ai 的 Coding Plan API、Hugging Face 上的 MIT 开源权重、以及 20 多个第三方 coding 工具的支持,全部同步上线,不再是"下周见"。更关键的是这次发布带了真实跑分——不是 PPT 上的宣传,是能复现的 benchmark。
封面图

Codex AGENTS.md 在 symlink 工作区无法加载的问题已在 v0.138 版本中修复

6 月 15 日
阅读 11 分钟
776
如果你在一个 symlink 工作区里跑 Codex CLI,模型却装作 AGENTS.md 不存在——你不是疯了,你还在 v0.137 或更早。2026-06-08 发布的 v0.138.0 修的就是这个,背后两个 PR 悄悄重写了 Codex 解析指令路径的方式。
封面图

Claude与GPT-5.5提示缓存省钱实战:2026成本测算及三个常见陷阱解析

6 月 14 日
阅读 9 分钟
715
cached-input 折扣大战已经收官。 2026 年 Anthropic 和 OpenAI 最新一代旗舰模型都把 cached 读取价砍到标准输入价的 10%——一个 9 折,最初是 Anthropic 的招牌,在 GPT-5.4 上线时被悄悄追平。真正值得问的问题不再是”谁的折扣更大”,而是哪家的 cache 机制能扛住你真实的 prompt 形态,以及哪三个错误正在无声地把你...
封面图

npm全局安装后提示codex command not found的7种解决方法

6 月 13 日
阅读 14 分钟
579
最常见的就是 Fix 1——PATH 里没有 npm 全局 bin 目录。其余 6 个 fix 处理长尾。每一个都在 Codex CLI 0.137.0(2026-06-04 发布)上验过,环境包括 macOS 14、Ubuntu 24.04、Windows 11 + WSL2。

Claude Code /cd 切换目录时保留提示缓存的正确姿势:v2.1.169 实测与三个踩坑记录

6 月 12 日
阅读 7 分钟
596
2026 年呼声最高的 Claude Code 功能,悄悄在 v2.1.169 上线了,多数人还不知道它切目录时能把提示缓存保住,不是清掉重来。
封面图

Claude Fable 5、Opus 4.8 与 GPT-5.5 在 SWE-Bench 上的表现、定价及切换时机分析

6 月 11 日
阅读 5 分钟
1.2k
TL;DR —— Anthropic 在 2026 年 6 月 9 日发布 Claude Fable 5,这是他们第一个面向公众的 Mythos 级模型。它在 SWE-bench Verified 拿 95.0%、SWE-bench Pro 80.3%——比 Opus 4.8 高 11 分、比 GPT-5.5 高 21.7 分。价格是 $10/$50 / 百万 token,正好是 Opus 4.8 的两倍。GPT-5.5 仍然守住 Terminal-Bench 2.1(82.7% v...
封面图