
Claude 用 11 天形式化费马大定理:再用 Fable 5.1 实测一道小题
Claude 将费马大定理的已有证明写成了 Lean 可检查的代码。这项研究验证了什么?如何用一道小定理测试模型,并识别偷换命题与未完成证明?
阅读
Claude 将费马大定理的已有证明写成了 Lean 可检查的代码。这项研究验证了什么?如何用一道小定理测试模型,并识别偷换命题与未完成证明?
阅读
SandBase 用跨两个仓库升级账单客户端的示例,说明 Fable 5.1 长任务如何验收:兼容测试、工具超时后的检查、重试上限和实际完成一项任务的费用。
阅读
SandBase 对比 Fable 5.1 与 Mythos 5.1 的资格、API 价格、回退和数据留存:为什么有 Fable 账户,不等于能调用 Mythos 做科研。
阅读
拆解 Fable 5.1 与 Mythos 5.1 的三项科研案例:金星地形重建、蛋白质候选实验验证、GPU Kernel 加速,分别核对输入、结果、样本与适用限制。
阅读
Cursor 还能用 OpenAI 吗?核对 GPT-6 Astra 支持范围,排查 API Key 在外部能用、在 Cursor 却失败的问题,并比较 BYOK 限制与替代模型。
阅读
Claude Fable 5.1 已于 9 月 1 日发布。本文更新当前状态,并保留 8 月 EAP 代号、知识截止测试与网页灰度传闻的核查记录,说明哪些线索不能证明型号。
阅读
梳理 2026 年 AI Agent 技术栈:模型、API 网关、工具协议、Skills、编排与 Runtime,并说明每一层应该负责什么。
阅读
Anthropic 将 Computer Use、Browser Use、Skills API 和 Files API 推向 GA。本文解释它们如何组合,以及生产风险仍在哪里。
阅读
Claude Tag 让团队在 Slack 频道里 @Claude 委派任务。多人协作、持久记忆、主动跟进、异步执行。Team 和 Enterprise 可用。
阅读
手把手教你在 Agent 循环中实现 Anthropic prompt caching。包含完整 Python 代码、成本计算和高级缓存模式,帮助你将 Claude API 账单砍掉 60%。
阅读