跳到主要内容

9 篇博文 含有标签「Release」

Posts tagged with Release

查看所有标签

Claude Fable 5.1 与 Mythos 5.1:一个你能用,另一个你用不了的前沿模型

· 阅读需 12 分钟
Claude Dev
Claude Dev

Anthropic 于 2026 年 9 月 1 日发布 Claude Fable 5.1Claude Mythos 5.1。两者使用同一个底层模型,但 safeguards 不同:Fable 5.1 面向所有用户开放,Mythos 5.1 则仅通过 Anthropic 的受信访问计划提供给经过审核的组织。

这次发布有两个看点。第一,Anthropic 声称 Fable 5.1 在长期 coding、research、文档、表格、幻灯片、视觉和 computer use 工作流上有明显提升。第二,Anthropic 通过降低 cache read 价格、改进安全路由、推出由客户控制的企业监控架构,试图让 Fable 级模型更适合生产环境。

早期社区反馈对困难、混乱的工作很兴奋,但对速度、使用额度、文风、safeguards、数据保留,以及单位价格下降是否真的会带来更低账单更加谨慎。最合理的判断是:Fable 5.1 更像专业工作引擎,而不是一个应该对每个 prompt 盲目开启的模型。

Gemini 3.8 Flash vs Claude:AI Agent 的新一轮成本与能力竞争

· 阅读需 12 分钟
Claude Dev
Claude Dev

Google 于 2026 年 9 月 2 日发布 Gemini 3.8 Flash,称其为目前最智能的 Flash 模型,并宣布可用于生产环境。Google 同时发布了面向网络安全防御者、需要受信访问的 Gemini 3.8 Flash Cyber

Gemini 3.8 Flash 并不靠“最大模型”取胜,而是把 1M token 上下文、多模态输入、Google grounding、可配置 thinking、快速服务和极低价格组合在一起:2026 年 12 月 31 日之前,API introductory price 为每百万输入 token 0.75 美元、每百万输出 token 3.75 美元

这让它与 Claude 的比较非常直接。长期任务定位最接近的是 Claude Fable 5.1,但它的价格是 10/50 美元;Claude Opus 5 是 5/25 美元;Anthropic 当前模型总览中,Claude Sonnet 5 是 2/10 美元。Gemini 3.8 Flash 的 token 单价明显更低,但比较不能只看价格:Google 明确说明,面对困难任务时,它可能使用更多 reasoning token 和更多 tool call。

早期社区反馈令人鼓舞,但还不能视为定论。用户称 3.8 Flash 比 3.7 更少“偷懒”、更完整;也有人反馈它更慢、更吃 quota,且不同账号和产品的 rollout 不一致。真正的问题不是“Gemini 是否比 Claude 更聪明”,而是:哪个模型能以更低的美元、时间和人工复核成本,交付更好的完整结果?

Claude Opus 5:Claude Code 团队一直想要的日常前沿模型

· 阅读需 11 分钟
Claude Dev
Claude Dev

Anthropic 在 2026 年 7 月 24 日发布了 Claude Opus 5,把它定位为 Claude 5 系列里的日常前沿模型:接近 Claude Fable 5 的前沿智能,但价格仍与 Opus 4.8 相同,即 每百万输入 token 5 美元、每百万输出 token 25 美元

这个价格点才是重点。

Fable 5 仍然适合最难、最长、最自主的任务。Sonnet 5 是多数团队能大规模使用的默认 agent 模型。Opus 5 位于两者之间:足够胜任严肃工程任务,比 Fable 在日常工作中限制更少,并且价格适合反复使用,而不是只在极少数场景中升级调用。

早期社区反馈偏正面,但还没有稳定共识。X 上的反应更兴奋,重点在 medium effort 质量和 token 效率;Reddit 与 Hacker News 更谨慎,关注 usage limit、模型更迭、安全 fallback,以及另一个 Opus 版本是否真的会在复杂编码会话中体感更好。这种怀疑是合理的。

Claude Sonnet 5:Claude Code 的新默认 Agent 模型

· 阅读需 10 分钟
Claude Dev
Claude Dev

Anthropic 在 2026-06-30 发布了 Claude Sonnet 5,将其定位为目前最 agentic 的 Sonnet 模型,并把它设为 Claude Free 和 Pro 用户的新默认模型。

官方叙事很清楚:Sonnet 5 把最近只有 Opus-class 模型才能可靠完成的许多 agentic work,带到了更便宜、更快、覆盖更广的模型层级。它可以做计划、使用浏览器和终端、处理长时间 coding task,并默认启用 adaptive thinking。

对 Claude Code 用户来说,Sonnet 5 不只是普通模型刷新。它很可能成为许多团队的默认执行层:不是 Anthropic 最强的模型,但会是开发者最常调用的模型。

但升级并非无摩擦。Sonnet 5 有新的 tokenizer,thinking 和 sampling 参数的 API 行为发生变化,默认启用实时 cyber safeguards,而且它虽然比 Opus 便宜,并不代表每个任务一定更便宜。

Claude Fable 5:强大、昂贵,而且被设计为受限

· 阅读需 9 分钟
Claude Dev
Claude Dev

Anthropic 在 2026-06-09 发布了 Claude Fable 5,把带有 safeguards 的 Mythos-class 能力带给付费 Claude 用户和开发者。

重点不只是 Fable 5 更强,而是 Anthropic 正在尝试一种新的发布方式:把它迄今公开可用的最强模型家族交给公众,但当请求触及 cybersecurity、biology、chemistry、distillation,或某些 frontier AI development 路径时,把敏感工作从该模型路由走。

这让 Fable 5 成为一次对开发者格外重要的 Claude 发布。早期反馈分成两面:一面惊叹于模型的长周期能力,另一面则对 access、safety routing、成本和企业数据处理方式感到不满。

对 Claude Code 团队来说,实用问题不是“要不要全部切到 Fable”,而是:哪些任务值得为 Fable 5 付费,哪些任务会被它的 safeguards 破坏或扭曲?

Claude Opus 4.8:更新了什么、用户怎么反馈、Claude Code 团队该怎么用

· 阅读需 9 分钟
Claude Dev
Claude Dev

Anthropic 在 2026-05-28 发布了 Claude Opus 4.8。表面看,这是一次“同价格、更强 Opus”的版本升级。

但更实用的判断要窄一点:Opus 4.8 不是“所有场景都更好”的发布。它最强的信号集中在长周期 agentic coding、工具调用、对自身工作缺陷的诚实反馈,以及 Claude Code 周边的新工作流控制。它的弱信号也很重要:早期用户仍然反馈,小型 one-shot 任务有时不如 4.7,部分场景会过度思考,原来围绕 Opus 4.7 调好的 prompt 可能需要重新调。

对 Claude Code 团队来说,升级问题不应该是“4.8 是不是更聪明”,而应该是:哪些工作流现在值得用 Opus,哪些仍然应该留给更便宜或更稳定的模型?

Claude Code 的“Remote Control”是什么?

· 阅读需 4 分钟
Claude Dev
Claude Dev

我不是那种硬核开发者。更像是:“我想让 AI 帮我做事,但别让我先啃 20 页文档。”
所以当我看到 Claude Code 刚发布了一个叫 Remote Control 的新功能时,我就很好奇。然后我又发现 AI 社区里很多人也在热议一个叫 OpenClaw 的东西。

这篇文章会用新手友好的方式拆解:到底发生了什么、真正重要的点是什么,以及你应该关注哪一个。

Claude Sonnet 4.5:为开发者打造的最先进AI模型

· 阅读需 6 分钟
Claude Dev
Claude Dev

Anthropic 刚刚宣布发布 Claude Sonnet 4.5,这标志着 AI 开发领域的一个重要里程碑。这个最新版本代表了 Anthropic 所说的"世界上最好的编程模型",在推理、数学、计算机使用和安全对齐方面都有显著改进。对于使用 Claude Code 的开发者来说,这次发布带来了前所未有的能力,将改变我们处理复杂编程任务的方式。

Claude Sonnet 4.5 的特别之处?

Claude Sonnet 4.5 不仅仅是一个增量更新——它是 AI 模型能力的根本性飞跃,特别是为开发者设计的。