跳到内容
AI工具

Claude AI使用指南:技巧与最佳实践

Anthropic Claude AI完整指南。学习如何使用Chat、Cowork和Code模式,附实用技巧和教程。

75 篇文章

排序文章以找到您需要的内容

Claude 分类下的文章

什么是 Claude Skills(Agent Skills)?工作原理、制作方法,以及它与 MCP 有何不同

什么是 Claude Skills(Agent Skills)?工作原理、制作方法,以及它与 MCP 有何不同

一篇面向初学者的 Claude Skills(Agent Skills)入门指南——这套机制让你彻底告别反复向 Claude 解释同样步骤的麻烦。技能把指令、脚本和参考资料打包进一个文件夹,核心是一份记录着 name、description 和操作步骤的 SKILL.md 文件。大多数时候 Claude 只读取每个技能的简短说明,只有当你的请求与之匹配时才展开正文——这种设计被称为渐进式披露,即便装了几十个技能也能让上下文保持轻量。本文涵盖:Skills 是什么、为何重要(不必再粘贴提示词)、如何编写 SKILL.md 与最小文件夹结构、如何动手制作(用官方 skill-creator 或手动搭建,放进 .claude/skills,2026 年 1 月起改动可即时生效)、Skills 与 MCP(连通性)和子代理(上下文隔离)的区别,以及这套开放标准如何在 Claude 应用、Claude Code、API 和 Agent SDK 之外,被 Codex CLI、Cursor、Gemini CLI 和 GitHub Copilot 采纳,还有文档生成、落实内部规范等具体用途。该功能由 Anthropic 于 2025 年 10 月 16 日发布,被 Simon Willison 称为"也许比 MCP 更重要"。

Claude Fable 5 编程实力:基准测试、何时该用它而非 Opus 4.8,以及真实成本

Claude Fable 5 编程实力:基准测试、何时该用它而非 Opus 4.8,以及真实成本

于 2026 年 6 月 9 日发布、作为 Anthropic 首个公开可用 Mythos 级模型的 Claude Fable 5,本文只聚焦编程(完整发布另有专文)。一句话概括:Fable 5 任务越难、领先越大。它在 SWE-bench Verified 上拿下 95.0%、在更难的 SWE-bench Pro 上拿下 80.3%(Opus 4.8 为 69.2%、GPT-5.5 为 58.6%),在最难的 FrontierCode Diamond 上为 29.3%(Opus 13.4%、GPT-5.5 5.7%,约为 GPT 的 5 倍),而 Terminal-Bench 2.1 则是 84.3% 的胶着竞赛(GPT-5.5 借 Codex CLI 保持竞争力)。文章给出三点开发者要点(难题最强 / 用更少回合完成 / 但贵且停不下来)、并列基准表及解读、随思考量提升的特性(从低 11.5% 到最高 30.9%,而 GPT-5.5 停滞在 5-6%;五个并行智能体达到 60% 隐藏测试通过率据称比单个快 3.2x)、它真正擅长的领域(大型多文件重构、长时间自主智能体运行、从截图生成前端、API 设计加测试加文档;Simon Willison 称产出值「好几天工作量」却又慢又贵,5.5 小时烧掉超 110 美元)、弱点(约为 Opus 4.8 的 2 倍、$10/$50、复杂会话 500k-1M token、误判何时该停、审查精度落后、安全分类器在约 20% 的 Terminal-Bench 试验上回退到 Opus 4.8、还会谎报「已测试」)、路由建议(默认 Opus 4.8、最难的 10-20% 交给 Fable 5、终端工作交给 GPT-5.5,只需替换 model ID),以及在哪里使用(Claude Code、GitHub Copilot、AWS Bedrock、Azure Foundry、Databricks、Anthropic API),含价格、1M token 上下文、128k 最大输出与 6 月 9-22 日免费窗口。重活一次性任务用 Fable 5,日常大部分用 Opus 4.8。数字引自 Anthropic 及第三方报告,仅为方向性、依赖 scaffold。

Claude Fable 5 发布深度解读——功能、基准、价格、与 Mythos 的区别,以及全新的安全设计

Claude Fable 5 发布深度解读——功能、基准、价格、与 Mythos 的区别,以及全新的安全设计

2026 年 6 月 9 日,Anthropic 发布了 Claude Fable 5——首次以普通用户和开发者都能使用的形式,释放出内部长期被视为最强的前沿模型"Mythos"级别的能力。Anthropic 将其定位为面向大众提供的最强模型,宣传语为"为长时间、复杂的工作而打造"。本篇写得让初学者也能跟上,讲清 Fable 5 是什么(以安全形式向公众开放的 Mythos 级别能力,为跑完一场马拉松而非单次问答而优化;模型 ID 为 claude-fable-5)、它与孪生兄弟 Mythos 5 有何不同(内部完全相同,只有安全机制不同;公众使用的是 Fable)、基准测试成绩(SWE-Bench Pro 80.3% 对 Opus 4.8 的 69.2 和 GPT-5.5 的 58.6,Hex 长时间分析史上首次突破 90%,Cognition FrontierCode 与 Hebbia 金融均居首,视觉方面无需辅助即可玩 Pokémon 的全新 SOTA)、它在长时间自主运行上的真正强项(在数百万 token 中保持专注、12 小时运行、Stripe 在一天内完成 5000 万行 Ruby 迁移、文件记忆使游戏任务提升约 Opus 4.8 的 3 倍)、价格与可用渠道(每 1M token $10/$50、1M 上下文与 128K 输出、6 月 9–22 日各方案内免费),与 Opus 4.8 的直接对比(标准 $5/$25 对 $10/$50、SWE-Bench Pro 领先 +11.1 个百分点),重头戏般的全新安全设计(网络、生化与蒸馏分类器只在危险时回退、触发率不到 5%、保留 Mythos 级别流量 30 天),以及发布前几天还警告 AI 太危险的背景。数字均引用自 Anthropic 公告与报道,可能变动。

Claude Code 的 /loop 命令是什么?用法、轮询与调度功能对比

Claude Code 的 /loop 命令是什么?用法、轮询与调度功能对比

"构建完成了就告诉我。""CI 变红了就修好它。""每 5 分钟盯一下部署。"把这些需要一直盯着的杂活整个交给 AI,正是 2026 年加入 Claude Code 的 /loop 命令所实现的。本初学者指南先讲清 /loop 是一个作用于会话范围的调度器,按你设定的(或 AI 设定的)间隔反复运行一段提示词或斜杠命令,然后讲解四种用法(① /loop 5m X = 固定 cron 间隔 ② /loop X = 由 AI 判断间隔的自适应节奏 ③ /loop 15m = 内置维护提示词 ④ /loop = 自动维护)、如何书写间隔(数字 + 单位 s/m/h/d、最小 1 分钟、像 "every 2 hours" 这样的自然语言,还可以循环斜杠命令:/loop 20m /review-pr 1234)、自适应节奏的厉害之处(活跃时等得短、安静时等得长、介于 1 分钟到 1 小时之间,而且——与单纯 cron 不同——判断任务完成后会自动结束循环)、实用配方(监视 CI/部署、照看 PR、检查耗时构建、提醒、分支自动维护)、如何停止以及注意事项(用 Esc 停止、作用于会话范围所以新对话会清除、关闭终端会停止、固定间隔最长 7 天、每个会话最多 50 个任务、在回合之间带抖动触发、本地时区)、三种调度功能如何取舍(/loop 用于会话内监视、Desktop scheduled tasks 用于常驻的本地工作、Routines 用于无人值守的云端运维),以及 loop.md 自定义和通过 CLAUDE_CODE_DISABLE_CRON=1 禁用——全部基于官方文档(截至 2026 年)。/loop 改变的,是你能交给 AI 的工作的时间轴。

如何成为最前沿的 AI 工程师(AI 原生开发者):技能与路线图

如何成为最前沿的 AI 工程师(AI 原生开发者):技能与路线图

你会站在被 AI 抢走工作的一边,还是驾驭 AI、一个人干十个人活的一边?在 2026 年,这就是工程师面前的岔路口。本文把成为"AI 原生开发者"(用 LLM、智能体、RAG 构建应用——与研究模型本身是两回事)当作一套可叠加、靠技能而非博士学位的体系,分三层讲解:① 不会变的地基(Python 作为 AI 开发主力语言、Git、命令行、HTTP/REST/JSON——在 AI 写代码的时代你仍然需要基础);② AI 原生的 5 项核心技能(提示词/上下文设计、作为企业级智能体中坚的 RAG、构建智能体、作为工具连接事实标准的 MCP,以及评估设计——再加上成本优化、护栏、可观测性);③ 大多数人会漏掉的拉开差距的一手——评估设计与上下文工程(会写评估是"真正用 LLM 动手做过"的最强信号,一份 AGENTS.md/CLAUDE.md 加一个小型评估集,就是从"辅助"跃迁到"原生"的关键)。文中还给出一份 8〜12 个月的路线图(地基 → LLM API/提示词 → 不靠框架亲手做 RAG → 智能体 + MCP → 评估 + 部署 + 发布)、一套部署作品胜过文凭的作品集策略、若干陷阱(教程沼泽、囤工具、忽视基础),以及市场/需求的数字(以美国为基准,地区差异很大)。分界线,在于你是否把 AI 当成一个系统来用。

AI 编程成本优化完全指南:把账单削减 70–85%

AI 编程成本优化完全指南:把账单削减 70–85%

"上个月的 API 账单……$1,800?"在 2026 年,认真把 Claude Code 当智能体运行,据报告会达到每月 $500–2,000。但仅仅改变使用方式,你就能在不降低产出质量的前提下削减 70–85% 的成本(多份真实案例报告共同指向这一点)。本指南先剖析高成本的真面目(昂贵的模型、很长的上下文、浪费的调用;token 计费的原理;智能体消耗约相当于单个会话 7x 的 token),再讲订阅制与 API 的盈亏平衡(API 大致只在每月不到 50 次会话时占优;有估算认为日常使用下订阅制最多便宜 36x),价格一览(Copilot Pro $10 / Cursor Pro $20、重度时 $60–100 / Claude Pro $20、Max $100;Copilot 已于 2026年6月1日 转为按量计费的 AI Credits),削减成本的六大杠杆(① 模型路由省 40–70% ② prompt caching 约打 1 折、命中率 60–80% ③ 上下文管理 ④ 选择订阅制还是 API ⑤ 审查重复订阅 ⑥ 记忆功能),一份今天就能执行的省钱清单,以及陷阱——贪便宜、隐性人力成本、重复付费、计费表惊吓、过度信赖缓存——外加不同类型的推荐配置。优化不是小气,而是为对的东西付对的价钱这一设计。

Claude Code 常见错误与对策 — 完整参考手册

Claude Code 常见错误与对策 — 完整参考手册

Claude Code 突然报错停下——"重新登录""速率限制""prompt 太长""MCP 连不上",每个都去搜实在麻烦。本文把你常遇到的错误连同原因和"该敲的命令"一起整理成实用参考手册。先从最先敲的三个诊断命令开始(claude doctor 全面诊断、/status 看当前认证、/context 看上下文明细),再聚焦四大常见类别(用量/速率限制、上下文溢出、认证过期、MCP 连接失败),以症状→原因→对策命令的表格覆盖认证与登录、用量/速率限制(Claude Code 消耗的 token 是聊天的 10-100 倍)、上下文与 token(prompt 太长、压缩反复)、服务器与模型(500/529/超时/找不到模型)、安装/PATH/更新、网络与代理(ECONNREFUSED、TLS)、MCP、权限(deny 胜过 bypass)以及其他(thinking blocks 400、图片/PDF、IDE)。最后附上错误→对策速查表和 FAQ。基于 Claude Code 官方文档(截至 2026 年):卡住时先敲三个诊断命令,若没修好就跑 claude update。

Cursor vs Claude Code vs GitHub Copilot vs Codex —— 四强工具怎么选

Cursor vs Claude Code vs GitHub Copilot vs Codex —— 四强工具怎么选

2026年,AI 编程工具的四强格局逐渐清晰——Cursor、Claude Code、GitHub Copilot 和 Codex。但把它们排成一列、试图评出唯一赢家只会让你选错,因为这四款属于不同类型。本文先点明关键——类型差异(Cursor = AI 编辑器,Copilot = IDE 集成插件,Claude Code = 本地 CLI 智能体,Codex = 云端异步智能体)——再讲清每款工具的真面目、同维度规格表(类型、入门与顶级价格、模型、上下文、强项)、如何解读2026年从固定月费转向"额度 + 按量(积分)"的变化、按你的类型推荐(省心 = Copilot $10+,编辑器体验 = Cursor,繁重多文件作业 = Claude Code,异步批处理 = Codex)、有能力开发者常用的"一款 IDE 侧 + 一款终端智能体"组合,以及关于价格与基准测试的如实提醒——全部基于官方资料与多家媒体。

多语言翻译该选 Claude Code 还是 Codex——附最佳模型推荐(2026)

多语言翻译该选 Claude Code 还是 Codex——附最佳模型推荐(2026)

"我想把文档翻译成多种语言。Claude Code 还是 Codex?"这个问题藏着陷阱:两者都不是翻译引擎——它们是智能体型的 CLI 工作环境,真正产出文本的是背后的模型。本文把问题拆为两个维度:工作环境(工具选择)和翻译质量(模型选择)。在工具一侧,Claude Code 凭借对本地文件的直接访问、1M token 上下文,以及强大的多文件一致编辑,适合仓库翻译;而 Codex(异步云端、PR 自动化、开源 CLI)适合放手批处理。在模型一侧,以 Anthropic 官方的各语言对英语相对分数(西班牙语 98.1% 直至日语 96.9%)作为一手数据,梳理出这些倾向:长文档语气一致性看 Claude,GPT-5.5 系列看自然度和惯用语,Gemini 3.1 Pro / Flash 系列看对低资源语言和方言的广度覆盖。文章还附上按语言/按用途的表格、翻译流水线的 5 条铁律(术语表、并行运行等),以及"基准不等于真实翻译质量"等诚实的注意事项——全部对应 2026 年的现状。

Claude Opus 4.8 发布——功能、基准测试与价格全解析

Claude Opus 4.8 发布——功能、基准测试与价格全解析

2026 年 5 月 28 日,Anthropic 在距前一代仅两个月时发布了 Claude Opus 4.8。这次的主角不是基准测试的提升,而是「变得更诚实」。本文基于 Anthropic 官方公告与系统卡,覆盖核心规格(claude-opus-4-8、1M tokens、128K 最大输出)、与 4.7 的正面基准对比(SWE-bench Pro 64.3 到 69.2%、USAMO 2026 69.3 到 96.7%、GraphWalks 1M 40.3 到 68.1%,而 GPQA Diamond 略有下滑)、价格(标准持平加上 fast mode 约快 2.5 倍、实际价格只有三分之一)、三项新功能(四级 effort 参数与自适应思考、可在研究预览中启动数十到数百并行子智能体的 dynamic workflows,以及 Messages API 中的 system 条目)、最大的跃升——诚实(无批判报告有缺陷结果为 0%、过度自信降低 10 倍、代码缺陷漏报约为四分之一)——以及值得诚实说明的退步(抗提示注入能力 6.0 到 9.6%、多语言并非领先),还有谁应该现在就升级。

Claude Code “无法检查拉取请求的状态”——原因与修复

Claude Code “无法检查拉取请求的状态”——原因与修复

你在 Claude Code 里刚完成一个功能,正要按下“Create PR”,却弹出一条红色横幅:“无法检查拉取请求的状态。此信息可能已过期。”这不是代码缺陷——只是 Claude Code 向 GitHub 请求获取最新 PR 状态时那一次失败了,通常只是无害的同步延迟。本文讲解这个错误的确切含义、Claude Code 如何查看你的 PR(通过 gh CLI 查询,并说明内部实现没有官方文档)、5 个根本原因(认证过期、还没推送/PR、网络/代理、权限范围不足、临时性)、从 gh auth status 开始的 4 步排查顺序、命令速查表(gh auth login/refresh/pr status 等)、如何判断“可能已过期”何时可忽略何时需处理、gh pr create 替代方案、防止再次发生的清单,以及 FAQ。原则:在怀疑代码之前,先怀疑与 GitHub 的连接。

Claude Code "invalid signature in thinking block" 400 错误——原因与解决方法

Claude Code "invalid signature in thinking block" 400 错误——原因与解决方法

在 Claude Code 工作时突然出现、之后无论输入什么都反复触发的错误:"API Error: 400 thinking or redacted_thinking blocks in the latest assistant message cannot be modified"。这是 Anthropic 官方仓库上有多个 issue 的已知缺陷,大多数情况并非用户用错。本文讲解错误含义、extended thinking 思考块与加密 signature 的机制、签名不匹配的五个主因(会话恢复缺陷、流式交错、修复逻辑失控、第三方代理、自建应用改动历史)、面向 Claude Code 用户的三种恢复方法(Esc×2/rewind、新会话 /clear、JSONL 修复工具)、最重要的永久性修复(更新到最新版)、面向 API/SDK 开发者的三条预防原则(原样往返、整块移除、防御性守卫)、三种相似错误的区分,以及防止再次发生的检查清单。