跳到内容
主题

AI新手入门指南:从零开始学AI工具

AI新手?从这里开始。面向初学者的AI概念、工具选择和实践入门指南。

146 篇文章

排序文章以找到您需要的内容

新手入门 分类下的文章

向量 DB / RAG 实现指南——从 naive RAG 到生产环境

向量 DB / RAG 实现指南——从 naive RAG 到生产环境

你已经懂了“什么是 RAG”,可一旦动手搭建,答案却偏了——因为它依然是 naive RAG:随意切碎再做普通向量检索。作为第 030 篇文章的实现篇续篇,本文逐阶段讲解 2026 年的实用 RAG 流水线(聪明的 chunking、embedding、向量 DB、混合检索、reranking):chunking 策略(recursive 512 默认,semantic/structural/parent-child,Contextual Retrieval 据报告把检索失败最多减少 67%)、选择 embedding 模型(text-embedding-3-large 等)、六款向量 DB 对比(原型用 Chroma、有 Postgres 用 pgvector、低延迟的 Qdrant、全托管的 Pinecone、混合冠军 Weaviate、超大规模的 Milvus)、用 RRF 融合 BM25 + 稠密向量的混合检索、先 bi-encoder 后 cross-encoder 的 retrieve-then-rerank(Cohere/Voyage/BGE/Jina)、LlamaIndex(检索)vs LangChain/LangGraph(控制)的分工、为何 1M-token 窗口不会取代 RAG(lost in the middle、干扰),以及先建立 eval 集等生产化注意事项。

如何构建 AI 智能体——新手指南(无代码与代码)

如何构建 AI 智能体——新手指南(无代码与代码)

你已经知道“什么是 AI 智能体”——那么如何自己构建一个?在 2026 年,无代码工具靠拖拽就能在一个下午做出可运行的智能体,现代 SDK 也能用不到 100 行搭出实用的东西。作为“什么是 AI 智能体”的实践篇,本文涵盖内部构成(大脑 LLM + 指令 + 工具 + 记忆 + 自主循环)、两条路径(无代码 vs 代码)、通用的 5 步构建框架(界定问题、选择基座、编写指令、连接工具、小范围测试)、无代码工具对比(Dify 为完整平台、n8n 用于业务集成、Flowise 用于原型,以及最简单的 Custom GPT/Gemini Gems/Claude Projects)、代码框架对比(稳妥的 Claude Agent SDK/OpenAI Agents SDK、复杂控制的 LangGraph、角色协同的 CrewAI)、一个具体的实战示例(总结客服邮件再通知 Slack)、成本(平台约 $10-$50/月外加模型使用费)与周期参考,以及陷阱(不要把范围铺得太大、权限与失控控制、警惕只停留在 PoC)。对大多数人来说,先用无代码做一个才是正确之举。

ChatGPT vs Claude vs Gemini——按用途该如何选择

ChatGPT vs Claude vs Gemini——按用途该如何选择

“ChatGPT、Claude 还是 Gemini——我该订阅哪个?”在 2026 年,三者都在每月 $20 左右、都是一流水准,所以没有“就是它最强”的单一答案。正确的问题是“对你的用途来说哪个最合适”。基于跨来源的共识,本文涵盖基础信息(提供方、主力模型系列、免费/标准/高级价格)、性格差异(Claude=写作/分析/代码的匠人,ChatGPT=带生态与图像/语音的全能选手,Gemini=多模态、长上下文、Google 整合)、按用途的详细表格(写作、代码、通用、图像生成、语音、图像/PDF/视频理解、超长文本、Google 整合、调研、中文),如何按使用量挑选套餐,以及选不出一个时聪明的两工具组合(一个主轴+一个补短板)。领先者每隔几个月就轮换,所以与其追逐固定的“最强”,不如各用所长,并用免费档在自己的任务上实测。

Claude Code 常见错误与对策 — 完整参考手册

Claude Code 常见错误与对策 — 完整参考手册

Claude Code 突然报错停下——“重新登录”“速率限制”“prompt 太长”“MCP 连不上”,每个都去搜实在麻烦。本文把你常遇到的错误连同原因和“该敲的命令”一起整理成实用参考手册。先从最先敲的三个诊断命令开始(claude doctor 全面诊断、/status 看当前认证、/context 看上下文明细),再聚焦四大常见类别(用量/速率限制、上下文溢出、认证过期、MCP 连接失败),以症状→原因→对策命令的表格覆盖认证与登录、用量/速率限制(Claude Code 消耗的 token 是聊天的 10-100 倍)、上下文与 token(prompt 太长、压缩反复)、服务器与模型(500/529/超时/找不到模型)、安装/PATH/更新、网络与代理(ECONNREFUSED、TLS)、MCP、权限(deny 胜过 bypass)以及其他(thinking blocks 400、图片/PDF、IDE)。最后附上错误→对策速查表和 FAQ。基于 Claude Code 官方文档(截至 2026 年):卡住时先敲三个诊断命令,若没修好就跑 claude update。

如何用 AI 自动生成会议纪要与转写

如何用 AI 自动生成会议纪要与转写

还在每周花一两个小时对着录音手动整理会议纪要?2026 年这些大多可以自动化。本文把纪要拆成四个阶段(录音 → 转写 → 摘要 → 提取决定事项/待办),对比两种思路(让 AI 列席的一体化工具,与录音 → 转写 AI → LLM 的自建组合),比较主流工具(Otter、Notta、Fireflies、tl;dv、Fathom、Granola,准确率均标注为厂商宣称值),介绍 Zoom/Teams/Meet 的内置 AI,演示用 Whisper 加 ChatGPT/Claude/Gemini 的自建路线及“不要凭猜测填补空缺”的提示词示例,给出提升准确率的五个技巧(音频质量、专有名词词典、说话人分离、语言匹配、模板化提示词),并讲清隐私/同意与过度信任的注意事项。最后一道防线在于人:务必亲眼核对决定事项和待办。

Claude Code “无法检查拉取请求的状态”——原因与修复

Claude Code “无法检查拉取请求的状态”——原因与修复

你在 Claude Code 里刚完成一个功能,正要按下“Create PR”,却弹出一条红色横幅:“无法检查拉取请求的状态。此信息可能已过期。”这不是代码缺陷——只是 Claude Code 向 GitHub 请求获取最新 PR 状态时那一次失败了,通常只是无害的同步延迟。本文讲解这个错误的确切含义、Claude Code 如何查看你的 PR(通过 gh CLI 查询,并说明内部实现没有官方文档)、5 个根本原因(认证过期、还没推送/PR、网络/代理、权限范围不足、临时性)、从 gh auth status 开始的 4 步排查顺序、命令速查表(gh auth login/refresh/pr status 等)、如何判断“可能已过期”何时可忽略何时需处理、gh pr create 替代方案、防止再次发生的清单,以及 FAQ。原则:在怀疑代码之前,先怀疑与 GitHub 的连接。

Claude Code “invalid signature in thinking block” 400 错误——原因与解决方法

Claude Code “invalid signature in thinking block” 400 错误——原因与解决方法

在 Claude Code 工作时突然出现、之后无论输入什么都反复触发的错误:“API Error: 400 thinking or redacted_thinking blocks in the latest assistant message cannot be modified”。这是 Anthropic 官方仓库上有多个 issue 的已知缺陷,大多数情况并非用户用错。本文讲解错误含义、extended thinking 思考块与加密 signature 的机制、签名不匹配的五个主因(会话恢复缺陷、流式交错、修复逻辑失控、第三方代理、自建应用改动历史)、面向 Claude Code 用户的三种恢复方法(Esc×2/rewind、新会话 /clear、JSONL 修复工具)、最重要的永久性修复(更新到最新版)、面向 API/SDK 开发者的三条预防原则(原样往返、整块移除、防御性守卫)、三种相似错误的区分,以及防止再次发生的检查清单。

AEO 与 LLMO 的区别——70% 重叠、30% 独有,以及 GEO 的定位

AEO 与 LLMO 的区别——70% 重叠、30% 独有,以及 GEO 的定位

2026 年 SEO 行业有三个新词同时走红——AEO、LLMO、GEO——连 Neil Patel、Profound 与 emarketer 对其定义都意见不一。本文提出截至 2026 年 5 月最务实的排序:AEO ⊂ GEO ⊃ LLMO。我们从八个维度对比 AEO(Google AI Overview / Featured Snippet / Perplexity / ChatGPT Search)与 LLMO(ChatGPT / Claude / Gemini 的普通聊天使用):目标平台、主要场景、目的、与 SEO 的关系、独有技巧、主要指标、见效时间、受益行业。随后梳理七项共通技巧(E-E-A-T / 结构化数据 / 一手数据 / 倒金字塔 / 允许 AI bot / Q&A 格式 / llms.txt)、四项 AEO 专属(SERP 富媒体结果 / Featured Snippet 狙击 / PAA 抓取 / 搜索意图匹配)、四项 LLMO 专属(训练语料曝光 / 品牌一致性 / 第三方提及 / 提示词召回测试),按行业的优先级矩阵,以及三个陷阱(术语争论 / 轻视 SEO / 测量含糊)。

什么是 AEO(Answer Engine Optimization)——定义、与 SEO 的区别,以及让你“被引用”的七项技巧

什么是 AEO(Answer Engine Optimization)——定义、与 SEO 的区别,以及让你“被引用”的七项技巧

2025 年零点击搜索达到 69%(前一年 56%),AI Overview 现已出现在约 55% 的 Google 搜索中。在这个“第 1 名也不再保证点击”的时代,新增的必备一层就是 AEO(Answer Engine Optimization)。本文涵盖其定义(让搜索与 AI 把内容本身作为“答案”展示,或作为来源加以引用的优化)、与 SEO 的区别、四大 Answer Engine(Google AI Overview / ChatGPT Search / Perplexity / Bing Copilot)的引用逻辑、七项行之有效的技巧(倒金字塔 / Q&A 格式 / FAQ-HowTo Schema / 列表与表格 / 一手数据 / 作者信号 / AI bot 允许)、新指标(Snippet 出现 / AI bot 命中 / 品牌搜索 / CVR)以及三大陷阱(忽视 SEO / 屏蔽 AI bot / 过度使用)。AEO 不是 SEO 的替代品而是叠加其上的一层——以正确的顺序把两者同时做好。

企业 AI 使用指南怎么制定——Samsung 泄漏、EU AI Act 与可直接落地的七项模板

企业 AI 使用指南怎么制定——Samsung 泄漏、EU AI Act 与可直接落地的七项模板

2023 年 4 月,Samsung 在 20 天内三次泄露机密数据,随即在全公司禁用 ChatGPT。但到了 2026 年,“一禁了之”与“放任不管”都行不通——EU AI Act 高风险系统规则将于 2026 年 8 月 2 日全面生效,违规处罚最高 3500 万欧元或全球营收 7%。本文给出两页 A4 的七项模板(允许使用的 AI、禁止数据、使用场景、责任、上报、培训、日志)、附具体示例与替代方案的五类禁止输入数据、EU AI Act 风险等级、中型企业 2 至 3 个月可完成的五阶段落地路线图,以及三大陷阱(全公司禁用、惩罚式设计、一次写完不修订)。一份完整的实战范例——帮你跳出“禁或允”的二选一,落地“在框内安全运营”的第三条路。

AI 写作实战——ChatGPT/Claude/Gemini 分工与拿下 SEO 的混合式工作流

AI 写作实战——ChatGPT/Claude/Gemini 分工与拿下 SEO 的混合式工作流

2026 年 5 月 Google 核心更新明确降权“单薄、量产、纯 AI 文章”,而混合式写作——AI 起草、专家编辑、追加第一方数据(如 Wayfair 案例)——带动自然流量上升 24%。本文涵盖三模型分工(长文嗓音用 Claude、研究与工具用 ChatGPT、Workspace 与时效数据用 Gemini)、真正奏效的提示词(Persona + Sample + Constraints,其中粘贴样本最强)、Wayfair 风格的四步混合式工作流、暴露 AI 写作的五大常见“破绽”及根除方法、六步实战工作流,以及必须避开的三大陷阱(让 AI 定选题、放任幻觉、未根除乖学生腔)。定位已从“靠 AI 偷懒”转向“以 AI 为抬升质量的基座”。

Midjourney 使用指南——V8.1 完全攻略:套餐、五层提示词、参数与参考

Midjourney 使用指南——V8.1 完全攻略:套餐、五层提示词、参数与参考

2026 年 4 月 30 日,Midjourney V8.1 在 midjourney.com 上线——Fast 生成速度提升 4–5 倍,--hd 提供原生 2K HD,复杂提示词准确率达到 95%,“必须用 Discord”的时代正式终结。本文涵盖套餐选择(Basic 10 美元 / Standard 30 美元 / Pro 60 美元 / Mega 120 美元,新手推荐 Standard)、Fast 与 Relax 模式、五层提示词结构(主体→环境→风格→光线→技术)、七大必备参数(--ar/--stylize/--chaos/--hd/--raw/--q/--no)、四项参考功能(--sref 氛围 / --oref 主体 / Moodboards / Personalization),以及三大陷阱(文字渲染、版权归 MJ 所有、无 API)。对于“漂亮的图、步骤最少”这套需求,2026 年的答案仍是 MJ。