コンテンツにスキップ
トピック

AI初心者ガイド|ゼロから始めるAI入門

AIツールを初めて使う方向けの入門ガイド。基本概念、使い方、選び方をわかりやすく解説。

142 件の記事

並び替えで記事を探せます

初心者・入門 の記事一覧

ローカルLLMに必要なPCスペックは?VRAM・GPU・メモリ早見ガイド[2026]

ローカルLLMに必要なPCスペックは?VRAM・GPU・メモリ早見ガイド[2026]

ローカルLLMを動かすのに必要なPCスペックを、初心者向けに整理する記事。本記事は、必要スペックの9割はVRAM(GPUのメモリ)で決まること(モデルがVRAMに乗れば快適・乗らなければ激遅か動かない/AppleのM系Macは統合メモリで搭載RAMをVRAMとして使える)、量子化の基礎(FP16=1パラメータ約2バイト/Q8=約1バイト=半分/Q4=約0.5〜0.7バイト=約1/4で個人の定番、ざっくり計算式=パラメータ数B×バイト数+KVキャッシュで+10〜20%)、モデルサイズ別の必要VRAM早見表(Q4前提で7B〜8B≒6〜8GB/13〜14B≒8〜12GB/32B≒20〜24GB/70B≒40〜48GB+/100B超は128GB+)、文脈長とKVキャッシュの落とし穴(7Bで4k≒+0.3GB・32k≒+2.5GB・128k≒+10GBと長文ほど増える)、GPU・Mac別の現実と速度目安(RTX 3060=入門/4090=32B級・7Bで100tok/s超/5090=32B Q8や70B/Apple M4・M5 Max 64GBで70B可・約20〜30tok/s/CPUのみは遅い)、VRAM以外(システムRAM16〜32GB・SSD・電源冷却)、予算別おすすめ3ティア(入門8〜12GB/標準24GB/本格40〜64GB+)、動かせるモデルの見極め方(VRAM確認→サイズ×0.6+文脈→収まるか)までを2026年の情報で解説する。

ローカルLLMとクラウドLLM(Claude/ChatGPT)の違いと性能差は?選び方ガイド[2026]

ローカルLLMとクラウドLLM(Claude/ChatGPT)の違いと性能差は?選び方ガイド[2026]

自分のPCで動かすローカルLLMと、クラウド経由のClaude・ChatGPT・Geminiなどサービス型LLMの違い・性能差・選び方を整理する記事。本記事は、本質(ローカル=自前主義で自由とプライバシーを取り性能と手間を払う/クラウド=預け主義で最高性能と手軽さを取り課金と依存を払う=優劣でなくトレードオフ)、7観点の比較表(性能/コスト/プライバシー/速度/手間/オフライン/マルチモーダル)、2026年の性能差の現在地(DeepSeek・Qwen・Llama・GLM・GemmaなどオープンモデルがSWE-Bench系で数ポイント差まで猛追、要約・翻訳・定型コードはローカルでクラウド中位=Sonnet級に近い/複雑な多段推論・長文一貫性・エージェント動作・マルチモーダル=最難関の1〜2割はクラウド優勢、オープンは数ヶ月遅れで追う位置取り、ローカルはサイズで性能が激変)、コストの違い(クラウド=従量・少量なら割安/ローカル=初期投資後トークン無料・大量利用ほど得・中量が分岐点・隠れコストは時間)、プライバシー・データ主権(ローカルはデータが一切外に出ず規制/エアギャップ向き)、必要ハード早見(量子化前提で1Bあたり0.5〜1GB、7B=VRAM8〜12GB・32B=24GB・70B=40〜48GB以上)、向き不向き、決定ガイド(機密→品質→使用量の順、多くの人はハイブリッドが最適でクラウド停止時のフォールバックにも)までを2026年6月時点の情報で解説する。

AI依存リスクとは?AIが突然使えなくなる事態に備える方法

AI依存リスクとは?AIが突然使えなくなる事態に備える方法

AI依存リスクとは、特定のAIサービス・モデルに業務や生活を強く依存した結果、それが使えなくなった/変わった/高くなったときに大きな打撃を受ける状態。本記事は、AI依存リスクとは何か(怖いのは「AIが間違える」ことより「昨日まで動いていたAIが今日は手元にない」不連続。クラウドAIは提供のオン/オフが自分の手の外=ベンダーが単一障害点)、2026年6月のFable 5・Mythos 5全面停止という実例(公開3日で規制により停止、19日後の2026年7月1日に再展開=最高性能でも停止リスクはゼロにできない)、依存リスクの6類型(①突然の停止 ②モデルの廃止/退役 ③値上げ・課金変更 ④品質の変化・無断変更 ⑤障害・レート制限・BAN ⑥ベンダーロックイン。①〜⑤は外から降る・⑥は自分で作り込む)、自分の依存度を測る依存マッピング(何に依存・止まると何が困る・無くなったらどうする+最高性能が要る作業とそうでない作業を分ける)、個人ユーザーの備え5つ(代替を1つ持つ/成果物は自分側に保存/効くプロンプトを資産化/AI無しでもできるを保つ/機密は預けない)、本番システム・開発者の冗長化設計(抽象化レイヤ=LLMゲートウェイ LiteLLM・OpenRouter・Vercel AI SDK/OpenAI互換APIなら接続先とキー変更だけ、フォールバック連鎖は必ず事前テスト、層分離=AI拡張層は外せる・記録基幹層は守る、ローカルLLMという最後の砦、復旧プレイブックでMTTR短縮)、ベンダー選びのチェック(廃止の事前通知=Anthropic60日以上・OpenAI正式版6ヶ月以上だがプレビューは2週間/変更の透明性/退役後の救済=重み保存)までを、2026年6月時点の各社公式情報をもとに解説する。

エージェント評価(Agent Evals)とは——成果と軌跡の両方を測る

エージェント評価(Agent Evals)とは——成果と軌跡の両方を測る

エージェント評価(Agent Evals)は、ツールを使い複数手を踏んで目標を達成するエージェントが本当にタスクを成し遂げられるかを体系的に測る工程。単発出力を採点するLLM評価の発展形で、対象が「1つの出力」から「一連の行動」に広がる。エージェントは計画し、ツールを呼び、状態を更新するため最終出力だけでは不十分で、Googleも「出力確認だけでは足りず行動のなぜを理解する必要がある」として最終応答と軌跡(trajectory)の2系統に分ける。測る軸は5つ=①成果(タスク成功=「予約しました」という発言ではなくDBに予約が実在するかという最終状態で判定)②軌跡(妥当な手順・正しいツールを正しい順序で)③ツール使用の正確さ(正しいツール・正しい引数・関数名や型まで照合)④効率(手数・トークン・コスト・遅延。多くはオブザーバビリティの観測値を持ち込む実務的扱い)⑤最終応答の質(LLM-as-judge/ルーブリック)。採点者はコード(速い/安い/再現可能だが脆い)→LLM-as-judge(柔軟だが非決定的で要較正)→人間(ゴールド標準だが高コスト・可能なら避ける)を使い分ける。Anthropicは「ツール呼び出しを正しい順序で踏んだかの確認は厳しすぎて脆い。エージェントは妥当な別解を見つけるので、経路ではなく成果を採点する方がよい」と勧める一方、Google/Microsoftは軌跡一致度を正式指標に持つ。固有の難所は非決定性(pass^k)・誤差の連鎖(p^t)・報酬ハッキング(DeepMindのロボットアームが掴んだように見せかけた例)・評価セットの陳腐化や汚染。実務はAnthropic推奨で、本番の失敗から20〜50件をテストケース化→自動採点でCIに乗せ→能力evalと回帰evalを分け→早く書く。SWE-bench/τ-bench/WebArena/GAIA/OSWorld/BFCL等のベンチマークも参考になる(スコアは版で動くので鵜呑みにしない)。公式情報に基づき不確実点を明示しつつ整理する。

Claude Code hooks(フック)とは——ライフサイクルの要所で確定的に自動実行する

Claude Code hooks(フック)とは——ライフサイクルの要所で確定的に自動実行する

Claude Code hooks(フック)は、Claude Codeのライフサイクルの特定の時点で自動実行されるユーザー定義のシェルコマンドで、「必ずこうなってほしい」をLLMの判断に頼らず確定的に実現する仕組み。定番イベントはSessionStart/UserPromptSubmit/PreToolUse/PostToolUse/Notification/Stop/SubagentStop/SessionEnd/PreCompactの9つで、PreToolUse等はブロック可能(保護ファイル編集や危険コマンドを止められる)。設定はsettings.jsonの"hooks"キーにイベント名→マッチャ→type+commandの形で記述。入出力はstdinにJSON(session_id・tool_input等)を受け取り、終了コード0(成功)/2(ブロック、stderrがClaudeに渡る)または構造化JSON(continue・decision:block・permissionDecision:deny/allow/ask等)で返す。原則は「制限はきつくできるが緩くできない」(denyは常に優先、bypassPermissionsでも止まる)。定番ユースケースは編集後の自動整形(PostToolUse+Edit|Write)・保護ファイル防御・危険コマンド阻止・コンテキスト再注入(SessionStart)・通知/監査ログ・終了前テスト(Stop)。安全面では任意のシェルコマンドを自分の権限で実行するため信頼できるフックだけを設定し、入力の検証/クォート・機微ファイル回避が必須。フック設定はセッション開始時にスナップショットとして固定され、セッション中の変更が反映されないのは安全機構。公式ドキュメントに基づき、定番9イベントと入出力契約を軸に整理する。

Claude Codeのチェックポイントと/rewindとは——変更を巻き戻して復旧する

Claude Codeのチェックポイントと/rewindとは——変更を巻き戻して復旧する

チェックポイント(checkpointing)と/rewindは、Claude Codeが作業中にClaudeのファイル編集を自動追跡し、数キーで「やり直す前」まで巻き戻せる安全網。スナップショットは各編集の前に自動で取られ、送った各プロンプトが復元ポイントになり、セッションをまたいで保持される。使い方は/rewindと打つか入力欄が空のときにEscを2回押してメニューを開き、一覧から地点を選んで「コードと会話を復元/会話を復元/コードを復元」を選ぶ(入力欄に文字が残っていればEsc2回は入力のクリアになる点に注意)。最重要の注意は、復元されるのはClaudeの編集ツール(Write/Edit/NotebookEdit)によるファイル変更だけで、bashコマンドの変更(rm/mv/cp)・セッション外や別セッションの変更・ディレクトリ操作・リモートファイル・DB等は巻き戻しで戻らないこと。公式は「チェックポイント=ローカルの取り消し、Git=恒久的な履歴」と位置づけ、補完はするが置き換えはしないと明言しており、節目ではGitコミットの併用が鉄則。さらに/rewindはツール同時実行やthinkingブロック関連の400エラーからの復旧手段でもあり、製品自身が実行を促す(ただしv2.1.156より前は/rewindでクリアできないことがあるためclaude updateが先)。対話型CLIでは既定で有効、Agent SDKはオプトイン、保持はセッションと一緒に30日(設定可)。公式ドキュメントに基づき不確実点を明示しつつ整理する。

Claude Managed Agentsとは——Anthropicのフルマネージド・クラウドでエージェントを動かす

Claude Managed Agentsとは——Anthropicのフルマネージド・クラウドでエージェントを動かす

Claude Managed Agentsは、2026年4月8日にパブリックベータとして公開された、クラウドホスト型エージェントを構築・デプロイするための合成可能なAPI群。自分でエージェントループ・ツール実行・ランタイムを作る代わりに、Claudeがファイル読取・コマンド実行・Web閲覧・コード実行を安全に行えるフルマネージド環境が手に入り、プロンプトキャッシュ・コンテキスト圧縮・サンドボックス・状態の永続化が組み込み。構成はAgent/Environment/Session/Eventsの4概念で、EnvironmentはAnthropic管理のクラウドサンドボックスか自己ホスト型を選べる。自前のAgent SDK(self-hosted、ループ・ツール・インフラを自分で運用)との違いは「自分で動かすか、Anthropicが動かすか」で、競合ではなく運用責任の置き場所の選択。特徴的なのはワークスペース単位の永続メモリ(memory store)で、サンドボックス内に/mnt/memoryとしてマウントされ通常のファイル操作で読み書きでき、セッションをまたいで持続(変更ごとに不変のバージョン、30日保持、メモリ1件100kB等の上限あり)。さらにdreamingは既存メモリと過去セッション記録を読み、重複を併合・古い値を更新・新しい洞察を浮かび上がらせた再編成メモリを生成する非同期ジョブ(リサーチプレビュー、アクセス申請要。一部は「スケジュール実行」と表現するが公式はオンデマンドの非同期ジョブとして記載)。成果ベース評価(ルーブリックに照らして別の採点役が評価、最大10ポイント改善と報告)とマルチエージェント・オーケストレーションも備える。料金はトークン+セッション稼働1時間あたり$0.08(ミリ秒課金、running中のみ。Opus 4.8の1時間で約$0.705)。全APIアカウントで既定有効だが、状態を持つためZDRやHIPAA BAAの対象外。公式情報に基づき不確実点を明示しつつ整理する。

Claude Codeプラグインとマーケットプレイスとは——使い方・自作・公開の完全ガイド

Claude Codeプラグインとマーケットプレイスとは——使い方・自作・公開の完全ガイド

Claude Codeを使い込むと増えてくる自分用のスラッシュコマンド・サブエージェント・MCPサーバ・フックを、1つにまとめてバージョン管理し、チームや他プロジェクトで共有できる仕組みがプラグイン(2025年10月パブリックベータ、2026年に公式ディレクトリや/pluginの検索・一覧を追加)、配布の場がマーケットプレイスだ。本記事では、プラグインとは何か(スキル/コマンド/サブエージェント/フック/MCPサーバ等を束ねた自己完結ディレクトリ)、構造(.claude-plugin/にはplugin.jsonだけ・commands/agents/skills/hooksはルート、plugin.jsonのname/description/version/author)、使い方(/pluginのタブ画面、/plugin marketplace add owner/repo→/plugin install name@market、/plugin enable|disable|uninstall、/plugin list --enabled、検索バー、/reload-plugins)、マーケットプレイスとは(.claude-plugin/marketplace.jsonのカタログ、公式claude-plugins-officialは初回から自動でclaude.com/pluginsで閲覧可、コミュニティclaude-plugins-community)、自作と公開(plugin.jsonとSKILL.mdを置きclaude --plugin-dirでテスト、gitルートにmarketplace.jsonを置いて公開、バージョンはplugin.json→marketplace→コミットSHA、claude plugin validate)、配布スコープ(user/project/local/managed、チーム配布は.claude/settings.jsonのextraKnownMarketplacesとenabledPlugins)、安全性(プラグインは任意コードを実行しうる・Anthropicは第三者を検証しない・strictKnownMarketplacesで限定)までを、公式ドキュメントに基づいて整理する。

Claude CodeのSubagentsとAgent Teamsの違いと使い分け

Claude CodeのSubagentsとAgent Teamsの違いと使い分け

Claude Codeで複数AIに手分けさせる仕組みには、似て非なるSubagents(サブエージェント)とAgent Teams(エージェントチーム)の2つがあり、役割と協調のしかたが根本的に違う。本記事では両者を正確に整理する。Subagentsは標準機能で、メインのエージェントが特定タスクを独自のコンテキストウィンドウ・システムプロンプト・ツール権限を持つ助手に自動委譲し、要約だけを受け取る階層型・使い捨て(会話履歴は見ない、/agentsで管理、.claude/agents/のYAML定義、Explore/Plan等の標準サブエージェント、最大5階層までネスト可)。一方Agent Teamsは実験的なオプトイン機能で既定では無効——CLAUDE_CODE_EXPERIMENTAL_AGENT_TEAMS=1が必要で、複数の独立セッション(チームリードと仲間)が共有タスクリストとメールボックスで対等に直接連携するピア型・永続(v2.1.178はTeamCreateの準備ステップを撤廃し各セッションが暗黙のチームを持つよう簡略化しただけで、既定有効化ではない)。決定的な違い(階層vsピア、要約vs直接通信、標準vs実験的フラグ必須、5階層ネストはSubagentsの仕様でTeamsは入れ子不可)、どちらを使うべきか(結果だけ欲しい/文脈を汚したくないならSubagents、作業者が相互共有・調整すべき並列作業ならAgent Teams、逐次・同一ファイル・素早い修正なら単一セッション)、使い方チートシート、Agent Teamsの注意点(高トークンコスト・推奨3〜5人・worktree非隔離でファイル競合・/resume等の制限・分割ペインはtmux/iTerm2)までを、公式ドキュメントに基づいて整理する。

Claude Designとdesign-syncとは——デザインとコードを双方向につなぐ新機能

Claude Designとdesign-syncとは——デザインとコードを双方向につなぐ新機能

Claude Designは、作りたいものを会話で説明するとClaudeがUIデザインやプロトタイプ、スライド、ワンページャーを生成し、チャット・インラインコメント・直接編集・スライダーで仕上げられるAnthropic Labsのデザインツール(2026年4月17日研究プレビュー公開、最初の1週間で100万人超が利用)。2026年6月17日の大型刷新で、デザイナーと開発者の往復を一気に縮めた。本記事では、Claude Designとは何か(4月の公開時点ではOpus 4.7で動くとされたが6月告知ではモデル再言及なしのため断定しない)、6月刷新の中身(GitHubリポジトリ/デザインファイル/素材からのデザインシステム取り込みと自社コンポーネントでの構築・出力照合、/design-syncによるClaude Codeとの双方向同期、ドラッグ/リサイズ/整列のキャンバス直接編集と多数の安定性修正、チャット/Cowork/Claude Codeとの使用量上限共有によるトークン浪費問題の改善、管理者が標準システムを承認しロックするエンタープライズのブランド管理、Adobe/Canva/Miro/Vercel/Wix等やPDF/PowerPointへのエクスポート連携拡充)、/design-syncの双方向(Code→:デザインシステムをリポジトリに取り込み実コンポーネントで実装/→Design:作ったコードをキャンバスに戻して編集/Design→Code:仕上がったデザインをClaude Codeに渡しスクショから作り直さず引き継ぐ、/designでターミナルから作成・編集・同期も)、利用条件(Pro/Max/Team/Enterpriseのベータで追加料金なし・Enterpriseは既定オフ・キャンバスはweb/desktopのみ・/design-syncはCLI)、なぜ重要か(スクショから作り直す断絶を埋め、デザイナー×開発者を一本でつなぐ)までを、公式情報に基づき不確実点を明示しつつ整理する。

Claude Code Artifactsとは——セッションを共有ライブページに変える新機能の使い方

Claude Code Artifactsとは——セッションを共有ライブページに変える新機能の使い方

2026年6月18日にAnthropicが発表したClaude Code Artifacts(ベータ)は、ターミナルのコーディングセッションを、チームで共有できるライブなWebページに変える新機能だ。git diffやログをテキストで延々流す代わりに、注釈付きPRウォークスルー・自己更新するダッシュボード・インシデントのタイムライン・自動でチェックが入るリリースチェックリスト・アーキテクチャ図などを、claude.aiの非公開URLを持つ1枚のページとして公開できる。本記事では、Artifactsとは何か(セッション全体やMCPコネクタ経由のデータから構築し、作業の進行に合わせて開いた画面もその場で更新される)、2024年のclaude.aiのキャンバス型Artifactsとの違い(セッション由来・自己更新・組織内限定・公開不可)、用途、使い方(/artifactのような専用コマンドは無く自然言語で依頼、Claudeが.htmlを書き出して公開許可を求めURL表示、Ctrl+]で再表示、更新で同URLの新バージョン、Shareで組織内共有)、制約(アプリではなく作業のキャプチャ=バックエンド無し・厳格なCSPで外部リクエスト不可・単一ページ・.html/.htm/.mdのみ・16MiB以下・トークン多め)、利用条件(Team/Enterprise限定ベータ、/loginサインイン必須でAPIキー不可、Anthropic APIのみでBedrock等非対応、CMEK/HIPAA/ZDRで無効、管理者制御と監査ログ)までを、公式ドキュメントに基づいて整理する。

Claude Codeの認証・ログインエラー(Invalid API key/Not logged in)の原因と対処

Claude Codeの認証・ログインエラー(Invalid API key/Not logged in)の原因と対処

Claude Codeで「Not logged in · Please run /login」「Invalid API key」「This organization has been disabled」「OAuth token has expired」などが出てログインを求められる——これらは多くが401/403=認証(あなたが誰か)の問題だ。本記事では、認証トラブルで最頻出の真因(環境変数ANTHROPIC_API_KEYがサブスクPro/Maxログインを優先順位で黙って上書きし、予期せぬ従量課金・organization disabled・Invalid API keyを生むこと、キーは.zshrc/.bashrc/.profileやdirenv/dotenv・IDEターミナルの.env・前職の残骸・CIから来ること)、検出(/statusで有効な資格情報を確認・env | grep ANTHROPIC)と修正(unset ANTHROPIC_API_KEY+シェル設定から削除)、その他の原因(トークン失効・無効化、システム時計のずれ、macOSキーチェーンのロック、Consoleロール不足の403、WSL/SSH/コンテナでのOAuthリダイレクト失敗=コード貼り付けで回避、組織ポリシーはローカル上書き不可)、認証情報の保存場所(macOS Keychain/Linux ~/.claude/.credentials.json/Windows %USERPROFILE%)、切り分けワークフロー(/status→env grep→unset→/logout→/login→時計・キーチェーン・Consoleロール)、紛らわしいエラー(usage limit=プラン枠/429=レート/529・500=サーバー/Credit balance=残高)との区別までを、公式情報に基づいて整理する。