Перейти к содержимому
Темы

AI-агенты и автоматизация: RAG, воркфлоу и гайды

Разберитесь в AI-агентах, RAG и автоматизации процессов. От концепций до реальных применений.

50 статей

Сортируйте статьи, чтобы найти нужное

Статьи в категории AI-агенты и автоматизация

Что такое MCP (Model Context Protocol)? — 16-месячная история о том, как ИИ обрёл свой «USB-C», и практическое руководство

Что такое MCP (Model Context Protocol)? — 16-месячная история о том, как ИИ обрёл свой «USB-C», и практическое руководство

MCP (Model Context Protocol) начинался как маленькая спецификация, которую Anthropic тихо выложила на GitHub. Шестнадцать месяцев спустя он достиг 97 млн ежемесячных загрузок SDK (+4 750%), 10 000+ публичных серверов, полного принятия OpenAI/Google/Microsoft/AWS, а в декабре 2025 года Anthropic передала владение Linux Foundation — сделав его общей отраслевой инфраструктурой, «USB-C эпохи ИИ». В статье: 16-месячная история, трёхкомпонентная архитектура Client/Server/Transport, пять MCP-серверов, доступных уже сегодня (filesystem/github/postgres/slack/fetch), минимальная DIY-реализация на Python в 30 строк, причины победы MCP, подводные камни безопасности и prompt injection, а также что нас ждёт дальше — на основе официальных источников и личного опыта.

Как сократить расходы на ИИ — 3 рычага: кэширование промптов, выбор модели, бюджет вывода

Как сократить расходы на ИИ — 3 рычага: кэширование промптов, выбор модели, бюджет вывода

«Перешёл с ChatGPT Plus на Claude Code, и счёт вырос в 10 раз» — на пороге 2026 года такие жалобы стали массовыми. Хорошая новость: сочетая три рычага — кэширование промптов, маршрутизацию моделей и бюджет вывода — можно делать ту же работу за 20–30% от неоптимизированной стоимости. В статье: структура расходов API (вход $5, выход $25, чтение из кэша $0,50 за 1M токенов), выбор тарифа (Free/Pro/Max/Team/Enterprise/API), кэширование промптов (главный рычаг 2026 года; важное изменение TTL по умолчанию с 60 минут до 5 минут), управление контекстом через /compact и Hooks, маршрутизация Opus/Sonnet/Haiku по задачам (разница до ×6), бюджет вывода через max_tokens, ловушка мультиагентов (×15 токенов), мониторинг через /cost и оповещения о биллинге, семь типичных шаблонов расточительства и FAQ для индивидуальных пользователей и администраторов организаций.

ИИ заменяет ветеранов или джуниоров? Данные Stanford и стратегии выживания

ИИ заменяет ветеранов или джуниоров? Данные Stanford и стратегии выживания

Когда говорят о профессиях, которые ИИ ликвидирует первыми, большинство интуитивно думает: «Под ударом — ветераны на рутине». Но реальность последних двух лет противоположная. Анализ Stanford Digital Economy Lab «Canaries in the Coal Mine» (ноябрь 2025), исследования Yale SOM, Federal Reserve и отраслевые опросы сходятся в одном — ИИ заменяет первыми именно джуниоров, тогда как сеньоры наращивают долю занятости. Разработчики ПО 22–25 лет — на −20% от пика, IT-работники 35–49 лет — на +9%. Исследователи назвали это «seniority-biased technological change». В статье разбираем последние данные, почему сеньоры выигрывают (постановка вопроса, чутьё на хайл, контекст, ответственность), влияние по отраслям, надвигающуюся проблему «испарения пайплайна обучения», контраргументы (отскок пандемийного перенайма, ставки, визы) и стратегии выживания для джуниоров и линии опасности для сеньоров.

Что такое vibe coding? Полный гид: определение Карпатого, рабочий процесс, инструменты и риски безопасности

Что такое vibe coding? Полный гид: определение Карпатого, рабочий процесс, инструменты и риски безопасности

В феврале 2025 года Andrej Karpathy одним постом в X запустил по миру термин «vibe coding» — стиль программирования, в котором вы доверяете ИИ генерировать код и не читаете его. Год спустя, в 2026, сам Карпатый предложил переименовать его в «agentic engineering», корпоративный сегмент фиксирует всплеск инцидентов безопасности (40–62% ИИ-кода содержит уязвимости, CVE выросли в 6 раз за три месяца), но для инди-разработчиков и MVP стартапов стиль закрепился как стандарт. В статье разбираем определение, типичный 4-шаговый цикл (опиши → сгенерируй → запусти → ответь), ведущие инструменты (Claude Code, Cursor Composer, Codex CLI, Lovable, v0, Bolt.new, Devin), различие vibe vs agentic engineering, реальные данные о безопасности и операционные правила «Vibe & Verify» для практического применения.

Что такое мультиагент? Полный гид по архитектуре, фреймворкам и реальной стоимости

Что такое мультиагент? Полный гид по архитектуре, фреймворкам и реальной стоимости

В 2026 году разговор об ИИ-агентах сместился с «один супер-агент» на «команду агентов с разными ролями». Anthropic Research, субагенты Claude Code, Devin, параллельные воркеры Cursor — все построены на координации нескольких ИИ. В статье разбираем определение мультиагента, пять ключевых архитектурных паттернов (оркестратор-воркер, handoff, иерархия, peer-to-peer, конвейер), сравниваем большую четвёрку фреймворков (Claude Agent SDK, OpenAI Agents SDK, LangGraph, Strands), показываем реальные продакшен-примеры, разбираем структуру стоимости (в 2-15 раз больше токенов) и даём практические правила: когда мульти оправдан, когда лучше одиночный.

Полное сравнение GPT-5.5 и Claude Opus 4.7: какую модель выбрать?

Полное сравнение GPT-5.5 и Claude Opus 4.7: какую модель выбрать?

В апреле 2026 года с разницей в неделю вышли Claude Opus 4.7 и GPT-5.5. Обе позиционируются как «фундамент агентов следующего поколения», но их философии и сильные стороны почти зеркально противоположны. В статье сравниваем модели по официальной документации и публичным бенчмаркам (SWE-bench, Terminal-Bench, OSWorld, GPQA, GDPVal), разбираем стену токен-эффективности (GPT выдаёт на 72% меньше выходных токенов), приводим карту сильных и слабых сторон и даём практические рекомендации по выбору модели и стратегии работы с двумя вендорами.

Что такое Harness Engineering? Проектирование слоя вокруг LLM в эпоху ИИ-агентов

Что такое Harness Engineering? Проектирование слоя вокруг LLM в эпоху ИИ-агентов

Центр тяжести сместился от prompt engineering к harness engineering — новому полю битвы эпохи ИИ-агентов. В статье разбираем, что такое harness engineering на самом деле, чем он отличается от prompt engineering, шесть компонентов (определение инструментов, управление контекстом, память, цикл, guardrails, output UX), сравнение Claude Code, Cursor, Codex CLI и Devin, а также практический чек-лист — фундамент, нужный, чтобы всерьёз использовать или строить ИИ-агентов.

Почему ИИ игнорирует правила: проверяем CLAUDE.md, Cursor Rules и AGENTS.md

Почему ИИ игнорирует правила: проверяем CLAUDE.md, Cursor Rules и AGENTS.md

Если ИИ игнорирует правила, отличайте незагруженные инструкции от загруженных, но не выполненных. Разбираем восстановление CLAUDE.md после сжатия, разницу между рекомендациями по длине и пределами загрузки, а также проверку области действия и результатов через Hooks, CI, ИИ-ревью и навыки.

Релиз ChatGPT 5.5 (GPT-5.5): возможности, бенчмарки, цены и сравнение с Claude Opus 4.7

Релиз ChatGPT 5.5 (GPT-5.5): возможности, бенчмарки, цены и сравнение с Claude Opus 4.7

OpenAI выпустила «ChatGPT 5.5 (GPT-5.5)» 23 апреля 2026 года. Позиционируемая как «новый класс интеллекта для real work и AI-агентов», модель набрала 82.7% на Terminal-Bench 2.0, обойдя Claude Opus 4.7 (69.4%) и Gemini 3.1 Pro (68.5%) и вернув себе первое место. При этом цены API выросли вдвое по сравнению с GPT-5.4 ($5/$30 за MTok), а на SWE-Bench Pro Claude Opus 4.7 по-прежнему её опережает. В статье — полная картина: возможности, бенчмарки, цены, доступность по тарифам, прямое сравнение с Claude и Gemini и рекомендации, как выбрать — всё на основе официальных источников.

Что такое RAG? Простое объяснение принципа и применений для начинающих

Что такое RAG? Простое объяснение принципа и применений для начинающих

«Хочу, чтобы ChatGPT прочитал внутренние документы компании и отвечал по ним на вопросы сотрудников» — именно для таких задач существует RAG (Retrieval-Augmented Generation, генерация с дополненной выборкой). В этой статье мы наглядно разбираем принцип работы RAG в три шага, рассказываем про векторные базы данных, реализацию на LangChain и сравнение с дообучением — на уровне, понятном новичку. С большим набором практических примеров: внутренний QA, поддержка клиентов, право и медицина.

Заменят ли Claude Code и Codex инженеров инфраструктуры и сетей? — Реальность эксплуатации в эпоху ИИ

Заменят ли Claude Code и Codex инженеров инфраструктуры и сетей? — Реальность эксплуатации в эпоху ИИ

Claude Code и OpenAI Codex теперь умеют автоматически генерировать инфраструктурный код (Terraform, Docker, Ansible и др.). Поэтому звучат голоса: «инженеры инфры больше не нужны». Но реальность сложнее. В статье мы раскладываем, что ИИ делает хорошо и что остаётся за человеком — физический уровень, решения при авариях, ответственность за безопасность — и объясняем, как инженерам инфраструктуры развиваться в эпоху ИИ.

Что такое OpenClaw? Открытый ИИ-ассистент с 240 000+ звёзд на GitHub

Что такое OpenClaw? Открытый ИИ-ассистент с 240 000+ звёзд на GitHub

OpenClaw — самый быстрорастущий проект на GitHub в 2026 году. Этот ИИ-ассистент с открытым кодом подключается к WhatsApp, Slack, Discord и более чем 50 платформам. Но что именно он умеет и какие риски несёт? От архитектуры до уязвимостей — всё, что нужно знать.