Перейти к содержимому
Темы

ИИ для начинающих: первые шаги с AI-инструментами

Новичок в ИИ? Начните здесь. Понятные руководства по основам ИИ и выбору инструментов.

146 статей

Сортируйте статьи, чтобы найти нужное

Статьи в категории Для начинающих

Как начать с генерации изображений ИИ — как это работает, 4 шага, анатомия промпта и права

Как начать с генерации изображений ИИ — как это работает, 4 шага, анатомия промпта и права

«Я не умею рисовать, значит, это не для меня» — это предубеждение насчёт генерации изображений ИИ перевёрнуто с ног на голову. Достаточно дать указание словами — и через секунды у вас готов визуал профессионального уровня. Это межинструментальное руководство охватывает: что такое генерация изображений ИИ (создание изображений с нуля посредством слов — навык умения формулировать, а не рисовать; версия промпт-инжиниринга для изображений), как это работает (диффузионные модели вырезают картинку из случайного шума, используя ваш промпт как подсказку, каждый раз рисуя с нуля, отчего результаты «дрожат»), общий рабочий процесс из 4 шагов, работающий в любом инструменте (выбрать инструмент, написать промпт, сгенерировать и выбрать, доработать и завершить — итерации это базовая предпосылка), ключевую анатомию промпта из 6 частей (объект, сцена/обстановка, стиль, свет/цвет, композиция/ракурс, технические параметры) плюс негативные промпты и соотношение сторон — хотя GPT Image и Imagen предпочитают простые предложения, тогда как инструменты семейства Stable Diffusion любят списки слов и негативы, 7 приёмов мастерства (перебирать число вариантов, добавлять понемногу, референсы, inpainting, фиксировать сид, увеличивать, сохранять удачные промпты), с чем ИИ справляется плохо (кисти, текст, согласованность, точность деталей) и обходные приёмы, а также основы прав, коммерческого использования и этики для работы (чисто ИИ-результат защищён слабо по позиции Ведомства США по авторским правам и решению по делу Thaler 2025 года, с различиями по странам; коммерческое использование зависит от условий каждого инструмента; дипфейки и несанкционированное копирование стиля недопустимы; распространяются метаданные о происхождении вроде C2PA у DALL-E). Какой инструмент выбрать и приёмы по конкретным инструментам — со ссылками на сравнение, Midjourney и Stable Diffusion. Знайте анатомию, перебирайте число вариантов, добавляйте слова понемногу — и кто угодно сможет приблизиться к задуманному кадру.

Промпт-инжиниринг: практический сборник — 6 частей и приёмы, чтобы получать от ИИ нужные ответы

Промпт-инжиниринг: практический сборник — 6 частей и приёмы, чтобы получать от ИИ нужные ответы

Вы задаёте одному и тому же ИИ один и тот же вопрос, и при этом один называет его бесполезным, а другой поражается тому, насколько он способный — и истинная причина этого разрыва часто не в мощности ИИ, а в том, как написан промпт. Это практический сборник того самого навыка, промпт-инжиниринга, выстроенный так, чтобы новичок мог пользоваться им сразу. Он охватывает, что такое промпт-инжиниринг (навык проектировать и улучшать вашу инструкцию для ИИ — не код, а мастерство того, как формулировать), три принципа, которые меняют результат (будьте конкретны, давайте контекст, задавайте формат вывода, плюс «делай X» вместо «не делай Y»), основные 6 частей хорошего промпта (роль, контекст, инструкция, примеры, формат, ограничения — элементы, общие для крупных фреймворков вроде COSTAR и RCOF; все шесть нужны не всегда), 7 практических приёмов (дать роль, показать образец/few-shot, рассуждать по шагам, зафиксировать формат вывода, структурировать разделителями, не просить слишком много за раз и итерировать — сильнейший из них итерация), пример до/после, приёмы следующего уровня (цепочка рассуждений, самосогласованность, цепочки промптов, ReAct — хотя рассуждающие модели вроде o-серии и расширенного мышления у Claude делают CoT внутри, поэтому формулировка цели работает лучше), 7 частых ошибок, а также особенности моделей и безопасность ввода. С внутренними ссылками на советы по промптам для разработки приложений и меры предосторожности при вводе. Превращайте расплывчатое в конкретное, сваливание в диалог — улучшаться может любой уже сегодня.

Что такое технологическая сингулярность? Понятное руководство для новичков — механизм, прогнозы и отличие от AGI

Что такое технологическая сингулярность? Понятное руководство для новичков — механизм, прогнозы и отличие от AGI

В июне 2025 года Сэм Альтман из OpenAI написал в блоге: «Мы прошли горизонт событий; взлёт начался» («The Gentle Singularity»). Однако другие исследователи напрочь отвергают идею как то, что никогда не наступит. Это руководство для новичков объясняет, что сингулярность (технологическая сингулярность) — это «точка перелома, в которой ИИ превосходит человеческий интеллект и начинает совершенствовать сам себя, так что прогресс становится взрывообразно быстрым и его уже нельзя ни предсказать, ни контролировать» (гипотеза, не реализованная на 2026 год). Разбираем суть — взрыв интеллекта = рекурсивное самосовершенствование, где умный ИИ строит ещё более умный, а улучшающий меняется с человека на ИИ; чем это отличается от AGI и ASI (AGI/ASI — «состояния» интеллекта, сингулярность — «событие» обретения непредсказуемости; AGI → самосовершенствование → внезапный скачок к ASI = сингулярность); историю термина (1965 — «взрыв интеллекта» I. J. Good → 1993 — Виндж делает название популярным → Курцвейл выводит в мейнстрим с «2045»); широкий разброс прогнозов (Курцвейл 2045, Альтман «уже началась», Виндж, а также скептики вроде Gary Marcus и «тормоз сложности» покойного Paul Allen); внезапный жёсткий взлёт против постепенного мягкого; надежды (прорывы в медицине и науке) и риски (потеря контроля, проблема согласования); глубокий скепсис (тормоз сложности, физические пределы, совсем иная вещь); и распространённые мифы вроде «роботы правят», «немедленно, как только появится AGI» и «фиксировано на 2045». Не бойтесь её чрезмерно и не мечтайте слишком сильно — выжимайте максимум из сегодняшнего ИИ, спокойно наблюдая за тем, что может прийти дальше.

Влияние ИИ на юристов, бухгалтеров и налоговых консультантов: что меняется, а что остаётся

Влияние ИИ на юристов, бухгалтеров и налоговых консультантов: что меняется, а что остаётся

В 2023 году юрист получил санкции после того, как записка, написанная с помощью ChatGPT, процитировала дела, оказавшиеся выдумкой ИИ, — и этот случай распространил по миру настороженность к теме права и ИИ. И всё же за несколько лет внедрение резко выросло: говорят, более 90% юристов используют тот или иной ИИ в повседневной работе. Как следующая часть нашей серии о влиянии ИИ по отраслям после #068 (торговля), #094 (маркетинг) и #097 (консалтинг), здесь разбираются профессии. Текущая ситуация в цифрах (62% юристов сообщают об экономии времени 6–20% в неделю; Harvey и CoCounsel от Thomson Reuters обработали 10М+ юридических документов в 1-м квартале 2026; использование генеративного ИИ в налоговых/бухгалтерских/аудиторских фирмах подскочило с 8% в 2024 до 21% в 2025; исследование Stanford показывает, что рабочие места для начинающих в таких сферах, как бухгалтерия, упали на 13% к 2022, у бухгалтеров +5%, у счетоводов -5%), какую работу меняет ИИ по профессиям (юристы = поиск дел, проверка договоров, извлечение обязательств; бухгалтеры = бухучёт, проверка первички, выборка, выявление рисков; налоговые консультанты = ввод данных, черновики деклараций, поиск норм — ИИ делает подготовительную работу, человек выносит окончательное решение), главную ловушку галлюцинации (выдумывание несуществующих дел/норм — ведущее к санкциям и потере доверия; Harvey заявляет о 99,7% точности проверенных ссылок и помечает остальные, CoCounsel опирает ссылки на базу данных дел, цитируя только реальные дела), неизменную суть ценности (окончательное суждение, профессиональный скептицизм, этика, серые налоговые суждения и — решающее — подпись и юридическая ответственность, которые нельзя делегировать ИИ), кризис молодых специалистов (автоматизация ученической рутины) и новые роли (специалисты по ИИ-комплаенсу, налоговые промпт-инженеры), а также советы по ролям для практиков, будущих специалистов и клиентов (сверяйте ссылки и цифры с первоисточниками; уточняйте обращение с конфиденциальностью). Регулирование и ответственность различаются по странам; в Японии ИИ-функции в бухгалтерском ПО тоже широко распространены. Вопрос, который ставит ИИ: то, что вы продаёте, — это работа или суждение и ответственность?

Что такое команда /loop в Claude Code? Применение, опрос и сравнение планирования

Что такое команда /loop в Claude Code? Применение, опрос и сравнение планирования

«Сообщи, когда сборка завершится». «Если CI станет красным — почини». «Следи за деплоем каждые 5 минут». Передать эти «прилипшие» рутинные дела целиком AI позволяет команда /loop, добавленная в Claude Code в 2026 году. Это руководство для новичков объясняет, что /loop — это планировщик в рамках сессии, который повторно запускает запрос или slash-команду с заданным вами (или AI) интервалом, а затем разбирает четыре способа применения (① /loop 5m X = фиксированный интервал cron ② /loop X = self-pacing, где AI определяет интервал ③ /loop 15m = встроенный обслуживающий запрос ④ /loop = авто-обслуживание), как записывать интервалы (число + единица s/m/h/d, минимум 1 минута, естественный язык вроде «every 2 hours», и можно зациклить slash-команду: /loop 20m /review-pr 1234), силу self-pacing (короче при активности, дольше при затишье, от 1 минуты до 1 часа, и — в отличие от обычного cron — он сам завершает цикл, когда считает задачу выполненной), практические рецепты (наблюдение за CI/деплоями, «нянченье» PR, проверки долгих сборок, напоминания, авто-обслуживание ветки), как остановить и на что обратить внимание (Esc для остановки, привязка к сессии, поэтому новый разговор её стирает, закрытие терминала останавливает, фиксированные интервалы живут до 7 дней, до 50 задач на сессию, срабатывает между ходами с джиттером, локальный часовой пояс), как выбрать между тремя функциями планирования (/loop для мониторинга в сессии, Desktop scheduled tasks для резидентной локальной работы, Routines для облачных операций без присмотра), а также настройку loop.md и отключение через CLAUDE_CODE_DISABLE_CRON=1 — всё на основе официальной документации (на 2026 год). /loop меняет временную ось работы, которую можно передать AI.

Как сделать субтитры и расшифровку из видео/аудио с помощью ИИ

Как сделать субтитры и расшифровку из видео/аудио с помощью ИИ

Раньше на субтитрование часового видео вручную уходил целый день — слушать, ставить на паузу, печатать, выставлять тайм-код. В 2026 году этот ад завершается тем, что вы "закидываете видео и ждёте несколько минут". С упором на субтитрование/расшифровку видео- и аудиоконтента (протоколы совещаний — в #086, OCR изображений — в #091) этот гид разбирает четыре этапа, которые автоматизирует ИИ (извлечение звука → расшифровка с диаризацией → нарезка тайм-кодов в SRT/VTT → перевод и оформление), отличие субтитров (SRT/VTT) от расшифровки и когда что использовать, сравнение инструментов (бесплатный и приватный Whisper, монтаж-всё Descript, высокоточный многоязычный Sonix и Happy Scribe, удобный для частных лиц Notta, мобильный CapCut, самые простые авто-субтитры YouTube — многие под капотом используют распознавание семейства Whisper), наиболее воспроизводимый процесс из 4 шагов (подготовка → расшифровка → вычитка → экспорт/наложение SRT/VTT), рекомендации по сценариям (YouTube, подкасты, лекции, интервью, конфиденциальное, многоязычное), шесть приёмов точности, где качество звука — это 80% результата (качество, настройка языка, список имён собственных, поиск-замена, диаризация, длина строк), главный путь многоязычного процесса (довести оригинал → ИИ-перевод → проверка носителем) и подводные камни — излишнее доверие к точности, слабость на шуме и жаргоне, авторские права, загрузка конфиденциального и смещение тайм-кодов. На чистом звуке точность 90–96% (по публикациям, зависит от условий), а труд падает на 80–90%. Работу — ИИ; отделку — проверку имён собственных и просмотр до публикации — вам.

Влияние ИИ на консалтинговую отрасль: что меняется, что нет и как выжить

Влияние ИИ на консалтинговую отрасль: что меняется, что нет и как выжить

Обряд посвящения младших консультантов — бессонные ночи над слайдами, бесконечный ручной поиск — трещит по швам. "Lilli" от McKinsey просматривает 100 000+ документов за секунды и набрасывает презентации; "Deckster" от BCG мгновенно доводит слайды; по одной из оценок ~80% исследовательской и слайдовой работы младшего аналитика могут быть заменены за секунды. Как следующий выпуск серии "Влияние ИИ по отраслям" после #068 (торговые компании) и #094 (маркетинг), статья обозревает консалтинг: картину в цифрах (Big Four и стратегические дома вложили 10+ млрд долларов в ИИ с 2023 года, PwC 1 млрд за три года, BCG ~25% выручки в 14,4 млрд за 2025 год = ~3,6 млрд от ИИ, исследование HBS с 758 консультантами BCG: пользователи ИИ делали на 12,2% больше задач, на 25,1% быстрее, на 40%+ качественнее), пять областей, которые меняет ИИ (исследования, слайды, анализ, протоколы и новые ИИ-стратегические услуги — пока чистый создатель рабочих мест в крупных фирмах), крах пирамидальной модели (рутинная работа джуниоров, ~80% по одной из оценок, автоматизируется за секунды; движение к компактным командам несколько-человек-плюс-ИИ с тревогой за карьерный конвейер), тектонический сдвиг цен (парадокс производительности — закончить быстрее значит выставить меньше при почасовых ставках — и 73% клиентов предпочитают оплату по результату, толкая переход к оплате по результату и фиксированной цене), неизменную суть ценности (постановка вопроса, интерпретация, суждение, доверие, исполнение — консультант, управляющий системой, важнее самой системы), разделение на гигантов-танкеров против бутиков-катеров (рост небольших фирм до 50% по оценкам) и советы по ролям для соискателей, практиков и компаний-клиентов. Вопрос, который ставит ИИ: ваша ценность — это работа или суждение?

Что такое AGI (общий искусственный интеллект)? Понятное руководство для новичков

Что такое AGI (общий искусственный интеллект)? Понятное руководство для новичков

На форуме в Davos в январе 2026 года ведущие умы отрасли столкнулись по поводу «AGI уже не за горами» против «до сути ещё далеко» — а запалом послужил AGI (Artificial General Intelligence). Эта понятная для новичков статья начинается с того, что такое AGI — «универсальный ИИ, который, подобно человеку, способен сам учиться и решать даже совершенно новые задачи в любой области» (хотя это ещё не реализованная цель на 2026 год), — затем разбирает решающее отличие от сегодняшнего узкого ИИ в стиле ChatGPT (может ли он «переносить» знания в другую область; обобщение и автономное освоение навыков), трёхступенчатую схему узкий ИИ → AGI → ASI (сверхинтеллект), широкий разброс прогнозов экспертов по срокам (Amodei из Anthropic оптимистичен — в пределах нескольких лет/около 2027 года, Hassabis из DeepMind осторожен — ~50% к 2030 году, медиана опроса исследователей — 2047 год, скептики вроде Marcus говорят, что это далеко или не случится — разброс проистекает из различающихся определений), насколько сегодняшний ИИ близок (ниже человеческого базового уровня на ARC-AGI, но подбирается к порогу за счёт мультимодальности и агентов), надежды (ускорение исследований болезней и науки) и риски (рабочие места, злоупотребления, проблема согласования — позиционируемая Anthropic и UK AISI как критическая точка принятия решений), а также частые мифы вроде «ChatGPT — это уже AGI» и «AGI = обладает сознанием». Ни чрезмерно боясь, ни чрезмерно мечтая, освойте узкий ИИ, что у вас в руках, спокойно наблюдая за тем, что придёт дальше.

Как стать передовым ИИ-инженером (AI-native разработчиком): навыки и дорожная карта

Как стать передовым ИИ-инженером (AI-native разработчиком): навыки и дорожная карта

Окажетесь ли вы на стороне, у которой ИИ отбирает работу, или на стороне, что владеет ИИ и делает работу за десятерых? В 2026 году это развилка для инженеров. Статья представляет путь "AI-native разработчика" (создание приложений с LLM, агентами, RAG — в отличие от исследования моделей) как выстраиваемый набор навыков, а не докторскую степень, в трёх слоях: ① неизменный фундамент (Python как основной язык ИИ-разработки, Git, командная строка, HTTP/REST/JSON — основы нужны и в эпоху кода, написанного ИИ); ② 5 ключевых AI-native навыков (проектирование промптов/контекста, RAG как основа корпоративных агентов, создание агентов, MCP как де-факто стандарт подключения инструментов и проектирование evals — плюс оптимизация затрат, ограждения, наблюдаемость); ③ преимущество, которое большинство упускает, — проектирование evals и инженерия контекста (умение писать evals — сильнейший признак того, что человек "реально строил с LLM", а AGENTS.md/CLAUDE.md плюс небольшой набор evals — это скачок от "с помощником" к "native"). Добавлены дорожная карта на 8–12 месяцев (фундамент → LLM API/промптинг → постройте RAG без фреймворков → агенты + MCP → evals + развёртывание + публикация), стратегия портфолио, где развёрнутая работа важнее диплома, подводные камни (болото туториалов, коллекционирование инструментов, пренебрежение основами) и цифры рынка/спроса (на основе данных США, большой разброс по регионам). Граница — используете ли вы ИИ как систему.

Как ИИ влияет на маркетинг и рекламу: что меняется, а что нет

Как ИИ влияет на маркетинг и рекламу: что меняется, а что нет

Когда генеративно-ИИ рождественский ролик Coca-Cola в конце 2024 года раскритиковали как «бездушный», это символизировало перетягивание каната, которое ИИ привносит в маркетинг: «эффективность и результативность» против «доверия и эмоций». Эта статья обозревает тему, сначала измеряя положение дел в цифрах (около 87% маркетологов используют генеративный ИИ, рост с 51% в 2024 году; более 71% рекламных бюджетов управляются алгоритмами; Google создал около 70 миллионов креативов с помощью Gemini только за Q4 2025; расходы на ИИ-инструменты в маркетинге выросли примерно втрое за 18 месяцев). Она охватывает пять областей, которые меняет ИИ (① создание контента ② рекламный креатив ③ таргетинг и доставка / программатик ④ персонализация / DCO ⑤ аналитика и измерения) и сообщённые эффекты (DCO с ~32% более высокой CTR и ~56% более низкой CPC, тексты от ИИ с 3,2-кратным ROI, first-party/контекстный таргетинг вплоть до 2-кратного ROAS — все опубликованы, зависят от условий); ядро, которое не меняется (стратегия, бренд, доверие, прорывное творчество остаются за людьми — ИИ это усилитель, нулевая база означает нулевой ответ); тектонический сдвиг SEO/AEO/LLMO (с внутренними ссылками); риски (разрыв восприятия 82% руководителей против 45% потребителей в отношении ИИ-рекламы, правдоподобные выдумки, brand safety, права/регулирование, бесконтрольная работа на автомате); как смещается работа маркетолога (задачи забираются, ответственность за суждения тяжелее; от производителя к главному редактору и стратегу); и пятишаговый план практики на сегодня. Самое большое влияние ИИ — освобождение человеческого времени от делания ради решения.

Как делать слайды презентаций с ИИ: инструменты, рабочий процесс и промпты

Как делать слайды презентаций с ИИ: инструменты, рабочий процесс и промпты

Выбирая ИИ для слайдов, начните с места показа и формата итогового файла. Разберите работу на структуру, текст и дизайн. В статье сравниваются Gamma, встроенный в PowerPoint Copilot, Gemini для Google Slides, Beautiful.ai, Canva, надстройка ChatGPT и Claude Slides. Мы показываем, как превратить разговор с Claude в презентацию и когда вместо слайдов подойдёт документ в Claude Docs. Пять шагов охватывают путь от структуры до проверки цифр, источников и отображения экспортированного файла. Дополняют их три практических промпта и приёмы, помогающие сократить информацию до главного. Независимо от того, используете ли вы одно приложение или несколько инструментов, проверяйте содержание и оформление отдельно.

Извлечение текста из изображений с помощью ИИ (OCR): полное руководство

Извлечение текста из изображений с помощью ИИ (OCR): полное руководство

Рукописная заметка, бумажный чек, английский внутри скриншота, вывеска на фото — перепечатка, которую вы всегда делали вручную, в 2026 году почти полностью не нужна благодаря ИИ. Это руководство начинается с того, чем AI OCR отличается от традиционного OCR (чтение по одному символу против понимания всей страницы по смыслу), затем сортирует три варианта (обычный чат-ИИ / специализированные инструменты вроде Google Lens / API и OSS, такие как Mistral OCR и PaddleOCR-VL) по сценариям. Сравниваются ChatGPT (GPT-5.5), Gemini 3.1 Pro и Claude (Opus 4.8) по сильным сторонам (рукопись → семейство GPT, структурирование таблиц → семейство Claude, множество страниц → длинный контекст Gemini, «чистый» OCR → специализированные модели; абсолютного чемпиона нет), даются три готовых промпта (расшифровать, не ломая; таблица в Markdown; чек в JSON, все с правилом «не выдумывать»), лучший выбор под каждый случай (рукопись, чеки, PDF, сложные таблицы, вертикальный/старый текст, формулы и код), шесть советов по точности с качеством изображения как 80 % результата, и единственная величайшая слабость AI OCR — правдоподобно выдумать то, что не смог прочитать (всегда сверяйте суммы, даты и имена с оригиналом) — плюс предостережения о приватности при отправке конфиденциального, об авторских правах и использовании для обучения. ИИ можно доверить только «чтение»; подтверждение — за человеком, который видел оригинал.