Перейти к содержимому
ИИ-инструменты

Другие AI-инструменты: обзоры и сравнения

Откройте для себя новые AI-инструменты. Обзоры, характеристики и практические руководства.

48 статей

Сортируйте статьи, чтобы найти нужное

Статьи в категории Другие ИИ

Как запустить локальную LLM: ИИ на собственном ПК — характеристики, инструменты и лучшие модели для новичков

Как запустить локальную LLM: ИИ на собственном ПК — характеристики, инструменты и лучшие модели для новичков

Вы наверняка считаете, что LLM обязательно работает в облаке, но к 2026 году запуск ИИ целиком внутри собственного ПК — «локальная LLM» — стал реальным вариантом. Локальная LLM означает запуск модели вроде ChatGPT или Claude прямо на вашей машине, а не в облаке. Три главных преимущества: приватность (ввод никогда не покидает устройство), нулевая стоимость (нет платы за API) и работа офлайн (без интернета). Минусы: она не так умна, как топовый облачный ИИ, требует достаточно мощного ПК, нуждается в некоторой настройке и не имеет актуальных знаний. Это руководство для новичков объясняет, что такое локальная LLM (аналогия «стриминг против скачивания»), её плюсы и минусы, нужные характеристики и квантование (формат GGUF, где Q4_K_M — выбор по умолчанию, сохраняющий качество при урезании памяти примерно до четверти; около 0,5 ГБ памяти на 1B параметров при 4-битном квантовании), как начать (графический LM Studio для новичков, командный Ollama для разработчиков — 52 миллиона загрузок в месяц в первом квартале 2026), рекомендуемые модели 2026 года (Llama 3.2 7B, Google Gemma 4, Alibaba Qwen3.5, а также DeepSeek и Mistral — все открытые) и когда выбирать локально или облако (локально — для конфиденциальной, массовой и офлайн-работы; облако — для сложных задач). Самый быстрый первый шаг: запустить одну небольшую модель 3B–7B в LM Studio.

Подробный разбор релиза Claude Fable 5 — возможности, бенчмарки, цены, отличие от Mythos и новый дизайн безопасности

Подробный разбор релиза Claude Fable 5 — возможности, бенчмарки, цены, отличие от Mythos и новый дизайн безопасности

9 июня 2026 года Anthropic выпустила Claude Fable 5 — впервые в форме, доступной обычным пользователям и разработчикам, раскрыв возможности уровня «Mythos», флагманской модели, которую внутри компании давно считали самой мощной. Anthropic называет её самой мощной моделью из тех, что предлагает широкому кругу, со слоганом «создана для долгой и сложной работы». Этот разбор, написанный так, чтобы понял и новичок, охватывает то, что такое Fable 5 (публичная, безопасная форма возможностей класса Mythos, оптимизированная под завершение марафона, а не под один вопрос и ответ; идентификатор модели claude-fable-5), чем она отличается от своего близнеца Mythos 5 (идентичны внутри, различаются только ограничители; публика использует Fable), бенчмарки (SWE-Bench Pro 80.3% против Opus 4.8 69.2 и GPT-5.5 58.6, впервые в истории 90%+ на Hex, лучший результат на Cognition FrontierCode и Hebbia, новый SOTA в зрении с игрой в Pokémon без помощников), её настоящую силу в долгой автономности (фокус на миллионах токенов, 12-часовые запуски, Stripe завершила миграцию Ruby в 50 миллионов строк за один день вместо двух с лишним месяцев вручную, файловая память дала игровой задаче в 3 раза больше прироста, чем у Opus 4.8, GitHub сообщил о высокоавтономном долгосрочном кодинге), цены и доступность ($10 ввод / $50 вывод за 1M токенов, контекст 1M и вывод 128K, бесплатно в рамках каждого плана 9–22 июня, затем кредиты, API claude-fable-5 и GitHub Copilot), прямое сравнение с Opus 4.8 (стандартная $5/$25 против $10/$50, +11.1 пункта в SWE-Bench Pro, тот же контекст 1M, Opus 4.8 Fast Mode по $10/$50; тяжёлую работу — Fable 5, повседневную — стандартной Opus 4.8), главный новый дизайн безопасности (классификаторы кибер, биохимии и дистилляции, откатывающиеся к Opus 4.8 только при опасности, срабатывающие менее чем в 5% сессий, так что 95%+ работают на полной производительности, с хранением трафика класса Mythos 30 дней), контекст выпуска через несколько дней после предупреждения, что ИИ слишком опасен (третий путь, закрывающий только опасные зоны), и когда её использовать. Цифры приводятся по заявлению Anthropic и сообщениям и могут измениться.

Введение в генерацию видео с помощью ИИ [2026] — расстановка сил после Sora, Veo/Kling и советы по промптам

Введение в генерацию видео с помощью ИИ [2026] — расстановка сил после Sora, Veo/Kling и советы по промптам

Вводишь текст — и за секунды рождается видео со звуком: то, что ещё недавно было научной фантастикой, в 2026 году стало реальностью, и ситуация меняется с пугающей скоростью. Sora от OpenAI, которая была у всех на устах, закрыла приложение и веб-версию в апреле 2026 года (API отключат позже, в сентябре); её место заняли Google Veo, Kling и Runway. Это актуальное (июнь 2026) и не привязанное к инструменту руководство охватывает, что такое генерация видео на ИИ (создание движущихся кадров из слов или изображения, где синхронизация звука, 1080p–4K и «изображение-в-видео» теперь стандарт), расстановку сил в 2026 году (закрытие Sora — сообщается о давлении на ресурсы и расходы и снижении числа пользователей — и нынешние лидеры Google Veo 3.1, Kling 3.0 и Runway Gen-4.5, при норме посекундной оплаты), как это работает (диффузионные модели, расширенные на измерение времени; текст-в-видео и изображение-в-видео), общий рабочий процесс из 5 шагов (выбрать инструмент, промпт/изображение, задать длину/формат/звук, сгенерировать и выбрать, соединить при монтаже), главные советы по промптам для видео (объект + движение + работа камеры + стиль + длина + звук, где глаголы и камера — ключевое, одна склейка одно действие, используйте «изображение-в-видео», генерируйте с запасом), что она уже умеет, а что пока нет (длинные произведения за один заход и полная консистентность остаются трудными, а посекундная стоимость накапливается), и основы прав, водяных знаков и этики (SynthID и C2PA делают происхождение ИИ стандартным и неудаляемым, чисто ИИ-вывод защищён слабо с различиями по странам, коммерческое использование зависит от условий, а дипфейки реальных людей под запретом). Делайте склейки и соединяйте их при монтаже, а не стремитесь к длинному произведению за один заход. Поскольку область меняется быстро, всегда сверяйтесь с актуальной официальной информацией.

Как начать с генерации изображений ИИ — как это работает, 4 шага, анатомия промпта и права

Как начать с генерации изображений ИИ — как это работает, 4 шага, анатомия промпта и права

«Я не умею рисовать, значит, это не для меня» — это предубеждение насчёт генерации изображений ИИ перевёрнуто с ног на голову. Достаточно дать указание словами — и через секунды у вас готов визуал профессионального уровня. Это межинструментальное руководство охватывает: что такое генерация изображений ИИ (создание изображений с нуля посредством слов — навык умения формулировать, а не рисовать; версия промпт-инжиниринга для изображений), как это работает (диффузионные модели вырезают картинку из случайного шума, используя ваш промпт как подсказку, каждый раз рисуя с нуля, отчего результаты «дрожат»), общий рабочий процесс из 4 шагов, работающий в любом инструменте (выбрать инструмент, написать промпт, сгенерировать и выбрать, доработать и завершить — итерации это базовая предпосылка), ключевую анатомию промпта из 6 частей (объект, сцена/обстановка, стиль, свет/цвет, композиция/ракурс, технические параметры) плюс негативные промпты и соотношение сторон — хотя GPT Image и Imagen предпочитают простые предложения, тогда как инструменты семейства Stable Diffusion любят списки слов и негативы, 7 приёмов мастерства (перебирать число вариантов, добавлять понемногу, референсы, inpainting, фиксировать сид, увеличивать, сохранять удачные промпты), с чем ИИ справляется плохо (кисти, текст, согласованность, точность деталей) и обходные приёмы, а также основы прав, коммерческого использования и этики для работы (чисто ИИ-результат защищён слабо по позиции Ведомства США по авторским правам и решению по делу Thaler 2025 года, с различиями по странам; коммерческое использование зависит от условий каждого инструмента; дипфейки и несанкционированное копирование стиля недопустимы; распространяются метаданные о происхождении вроде C2PA у DALL-E). Какой инструмент выбрать и приёмы по конкретным инструментам — со ссылками на сравнение, Midjourney и Stable Diffusion. Знайте анатомию, перебирайте число вариантов, добавляйте слова понемногу — и кто угодно сможет приблизиться к задуманному кадру.

Промпт-инжиниринг: практический сборник — 6 частей и приёмы, чтобы получать от ИИ нужные ответы

Промпт-инжиниринг: практический сборник — 6 частей и приёмы, чтобы получать от ИИ нужные ответы

Вы задаёте одному и тому же ИИ один и тот же вопрос, и при этом один называет его бесполезным, а другой поражается тому, насколько он способный — и истинная причина этого разрыва часто не в мощности ИИ, а в том, как написан промпт. Это практический сборник того самого навыка, промпт-инжиниринга, выстроенный так, чтобы новичок мог пользоваться им сразу. Он охватывает, что такое промпт-инжиниринг (навык проектировать и улучшать вашу инструкцию для ИИ — не код, а мастерство того, как формулировать), три принципа, которые меняют результат (будьте конкретны, давайте контекст, задавайте формат вывода, плюс «делай X» вместо «не делай Y»), основные 6 частей хорошего промпта (роль, контекст, инструкция, примеры, формат, ограничения — элементы, общие для крупных фреймворков вроде COSTAR и RCOF; все шесть нужны не всегда), 7 практических приёмов (дать роль, показать образец/few-shot, рассуждать по шагам, зафиксировать формат вывода, структурировать разделителями, не просить слишком много за раз и итерировать — сильнейший из них итерация), пример до/после, приёмы следующего уровня (цепочка рассуждений, самосогласованность, цепочки промптов, ReAct — хотя рассуждающие модели вроде o-серии и расширенного мышления у Claude делают CoT внутри, поэтому формулировка цели работает лучше), 7 частых ошибок, а также особенности моделей и безопасность ввода. С внутренними ссылками на советы по промптам для разработки приложений и меры предосторожности при вводе. Превращайте расплывчатое в конкретное, сваливание в диалог — улучшаться может любой уже сегодня.

Что такое технологическая сингулярность? Понятное руководство для новичков — механизм, прогнозы и отличие от AGI

Что такое технологическая сингулярность? Понятное руководство для новичков — механизм, прогнозы и отличие от AGI

В июне 2025 года Сэм Альтман из OpenAI написал в блоге: «Мы прошли горизонт событий; взлёт начался» («The Gentle Singularity»). Однако другие исследователи напрочь отвергают идею как то, что никогда не наступит. Это руководство для новичков объясняет, что сингулярность (технологическая сингулярность) — это «точка перелома, в которой ИИ превосходит человеческий интеллект и начинает совершенствовать сам себя, так что прогресс становится взрывообразно быстрым и его уже нельзя ни предсказать, ни контролировать» (гипотеза, не реализованная на 2026 год). Разбираем суть — взрыв интеллекта = рекурсивное самосовершенствование, где умный ИИ строит ещё более умный, а улучшающий меняется с человека на ИИ; чем это отличается от AGI и ASI (AGI/ASI — «состояния» интеллекта, сингулярность — «событие» обретения непредсказуемости; AGI → самосовершенствование → внезапный скачок к ASI = сингулярность); историю термина (1965 — «взрыв интеллекта» I. J. Good → 1993 — Виндж делает название популярным → Курцвейл выводит в мейнстрим с «2045»); широкий разброс прогнозов (Курцвейл 2045, Альтман «уже началась», Виндж, а также скептики вроде Gary Marcus и «тормоз сложности» покойного Paul Allen); внезапный жёсткий взлёт против постепенного мягкого; надежды (прорывы в медицине и науке) и риски (потеря контроля, проблема согласования); глубокий скепсис (тормоз сложности, физические пределы, совсем иная вещь); и распространённые мифы вроде «роботы правят», «немедленно, как только появится AGI» и «фиксировано на 2045». Не бойтесь её чрезмерно и не мечтайте слишком сильно — выжимайте максимум из сегодняшнего ИИ, спокойно наблюдая за тем, что может прийти дальше.

Влияние ИИ на юристов, бухгалтеров и налоговых консультантов: что меняется, а что остаётся

Влияние ИИ на юристов, бухгалтеров и налоговых консультантов: что меняется, а что остаётся

В 2023 году юрист получил санкции после того, как записка, написанная с помощью ChatGPT, процитировала дела, оказавшиеся выдумкой ИИ, — и этот случай распространил по миру настороженность к теме права и ИИ. И всё же за несколько лет внедрение резко выросло: говорят, более 90% юристов используют тот или иной ИИ в повседневной работе. Как следующая часть нашей серии о влиянии ИИ по отраслям после #068 (торговля), #094 (маркетинг) и #097 (консалтинг), здесь разбираются профессии. Текущая ситуация в цифрах (62% юристов сообщают об экономии времени 6–20% в неделю; Harvey и CoCounsel от Thomson Reuters обработали 10М+ юридических документов в 1-м квартале 2026; использование генеративного ИИ в налоговых/бухгалтерских/аудиторских фирмах подскочило с 8% в 2024 до 21% в 2025; исследование Stanford показывает, что рабочие места для начинающих в таких сферах, как бухгалтерия, упали на 13% к 2022, у бухгалтеров +5%, у счетоводов -5%), какую работу меняет ИИ по профессиям (юристы = поиск дел, проверка договоров, извлечение обязательств; бухгалтеры = бухучёт, проверка первички, выборка, выявление рисков; налоговые консультанты = ввод данных, черновики деклараций, поиск норм — ИИ делает подготовительную работу, человек выносит окончательное решение), главную ловушку галлюцинации (выдумывание несуществующих дел/норм — ведущее к санкциям и потере доверия; Harvey заявляет о 99,7% точности проверенных ссылок и помечает остальные, CoCounsel опирает ссылки на базу данных дел, цитируя только реальные дела), неизменную суть ценности (окончательное суждение, профессиональный скептицизм, этика, серые налоговые суждения и — решающее — подпись и юридическая ответственность, которые нельзя делегировать ИИ), кризис молодых специалистов (автоматизация ученической рутины) и новые роли (специалисты по ИИ-комплаенсу, налоговые промпт-инженеры), а также советы по ролям для практиков, будущих специалистов и клиентов (сверяйте ссылки и цифры с первоисточниками; уточняйте обращение с конфиденциальностью). Регулирование и ответственность различаются по странам; в Японии ИИ-функции в бухгалтерском ПО тоже широко распространены. Вопрос, который ставит ИИ: то, что вы продаёте, — это работа или суждение и ответственность?

Как сделать субтитры и расшифровку из видео/аудио с помощью ИИ

Как сделать субтитры и расшифровку из видео/аудио с помощью ИИ

Раньше на субтитрование часового видео вручную уходил целый день — слушать, ставить на паузу, печатать, выставлять тайм-код. В 2026 году этот ад завершается тем, что вы "закидываете видео и ждёте несколько минут". С упором на субтитрование/расшифровку видео- и аудиоконтента (протоколы совещаний — в #086, OCR изображений — в #091) этот гид разбирает четыре этапа, которые автоматизирует ИИ (извлечение звука → расшифровка с диаризацией → нарезка тайм-кодов в SRT/VTT → перевод и оформление), отличие субтитров (SRT/VTT) от расшифровки и когда что использовать, сравнение инструментов (бесплатный и приватный Whisper, монтаж-всё Descript, высокоточный многоязычный Sonix и Happy Scribe, удобный для частных лиц Notta, мобильный CapCut, самые простые авто-субтитры YouTube — многие под капотом используют распознавание семейства Whisper), наиболее воспроизводимый процесс из 4 шагов (подготовка → расшифровка → вычитка → экспорт/наложение SRT/VTT), рекомендации по сценариям (YouTube, подкасты, лекции, интервью, конфиденциальное, многоязычное), шесть приёмов точности, где качество звука — это 80% результата (качество, настройка языка, список имён собственных, поиск-замена, диаризация, длина строк), главный путь многоязычного процесса (довести оригинал → ИИ-перевод → проверка носителем) и подводные камни — излишнее доверие к точности, слабость на шуме и жаргоне, авторские права, загрузка конфиденциального и смещение тайм-кодов. На чистом звуке точность 90–96% (по публикациям, зависит от условий), а труд падает на 80–90%. Работу — ИИ; отделку — проверку имён собственных и просмотр до публикации — вам.

Влияние ИИ на консалтинговую отрасль: что меняется, что нет и как выжить

Влияние ИИ на консалтинговую отрасль: что меняется, что нет и как выжить

Обряд посвящения младших консультантов — бессонные ночи над слайдами, бесконечный ручной поиск — трещит по швам. "Lilli" от McKinsey просматривает 100 000+ документов за секунды и набрасывает презентации; "Deckster" от BCG мгновенно доводит слайды; по одной из оценок ~80% исследовательской и слайдовой работы младшего аналитика могут быть заменены за секунды. Как следующий выпуск серии "Влияние ИИ по отраслям" после #068 (торговые компании) и #094 (маркетинг), статья обозревает консалтинг: картину в цифрах (Big Four и стратегические дома вложили 10+ млрд долларов в ИИ с 2023 года, PwC 1 млрд за три года, BCG ~25% выручки в 14,4 млрд за 2025 год = ~3,6 млрд от ИИ, исследование HBS с 758 консультантами BCG: пользователи ИИ делали на 12,2% больше задач, на 25,1% быстрее, на 40%+ качественнее), пять областей, которые меняет ИИ (исследования, слайды, анализ, протоколы и новые ИИ-стратегические услуги — пока чистый создатель рабочих мест в крупных фирмах), крах пирамидальной модели (рутинная работа джуниоров, ~80% по одной из оценок, автоматизируется за секунды; движение к компактным командам несколько-человек-плюс-ИИ с тревогой за карьерный конвейер), тектонический сдвиг цен (парадокс производительности — закончить быстрее значит выставить меньше при почасовых ставках — и 73% клиентов предпочитают оплату по результату, толкая переход к оплате по результату и фиксированной цене), неизменную суть ценности (постановка вопроса, интерпретация, суждение, доверие, исполнение — консультант, управляющий системой, важнее самой системы), разделение на гигантов-танкеров против бутиков-катеров (рост небольших фирм до 50% по оценкам) и советы по ролям для соискателей, практиков и компаний-клиентов. Вопрос, который ставит ИИ: ваша ценность — это работа или суждение?

Что такое AGI (общий искусственный интеллект)? Понятное руководство для новичков

Что такое AGI (общий искусственный интеллект)? Понятное руководство для новичков

На форуме в Davos в январе 2026 года ведущие умы отрасли столкнулись по поводу «AGI уже не за горами» против «до сути ещё далеко» — а запалом послужил AGI (Artificial General Intelligence). Эта понятная для новичков статья начинается с того, что такое AGI — «универсальный ИИ, который, подобно человеку, способен сам учиться и решать даже совершенно новые задачи в любой области» (хотя это ещё не реализованная цель на 2026 год), — затем разбирает решающее отличие от сегодняшнего узкого ИИ в стиле ChatGPT (может ли он «переносить» знания в другую область; обобщение и автономное освоение навыков), трёхступенчатую схему узкий ИИ → AGI → ASI (сверхинтеллект), широкий разброс прогнозов экспертов по срокам (Amodei из Anthropic оптимистичен — в пределах нескольких лет/около 2027 года, Hassabis из DeepMind осторожен — ~50% к 2030 году, медиана опроса исследователей — 2047 год, скептики вроде Marcus говорят, что это далеко или не случится — разброс проистекает из различающихся определений), насколько сегодняшний ИИ близок (ниже человеческого базового уровня на ARC-AGI, но подбирается к порогу за счёт мультимодальности и агентов), надежды (ускорение исследований болезней и науки) и риски (рабочие места, злоупотребления, проблема согласования — позиционируемая Anthropic и UK AISI как критическая точка принятия решений), а также частые мифы вроде «ChatGPT — это уже AGI» и «AGI = обладает сознанием». Ни чрезмерно боясь, ни чрезмерно мечтая, освойте узкий ИИ, что у вас в руках, спокойно наблюдая за тем, что придёт дальше.

Как ИИ влияет на маркетинг и рекламу: что меняется, а что нет

Как ИИ влияет на маркетинг и рекламу: что меняется, а что нет

Когда генеративно-ИИ рождественский ролик Coca-Cola в конце 2024 года раскритиковали как «бездушный», это символизировало перетягивание каната, которое ИИ привносит в маркетинг: «эффективность и результативность» против «доверия и эмоций». Эта статья обозревает тему, сначала измеряя положение дел в цифрах (около 87% маркетологов используют генеративный ИИ, рост с 51% в 2024 году; более 71% рекламных бюджетов управляются алгоритмами; Google создал около 70 миллионов креативов с помощью Gemini только за Q4 2025; расходы на ИИ-инструменты в маркетинге выросли примерно втрое за 18 месяцев). Она охватывает пять областей, которые меняет ИИ (① создание контента ② рекламный креатив ③ таргетинг и доставка / программатик ④ персонализация / DCO ⑤ аналитика и измерения) и сообщённые эффекты (DCO с ~32% более высокой CTR и ~56% более низкой CPC, тексты от ИИ с 3,2-кратным ROI, first-party/контекстный таргетинг вплоть до 2-кратного ROAS — все опубликованы, зависят от условий); ядро, которое не меняется (стратегия, бренд, доверие, прорывное творчество остаются за людьми — ИИ это усилитель, нулевая база означает нулевой ответ); тектонический сдвиг SEO/AEO/LLMO (с внутренними ссылками); риски (разрыв восприятия 82% руководителей против 45% потребителей в отношении ИИ-рекламы, правдоподобные выдумки, brand safety, права/регулирование, бесконтрольная работа на автомате); как смещается работа маркетолога (задачи забираются, ответственность за суждения тяжелее; от производителя к главному редактору и стратегу); и пятишаговый план практики на сегодня. Самое большое влияние ИИ — освобождение человеческого времени от делания ради решения.

Как делать слайды презентаций с ИИ: инструменты, рабочий процесс и промпты

Как делать слайды презентаций с ИИ: инструменты, рабочий процесс и промпты

Презентация — завтра с утра, а слайды пустые — но напечатайте одну строку с темой, и через минуты перед вами 20 черновых слайдов. Это ИИ-слайды в 2026 году. Гид разбивает создание слайдов на три этапа (структура, текст, дизайн) и излагает два подхода: генерация «всё в одном» (дайте тему — получите всё) против разделения труда (доведите структуру и текст в ChatGPT/Claude/Gemini, затем оформите специализированным инструментом). Сравниваются основные инструменты (быстрый Gamma, нативный-.pptx-без-поломок Copilot в PowerPoint, сильный в совместной работе Gemini для Google Slides, самый красивый Beautiful.ai, богатый шаблонами Canva, надстройка ChatGPT для PowerPoint, запущенная в мае 2026 — абсолютного чемпиона нет; выбирайте по выходу), самый воспроизводимый процесс из 5 шагов (структура → текст → влить в инструмент дизайна → проверить цифры и источники → экспорт в .pptx/Slides), три готовых промпта (план, развернуть слайд с заметками докладчика, переформатировать для инструмента дизайна), шесть приёмов для слайдов, которые попадают в цель (одно сообщение на слайд, сократить текст вдвое и др.) и подводные камни — поломка вёрстки .pptx, раздутый первый черновик, правдоподобно выдуманные данные, отправка конфиденциального и закрытие инструментов (закрытие слайдов Tome в апреле 2025 как урок). ИИ — партнёр, который выдаёт черновик в одно мгновение; сокращение и проверка — работа человека.