Вот и последняя глава курса. Здесь мы разом окинем взглядом, что происходит сейчас на переднем крае. Мультимодальность, модели рассуждений, ИИ-агенты, открытый исходный код, робототехника, AGI — разберём без технического жаргона «текущую точку» мира, где картина меняется за полгода. Числа и имена собственные читайте как снимок на момент марта 2026 года.

Что вы узнаете из этой главы

Обзор «сегодняшнего дня» ИИ за 5 минут

К ИИ с органами чувств
Главным становится «мультимодальный ИИ», работающий не только с текстом, но и с изображениями, звуком и видео.
«Думать», «поручать»
Благодаря моделям рассуждений и ИИ-агентам ИИ из того, кто просто отвечает, превращается в того, кто действует автономно.
Будущее поле битвы
Робототехника, AGI, стратегии стран. Наслаждайтесь эпохой, где привычное меняется за полгода.

Прочувствуем скорость развития ИИ

Сейчас, когда пишется эта глава, в марте 2026 года, в индустрии ИИ девизом стало «то, что было нормой полгода назад, уже не работает».

Скорость хорошо видна в цифрах. Объём инвестиций в ИИ в 2025 году достиг рекордных 225,8 млрд долларов (около 34 трлн иен)[1]. 77% компаний уже внедрили ИИ или тестируют его, а 21% населения мира пользуется ИИ-инструментами ежедневно. Объём рынка ИИ в 2025 году оценивается примерно в 244–391 млрд долларов.

225,8 млрд $
инвестиции в ИИ в 2025 году (рекорд)
около 34 трлн иен
77%
компаний внедрили ИИ или тестируют его
21%
доля населения мира, использующая ИИ ежедневно

Что произошло за эти полтора года — оглянемся на ключевые события в хронологическом порядке.

Хронология развития ИИ (2024–2026)
📘 2024 год
Май — анонс GPT-4o. Начало эпохи мультимодальности
Август — принят EU AI Act. Первое в мире всеобъемлющее регулирование ИИ
Сентябрь — анонс o1. Начало моделей рассуждений
Декабрь — DeepSeek V3. Обучен примерно за 6 млн долларов и потряс отрасль
📗 2025 год
Январь — DeepSeek R1. №1 в США в iOS, акции Nvidia временно упали на 18%
Март — Gemini 2.5 Pro / нативная генерация изображений GPT-4o
Апрель — Llama 4 / o3, o4-mini / Qwen 3
Май — Claude 4 (Opus / Sonnet) / Veo 3
Октябрь — NTT tsuzumi 2 / открыт предзаказ на 1X NEO
Декабрь — Базовый план Японии по ИИ (1 трлн иен) / стандартизация MCP
📕 2026 год
Февраль — Claude Opus 4.6. SWE-Bench 72,5%
Март — завершение Sora / рынок ИИ-агентов 7,8 млрд долларов
🚀 2026 год — год ускорения практического внедрения ИИ-агентов и человекоподобных роботов

Отсюда углубимся в четыре особенно важных тренда.

Мультимодальный ИИ — ИИ с органами чувств

Мультимодальный ИИ — это ИИ, способный интегрированно работать с несколькими форматами: текстом, изображениями, звуком, видео. Ранние LLM были «теми, кто умеет лишь читать и писать текст», а нынешний ИИ видит фотографии, слышит голос и создаёт видео.

Прорывы 2025 года

Область Название сервиса Что умеет
Генерация изображений GPT-4o (нативная генерация изображений) Точно генерирует изображения с текстом. Сразу после выхода в марте 2025 года спрос был таким, что Альтман сказал, будто GPU «расплавились»
Генерация видео Google Veo 3 Генерирует видео со звуком. После выхода суммарно сгенерировано более 270 млн видео
Понимание длинных текстов Gemini 2.5 Pro Обрабатывает 1 млн токенов (больше одной книги) за раз. Дебютировал на 1-м месте в LMArena
Голосовой диалог GPT-4o Advanced Voice Естественный голосовой диалог в реальном времени без посредства текста. Возможно использование как переводчика

С другой стороны, о завершении сервиса ИИ-генерации видео «Sora» от OpenAI было объявлено в 2026 году — из-за оценочных инфраструктурных затрат около 1 млн долларов в день и застоя в росте числа пользователей (Web и приложение — в апреле, API — в сентябре). Это высветило и реальность: качественная генерация видео пока требует колоссальных затрат.

💡 Подсказка для практики: анализ изображений (фото → текст) у большинства компаний доступен почти в бесплатном лимите. Попробуйте в повседневности: считывание чеков, преобразование рукописных заметок в текст, извлечение чисел из графиков.

Революция моделей рассуждений — появление «думающего» ИИ

С конца 2024 года в мире ИИ родилась новая категория — модели рассуждений.

Прежний ИИ действовал в стиле «спросили — мгновенно ответил». Модели рассуждений иные. Они берут «время подумать» перед тем, как ответить. Как человек, решая математическую задачу, не пишет ответ сразу, а рассуждает поэтапно, делая пометки.

Почему это важно

С появлением моделей рассуждений резко выросла производительность в областях, где ИИ был слаб, — математике, науке, сложном программировании.

OpenAI o4-mini

На задачах уровня математической олимпиады (AIME 2025) достиг 92,7%. При совместном использовании инструментов Python — 99,5%.

DeepSeek R1

Достиг высокой производительности при стоимости обучения всего около 6 млн долларов (против оценочных более 100 млн долларов у GPT-4) и в январе 2025 года стал №1 в США среди iOS-приложений. Акции Nvidia временно упали на 18%[2].

Расширенное мышление Claude

Уникальная функция, где разработчик может свободно задать «бюджет мышления». Реализовано «чередующееся мышление» (interleaved thinking), при котором рассуждение продолжается по ходу использования инструментов.

⚡ На что обратить внимание: вычисления во время вывода
Открытие «если дать подумать больше времени, ответ будет точнее» добавило новую ось в развитие ИИ. Помимо прежних «увеличить обучающие данные» и «увеличить модель» выяснилось, что производительность растёт и при увеличении объёма вычислений во время вывода.

ИИ-агенты — эпоха «поручать»

Самое горячее ключевое слово 2025–2026 годов — ИИ-агенты.

Прежний ИИ был собеседником, который «отвечает, когда спросишь». ИИ-агенты иные. Сообщаешь цель — и они строят план, используют инструменты и автономно выполняют задачу. Это близко к ощущению, когда «поручаешь» работу секретарю или ассистенту. Кто хочет разобраться в механизме подробнее — обратитесь к материалу «Что такое ИИ-агент», а о том, как несколько ИИ действуют согласованно, — «Что такое мультиагентность».

Конкретные примеры ИИ-агентов

Агент Что умеет Особенности
Claude Code Целостно и автономно выполняет генерацию, запуск и отладку кода Один из трёх продуктов, достигших ARR более 1 млрд долларов в качестве ИИ для программирования
Operator Управляет веб-браузером, выполняя бронирования и поиск за вас Предусматривает точки контроля человеком, но защита от атак через промпты остаётся вызовом
Manus AI Асинхронно выполняет сложные задачи в облаке Появился в 2025 году. Meta приобрела его примерно за 2 млрд долларов, но в 2026 году власти Китая заблокировали сделку, и идёт процедура её расторжения
Devin ИИ-инженер, автономно выполняющий разработку ПО 500 долларов в месяц. Официальная доля успеха 13,86% — находится в развитии

🛠 Если хотите всерьёз использовать «напарника», пишущего код, родственный курс «Практика ИИ-программирования» объясняет всё — от внедрения Claude Code и подобных до уверенного владения. Тем, кто хочет создавать приложения в одиночку, рекомендуем и «Инди-разработку с ИИ».

MCP — «общий язык» ИИ-агентов

Как стандарт для связи агентов с внешними инструментами стремительно распространяется разработанный Anthropic MCP (Model Context Protocol). В декабре 2025 года он был передан Linux Foundation, а число ежемесячных загрузок SDK достигло 97 млн. Его наперебой внедряют основные платформы — ChatGPT, Gemini, VS Code, AWS, Azure и другие.

По прогнозу Gartner, к концу 2026 года ИИ-агенты будут встроены в 40% корпоративных приложений[1].

⚠️ Вызовы агентов: агенты удобны, но на данный момент у них есть ряд важных ограничений. Ошибки в сложных решениях, риски безопасности (например, самовольная отправка информации), затраты (автономное повторение API-вызовов), непрозрачность подотчётности и прочее. Железное правило — не «поручить и забыть», а «поручить и проверить».

Подъём ИИ с открытым исходным кодом

Коммерческие ИИ вроде GPT-4 и Claude — это не всё. С огромной скоростью развивается ИИ с открытым исходным кодом, который можно использовать бесплатно и изменять.

Основные модели (на 2025 год)

Модель Разработчик Особенности
Llama 4 Scout / Maverick Meta Scout: поддержка сверхдлинных текстов до 10 млн токенов, работает на одной H100. Maverick: производительность на уровне GPT-4o
DeepSeek V3 / R1 DeepSeek (Китай) V3 — уровня GPT-4o при стоимости обучения около 6 млн долларов. R1 стал №1 в США как модель рассуждений
Qwen 3 Alibaba Лицензия Apache 2.0. Поддержка 119 языков. По числу загрузок обошёл Llama

🖥 Хотите запустить на своём ПК? Модели с открытым исходным кодом можно запускать и в своей среде. С чего начать — в материале «Как начать с локальной LLM», а какую модель выбрать — в «Сравнение локальных LLM-моделей».

Почему открытый исходный код важен

У ИИ с открытым исходным кодом есть пять значений.

① Прозрачность

Можно проверить устройство модели и оценить безопасность.

② Кастомизация

Можно построить специализированную модель на своих данных.

③ Затраты

Если запускать на своём сервере, плата за API — ноль.

④ Конфиденциальность

Можно использовать ИИ, не отправляя данные наружу.

⑤ Стимул к конкуренции

Предотвращает монополию небольшого числа крупных компаний на ИИ.

Летом 2025 года случилось и символическое событие: по суммарному числу загрузок моделей с открытым исходным кодом модели из Китая (DeepSeek + Qwen) обошли модели из США. Геополитический баланс в разработке ИИ меняется.

💡 Что это значит для обычного пользователя: ИИ с открытым исходным кодом в основном для компаний и разработчиков, но его выгоды косвенно доходят до всех. Из-за обострения конкуренции цены на коммерческий ИИ падают, а производительность растёт. И правда, после появления DeepSeek R1 компании резко снизили плату за API.

ИИ будущего — перспективы после 2026 года

Напоследок посмотрим, куда ИИ движется в ближайшие годы, под тремя углами: робототехника, AGI, стратегия Японии в сфере ИИ.

🤖 ИИ × робототехника
к эпохе человекоподобных роботов

Tesla Optimus нацелен на серийную цену 20–30 тыс. долларов. Figure 03 реально работает на заводе BMW. 1X NEO — домашний, около 20 тыс. долларов, поставки в 2026 году. Китай разрабатывает более 330 моделей силами свыше 140 компаний. Приоритетное направление и в Базовом плане Японии по ИИ (решение проблемы нехватки рабочей силы).

🧠 Путь к AGI
прогнозы компаний по AGI расходятся

Anthropic — начало 2027 года, Google DeepMind — в пределах 3–5 лет, OpenAI — «мы поняли, как это построить», скептики — «нужен ещё принципиальный прорыв». Внимание привлекает и новая ось расширения — вложение вычислений во время вывода.

🇯🇵 Стратегия Японии в сфере ИИ
Базовый план по ИИ (декабрь 2025)

Бюджет — 1 трлн иен за 5 лет. SoftBank + OpenAI инвестируют около 41 млрд долларов, NTT tsuzumi 2 — отечественная LLM, «Гэннай» от Цифрового агентства — государственная ИИ-платформа. Особенность — приоритет инноваций над регулированием.

ИИ × робототехника — практическое внедрение «движущегося ИИ»

Человекоподобные роботы, соединившие интеллект LLM с телом робота, наконец начинают работать в реальных условиях.

  • Figure 03 — реально развёрнут на заводе BMW. Инвестиции более 1 млрд долларов
  • 1X NEO — первый в мире домашний человекоподобный робот. Около 20 тыс. долларов (499 долларов в месяц), поставки начинаются в 2026 году
  • Tesla Optimus — нацелен на серийную цену 20–30 тыс. долларов. План производства десятков тысяч единиц в 2026 году
  • Китай — более 140 компаний, разрабатывается свыше 330 моделей

В Базовом плане Японии по ИИ «физический ИИ» (робот × ИИ) тоже отнесён к приоритетным направлениям как решение проблемы нехватки рабочей силы[3].

Путь к AGI — прогнозы экспертов

О сроках наступления AGI (общего искусственного интеллекта — ИИ с интеллектом на уровне человека и выше) взгляды в индустрии расходятся. Значение термина подробно разобрано в материале «Что такое AGI (общий искусственный интеллект)», а о «технологической сингулярности», когда ИИ превзойдёт человека, — в «Что такое технологическая сингулярность».

Позиция Прогноз
Anthropic «Начало 2027 года» — ИИ уровня нобелевских лауреатов к концу 2026 — началу 2027 года
OpenAI «Мы поняли, как это построить» — оптимистичны, но избегают называть конкретный срок
Google DeepMind «В пределах 3–5 лет» — существенно раньше прежних «10 лет»
Скептически настроенные исследователи «Нужен ещё принципиальный прорыв» — на нынешней траектории 10–20 лет

Даже если говорят «AGI грядёт», жизнь не изменится радикально прямо сейчас. Однако факт, что круг того, что ИИ умеет, расширяется буквально каждый месяц. Убеждение «ИИ это пока не по силам» через полгода может устареть.

Стратегия Японии в сфере ИИ

В декабре 2025 года правительство Японии разработало первый Базовый план по ИИ и объявило курс на инвестиции 1 трлн иен (около 7 млрд долларов) в ИИ и полупроводники за 5 лет[3].

  • SoftBank × OpenAI — SoftBank инвестирует в OpenAI около 41 млрд долларов. Совместное предприятие «SB OAI Japan» строит ИИ-платформу для Японии
  • NTT tsuzumi 2 — отечественная LLM. Работает на одной H100, мировой топ-уровень по производительности на японском языке
  • «Гэннай» от Цифрового агентства — ИИ-платформа для примерно 180 тыс. госслужащих. Её приняли 7 компаний, включая NTT, KDDI и PFN

Япония придерживается позиции «приоритет инноваций над регулированием», что контрастирует со строгим регуляторным подходом ЕС.

Что стоит делать «сейчас» в эпоху ИИ

① Пробовать и привыкать

Реально попробуйте на бесплатных ИИ-инструментах. Лучше один раз попробовать, чем сто раз услышать.

② Сочетать со своими сильными сторонами

ИИ — инструмент. Ценность рождается в сочетании с вашей компетенцией и креативностью.

③ Наслаждаться переменами

Эпоха, где привычное меняется за полгода. Сохранять любопытство — главный навык.

Итоги главы
  • ИИ стал мультимодальным — научился работать не только с текстом, но и с изображениями, звуком и видео.
  • С моделями рассуждений «думающий» ИИ, а с ИИ-агентами «поручаемый» ИИ стали реальностью.
  • ИИ с открытым исходным кодом стремительно растёт, и геополитический баланс тоже меняется.
  • Следующее поле битвы — робототехника, AGI, стратегии стран. Привычное меняется за полгода.
  • Главное — три вещи: пробовать и привыкать, сочетать со своими сильными сторонами, наслаждаться переменами.

Источники

  1. Gartner. "Worldwide AI Spending Will Total $1.5 Trillion in 2025." Gartner Newsroom, September 2025. / Fortune Business Insights. "Artificial Intelligence Market Report." 2025.
  2. "DeepSeek R1: Open-source reasoning model." DeepSeek API Docs, January 20, 2025. / Market impact reported by multiple financial outlets, January 27, 2025.
  3. "Japan adopts first AI basic plan with 1 trillion yen investment." Nikkei, December 2025. / "Japan AI Basic Plan." AI Strategy Headquarters, December 2025.

Полезные ссылки:

  • Hugging Face Models — хаб ИИ-моделей с открытым исходным кодом
  • LM Arena — лидерборд для сравнения производительности ИИ-моделей
🎓 Поздравляем с завершением всех 6 глав!

Вы системно освоили знания об ИИ — от основ до новейших тенденций. ИИ развивается день ото дня. Опираясь на заложенный в этом курсе фундамент, продолжайте пробовать инструменты на практике и следить за свежей информацией. Кто хочет освоить ИИ как напарника для написания кода — вам в родственный курс «Практика ИИ-программирования», а кто хочет создавать сервисы в одиночку — в «Инди-разработку с ИИ».