Вот и последняя глава курса. Здесь мы разом окинем взглядом, что происходит сейчас на переднем крае. Мультимодальность, модели рассуждений, ИИ-агенты, открытый исходный код, робототехника, AGI — разберём без технического жаргона «текущую точку» мира, где картина меняется за полгода. Числа и имена собственные читайте как снимок на момент марта 2026 года.
Обзор «сегодняшнего дня» ИИ за 5 минут
Прочувствуем скорость развития ИИ
Сейчас, когда пишется эта глава, в марте 2026 года, в индустрии ИИ девизом стало «то, что было нормой полгода назад, уже не работает».
Скорость хорошо видна в цифрах. Объём инвестиций в ИИ в 2025 году достиг рекордных 225,8 млрд долларов (около 34 трлн иен)[1]. 77% компаний уже внедрили ИИ или тестируют его, а 21% населения мира пользуется ИИ-инструментами ежедневно. Объём рынка ИИ в 2025 году оценивается примерно в 244–391 млрд долларов.
около 34 трлн иен
Что произошло за эти полтора года — оглянемся на ключевые события в хронологическом порядке.
Отсюда углубимся в четыре особенно важных тренда.
Мультимодальный ИИ — ИИ с органами чувств
Мультимодальный ИИ — это ИИ, способный интегрированно работать с несколькими форматами: текстом, изображениями, звуком, видео. Ранние LLM были «теми, кто умеет лишь читать и писать текст», а нынешний ИИ видит фотографии, слышит голос и создаёт видео.
Прорывы 2025 года
| Область | Название сервиса | Что умеет |
|---|---|---|
| Генерация изображений | GPT-4o (нативная генерация изображений) | Точно генерирует изображения с текстом. Сразу после выхода в марте 2025 года спрос был таким, что Альтман сказал, будто GPU «расплавились» |
| Генерация видео | Google Veo 3 | Генерирует видео со звуком. После выхода суммарно сгенерировано более 270 млн видео |
| Понимание длинных текстов | Gemini 2.5 Pro | Обрабатывает 1 млн токенов (больше одной книги) за раз. Дебютировал на 1-м месте в LMArena |
| Голосовой диалог | GPT-4o Advanced Voice | Естественный голосовой диалог в реальном времени без посредства текста. Возможно использование как переводчика |
С другой стороны, о завершении сервиса ИИ-генерации видео «Sora» от OpenAI было объявлено в 2026 году — из-за оценочных инфраструктурных затрат около 1 млн долларов в день и застоя в росте числа пользователей (Web и приложение — в апреле, API — в сентябре). Это высветило и реальность: качественная генерация видео пока требует колоссальных затрат.
💡 Подсказка для практики: анализ изображений (фото → текст) у большинства компаний доступен почти в бесплатном лимите. Попробуйте в повседневности: считывание чеков, преобразование рукописных заметок в текст, извлечение чисел из графиков.
Революция моделей рассуждений — появление «думающего» ИИ
С конца 2024 года в мире ИИ родилась новая категория — модели рассуждений.
Прежний ИИ действовал в стиле «спросили — мгновенно ответил». Модели рассуждений иные. Они берут «время подумать» перед тем, как ответить. Как человек, решая математическую задачу, не пишет ответ сразу, а рассуждает поэтапно, делая пометки.
Почему это важно
С появлением моделей рассуждений резко выросла производительность в областях, где ИИ был слаб, — математике, науке, сложном программировании.
На задачах уровня математической олимпиады (AIME 2025) достиг 92,7%. При совместном использовании инструментов Python — 99,5%.
Достиг высокой производительности при стоимости обучения всего около 6 млн долларов (против оценочных более 100 млн долларов у GPT-4) и в январе 2025 года стал №1 в США среди iOS-приложений. Акции Nvidia временно упали на 18%[2].
Уникальная функция, где разработчик может свободно задать «бюджет мышления». Реализовано «чередующееся мышление» (interleaved thinking), при котором рассуждение продолжается по ходу использования инструментов.
⚡ На что обратить внимание: вычисления во время вывода
Открытие «если дать подумать больше времени, ответ будет точнее» добавило новую ось в развитие ИИ. Помимо прежних «увеличить обучающие данные» и «увеличить модель» выяснилось, что производительность растёт и при увеличении объёма вычислений во время вывода.
ИИ-агенты — эпоха «поручать»
Самое горячее ключевое слово 2025–2026 годов — ИИ-агенты.
Прежний ИИ был собеседником, который «отвечает, когда спросишь». ИИ-агенты иные. Сообщаешь цель — и они строят план, используют инструменты и автономно выполняют задачу. Это близко к ощущению, когда «поручаешь» работу секретарю или ассистенту. Кто хочет разобраться в механизме подробнее — обратитесь к материалу «Что такое ИИ-агент», а о том, как несколько ИИ действуют согласованно, — «Что такое мультиагентность».
Конкретные примеры ИИ-агентов
| Агент | Что умеет | Особенности |
|---|---|---|
| Claude Code | Целостно и автономно выполняет генерацию, запуск и отладку кода | Один из трёх продуктов, достигших ARR более 1 млрд долларов в качестве ИИ для программирования |
| Operator | Управляет веб-браузером, выполняя бронирования и поиск за вас | Предусматривает точки контроля человеком, но защита от атак через промпты остаётся вызовом |
| Manus AI | Асинхронно выполняет сложные задачи в облаке | Появился в 2025 году. Meta приобрела его примерно за 2 млрд долларов, но в 2026 году власти Китая заблокировали сделку, и идёт процедура её расторжения |
| Devin | ИИ-инженер, автономно выполняющий разработку ПО | 500 долларов в месяц. Официальная доля успеха 13,86% — находится в развитии |
🛠 Если хотите всерьёз использовать «напарника», пишущего код, родственный курс «Практика ИИ-программирования» объясняет всё — от внедрения Claude Code и подобных до уверенного владения. Тем, кто хочет создавать приложения в одиночку, рекомендуем и «Инди-разработку с ИИ».
MCP — «общий язык» ИИ-агентов
Как стандарт для связи агентов с внешними инструментами стремительно распространяется разработанный Anthropic MCP (Model Context Protocol). В декабре 2025 года он был передан Linux Foundation, а число ежемесячных загрузок SDK достигло 97 млн. Его наперебой внедряют основные платформы — ChatGPT, Gemini, VS Code, AWS, Azure и другие.
По прогнозу Gartner, к концу 2026 года ИИ-агенты будут встроены в 40% корпоративных приложений[1].
⚠️ Вызовы агентов: агенты удобны, но на данный момент у них есть ряд важных ограничений. Ошибки в сложных решениях, риски безопасности (например, самовольная отправка информации), затраты (автономное повторение API-вызовов), непрозрачность подотчётности и прочее. Железное правило — не «поручить и забыть», а «поручить и проверить».
Подъём ИИ с открытым исходным кодом
Коммерческие ИИ вроде GPT-4 и Claude — это не всё. С огромной скоростью развивается ИИ с открытым исходным кодом, который можно использовать бесплатно и изменять.
Основные модели (на 2025 год)
| Модель | Разработчик | Особенности |
|---|---|---|
| Llama 4 Scout / Maverick | Meta | Scout: поддержка сверхдлинных текстов до 10 млн токенов, работает на одной H100. Maverick: производительность на уровне GPT-4o |
| DeepSeek V3 / R1 | DeepSeek (Китай) | V3 — уровня GPT-4o при стоимости обучения около 6 млн долларов. R1 стал №1 в США как модель рассуждений |
| Qwen 3 | Alibaba | Лицензия Apache 2.0. Поддержка 119 языков. По числу загрузок обошёл Llama |
🖥 Хотите запустить на своём ПК? Модели с открытым исходным кодом можно запускать и в своей среде. С чего начать — в материале «Как начать с локальной LLM», а какую модель выбрать — в «Сравнение локальных LLM-моделей».
Почему открытый исходный код важен
У ИИ с открытым исходным кодом есть пять значений.
Можно проверить устройство модели и оценить безопасность.
Можно построить специализированную модель на своих данных.
Если запускать на своём сервере, плата за API — ноль.
Можно использовать ИИ, не отправляя данные наружу.
Предотвращает монополию небольшого числа крупных компаний на ИИ.
Летом 2025 года случилось и символическое событие: по суммарному числу загрузок моделей с открытым исходным кодом модели из Китая (DeepSeek + Qwen) обошли модели из США. Геополитический баланс в разработке ИИ меняется.
💡 Что это значит для обычного пользователя: ИИ с открытым исходным кодом в основном для компаний и разработчиков, но его выгоды косвенно доходят до всех. Из-за обострения конкуренции цены на коммерческий ИИ падают, а производительность растёт. И правда, после появления DeepSeek R1 компании резко снизили плату за API.
ИИ будущего — перспективы после 2026 года
Напоследок посмотрим, куда ИИ движется в ближайшие годы, под тремя углами: робототехника, AGI, стратегия Японии в сфере ИИ.
Tesla Optimus нацелен на серийную цену 20–30 тыс. долларов. Figure 03 реально работает на заводе BMW. 1X NEO — домашний, около 20 тыс. долларов, поставки в 2026 году. Китай разрабатывает более 330 моделей силами свыше 140 компаний. Приоритетное направление и в Базовом плане Японии по ИИ (решение проблемы нехватки рабочей силы).
Anthropic — начало 2027 года, Google DeepMind — в пределах 3–5 лет, OpenAI — «мы поняли, как это построить», скептики — «нужен ещё принципиальный прорыв». Внимание привлекает и новая ось расширения — вложение вычислений во время вывода.
Бюджет — 1 трлн иен за 5 лет. SoftBank + OpenAI инвестируют около 41 млрд долларов, NTT tsuzumi 2 — отечественная LLM, «Гэннай» от Цифрового агентства — государственная ИИ-платформа. Особенность — приоритет инноваций над регулированием.
ИИ × робототехника — практическое внедрение «движущегося ИИ»
Человекоподобные роботы, соединившие интеллект LLM с телом робота, наконец начинают работать в реальных условиях.
- Figure 03 — реально развёрнут на заводе BMW. Инвестиции более 1 млрд долларов
- 1X NEO — первый в мире домашний человекоподобный робот. Около 20 тыс. долларов (499 долларов в месяц), поставки начинаются в 2026 году
- Tesla Optimus — нацелен на серийную цену 20–30 тыс. долларов. План производства десятков тысяч единиц в 2026 году
- Китай — более 140 компаний, разрабатывается свыше 330 моделей
В Базовом плане Японии по ИИ «физический ИИ» (робот × ИИ) тоже отнесён к приоритетным направлениям как решение проблемы нехватки рабочей силы[3].
Путь к AGI — прогнозы экспертов
О сроках наступления AGI (общего искусственного интеллекта — ИИ с интеллектом на уровне человека и выше) взгляды в индустрии расходятся. Значение термина подробно разобрано в материале «Что такое AGI (общий искусственный интеллект)», а о «технологической сингулярности», когда ИИ превзойдёт человека, — в «Что такое технологическая сингулярность».
| Позиция | Прогноз |
|---|---|
| Anthropic | «Начало 2027 года» — ИИ уровня нобелевских лауреатов к концу 2026 — началу 2027 года |
| OpenAI | «Мы поняли, как это построить» — оптимистичны, но избегают называть конкретный срок |
| Google DeepMind | «В пределах 3–5 лет» — существенно раньше прежних «10 лет» |
| Скептически настроенные исследователи | «Нужен ещё принципиальный прорыв» — на нынешней траектории 10–20 лет |
Даже если говорят «AGI грядёт», жизнь не изменится радикально прямо сейчас. Однако факт, что круг того, что ИИ умеет, расширяется буквально каждый месяц. Убеждение «ИИ это пока не по силам» через полгода может устареть.
Стратегия Японии в сфере ИИ
В декабре 2025 года правительство Японии разработало первый Базовый план по ИИ и объявило курс на инвестиции 1 трлн иен (около 7 млрд долларов) в ИИ и полупроводники за 5 лет[3].
- SoftBank × OpenAI — SoftBank инвестирует в OpenAI около 41 млрд долларов. Совместное предприятие «SB OAI Japan» строит ИИ-платформу для Японии
- NTT tsuzumi 2 — отечественная LLM. Работает на одной H100, мировой топ-уровень по производительности на японском языке
- «Гэннай» от Цифрового агентства — ИИ-платформа для примерно 180 тыс. госслужащих. Её приняли 7 компаний, включая NTT, KDDI и PFN
Япония придерживается позиции «приоритет инноваций над регулированием», что контрастирует со строгим регуляторным подходом ЕС.
Что стоит делать «сейчас» в эпоху ИИ
Реально попробуйте на бесплатных ИИ-инструментах. Лучше один раз попробовать, чем сто раз услышать.
ИИ — инструмент. Ценность рождается в сочетании с вашей компетенцией и креативностью.
Эпоха, где привычное меняется за полгода. Сохранять любопытство — главный навык.
- ИИ стал мультимодальным — научился работать не только с текстом, но и с изображениями, звуком и видео.
- С моделями рассуждений «думающий» ИИ, а с ИИ-агентами «поручаемый» ИИ стали реальностью.
- ИИ с открытым исходным кодом стремительно растёт, и геополитический баланс тоже меняется.
- Следующее поле битвы — робототехника, AGI, стратегии стран. Привычное меняется за полгода.
- Главное — три вещи: пробовать и привыкать, сочетать со своими сильными сторонами, наслаждаться переменами.
Источники
- Gartner. "Worldwide AI Spending Will Total $1.5 Trillion in 2025." Gartner Newsroom, September 2025. / Fortune Business Insights. "Artificial Intelligence Market Report." 2025.
- "DeepSeek R1: Open-source reasoning model." DeepSeek API Docs, January 20, 2025. / Market impact reported by multiple financial outlets, January 27, 2025.
- "Japan adopts first AI basic plan with 1 trillion yen investment." Nikkei, December 2025. / "Japan AI Basic Plan." AI Strategy Headquarters, December 2025.
Полезные ссылки:
- Hugging Face Models — хаб ИИ-моделей с открытым исходным кодом
- LM Arena — лидерборд для сравнения производительности ИИ-моделей
Вы системно освоили знания об ИИ — от основ до новейших тенденций. ИИ развивается день ото дня. Опираясь на заложенный в этом курсе фундамент, продолжайте пробовать инструменты на практике и следить за свежей информацией. Кто хочет освоить ИИ как напарника для написания кода — вам в родственный курс «Практика ИИ-программирования», а кто хочет создавать сервисы в одиночку — в «Инди-разработку с ИИ».