Дайджест новостей об ИИ (24-30 августа)

Нейросети уже понимают, когда вы просто сказали «угу». Другие превращают рабочие файлы в видео, помогают врачам проверять медицинские данные и работают с огромными объёмами контекста. Неделя получилась насыщенной прикладными ИИ-инструментами.

MAI-Image-2.5-Pro от Microsoft

MAI-Image-2.5-Pro от Microsoft создаёт изображения по запросу и позволяет точечно редактировать готовые картинки. Среди сильных сторон модели работа с текстом внутри изображений. Ограничения тоже есть: максимальное разрешение составляет 1024×1024 пикселя, а генерация работает с достаточно строгими фильтрами.

Claude Academy от Anthropic

Anthropic запустила бесплатную платформу Claude Academy с более чем 31 курсом по искусственному интеллекту и продуктам Claude. Есть программы для начинающих и продвинутые девятичасовые курсы для разработчиков. За некоторые программы можно получить сертификат.

ElevenLabs v3 Conversational

Модель v3 Conversational от ElevenLabs делает голосовой ИИ более естественным. Она учитывает тон разговора и способна отличать завершённую мысль от короткой реплики вроде «угу». Модель поддерживает 70 языков.

Медицинский ИИ-ассистент Яндекса

Яндекс открыл медицинского ИИ-ассистента для всех врачей. Система использует более 1000 источников и предоставляет ссылки на материалы, которые использовала при подготовке ответа.

GLM-5.3-Flash от Z.AI

GLM-5.3-Flash от Z.AI — открытая модель на 320 млрд параметров, ориентированная на программирование и сложные многошаговые задачи. Она заметно превосходит GLM-5.2, а по работе с кодом и агентами приближается к уровню Claude Opus 4.8.

FLUX Upscale

FLUX Upscale позволяет увеличивать разрешение ИИ-видео вплоть до 4K. Доступны два режима: один лучше сохраняет лицо и исходный референс, другой активнее восстанавливает и дорисовывает детали.

Команда /design в Claude Code

В Claude Code появилась команда /design. Одного запроса достаточно, чтобы получить несколько интерактивных вариантов интерфейса. После этого можно выбрать подходящий макет и передать его в код.

Wan 3.0 создаёт видео из документов

Wan 3.0 умеет создавать 30-секундные ролики на основе документов, таблиц, презентаций и веб-страниц. Генерация включает и звуковую дорожку, поэтому исходные рабочие материалы можно сразу превратить в готовый видеоконтент.

Qwen3.8-Flash от Alibaba

Qwen3.8-Flash от Alibaba работает с текстом, изображениями и видео и поддерживает контекст объёмом до 1 млн токенов. Это позволяет загружать в один запрос очень большие проекты. В тестах на программирование и агентные задачи модель показывает результаты, сопоставимые с более крупными системами.