Дайджест новостей об ИИ (24-30 августа)
Нейросети уже понимают, когда вы просто сказали «угу». Другие превращают рабочие файлы в видео, помогают врачам проверять медицинские данные и работают с огромными объёмами контекста. Неделя получилась насыщенной прикладными ИИ-инструментами.
MAI-Image-2.5-Pro от Microsoft
MAI-Image-2.5-Pro от Microsoft создаёт изображения по запросу и позволяет точечно редактировать готовые картинки. Среди сильных сторон модели работа с текстом внутри изображений. Ограничения тоже есть: максимальное разрешение составляет 1024×1024 пикселя, а генерация работает с достаточно строгими фильтрами.
Claude Academy от Anthropic
Anthropic запустила бесплатную платформу Claude Academy с более чем 31 курсом по искусственному интеллекту и продуктам Claude. Есть программы для начинающих и продвинутые девятичасовые курсы для разработчиков. За некоторые программы можно получить сертификат.
ElevenLabs v3 Conversational
Модель v3 Conversational от ElevenLabs делает голосовой ИИ более естественным. Она учитывает тон разговора и способна отличать завершённую мысль от короткой реплики вроде «угу». Модель поддерживает 70 языков.
Медицинский ИИ-ассистент Яндекса
Яндекс открыл медицинского ИИ-ассистента для всех врачей. Система использует более 1000 источников и предоставляет ссылки на материалы, которые использовала при подготовке ответа.
GLM-5.3-Flash от Z.AI
GLM-5.3-Flash от Z.AI — открытая модель на 320 млрд параметров, ориентированная на программирование и сложные многошаговые задачи. Она заметно превосходит GLM-5.2, а по работе с кодом и агентами приближается к уровню Claude Opus 4.8.
FLUX Upscale
FLUX Upscale позволяет увеличивать разрешение ИИ-видео вплоть до 4K. Доступны два режима: один лучше сохраняет лицо и исходный референс, другой активнее восстанавливает и дорисовывает детали.
Команда /design в Claude Code
В Claude Code появилась команда /design. Одного запроса достаточно, чтобы получить несколько интерактивных вариантов интерфейса. После этого можно выбрать подходящий макет и передать его в код.
Wan 3.0 создаёт видео из документов
Wan 3.0 умеет создавать 30-секундные ролики на основе документов, таблиц, презентаций и веб-страниц. Генерация включает и звуковую дорожку, поэтому исходные рабочие материалы можно сразу превратить в готовый видеоконтент.
Qwen3.8-Flash от Alibaba
Qwen3.8-Flash от Alibaba работает с текстом, изображениями и видео и поддерживает контекст объёмом до 1 млн токенов. Это позволяет загружать в один запрос очень большие проекты. В тестах на программирование и агентные задачи модель показывает результаты, сопоставимые с более крупными системами.