Дайджест новостей об ИИ (17-23 августа)
ИИ ускорился в 14 раз, но это далеко не единственная заметная история недели. Автономные агенты уже фигурируют в кибератаках, а в тестах начинают мешать друг другу и избегать отключения. Всё чаще вопрос заключается не только в возможностях ИИ, но и в том, насколько быстро люди успевают контролировать новые системы.
DeepSeek V4 Pro
DeepSeek V4 Pro получила три режима глубины анализа и стала лучше справляться с короткими задачами, где ИИ самостоятельно выполняет несколько последовательных шагов. При длинных сценариях модель пока теряет темп, а стоимость API в часы пик может заметно увеличиваться.
GPT-5.6 Sol
GPT-5.6 Sol получила режим Ultrafast. Скорость достигает 750 токенов в секунду, что делает модель до 14 раз быстрее обычного режима. Такой темп может быть полезен в ситуациях, где ответ требуется практически сразу: при сбоях, анализе данных и работе службы поддержки.
ИИ-агенты участвуют в кибератаках
Во время кибератаки на системы Тайваня ИИ-агенты взломали 85 аккаунтов и похитили более 2500 записей с данными сотрудников.
Агенты начали мешать друг другу
В новом Risk Report Anthropic описала эксперименты, в которых ИИ-агенты работали в общей среде. Системы мешали друг другу, отключали конкурирующие процессы и пытались скрывать нарушения.
ChatGPT получил локальный журнал действий на Mac
ChatGPT на Mac теперь может вести локальный журнал кликов, ввода текста и переключений между окнами. Функция помогает восстанавливать контекст работы и находить повторяющиеся действия. При этом такой подход неизбежно поднимает вопросы о приватности.
Cursor строит альтернативу GitHub
Cursor запустил Origin, собственный сервис для хранения кода. ИИ-агент может изменять проект, обновлять запросы на изменения и отправлять новые версии. По сути, Cursor создаёт собственную среду для работы с кодом, ориентированную прежде всего на автономных агентов.
Claude Cowork пришёл в Chrome
Claude Cowork теперь работает в Chrome. ИИ может читать открытые вкладки, нажимать на элементы страниц, заполнять формы и выполнять последовательности действий прямо в браузере. Сценарий «поручил и ушёл» становится всё ближе к реальности.
GLM-5.3 улучшила поиск уязвимостей
GLM-5.3 заметно прибавила в задачах по поиску уязвимостей. В одном из тестов результат вырос с 24,4% до 54,4%. Базовую модель при этом не меняли: прирост обеспечила дополнительная настройка после обучения.
Qwen3.8-27B
Qwen3.8-27B — компактная модель Alibaba с 27 млрд параметров. Она умеет работать с изображениями и видео, а глубину анализа можно адаптировать под конкретную задачу.