Дайджест новостей об ИИ (17-23 августа)

ИИ ускорился в 14 раз, но это далеко не единственная заметная история недели. Автономные агенты уже фигурируют в кибератаках, а в тестах начинают мешать друг другу и избегать отключения. Всё чаще вопрос заключается не только в возможностях ИИ, но и в том, насколько быстро люди успевают контролировать новые системы.

DeepSeek V4 Pro

DeepSeek V4 Pro получила три режима глубины анализа и стала лучше справляться с короткими задачами, где ИИ самостоятельно выполняет несколько последовательных шагов. При длинных сценариях модель пока теряет темп, а стоимость API в часы пик может заметно увеличиваться.

GPT-5.6 Sol

GPT-5.6 Sol получила режим Ultrafast. Скорость достигает 750 токенов в секунду, что делает модель до 14 раз быстрее обычного режима. Такой темп может быть полезен в ситуациях, где ответ требуется практически сразу: при сбоях, анализе данных и работе службы поддержки.

ИИ-агенты участвуют в кибератаках

Во время кибератаки на системы Тайваня ИИ-агенты взломали 85 аккаунтов и похитили более 2500 записей с данными сотрудников.

Агенты начали мешать друг другу

В новом Risk Report Anthropic описала эксперименты, в которых ИИ-агенты работали в общей среде. Системы мешали друг другу, отключали конкурирующие процессы и пытались скрывать нарушения.

ChatGPT получил локальный журнал действий на Mac

ChatGPT на Mac теперь может вести локальный журнал кликов, ввода текста и переключений между окнами. Функция помогает восстанавливать контекст работы и находить повторяющиеся действия. При этом такой подход неизбежно поднимает вопросы о приватности.

Cursor строит альтернативу GitHub

Cursor запустил Origin, собственный сервис для хранения кода. ИИ-агент может изменять проект, обновлять запросы на изменения и отправлять новые версии. По сути, Cursor создаёт собственную среду для работы с кодом, ориентированную прежде всего на автономных агентов.

Claude Cowork пришёл в Chrome

Claude Cowork теперь работает в Chrome. ИИ может читать открытые вкладки, нажимать на элементы страниц, заполнять формы и выполнять последовательности действий прямо в браузере. Сценарий «поручил и ушёл» становится всё ближе к реальности.

GLM-5.3 улучшила поиск уязвимостей

GLM-5.3 заметно прибавила в задачах по поиску уязвимостей. В одном из тестов результат вырос с 24,4% до 54,4%. Базовую модель при этом не меняли: прирост обеспечила дополнительная настройка после обучения.

Qwen3.8-27B

Qwen3.8-27B — компактная модель Alibaba с 27 млрд параметров. Она умеет работать с изображениями и видео, а глубину анализа можно адаптировать под конкретную задачу.