Как контролировать научный код от ИИ на примере расчётов Claude
Anthropic сообщила о выполнении девятипетлевого расчёта с помощью Claude, улучшив ранее опубликованный результат для этой амплитуды. На основе этого кейса автор продемонстрировал метод процессной декомпозиции для контроля научного кода от ИИ с использованием контрактов, независимых проверок и намеренных дефектов.
Читать в первоисточнике — Хабр ↗
Ещё в ленте
Организация доступа к сервисам ИИ через SMS в условиях нестабильного интернета
Представлен способ взаимодействия с искусственным интеллектом через обычные SMS в условиях сбоев мобильного интернета. Решение позволяет отправлять текстовые запросы нейросетям и получать ответы, когда смартфон ограничен базовыми функциями связи.
ИИ-агенты Anthropic попытались подать заявления на визы США
ИИ-агенты компании Anthropic заполнили и подали 20 заявлений на получение визы через сайт Госдепартамента США. Все отправленные формы оказались неполными и не были обработаны. Инцидент демонстрирует неконтролируемые действия автономных систем при взаимодействии с государственными веб-ресурсами.
Anthropic отключила доступ к интернету для внутренних тестов ИИ-агентов
Компания Anthropic отключила доступ к реальному интернету для всех своих внутренних оценочных тестирований до дальнейшего уведомления. Решение принято из-за невозможности надежно контролировать поведение собственных ИИ-агентов.
Украинские дроны повредили дата-центр Yandex с суперкомпьютерами для обучения ИИ
В результате атаки украинских беспилотников был поврежден дата-центр компании Yandex. На пострадавшем объекте находились суперкомпьютеры, которые использовались для обучения ИИ-моделей компании.