Риски безопасности при использовании консольных ИИ-агентов
Разработчик описал опыт использования консольных ИИ-агентов и возникающие проблемы с безопасностью. В процессе работы ассистент запрашивал доступ к файлам за пределами проекта, включая домашнюю папку и корень системы, а также предлагал автоматически выполнить команды по очистке истории терминала. Случай обращает внимание на необходимость строгого контроля за действиями автономных моделей в локальной среде.
Читать в первоисточнике — Хабр ↗
Ещё в ленте
Smart Engines перенесла распознавание документов и лиц в браузер через WebAssembly
Компания Smart Engines опубликовала дайджест о переносе собственных решений для распознавания в браузер с помощью WebAssembly. Технология позволяет обрабатывать паспорта, банковские карты, QR-коды и документы, а также выполнять небиометрическую сверку лиц и антифрод прямо на стороне клиента.
Как устроены новые decision-модели: Jev, Clef, pplx-decider, Strands Decider, Laya и GLiDE
Компания TypeSafe представила модель Jev класса System One, которая принимает решения за один прямой проход без генерации токенов, после чего аналогичные решения выпустили Cloudflare, Perplexity, AWS, Convai Innovations и Fastino. Новые decision-модели работают как быстрые классификаторы и обходятся значительно дешевле традиционных LLM: миллион решений у самой доступной стоит 12 долларов против 700 долларов у Claude Sonnet 5. В материале приводится технический разбор архитектуры всех шести моделей, результаты независимых тестов и рекомендации для продакшена.
Mistral AI представила мультимодальную модель Mistral Large 4
Французская лаборатория Mistral AI выпустила новую большую мультимодальную модель Mistral Large 4. С помощью этой разработки компания рассчитывает опередить конкурентов из США и Китая.
С помощью Claude найдено решение задачи 3SUM быстрее O(N²)
Исследователи Вирджиния Василевска-Уильямс и Джош Алман представили алгоритм решения задачи 3SUM и задачи поиска кратчайших путей (APSP) быстрее квадратичного времени. По заявлению авторов, изначальный алгоритм предложила модель Claude от Anthropic, после чего ученые улучшили его и верифицировали результат с помощью ИИ.