Причины шаблонности текстов от ИИ и методы измерения их похожести
Генерирующие контент модели искусственного интеллекта часто создают похожие друг на друга тексты. В материале объясняются причины появления шаблонов и описываются способы измерения похожести с помощью шинглов, алгоритма MinHash и структурных метрик.
Читать в первоисточнике — Хабр ↗
Ещё в ленте
Саймон Уиллисон создал функцию для блога с помощью голосового режима ChatGPT
Разработчик Саймон Уиллисон добавил на свой сайт раздел рассылок, написав код почти полностью голосом. Для работы использовалось десктопное приложение ChatGPT в режиме голосового общения, подключенное к локальной среде разработки. Модель реализовала функциональность на Django, включая структуру базы данных, шаблоны и функции импорта.
Опыт передачи кодовой базы ИИ-агентам через MCP-сервер
Автор поделился практическими наблюдениями за работой ИИ-агентов, изучающих проект через MCP-сервер. В материале рассматриваются нюансы управления контекстом, форматы передачи файловой структуры и способы защиты конфиденциальных данных от нейросетей.
Модель PANTHER стала самым быстрым решением на соревновании FLARE 2026
Проект участников Летней школы AIRI победил по скорости обработки данных на международном соревновании FLARE 2026 в рамках конференции MICCAI. Задача заключалась в обнаружении опухолей на КТ-снимках различных органов при жестких ограничениях по времени и видеопамяти. Разработанный ансамбль из пяти нейросетей PANTHER смог обрабатывать снимок за 11 секунд.
Опыт оптимизации запуска MoE-моделей в llama.cpp на GTX 1660 SUPER
Энтузиаст протестировал запуск модели gpt-oss-20b на видеокарте с 6 ГБ памяти через форк llama.cpp. Выяснилось, что штатный флаг -fit работает в 2,44 раза быстрее параметра -ngl 99 на длинных запросах, тогда как собственные оптимизации прироста не дали. В процессе автор также выявил нюансы измерения скорости и полезные параметры для слабых видеокарт.