Сравнение Mistral Large 4 и других моделей на генерации сложного SVG
Саймон Уиллисон провел тест Mistral Large 4, Claude, GPT и Gemini на генерацию SVG-графики по нестандартному промпту. Эксперимент стал реакцией на обсуждение перенасыщения традиционных бенчмарков для передовых моделей. Модели протестировали на одном задании с базовыми настройками рассуждений и визуализировали результаты.
Читать в первоисточнике — Simon Willison ↗
Ещё в ленте
Защита сайтов от ботов мешает работе персональных ИИ-агентов
Персональные ИИ-агенты создаются для покупок и бронирования билетов за пользователей, однако сталкиваются с намеренными блокировками и защитными антибот-системами веб-сайтов. В результате потребители оказываются заложниками ситуации. Решить возникшую проблему призван новый отраслевой стандарт.
OpenAI тестирует цветные товарные карточки в выдаче ChatGPT
В органических результатах ChatGPT заметили тестирование товарных карточек с цветными лейблами вроде «лучший универсальный» или «лучший для новичков». Заметные плашки призваны повысить кликабельность товарных рекомендаций. Изменение стало расширением более раннего эксперимента OpenAI с менее заметными метками.
Hark представила персонального ИИ-ассистента с акцентом на приватность
Лаборатория Hark выпустила персонального ИИ-ассистента, ориентированного на конфиденциальность данных. Продукт позиционируется как операционная система будущего и предназначен для конкуренции с Muse, Dots и Instinct.
Использование LLM для инкрементального обновления карт в PlyLoom
Автор описал опыт интеграции больших языковых моделей (LLM) для доработки карт сущностей. В проекте PlyLoom рассматривается переход к инкрементальным изменениям без перезагрузки всего проекта, а также возможность сравнения версий файлов.