· Simon Willison

Сравнение Mistral Large 4 и других моделей на генерации сложного SVG

Саймон Уиллисон провел тест Mistral Large 4, Claude, GPT и Gemini на генерацию SVG-графики по нестандартному промпту. Эксперимент стал реакцией на обсуждение перенасыщения традиционных бенчмарков для передовых моделей. Модели протестировали на одном задании с базовыми настройками рассуждений и визуализировали результаты.

Читать в первоисточнике — Simon Willison ↗

Ещё в ленте

· TechCrunch · Продукты · Безопасность

Защита сайтов от ботов мешает работе персональных ИИ-агентов

Персональные ИИ-агенты создаются для покупок и бронирования билетов за пользователей, однако сталкиваются с намеренными блокировками и защитными антибот-системами веб-сайтов. В результате потребители оказываются заложниками ситуации. Решить возникшую проблему призван новый отраслевой стандарт.

· Хабр · Продукты

OpenAI тестирует цветные товарные карточки в выдаче ChatGPT

В органических результатах ChatGPT заметили тестирование товарных карточек с цветными лейблами вроде «лучший универсальный» или «лучший для новичков». Заметные плашки призваны повысить кликабельность товарных рекомендаций. Изменение стало расширением более раннего эксперимента OpenAI с менее заметными метками.

· TechCrunch · Продукты · Безопасность

Hark представила персонального ИИ-ассистента с акцентом на приватность

Лаборатория Hark выпустила персонального ИИ-ассистента, ориентированного на конфиденциальность данных. Продукт позиционируется как операционная система будущего и предназначен для конкуренции с Muse, Dots и Instinct.

· Хабр · Продукты

Использование LLM для инкрементального обновления карт в PlyLoom

Автор описал опыт интеграции больших языковых моделей (LLM) для доработки карт сущностей. В проекте PlyLoom рассматривается переход к инкрементальным изменениям без перезагрузки всего проекта, а также возможность сравнения версий файлов.