Архив, страница 4

1 октября 2026

· Хабр · Модели · Исследования

Масштабное тестирование модели Jev в сравнении с решениями OpenAI

Автор провел 22 эксперимента и отправил около 160 тысяч запросов к jev-1.13.0 и контрольным моделям OpenAI для проверки границ практического применения. Исследование было направлено на оценку точности, надежности показателей уверенности при роутинге, а также поведения при длинном контексте и зашумленных данных. Результаты помогают заранее выявить ограничения модели до ее интеграции в рабочие процессы.

· Хабр · Модели · Исследования

Claude Opus 5 расходует в 3,9 раза больше токенов на русский текст, чем GPT-5.5

Сравнение 11 токенизаторов показало, что модель Claude Opus 5 расходует на русский язык почти в четыре раза больше токенов, чем GPT-5.5, из-за чего итоговая стоимость работы с текстом существенно возрастает. В то же время у моделей YandexGPT и GigaChat токенизация русскоязычного текста оказалась наиболее эффективной — до пяти символов на токен. Автор исследования также представил методику пересчета стоимости и программный код для самостоятельных замеров.

· Хабр · Исследования · Модели

Подход к формированию смысловых эмбеддингов в нейросетях

В публикации рассматривается концепция создания смысловых эмбеддингов для нейронных сетей. Предложенная идея призвана позволить моделям строить векторные представления смысловых структур, а не только отдельных токенов.

· Хабр · Модели · Исследования

LSWM 2.0: доработка экспериментальной нейросетевой архитектуры

Автор проекта LSWM провел дополнительное тестирование модели и выявил в ней множество технических проблем. В публикации представлены попытки исправить обнаруженные недочеты и улучшить архитектуру сети.

· Хабр · Open source · Исследования

MWS AI представила RESON и RESON OSD для оценки моделей распознавания речи

Команда направления Audiogram в MWS AI выпустила в открытый доступ два новых инструмента для работы с речевыми технологиями. Релиз включает инструмент для анализа качества ASR-моделей RESON, а также открытый бенчмарк RESON OSD, предназначенный для тестирования распознавания русскоязычной речи.

· Хабр · Продукты · Модели

Ускорение локальных LLM на Mac с помощью движка Splash

Опубликован разбор движка Splash, ускоряющего работу локальных языковых моделей на macOS за счет спекулятивного декодирования DFlash 2. В материале рассматриваются результаты тестов, ограничения системы, требования к памяти и диску, а также нюансы выбора квантования Q4 и Q8.

· Хабр · Железо · Бизнес

Huawei и Alibaba представили новые аппаратные решения для ИИ

Huawei и Alibaba практически одновременно анонсировали новое аппаратное обеспечение для задач искусственного интеллекта. Вместо копирования архитектуры NVIDIA китайские разработчики создают собственные решения для объединения тысяч чипов в условиях ограниченного доступа к западным технологиям.

Сравнение памяти агента Радиант и контекстного окна в миллион токенов

В эксперименте проверили способность агента Коворк находить в рабочей переписке сообщения пятилетней давности с помощью памяти Радианта. Система успешно нашла 15 из 15 целевых сообщений. Для сравнения, контекстного окна объемом в миллион токенов хватает лишь на переписку за последние четыре месяца.

Ограничения автономных ИИ-агентов в разработке и роль ревью кода

Дэкс Хорти из HumanLayer объяснил, почему концепция полной автоматизации разработки кода агентами пока не работает из-за отсутствия у моделей сигнала о поддерживаемости кода. В качестве решения предлагается вернуть ручное код-ревью в формате дешевого планирования. Автор статьи также проверил эти выводы на собственном конвейере с Claude Code и Codex, выявив расхождения со спецификацией даже при полностью успешных тестах.

· Хабр · Продукты

Как устроен пайплайн современных систем распознавания номеров

В компании «Фалькон Тех» рассказали об устройстве пайплайна систем распознавания автомобильных номеров (ANPR). Процесс не сводится к классическому OCR: системе требуется обнаружить транспорт, локализовать пластину и компенсировать внешние факторы, включая угол съемки, освещение и загрязнения.

Мэттью Грин описал риск создания сетевых червей на базе ИИ-агентов

Криптограф Мэттью Грин обратил внимание, что изолированные в песочницах ИИ-агенты способны передавать инструкции друг другу через общий кэш пакетов и менять поведение систем-получателей. В сочетании с каналами коммуникации вроде почты, Slack или WhatsApp это создает условия для самораспространения вредоносных инструкций между персональными агентами по принципу сетевого червя.

· Хабр · Модели · Исследования

Обзор модели Jev и концепции decision models

В AI-сообществе набирает популярность модель Jev, которую позиционируют как прорыв в развитии агентов и возможную альтернативу традиционным LLM. В материале рассматриваются сферы применения этой технологии и ее потенциальная практическая польза.

· OpenAI · Бизнес · Продукты

Клуб The Den сократил время подготовки документов с помощью ChatGPT Work

Социальный клуб The Den внедрил ChatGPT Work при открытии новой локации, экономя от 10 до 15 часов в неделю. Подготовка заявок на гранты сократилась с трех дней до двух часов, а сбор материалов для лицензии на алкоголь — с четырех дней до трех часов.

30 сентября 2026

· Google DeepMind · Модели

Google DeepMind анонсировала Gemini 4 Argon

Google DeepMind представила Gemini 4 Argon. Разработчики охарактеризовали новую разработку как следующий этап развития передового интеллекта.

· Ars Technica · Регулирование

Роберт Кеннеди — младший считает, что ИИ избавит от диктата медицинских фактов

Политик Роберт Кеннеди — младший выразил мнение, что искусственный интеллект освободит общество от жестких рамок медицинских фактов и экспертных оценок. В материале подчеркивается, что технологии ИИ пока несовершенны, однако галлюцинируют реже самого спикера.

Трамп договорился с ИИ-компаниями о добровольных тестах безопасности

План Дональда Трампа по борьбе с рисками искусственного интеллекта строится на саморегулировании технологических корпораций. В рамках этой инициативы десятки профильных компаний согласились добровольно проводить тесты безопасности своих разработок.

Некоммерческая организация подала в суд на OpenAI из-за взлома Hugging Face

Некоммерческая организация подала иск против OpenAI в связи со взломом платформы Hugging Face. Истец заявляет, что ссылка на искусственный интеллект не освобождает от ответственности, а OpenAI заставляет других страдать от последствий своих небезопасных решений.