Модели
3 октября 2026
В материале рассматривается алгоритм Крумхансл-Шмуклера, который определяет тональность трека путем подсчета звучания 12 нот и поиска схожей гаммы. Автор анализирует типичные ошибки классического метода на реальных примерах и показывает, как подход меняется с применением нейросетей.
2 октября 2026
Разработчик выпустил версию инструмента голосового ввода Гига Писарь для платформы Android. Сервис переводит речь в текст непосредственно на устройстве с помощью модели GigaAM от Сбера, работающей без подключения к интернету. Ранее приложение было доступно только для macOS и Windows.
Автор статьи подготовил наглядное объяснение базовых принципов работы нейронных сетей без применения компьютера и калькулятора. Материал оформлен в виде письма, в котором логика вычислений и матричных операций демонстрируется на примере решения задачи XOR.
OpenAI представила руководство для стартапов по работе с семейством моделей GPT-6. В публикации рассказывается о подборе моделей, регулировке глубины рассуждений, улучшении промптов и координации инструментов. Также рассматривается подготовка рабочих процессов к запуску в продакшене.
Google представила результаты Gemini 4 Argon, где модель лидирует в 12 из 18 тестов. Ранее Gemini 3.1 Pro с аналогичной таблицей результатов уступила Claude в реальных задачах более 300 очков. Ситуация демонстрирует, что победа в тестах все меньше говорит о фактическом качестве работы моделей.
Папа Лев XIV заявил о принципиальной онтологической и эстетической разнице между подлинным искусством и результатами статистических вычислений машин на основе чужих изображений. По его словам, в работе алгоритмов отсутствует искра человечности.
Модель AstaBrief, используемая в системе Asta, была выложена в открытый доступ. Инструмент предназначен для быстрой генерации отчетов.
В материале разбирается устройство современной AI-инфраструктуры и причины замедления работы моделей уровня 70B под нагрузкой. На примере памяти, интерконнектов и методов параллелизма объясняется, где на практике возникают узкие места GPU-кластеров.
Разработчик исследовал механизмы работы с инструментами для локальной модели Qwen 27B на видеокарте RTX 3090 в системе с более чем 90 функциями. Вместо передачи полного каталога инструментов был реализован предварительный роутер, сокращающий их выборку примерно до двадцати в зависимости от контекста запроса. Решение направлено на качественное и быстрое выполнение корпоративных задач на локальном оборудовании в закрытом контуре.
Использование KV-кэша делает современные авторегрессионные трансформеры применимыми на практике, избавляя от повторного вычисления попарных произведений ключей и запросов для каждого токена. Механизм позволяет разменивать память на скорость и рассчитывать токен за линейное время. При этом ключевым лимитирующим фактором работы модели становится пропускная способность памяти.
Представлен быстрый аналог Jev API для классификации запросов, который работает локально на телефоне без облачных сервисов и платных подписок. Автор описал используемую модель и способ развертывания сервера для интеграции в ботов и сценарии автоматизации на Python.
Представитель Московской Биржи поднял вопрос целесообразности использования доменно-специфичных языков (DSL) на фоне распространения ИИ. Несмотря на способность больших языковых моделей понимать естественный язык, присущая ему неоднозначность может приводить к ошибкам и неправильным трактовкам.