Huawei и Alibaba представили новые аппаратные решения для ИИ
Huawei и Alibaba практически одновременно анонсировали новое аппаратное обеспечение для задач искусственного интеллекта. Вместо копирования архитектуры NVIDIA китайские разработчики создают собственные решения для объединения тысяч чипов в условиях ограниченного доступа к западным технологиям.
Читать в первоисточнике — Хабр ↗
Ещё в ленте
LSWM 2.0: доработка экспериментальной нейросетевой архитектуры
Автор проекта LSWM провел дополнительное тестирование модели и выявил в ней множество технических проблем. В публикации представлены попытки исправить обнаруженные недочеты и улучшить архитектуру сети.
MWS AI представила RESON и RESON OSD для оценки моделей распознавания речи
Команда направления Audiogram в MWS AI выпустила в открытый доступ два новых инструмента для работы с речевыми технологиями. Релиз включает инструмент для анализа качества ASR-моделей RESON, а также открытый бенчмарк RESON OSD, предназначенный для тестирования распознавания русскоязычной речи.
Ускорение локальных LLM на Mac с помощью движка Splash
Опубликован разбор движка Splash, ускоряющего работу локальных языковых моделей на macOS за счет спекулятивного декодирования DFlash 2. В материале рассматриваются результаты тестов, ограничения системы, требования к памяти и диску, а также нюансы выбора квантования Q4 и Q8.
Сравнение памяти агента Радиант и контекстного окна в миллион токенов
В эксперименте проверили способность агента Коворк находить в рабочей переписке сообщения пятилетней давности с помощью памяти Радианта. Система успешно нашла 15 из 15 целевых сообщений. Для сравнения, контекстного окна объемом в миллион токенов хватает лишь на переписку за последние четыре месяца.