IT Herald

AI

Спекулятивное декодирование в vLLM на AMD GPU

vLLM поддерживает спекулятивное декодирование — метод, который позволяет проверить несколько предложенных токенов за один проход целевой модели. В экспериментах на AMD Instinct MI300X и MI355X это повышало пропускную способность выходных токенов в зависимости от метода предложения и других факторов.

Входит ли математика в консерваторию?

Доказательство гипотезы о сферической теореме Адвигера, полученное с помощью ИИ, подняло остро стоящий вопрос: как институты будут поддерживать математику, когда её творческая работа станет в основном компьютерной?

Универсальная геометрия векторных представлений: новый метод трансляции embeddings без обучения

Исследователи представили первый метод для трансляции текстовых embeddings из одного векторного пространства в другое без парных данных и предварительного обучения. Методика достигает высокого косинусного сходства между моделями разных архитектур — и открывает серьёзные вопросы о безопасности векторных баз данных.

Caltech Mathathon — первый в истории хакатон, посвящённый исследовательской математике

ИИ за последние месяцы решил несколько математических гипотез, открытых десятилетиями. Калифорнийский технологический институт организует первый хакатон, посвящённый исследовательской математике, где сотня команд будет решать открытые гипотезы с помощью фронтальных моделей ИИ.

Как я отношусь к AI

Персональный взгляд на феномен искусственного интеллекта — от удивления его возможностями до опасений по поводу влияния на общество. Смесь надежд и тревог разработчика, наблюдающего кардинальную трансформацию отрасли.

AI, инструменты и трансформация

Во многих крупных компаниях сотни приложений и тысячи автоматизаций, но огромное количество рутинных задач по-прежнему выполняется вручную. AI обещает радикально упростить создание инструментов автоматизации, однако реальные процессы трансформации компаний гораздо сложнее.

Интеллектуальный люк открыт

Брайан Кентрилл критикует растущую тенденцию использования LLM для генерации контента в социальных сетях. Текст, написанный нейросетями, легко узнать по характерным стилистическим ошибкам, что подрывает доверие к автору и заставляет читателей прекратить чтение.

GPT-6 Astra в манипуляции роботизированными конечностями

Исследователи протестировали GPT-6 Astra на управлении роботизированными манипуляторами в двух задачах захвата и размещения предметов. На простой задаче размещения кубика Astra показала 95% успешность против 40% у Claude Fable 5.1, при этом работая быстрее и дешевле.

Восстание читателя: почему людей раздражает текст, написанный ИИ

Читатели начинают активно отвергать тексты, написанные с помощью больших языковых моделей. Вместе с обученным инструментом для обнаружения AI-текстов люди научились отличать подделки и теперь наказывают авторов потерей доверия.

Большие языковые модели как когнитивный вирус

Команда учёных предложила вирусную модель распространения LLM, показав, как использование больших языковых моделей может вызвать резкие фазовые переходы в обществе с непредсказуемыми последствиями для когнитивной независимости. Исследование выявило условия для возникновения «когнитивного иммунитета» против технологической зависимости.

«Предиктор следующего токена» — неправильная модель мышления об LLM

Хотя трансформеры генерируют текст по одному токену за раз, современные LLM обучаются не только на прогнозировании следующего токена из тренировочных данных. Они также учатся из собственных исследований через усиленное обучение с проверяемыми вознаграждениями.

Выпуск Artificial Analysis Intelligence Index v4.2

Artificial Analysis представила промежуточное обновление индекса v4.2 с более сложными задачами и приватными тестовыми наборами для предотвращения игр с метриками. Обновление включает новую оценку AA-Briefcase для агентских систем и GDP.pdf для работы с длинными документами.

Новости и дайджесты — в Telegram @it_herald