Back to Timeline
TO
Сегодня я узнал

БлоGнот

Мира Мурати наконец показала, над чем работает её Thinking Machines Lab с двумя миллиардами seed-финансирования. На этой неделе компания запустила собственный блог и выложила первую статью в нем. Статья посвящена попытке сделать ответы LLM детерминированными — воспроизводимыми при одинаковых запросах.

Исследователь Хорас Хе пишет о проблеме недетерминированности в LLM — когда даже при установке температуры в 0, API языковых моделей выдают разные результаты при одинаковых запросах. Многие считают, что причина недетерминированности - это комбинация параллельных вычислений и неассоциативности операций с плавающей точкой на GPU. Хорас показывает, что это не полная картина.

Главная причина недетерминированности - отсутствие batch-инвариантности в ядрах GPU. Когда размер батча (количество одновременно обрабатываемых запросов) меняется, результаты для отдельных элементов могут отличаться из-за разного порядка суммирования чисел с плавающей точкой. В статье предлагается создать batch-инвариантные версии ключевых операций. По результатам тестирования на модели Qwen3-235B удалось добиться полной идентичности ответов — правда, ценой снижения производительности в 1,6 раза.

Это, конечно, еще не полное оправдания полученного финансирования, но хорошая иллюстрация его полезности, как мне кажется.

https://techcrunch.com/2025/09/10/thinking-machines-lab-wants-to-make-ai-models-more-consistent/


Что там у евреев? | Израиль

Бени Ландау и Джалле - песня Шевет Иегуда к месяцу Элуль и молитвам Слиxот.

Шаббат Шалом 🕯️🕯️

Хочешь знать, что там у евреев? 👉 Тебе сюда

Thinking Machines Lab wants to make AI models more consistent | TechCrunch
In a blog post shared Wednesday, Mira Murati's startup offered a rare glimpse into some of work its doing to improve AI …
TechCrunchTECHCRUNCH.COM