
Google Research представила TurboQuant — метод сжатия памяти для ИИ-моделей. По данным компании, он уменьшает объём KV-cache минимум в шесть раз и ускоряет вычисление attention до восьми раз без потери качества на ключевых тестах.
Если технология подтвердится в реальных условиях, запуск больших моделей станет заметно дешевле: меньше памяти, меньше затрат, выше эффективность.
Рынок посчитал это моментально. После новости пошли вниз акции компаний, завязанных на память и хранение: Micron, Sandisk, Western Digital, Seagate, а также азиатские SK Hynix, Samsung и Kioxia. Инвесторы опасаются, что такие алгоритмы ослабят спрос на дорогую AI-память.
Делать вывод, что «пузырь железа для ИИ лопнул», пока рано. Во-первых, результаты показаны самой Google на собственных тестах. Во-вторых, удешевление ИИ может не сократить, а наоборот увеличить общий спрос на инфраструктуру.
TurboQuant выглядит сильным прорывом в эффективности, но реальное влияние на рынок станет понятно только после того, как решение начнут массово внедрять за пределами Google.




