На Cloud Next Google представила TPU 8-го поколения, разработанные для обработки агентских задач, впервые разделив обучение и вывод результатов на два отдельных чипа.
TPU 8t — версия для тяжелого training. Google говорит, что один superpod теперь масштабируется до 9600 чипов и дает до 121 exaflops compute. Главная цель — сократить цикл обучения frontier-моделей с месяцев до недель.
TPU 8i, наоборот, заточен под inference, reasoning и работу AI-агентов. Здесь упор на память, низкую задержку и быструю координацию между множеством агентов, которые работают параллельно. По данным Google, он дает на 80% лучше performance-per-dollar по сравнению с прошлым поколением.
Обе платформы Google явно подает как инфраструктуру для agentic era — когда модели не просто отвечают, а планируют, действуют, используют инструменты и работают в длинных циклах. Чипы будут доступны позже в этом году.