#AI: Nvidia снизила цену генерации AI в 35 раз 🔭
😐 Ранее писали про гонку за розетки - кто контролирует энергию, тот и выигрывает AI. Nvidia сняла первые замеры Vera Rubin и вышло не про розетки, а про экономику - генерация подешевела в 35 раз.
Vera Rubin NVL72 - новая стойка Nvidia на смену Blackwell. Меряли не на синтетике, а на записанных сессиях реальных агентов.
Что показали замеры:
На бенче SemiAnalysis AgentX (сессии агент-кодеров с ростом контекста и вызовами тулз) Rubin выдаёт до 30x больше работы на мегаватт и до 35x дешевле токен, чем прошлая стойка GB300.
Почему это важно юзеру:
🟢Агент жрёт в 15 раз больше токенов чем обычный чат
🟢Длинные автономные сессии стоят достаточно дорого
🟢Дешевле инференс = агентов можно крутить нон-стоп
🟢Чип Groq 3 LPX под инференс уже в серийном производстве
Есть нюанс:
🟠Это цифры самой Nvidia на своём же железе
🟠Стойка ещё не у всех - доставляют постепенно
🟠"35x" - это максимум на идеальном воркфлоу
🗒 Если цифры хотя бы наполовину правда - следующая волна не про новые модели, а про то что старые агенты станут в разы дешевле и экономика ИИ может сильно измениться. Как собрать своего агента пока инференс дешевеет - разбираем в ИИ-клубе.
Slavik | Updates | Инстаграм | ИИ Клуб