🚨 СРОЧНО
GPT-5.6 или Claude Fable 5? Всё решит не хайп, а тесты в Physical AI — способности модели понимать и рассуждать о физическом мире.
Новый бенчмарк от JuliaHub сравнил две топовые модели именно в этой дисциплине. Это не абстрактные разговоры, а проверка на задачах, связанных с инженерией, проектированием и сложными системами. Такой навык критичен для автоматизации в науке, промышленности и R&D.
Пока что известно лишь о самом факте независимого сравнения. Кто победил и с каким отрывом — детали пока не раскрыты. Но сам подход говорит о тренде: нейросети всё активнее тестируют на прикладное, «физическое» мышление, а не только на креатив или код.
Итоги таких тестов — лучший ориентир для бизнеса, выбирающего AI под конкретные инженерные или аналитические задачи.
Читать подробности исследования:
JuliaHub Blog
🤖
AI MAN | Нейросети и деньги