Спросил ChatGPT.
Это Вы явно запустили ChatGPT на каком-то очень низком уровне размышления, возможно без доступа к интернету. Какие ещё o1/o3 в сентябре 2026. Да и остальные тоже.
Приведу выдержки из ответа ChatGPT 5.6 Sol на уровне High на данный вопрос:
Цитата:
Среди доступных пользователю универсальных ИИ я бы сейчас поставил на первое место
GPT-6 Astra; в ChatGPT её наиболее мощная пользовательская форма — GPT-6 Pro.
<...>
В математике Astra сейчас выглядит наиболее убедительным лидером
Здесь появились гораздо более серьёзные основания, чем обычные олимпиадные тесты.
На FrontierMath Tier 4, где задачи относятся уже к исследовательскому уровню, результаты таковы:
GPT-6 Astra — 97.6%;
Claude Fable 5.1 — 87.8%;
GPT-5.6 Sol — около 83%.
<...>
С теоретической физикой ситуация интереснее
Совсем недавно появился особенно полезный тест — CritPt (Complex Research using Integrated Thinking – Physics Test).
Это не школьная и не олимпиадная физика. В нём 71 составная задача исследовательского уровня, подготовленная более чем 50 действующими физиками.
<...>
И здесь на начало сентября результаты следующие:

То есть формально первый сейчас GPT-5.6 Sol, а не Astra.
Но разница

процентного пункта настолько мала, что я бы не делал отсюда вывода «Sol умнее Astra в физике».
<...>
Есть ещё Gemini Deep Think
Его тоже нельзя списывать со счетов.
Gemini 3.1 Deep Think демонстрировал очень высокие результаты именно в физике:

на теоретической части International Physics Olympiad 2025;

на CMT-Benchmark по теории конденсированного состояния.
На момент публикации это были чрезвычайно сильные результаты.
Ещё интереснее специализированная система Gemini Deep Think + tree search + численная обратная связь: Google описывает работу, в которой такая система решила открытую задачу теоретической физики, связанную со спектром гравитационного излучения космических струн, и нашла несколько аналитических методов решения.
-- добавлено через 23 минуты --DeepSeek (R1): Лучший «теоретик». Идеально выводит формулы из головы.
Где, интересно, у него голова?
Этого "лучшего теоретика" недавно поймали на списывании: согласно сообщению Anthropic, часть пользовательских запросов DeepSeek и другие китайские ИИ просто перенаправляли Claude'у, а не отвечали на них сами.
Вероятно, этим и объясняются периоды, когда DeepSeek внезапно резко умнел, а потом снова глупел. Их даже здесь на форуме отмечали.
А ещё китайские ИИ раньше ловили на том, что иногда они на вопрос "кто ты?" отвечали "я Клод". То ли дело тут было в дистилляции западных моделей (обучении на диалогах с ними), то ли просто в банальном перенаправлении запроса.
Конечно, если доступ к западным ИИ россиянам перекроют совсем серьёзно, с той или с другой стороны, то, возможно, придётся пользоваться китайскими. Но это искусственный интеллект второй свежести.