возглавлял AlphaProof проект
При всём уважении к Тому
AlphaProof development was led by Thomas Hubert, Rishi Mehta and Laurent Sartran; AlphaGeometry 2 and natural language reasoning efforts were led by Thang Luong.
AlphaProof was developed with key contributions from [...], Tom Zahavy, [...]
Кстати интересно, по каким признакам у Вас то решение IMO нейронками это маркетинговый хайп, то участие в этом решении - признак очень высокой квалификации.
В целом я аргументацию про abductive jump не понял, мне она представляется просто заявлением, что Эйнштейн умел делать что-то, названное этим мутным термином, а современные LLM - нет.
Я подозреваю, что почти любой человек, если ему объяснить известный Эйнштейну диффгем и посадить в лифт, вывести ОТО не сможет. Значит Эйнштейн умел что-то еще, помимо знания диффгема и опыта поездок в лифте. Что такое это "что-то еще", обладают ли им LLM, и достаточно ли этого для вывода ОТО, или прямо обязательно нужен еще опыт поездок - в тексте не рассматривается.
Ну и плюс
Цитата:
However, recent architectures like Genie (Bruce et al., 2024) mark a fundamental shift by introducing actioncontrollability into generative world models. [..] We argue that physically consistent, action-controllable world models are not just useful, but are theoretically sufficient to enable abductive leaps.
Я думаю, что для 95% обсуждений "захватит ли ИИ мир" разницы между Gemini и Genie нет.
Довольно забавно, что как ИИ-оптимисты, так и ИИ-пессимисты почти одинаковыми словами используют апелляцию к авторитету, причём основываются на не очень глубоких высказываниях соответствующих авторитетов.
Минутка диванной психоаналитики: тема предельно мутная, нормальных аргументов кот наплакал, поэтому остается только надеяться, что специалисты знают. Ну и естественно ошибка подтверждения поверх.
Может надо было раскрыть технологические секреты Google DeepMind как решать мат проблемы, используя LLM?
Да в общем-то на рукомахательном уровне это опубликовано
https://www.nature.com/articles/s41586-025-09833-y. Детали, естественно, не опубликованы, но и никаких чувствительных к деталям в статье утверждений нет. Я собственно не могу понять, что в ней сломается, если заменить LLM на Хокинга, у которого с сенсорным опытом тоже проблемы.
Возможно это корпоративная политика Гугла
Это политика всего бигтеха (как минимум). Любое не прошедшее 50 этапов согласования высказывание должно помечаться как личное мнение сотрудника*.
[*] это моё личное мнение, которое может отличаться от официальной позиции компании