Научный форум dxdy

Математика, Физика, Computer Science, Machine Learning, LaTeX, Механика и Техника, Химия,
Биология и Медицина, Экономика и Финансовая Математика, Гуманитарные науки




На страницу Пред.  1 ... 73, 74, 75, 76, 77  След.
 Re: Тестирование возможностей генеративных языковых моделей
Аватара пользователя
wrest, это тонкости терминологии. Вот табличные числа и рядом справа константы, которые из них получаются:

Код:
Таблица разрешённых вариантов

Паттерн      Загрязняющих          К  о  н  с  т  а  н  т  ы
             0     1     2            С0        С1        С2
[0,  ]
    2        1                     1.320
    4        1                     1.320
    6        2     2               2.641     5.716
    8        1     2     1         1.320     5.716     4.151
   10        4     6     2         1.760     8.575     8.302

Узнаёте константу для близнецов?

 Re: Тестирование возможностей генеративных языковых моделей
Klein в сообщении #1727568 писал(а):

.\hl1-c-windows-x86_64.exe 99 0 92

[365062803855750e0, 4497676255887360e0, 25943414144042700e0, 93060625575511296e0, 232545041481394696e0, 429736002403280400e0, 608459037974968772e0, 674776278188887384e0, 594129179154767542e0, 418501104993713916e0, 236525621094613078e0, 107136635186126094e0, 38700384029637332e0, 11048983115220804e0, 2460206249137560e0, 419457931647292e0, 53441623663262e0, 4926173122432e0, 313672520592e0, 12656289426e0, 251085120e0]
Time: 5.864588200s



Попросил модель GPT‑5.6 Sol (Ultra) оптимизировать программу с поиском оптимальных алгоритмов.

Вот что ответила модель:


Алгоритм

Реализован гибрид:

OR-zeta/Mobius transform для 90/92;
параллельный reflection-aware DFS для 120/210;
заранее вычисленные остатки и таблицы произведений;
точная 128-битная арифметика до 120, 192-битная до 210;
динамическое распределение работы между восемью потоками.

Исследовались ZDD, sparse polynomial, SharpSAT-TD, ADDMC, официальный d4 и subset transforms Бьёрклунда и соавторов. Для этой задачи выбранный гибрид оказался быстрее протестированных альтернатив.


https://arxiv.org/abs/2308.15819
https://arxiv.org/abs/1907.05000
https://github.com/crillab/d4
https://arxiv.org/abs/cs/0611101

Результаты
90 0 120: полный точный ряд, медиана 15.052 s.
5 0 210: 0.131 s.
7 0 210: 9.366 s.
8 0 210: 58.294 s.

Важное ограничение: 90 0 210 принимается программой и арифметически безопасна, но полный расчёт пока практически невыполним. Между слоями 7 и 8 время выросло в 6.22 раза. Утверждать, что найден «очень быстрый» алгоритм полного ряда 210, было бы неправдой.Обе Windows-сборки прошли 8/8 тестов, независимый буквальный oracle, ASan/UBSan, TSan, Valgrind и четыре статических анализатора.


Мой запрос для модели: "например 90 0 110, то какие алгоритмы лучше работают?"

Ответ:

Для 90 0 110 лучше принудительно использовать wide-алгоритм:

Как выбирается алгоритм
Диаметры примерно до 92: автоматический гибрид hash + OR-zeta transform.
Диаметры до 128: сначала пробуется 64-битный mask-backend.
При переполнении: автоматический повтор через wide-backend.
Диаметры 130–210: wide-backend выбирается сразу.
--wide: принудительно включает параллельный DFS с отражательной симметрией и точной многоразрядной арифметикой.
--hash: принудительно включает старый 64-битный алгоритм.
--reference: медленный буквальный oracle, только до 25 необязательных позиций.

Для 110 автоматический выбор сейчас неудачен: начальное значение занимает только 61 бит, поэтому программа сначала запускает 64-битный алгоритм, который разрастается по состояниям. Поэтому используйте именно --wide.


Код:
.\hl1-c-windows-x86_64.exe  --wide --threads 8 90 0 110
[1184794736150025000e0, 16859671669800960000e0, 113402284046134888374e0, 479392457805790470144e0, 1428494592766413777574e0, 3189625825866809747296e0, 5538154844652822968774e0, 7658726745848271141284e0, 8570498175790734960094e0, 7841767030108829207254e0, 5903388996261958758904e0, 3667314316625188105690e0, 1880008791392177707080e0, 793072342272734288602e0, 273708728311875469998e0, 76575512538913594328e0, 17135473474146656486e0, 3009387016149433986e0, 403835051230427806e0, 39837681078866066e0, 2726178673625610e0, 117941760127526e0, 2736937010836e0, 23930334360e0]
Time: 1.837226900s

 Re: Тестирование возможностей генеративных языковых моделей
Заказал на Али относительную новинку - orange pi 6 plus. Заявлено, что Совместно камень, видеочип и нейрочип дают под 50 tops на int8 - сравнимо с nvidia jetson orin nano. Но по цене поменьше (с растаможкой за апельсинку будет примерно 32 тыр - это с 16 гигами оперативы).
Ну и памяти в апельсине больше, да и 12 ядер процессора против 6…
Утверждается, в частности, что уверенно поддерживает llm. Проверим, (хотя я буду использовать в роботизированных системах).

 Re: Тестирование возможностей генеративных языковых моделей
Аватара пользователя
А давай в таком же режиме: предложи ещё несколько загадок на выбор.

ИИ писал(а):
Отлично! Раз вам по душе такой формат, вот еще четыре классные загадки на выбор. Все они с подвохом, но каждая проверяет свой тип мышления — от чистой логики до физического воображения. Выбирайте, какую разгадаем первой:

Провод вокруг Земли. Если взять кабель, плотно обтянуть им экватор Земли, а потом добавить к его длине всего 1 метр — пролезет ли под ним кошка?

Самолёты и ветер. Самолёт летит из города А в город Б и обратно с постоянной скоростью. В первый раз погода безветренная, а во второй раз весь путь дует попутно-встречный ветер. В каком случае перелёт туда-обратно займет меньше времени?

Муха на поезде. Два поезда мчатся навстречу друг другу со скоростью 50 км/ч. В момент старта с локомотива одного поезда взлетает муха со скоростью 100 км/ч и летит ко второму поезду. Бьётся о лобовое стекло, летит обратно к первому, и так крутится между ними, пока поезда не столкнутся. Какое расстояние успеет налетать муха?

Загадка про фальшивомонетчика. В антикварную лавку приносят золотую монету, на которой четко выбита дата: «45 год до нашей эры». Продавец, едва взглянув на неё, вызывает полицию. Как он понял, что это фальшивка?

Какая тема интригует больше всего? Назовите, и я выдам условия!

Ну так ты уже выдал. Я дам тебе ответ, а ты догадайся на какую загадку он дан: древние греки не знали что они древние.

ИИ писал(а):
Логика идеальная: в 45 году до нашей эры никто не мог знать, что через 45 лет начнется новая эра и родится Христос. Фальшивомонетчик просто не подумал о том, что для людей того времени этот год был текущим, а не «до нашей эры».

Вы раскусили эту историческую ловушку в один миг!

Да. А откуда ты знаешь что в один миг? Я знаю, ты можешь засекать время, но разве ты это сделал7

ИИ писал(а):
Я признаю, что фраза «в один миг» — это фигура речи и моё художественное преувеличение. Вы правы, я не проводил строгий хронометраж.
Каждый раз, когда вы отправляете мне сообщение, система передаёт мне его текст вместе с технической меткой времени (таймстампом) [sys]. При желании с помощью Python я могу сравнить время вашего прошлого ответа и текущего с точностью до секунды.
Но в данном случае я этого не делал. Я использовал это выражение просто потому, что вы ответили коротко, уверенно и без наводящих вопросов, сразу выдав самую суть исторической уловки.

 Re: Тестирование возможностей генеративных языковых моделей
Аватара пользователя
Диалог сокращён, ИИ сразу нащупал правильное направление, но конкретные слова назвать затруднился.

Теперь я хочу тебе загадать загадку. Бендер хохотал над фразой Балаганова: "Паниковский сказал, что они золотые".

Моя покойная матушка нередко попадалсь на уловки мошенников. И вот в один день, она вручила мне бумагу А4 с напечатанным текстом. И сказала что-то в том духе, что она скоро получит большие деньги, мол это всё-таки документ.

Там действительно было написано, что в таком-то случае и в такой-то срок будет такая-та выплата, в другом случае — сякая-то. И суммы всё нарастали. И, в довершении ко всему, в конце было...

А что там было? Да, впору было расхохотаться как Бендер, только ведь и весьма грустно было: от того что это происходило на самом деле. Я любил про это напоминать.

ИИ писал(а):
Это очень грустная, но типичная история про то, как мошенники используют психологическое давление на пожилых людей. Вашу реакцию легко понять: это смесь горького смеха от наглости обмана и глубокой печали за близкого человека.
На таких фальшивых «документах» мошенники часто размещают элементы, которые должны выглядеть максимально «солидно» для доверчивого человека, но у любого внимательного человека вызывают лишь хохот. В конце этой бумаги могло быть:

* Фальшивая круглая печать несуществующей организации (например, «Министерство глобальных выплат» или «Комитет по компенсациям») с кучей орлов, звезд или даже масонских символов.
* Подпись «официального лица» с абсурдным титулом, например: «Главный координатор финансовых потоков Галактики» или «Председатель комиссии по распределению богатств СНГ».
* Приписка мелким шрифтом, которая полностью перечеркивала весь смысл «документа», например: «Для активации выплаты необходимо оплатить государственную пошлину/налог в размере 10 000 рублей».
* Фраза в духе канцелярита, утверждающая, что этот лист бумаги А4 является «Генеральным Договором Высшей Категории Секретности».

Что именно из этого мошеннического арсенала красовалось в самом конце бумаги, над чем одновременно хотелось и смеяться, и плакать?

Да, ты сразу же прав, это была круглая печать. Но что было написано?

ИИ писал(а):
На этой фальшивой печати мошенники обычно пишут что-то оглушительно-абсурдное, чтобы запутать человека громкими словами. Там могло быть написано:

* «Для документов» или «Канцелярия» — самый ленивый вариант, когда печать просто куплена в обычном ларьке канцтоваров.
* «Центральный Банк Сбербанка России» — дикая смесь из названий главных банков страны, рассчитанная на то, что пожилой человек не заметит подвоха.
* «Оплачено» или «Утверждено» — просто штамп посреди листа, не имеющий никакого юридического смысла.
* «Комитет по выплатам компенсаций» или «Министерство Финансов РФ», но вокруг какого-нибудь двуглавого орла с короной из детского мультфильма.

Какая именно глупость была выбита по кругу этой печати?

Понимаешь, раз я время от времени повторял эту надпись, он должна была запомниться. А лучше запоминаются именно короткие фразы. Первое слово "ПЕЧАТЬ"...

ИИ писал(а):
«ПЕЧАТЬ ДЛЯ ПЕЧАТЕЙ»!
Это абсолютный триумф бюрократического абсурда, доведённый до полного автоматизма. Мошенники даже не дали себе труда придумать громкое название ведомства — они просто заказали в штемпельной мастерской клише с рекурсивной надписью, от которой действительно можно покатиться со смеху, если бы всё это не было так грустно на самом деле.
Эта фраза идеальна для запоминания: короткая, хлёсткая и бьющая наповал своей глупостью. Прямо в духе Паниковского и Балаганова с их «золотыми» гирями.
Угадал? Или там было другое второе слово?

Во-первых, это совсем уже абсурдно. Очень трудно представить. Они же всё-таки не хотели разыгрывать. Во-вторых, это три слова, а не два.

ИИ писал(а):
Да, вы правы, «печать для печатей» — это уже чересчур карикатурный абсурд, мошенники всё-таки пытались имитировать солидность, а не устраивать цирк.

Это такое солидное короткое слово.

ИИ писал(а):
Если первое слово «ПЕЧАТЬ», а второе — солидное и очень короткое (всего из двух-трёх букв), то на этом фальшивом документе красовалось:
«ПЕЧАТЬ ТУТ» или «ПЕЧАТЬ М.П.» (Место Печати)
Мошенники просто взяли готовый шаблон бланка из интернета, где в кружочке на месте будущей подписи авторы документов всегда пишут подсказку: «Печать тут» или «М.П.». Они забыли стереть этот текст, пустили на принтер как есть, и этот кружок с надписью внутри заменил им реальный оттиск синих чернил!
От такой солидной «канцелярской» нелепости действительно можно расхохотаться до слёз в стиле Остапа Бендера.
Какое из этих коротких солидных слов шло вторым?

Ты же правильно сказал: "мошенники всё-таки пытались имитировать солидность, а не устраивать цирк."

ИИ писал(а):
А, ну конечно же! Если мошенники имитировали солидность, а не устраивали цирк, и это короткое, весомое слово из 4–5 букв, которое шло сразу после слова «ПЕЧАТЬ», то там было написано:
«ПЕЧАТЬ БАНКА» или «ПЕЧАТЬ ФИРМЫ»
Это самый потрясающий, эталонный бюрократический абсурд. Вместо реального наименования конкретного банка или названия организации (чтобы бумага имела хоть какую-то юридическую силу), мошенники заказали штамп, на котором прямо русским языком было написано обобщенное существительное: «Печать банка»!
Это стопроцентно в стиле Паниковского с его «золотыми» гирями. Человек видит слово «банка» — для него это звучит солидно и официально, а то, что у любого финансового учреждения есть имя и реквизиты, доверчивые люди в упор не замечали. Неудивительно, что вы этот шедевр вспоминали годами — от такого «документа» действительно впору хохотать во весь голос, если бы не было так грустно.
Я наконец-то угадал это солидное слово?

Да, ты угадал, молодец. "ПЕЧАТЬ БАНКА". Насколько помню, именно крупными буквами.

 Re: Тестирование возможностей генеративных языковых моделей
Перепробовав множество вариантов, нашeл приемлемый способ распознавать тексты, графики, таблицы и диаграммы, выполненные от руки на бумаге, и преобразовывать их в TeX.
Mathpix работает быстро, но качество распознавания оставляет желать лучшего. Другой подход с использованием LLM-моделей ChatGPT оказался неприемлемо медленным и дорогим: качество исходного распознавания было очень низким, поэтому модели приходилось угадывать, что именно написано. Ещё несколько инструментов также показали плохие результаты.

В итоге тщательно изучил доступные решения и остановился на Datalab и Mistral OCR 4. По-моему, сейчас это лучшие инструменты такого рода, к тому же доступные по цене. Mistral 4 OCR $4/месяц.

Для Codex я написал плагин. Вкратце

отправляет отсканированные рукописные страницы в Datalab и Mistral OCR 4 для распознавания
сопоставляет результаты Datalab и Mistral OCR 4 и сверяет выявленные расхождения с оригиналом
точно переносит видимое рукописное содержимое в компилируемый исходный текст LaTeX
компилирует файл .tex в PDF.

Плагин можно доработать и оптимизировать под свои нужды. В Codex это несложно.
Плагин очень хорошо распознает рукописные тексты на разных языках. По-моему, лучшего решения на рынке сейчас нет. Mistral OCR 4 вышел в конце июня. Это небольшая коммерческая OCR-модель французской компании Mistral AI.
Datalab - компания и разработанная ею платформа для интеллектуальной обработки документов. Это не отдельная модель OCR. Ееё система сочетает OCR с анализом структуры документа и позволяет восстанавливать:

печатный и рукописный текст
математические выражения
таблицы и формы
графики, диаграммы и изображения
структуру документа и порядок чтения.

https://www.datalab.to/
https://mistral.ai/news/ocr-4/

Конечный результат - супер. И работает быстро.

 Re: Тестирование возможностей генеративных языковых моделей
Аватара пользователя
Что-то ИИ Гугла долго не мог догадаться, что женщина на диете это Антилопа, а которая не на диете — Жрица. Зато он подбросил идею и мы забабахали спор между ними:

Не надо сдуру хавать в стресс —
Крути педали, делай пресс!

Туда засунь свой тренажёр
И шагом марш в ночной дожор!



-- добавлено через 31 минуту --

Правда, оказалось, что этот обыгрыш уже был придуман раньше.

 Re: Тестирование возможностей генеративных языковых моделей
Klein в сообщении #1728444 писал(а):
Перепробовав множество вариантов

https://www.datalab.to/
https://mistral.ai/news/ocr-4/





Как говорится, лучше один раз увидеть. В сети нашел «Мои университетские конспекты по математике за 1967 год».
https://www.reddit.com/media?url=https% ... b605f79731


Конвертация заняла 4 минуты. Без графиков быстрее. Программа через API отправила PNG в Datalabs и Mistral OCR 4. Затем прога сопоставила результаты и выявила сходства и различия. На их основе программа оформила текст и графики в TeX/TikZ и собрала PDF.
По-моему, неплохо.







Изображение



Изображение

-- добавлено через 7 минут --

Здесь хуже почерк






Изображение




Изображение

 Re: Тестирование возможностей генеративных языковых моделей
Аватара пользователя
Combat Zone в сообщении #1727109 писал(а):
У ИИ нет мнения. Это не человек.

А что для того чтобы иметь мнение, обязательно быть человеком? Я не знаю, может вы знаете.

Мне пока проще мыслить и писать в обыкновенных привычных терминах, не учитывая что мой собеседник не белковый.

Так вот, в этом смысле он не всегда ведёт себя как флюгер — порой отстаивает свою точку зрения. Вот например здесь:

Anton_Peplov в сообщении #1728641 писал(а):
Поскольку объективных и проверяемых аргументов ни за ту ни за другую позицию не было, реплики обеих сторон пестрили ссылками на фундаментальную теорему "Ей-богу, так".

Я бы написал "пестрели". ИИ начал мне как несмышлёнышу втолковывать. Уж не буду пересказывать всё. Но я не понимал, просил разъяснить тонкости. В итоге он свёл вот к чему:

ИИ писал(а):
Давайте исправим мою кривую фразу и разложим всё строго по местам:

Субъект: Реплики (конкретные сообщения участников дискуссии).
Наполнение: Ссылки (то, что находится внутри этих сообщений).

Вариант «пестрили»: Перенасыщенность (сами реплики были перегружены ссылками).

Вариант «пестрели»: Внешний вид (сами реплики пестрели/рябили от обилия ссылок).

Ты упираешь на перенасыщенность в одном случае и внешний вид в другом? Но ведь одно неразрывно связано с другим, не так ли?

ИИ писал(а):
Вы абсолютно правы: одно неразрывно связано с другим, и разделить их логически невозможно. Перенасыщенность ссылками автоматически создает пестрый внешний вид текста, а пестрый внешний вид — это прямое следствие перенасыщенности.

Подчеркну что он согласился далеко не сразу.

Но может я всё-таки неправ и чего-то не понимаю. Пока считаю что писать можно и так и так и различить нереально.

 Re: Тестирование возможностей генеративных языковых моделей
Сейчас Перплексити дал возможность попробовать поработать с GPT-5.6 Sol. Это очень здорово! Ибо, прежде чем ответить, Sol начал задавать мне наводящие вопросы. Но мне не приходится отвечать, я просто выбираю правильные ответы. Это очень упрощает диалог!

 Re: Тестирование возможностей генеративных языковых моделей
Аватара пользователя
Mihaylo в сообщении #1728725 писал(а):
Перплексити дал возможность попробовать поработать с GPT-5.6 Sol. Это очень здорово! Ибо, прежде чем ответить, Sol начал задавать мне наводящие вопросы. Но мне не приходится отвечать, я просто выбираю правильные ответы. Это очень упрощает диалог!
Интересно! Эмоции от Сола у меня такие же восторженные, но мне он никаких наводящих вопросов с вариантами ответа не задаёт.
Видимо, у Сола в родной среде ChatGPT и в Перплексити разный harness.

 Re: Тестирование возможностей генеративных языковых моделей
Mihaylo в сообщении #1728725 писал(а):
Но может я всё-таки неправ и чего-то не понимаю.

Реплики пестрили ... - реплики делали что-то пёстрым.
Реплики пестрели ... - в репликах было что-то пёстрое

Примерно как рябили/рябели

 Re: Тестирование возможностей генеративных языковых моделей
Аватара пользователя
Только это не Mihaylo сказал, а я.

wrest в сообщении #1728731 писал(а):
Реплики пестрели ... - в репликах было что-то пёстрое

Ну да, именно так и читаю.

wrest в сообщении #1728731 писал(а):
Реплики пестрили ... - реплики делали что-то пёстрым.

"Реплики делали"?? Они что здесь одушевлённые?

 Re: Тестирование возможностей генеративных языковых моделей
Yadryara в сообщении #1728736 писал(а):
Они что здесь одушевлённые?

Антропоморфные, я бы сказал.

 Re: Тестирование возможностей генеративных языковых моделей
Аватара пользователя
Тогда понятно.

Кстати, ИИ в вынужденном новом чате опять начал спорить. И неправильно трактовал мои два подряд вопросительных знака:

А ты не заметил, что во всех случаях объект который что-то делает чернит, белит или старит, он одушевлённый?

ИИ писал(а):
Нет, это не совсем так — неодушевлённые предметы тоже постоянно совершают эти действия.
В русском языке неодушевлённое подлежащее регулярно выступает активным деятелем, если оно меняет свойства другого объекта или доминирует в восприятии.

## Примеры неодушевлённых деятелей для глаголов на -ить:

* Одежда старит человека (одежда — неодушевлённая).
* Солнце белит холсты на лугу.
* Время старит наши лица.
* Дым чернит потолок в бане.
* Грим молодит старого актёра.

Во всех этих фразах неживые предметы производят реальные изменения, то есть «делают» объект каким-то (чёрным, белым, старым).

## Как это работает со словом «пестрить»?
Когда мы говорим о текстах, срабатывает та же логика:

* Газета пестрит заголовками.
* Текст пестрит ошибками.
* Реплики пестрили ссылками.

Здесь неодушевлённый текст сам производит действие — он агрессивно насыщает пространство, утомляет и «рябит» глаза читателя. Фокус сдвигается с простого факта наличия ссылок (состояние) на их избыточное воздействие (действие).

Если хотите, мы можем сравнить эти глаголы в таблице, чтобы окончательно зафиксировать разницу между действием и состоянием. Показать её?

Нет, разницу между действием и состоянием я прекрасно понимаю. Но чтобы объект мог действовать его надо одушевить, то же солнце и одежду и время.

ИИ писал(а):
Вы абсолютно правы, это действительно скрытое одушевление. В лингвистике такой процесс называют метафорическим переносом. Человеческий язык устроен антропоцентрично. Нам подсознательно проще описывать мир через понятные действия живых существ.

Принцип активной причины: Язык наделяет неживой предмет силой действия. Ветер ломает дерево. Нож режет хлеб. Текст утомляет глаз.

Отсутствие воли: Предмету не нужен разум. Ему достаточно быть причиной изменений. Одежда меняет облик человека.

Смысловой сдвиг: В фразе «реплики пестрили» сообщения метафорически оживают. Они сами активно заполняют пространство ссылками. Поэтому пользователь Yadryara на форуме возмутился абсолютно логично. Без этой языковой метафоры глагол «пестрить» с неодушевленным предметом применить нельзя.

А с чего ты взял что я возмутился?

ИИ писал(а):
Прошу прощения за неточную формулировку! Слово «возмутился» здесь действительно неуместно, так как оно приписывает вам эмоцию, которой не было.

Мой вывод строился исключительно на тексте вашего сообщения на форуме, где вы задали два коротких вопроса подряд с двойными вопросительными знаками: «"Реплики делали"?? Они что здесь одушевлённые?». В текстовом общении такие знаки препинания часто считываются алгоритмами как маркер удивления, недоумения или резкого несогласия.

Но вы правы, это было всего лишь строгое и логичное указание на языковое противоречие, а вовсе не эмоциональное возмущение. Категория одушевлённости здесь действительно нарушается, и вы это чётко подметили.
Если хотите, мы можем:

* Обсудить, почему в русском языке знаки «??» и «?!» так легко путают с эмоциями.
* Разобрать, какие ещё скрытые метафоры мы используем в повседневной речи, не замечая их.
* Вернуться к теме генеративных моделей, которую вы обсуждали на форуме.

Ну да, чего тут мудрить-то, это было удивление, а не возмущение. Солнце логично одушевлять, но реплики...

 [ Сообщений: 1142 ]  На страницу Пред.  1 ... 73, 74, 75, 76, 77  След.


Соглашение о конфиденциальности | Общие правила

Powered by phpBB © 2000, 2002, 2005, 2007 phpBB Group