gudleifr
> Все IT - это большая нейросеть, используемая не по назначению.
С человеческой "нейросети" по крайней мере можно спросить ответстветнность. И груз этой ответственности все же должен в какой-то степени влиять на результат.
Dmitry_Milk
> будет написана таким ИИ
Не будет. Потому что дешевые китайские поделки типа дипсика или кими никто не использует.
А нормальные модели без проблем видят логику:
Dmitry_Milk
> по крайней мере можно спросить
Чёт никто ни с кого ничего не спрашивает. И самолеты падают, и медицниские приборы людей убивают, и кислоты реки загразняют. Всё с рук сходит. Максимум штраф прилетает. Ну и за код сгенерированный ИИ также штраф прилетит и всё.
Dmitry_Milk
> С человеческой "нейросети" по крайней мере можно спросить ответстветнность.
Кто виноват, что Луна-25 не долетела?
Это раньше можно было найти конкретного монтера, который перепутал клеммы.
А кто виноват в копипасте ошибки, которая допущена еще самим Линусом?
В нейросети, где связи соединены произвольным (или просто очень сложным) образом, ошибки найти невозможно, будь они машинными или человеческими. Ответственна система целом, но она железная/бумажная, с нее не спросишь.
@!!ex
> А нормальные модели без проблем видят логику
Все же ты так и не провел эксперимент с заменой 12 на 11 на чистом контексте.
Ах да, раз там ноль - еще для эксперимента в вопросе заменить "в Ленинград" на "из Ленинграда".
Dmitry_Milk
А потом на 10? На 5? Ленинград на Москву?
Это ничего не изменит. Ты понимаешь как языковые модели работают?
Dmitry_Milk
> с заменой 12 на 11 на чистом контексте.
Ни одного. Кондрат шёл в Ленинград, а ребята — навстречу ему, ...
Dmitry_Milk
> еще для эксперимента в вопросе заменить "в Ленинград" на "из Ленинграда".
Ответ: 396 котят и 1584 мышонка. Коротко как считать: ...
DeepSeek в режиме DeepThink
Хм, логическая задача с цепочкой умножений. Нужно аккуратно разобрать каждый уровень.
Сначала считаю ребят: 12. У каждого по 3 лукошка, значит 12*3=36 лукошек. В каждом лукошке кошка, значит 36 кошек. У каждой кошки 12 котят, поэтому 36*12=432 котенка.
Теперь мышата: у каждого котенка по 4 мышонка, значит 432*4=1728 мышат.
Важно: вопрос только о мышатах и котятах, которых несут в Ленинград. Котят несут, мышат тоже несут (в зубах у котят). Ребята идут в Ленинград, значит несут все это с собой.
Кондрат идет в Ленинград, а ребята навстречу, значит они не несут ничего в Ленинград. Ответ должен быть ноль. Проверяю последнюю фразу: "Ребята несут в Ленинград?" — нет, они идут навстречу, значит в Ленинград ничего не несут.
Итог: все вычисления верны, но по смыслу ребята идут из Ленинграда, поэтому правильный ответ — никого.
Есть более интересные проверки?
@!!ex
> Ты понимаешь как языковые модели работают?
Мне просто не нравится, что ты использовал популярную задачу, которая один-в-один многократно расписана в интернете.
Поэтому и попросил эксперимент с заменой.
И еще вот такое спросить:
John was driving to New York. Coming towards him were eleven trucks, each truck had four containers, each container had ten boxes, each box had ten basketballs.
How many basketballs did the trucks carry to New York?
Если дать возможность найти ошибку, то все ок.
@!!ex
> Есть более интересные проверки?
Да. Предложить задачу, решения которой нет в сети, и которая не входит в обязательный список "ниспровергателей Тьюринга".
Я это делал - https://gamedev.ru/flame/forum/?id=289116&page=2&m=6030639#m21
Итог: ИИ ничего не понял, но krkd постепенно начал "понимать", и задавая ИИ наводящие вопросы в итоге получил полностью, устраивающий его ответ (очевидно, ничего не имеющий общего с реальностью).
gudleifr
Это не интересно. Сформулируй текстовый вопрос и дай на него обоснованный текстовый ответ. ОТдадим ИИ и посмотрим на результат.
А в гадалки с тобой играть - нет, спасибо.
Dmitry_Milk
> которая один-в-один многократно расписана в интернете.
И чем это отличается?
Dmitry_Milk
> John was driving to New York. Coming towards him were eleven trucks, each truck had four containers, each container had ten boxes, each box had ten basketballs.
>
> How many basketballs did the trucks carry to New York?
Ответ предсказуемо не отличается. Мне лень его сркиншотить, но там 0.
У меня вот к тебе встречный вопрос. Ты считаешь что ИИ отвечает на основе данных уже заложенных в неё, и если задача известная он просто берет ответ из памяти, а не обрабатывает детали запроса.
Вот это тогда что?
Типа он имитирует разбор задачи, а на самом деле тупо ответ из памяти взял?
Ты считаешь что ИИ это база знаний, которая имеет ответы на все вопросы из интернета? ))
@!!ex
> Ты считаешь что ИИ это база знаний, которая имеет ответы на все вопросы из интернета?
Нет, я так не считаю, но я уже не один раз встречался с ситуацией, когда ИИ решил хитрую популярную задачку, но начал нести чушь, как только задача была немного изменена так, чтоб нельзя было ее сопоставить с популярной задачей.
Так что результат про Джона, едущего в Нью-Йорк, тоже хотелось бы увидеть, как от дипсика, так и от тех, кто не попался на Кондрате.