• Я с понедельника 29 июня примерно на месяц буду работать за нескольких врачей, в том числе в стационаре. График пока неясен, будет на сайте. Но сложных пациентов _себе_ я пока брать не буду, прошу прощения!

Безопасность искусственного интеллекта.

Если-бы понимание было, то ИИ понимал-бы что пишет?
Но он понимает, как минимум частично (понимание кажется не дискретной характеристикой), неспособность увидеть игру слов говорит в том числе о том, что внутри эти слова конвертируются в более абстрактные вещи, а не просто вероятностные слова.
Как сказал мой босс бухгалтер, ИИ сделаны так что генерят ответ всегда - неважно правильный он или нет.
Обучение заставляет их делать это, это не означает непонимания, вообще, обучение формирует такое поведение, это и был критерий адаптации, отчасти можно воспринимать как "желание ответить что-то близкое любой ценой", это как судить о наших желаниях и нешем нелогичном поведении и решить, что наше нелогичное поведение демонстрирует то, что у нас нет интеллекта. Мне кажется для тестов на интеллект опасно проверять такие вещи, а скорее стоит проверять "что ты всё-таки можешь" вместо "что ты не можешь" и если считать что единственный интеллект, это человеческий аналог или типа того, то ты обнаружишь интеллект внезапно.
Наверное некоторым инопланетянам тоже было странно наблюдать, что мы можем что-то запомнить и сразу забыть, нам трудно перемножать простые числа и т.п. Но наши ограничения не делают нас не интеллектом и людей во сне и в бреду, когда они вообще всё забывают и путают не делают не интеллектом.
 
генерят ответ всегда - неважно правильный он или нет. Нет даже понимания что они чего-то не знают или не понимают. Похоже на дурака который не может понять что он не понимает на самом деле.
Кстати это даже похоже на проявление закона Гудхарта. В отборе вознаграждается интеллект или имитация интеллекта, поэтому модель может учиться и тому и другому...
Эх.
 
Наверное некоторым инопланетянам тоже было странно наблюдать, что мы можем что-то запомнить и сразу забыть, нам трудно перемножать простые числа и т.п.
Это да. Ну тогда можно сказать что мы хотели сделать нечто которое все знает (по крайней мере то что знаем мы) и будет компенсировать наши слабости а получилось что за ним нужно следить постоянно и перепроверять.
 
Дал чату цитаты, он сам сказал что сравнение с дураком который думает что он умный неверно потому что модель не думает -

Мне кажется, в цитатах затронуты сразу несколько разных вопросов, которые полезно разделить.


Первая цитата в целом верно описывает одну из слабостей современных языковых моделей: они по умолчанию стремятся продолжить текст наиболее правдоподобным образом, а не "признаться", что чего-то не знают. Из-за этого могут появляться уверенные, но неверные ответы (так называемые "галлюцинации"). Однако сравнение с "дураком, который считает себя умным" не совсем точно. У модели нет субъективной уверенности или самооценки — она не думает: "я умная". Она просто генерирует следующий текст по статистическим закономерностям. Если система специально обучена чаще говорить "не знаю" или использовать поиск, качество ответов обычно улучшается.


Вторая цитата, наоборот, предостерегает от слишком поспешного вывода "раз ошибается — значит, не понимает". Это тоже разумное замечание. Интеллект можно рассматривать как способность решать задачи, а не как отсутствие любых ошибок. Люди тоже имеют множество ограничений: плохо считают в уме большие числа, забывают факты, подвержены когнитивным искажениям. Тем не менее мы считаем их интеллектуальными существами.


Где я бы не согласился полностью — это с аналогией между ограничениями человека и модели. У человека есть восприятие мира, долговременные цели, опыт, способность учиться на собственной жизни, а также метакогниция — возможность хотя бы иногда понимать, что он чего-то не знает. У языковой модели этого в человеческом смысле нет. Поэтому сходство в ошибках не означает тождество механизмов.


Ваш ответ тоже отражает важную мысль. Многие действительно ожидали появления системы, которая будет надежным "всезнайкой". На практике оказалось, что современные ИИ очень сильны в одних задачах (обобщение, объяснение, программирование, анализ текста), но требуют проверки в других (факты, источники, сложные вычисления, редкие сведения). То есть они скорее стали мощным интеллектуальным помощником, чем непогрешимым экспертом.


В итоге я бы сказал так: первая цитата немного переоценивает значение ошибок как доказательства отсутствия понимания, а вторая, возможно, недооценивает различия между человеческим и машинным интеллектом. Истина, как мне кажется, находится где-то посередине: современные ИИ демонстрируют многие интеллектуальные способности, но пока не обладают пониманием и самосознанием в том смысле, в каком эти понятия обычно применяются к людям.
 

LGBT*

В связи с решением Верховного суда Российской Федерации (далее РФ) от 30 ноября 2023 года), движение ЛГБТ* признано экстремистским и запрещена его деятельность на территории РФ. Данное решение суда подлежит немедленному исполнению, исходя из чего на форуме будут приняты следующие меры - аббривеатура ЛГБТ* должна и будет применяться только со звездочкой (она означает иноагента или связанное с экстремизмом движение, которое запрещено в РФ), все ради того чтобы посетители и пользователи этого форума могли ознакомиться с данным запретом. Символика, картинки и атрибутика что связана с ныне запрещенным движением ЛГБТ* запрещены на этом форуме - исходя из решения Верховного суда, о котором было написано ранее - этот пункт внесен как экстренное дополнение к правилам форума части 4 параграфа 12 в настоящее время.

Назад
Сверху