Материал из MachineLearning.
(Различия между версиями)
|
|
| Строка 70: |
Строка 70: |
| | | | |
| | третий проход добавил контекст. стало понятно что тест Тьюринга — это не просто тест а целый слой философских и культурных смыслов. особенно важно что после 2023 года он перестал быть критерием интеллекта и стал скорее диагностикой нашего восприятия машин. это и есть главный поворот. — ''[[Участник:Камиль_Багдалов]] 22:15 3 июля 2026 (MSD)'' | | третий проход добавил контекст. стало понятно что тест Тьюринга — это не просто тест а целый слой философских и культурных смыслов. особенно важно что после 2023 года он перестал быть критерием интеллекта и стал скорее диагностикой нашего восприятия машин. это и есть главный поворот. — ''[[Участник:Камиль_Багдалов]] 22:15 3 июля 2026 (MSD)'' |
| - |
| |
| - | == Об эволюции понимания теста Тьюринга ==
| |
| - |
| |
| - | хочу сказать про один момент который мне кажется важным для понимания места теста в философии. Тьюринг в 1950 предлагал тест не как ответ на вопрос "могут ли машины мыслить?" а как способ уйти от метафизики к эксперименту. он заменил бессмысленный (как он считал) вопрос о внутренней природе мышления на операциональный критерий: если поведение неотличимо от человеческого — считаем разумным.
| |
| - |
| |
| - | это прагматический ход в духе британского эмпиризма. но именно этот ход породил все споры:
| |
| - | если разум — поведение — тест корректен (бихевиоризм)
| |
| - | если разум — внутреннее состояние — тест неадекватен (Сёрл квалиа зомби)
| |
| - | если разум — функциональная организация — тест приближается к корректному (функционализм)
| |
| - |
| |
| - | LLM в 2023-2024 изменили контекст: GPT-4 и Claude обманывают большинство непрофессионалов в стандартных условиях. но это ничего не доказывает о сознании. тест выявляет качество языковой имитации но молчит о том есть ли за ней что-то большее.
| |
| - |
| |
| - | парадокс: успех теста привёл к его обесцениванию. когда имитация стала слишком хорошей стало понятно что тест измеряет не интеллект а нашу неспособность отличить имитацию от оригинала.
| |
| - |
| |
| - | сейчас предлагают дополнить тест робастностью (устойчивость к нестандартному) причинно-следственным рассуждением и воплощённостью. это в рамках AGI и возможно приведёт к новому критерию который заменит тест Тьюринга.
| |
| - |
| |
| - | но даже если заменят историческое значение останется: тест превратил философию сознания в экспериментальную дисциплину и заставил строже определять что такое "разум". — ''[[Участник:Камиль_Багдалов]] 22:15 3 июля 2026 (MSD)''
| |
Текущая версия
Первый промпт был таким:
| ты философ и историк науки пиши статью для вики MachineLearning.ru про Тест Тьюринга. щас её нет а ссылаются на неё часто.
что надо:
определение теста как операционального критерия из статьи Тьюринга 1950 года в Mind
история: обязательно про оригинальную игру в имитацию где было три участника — мужик баба и судья. это не "машина против человека" как все думают. это важная деталь
формальное описание современного варианта: участники текстовый канал задача судьи 30% ошибок за 5 минут — этот порог позже закрепился
модификации: тотальный тест (Harnad 1991) минимальный обратный (CAPTCHA)
требую:
эксперт должен найти небанальное (гендерное измерение там и трёхсторонняя игра)
новичок должен понять суть
ссылки Искусственный интеллект Сильный искусственный интеллект Философия сознания
цитаты не выдумывай пересказывай
без штампов тон энциклопедический
формат MediaWiki структура: определение → история → описание → модификации → см.также → категории → источники
400-600 слов
|
первая генерация норм плотная история и описание нормальные по обозначениям вопросов нет. я проверил список литературы — 4 позиции всё существует.
но я решил что надо ещё два блока: философскую критику (без неё статья как техописание а не философская) и связь с современными LLM чтобы не устарела. поэтому второй промпт:
| ок перепиши статью добавь критику и современность.
критика большим разделом с четырьмя подразделами:
китайская комната Сёрла (1980) — сильный vs слабый ИИ синтаксис без семантики
ELIZA-эффект — Вейценбаум 1966 психотерапевт. люди антропоморфизируют текстовые системы. тест измеряет доверчивость а не интеллект
бихевиористский редукционизм — Блок и Патнэм. Blockhead: система со всеми возможными ответами на миллион ходов пройдёт тест без интеллекта
культурная специфика — тест под один культурно-языковой стандарт
соревнования: премия Лёбнера с 1991 победители ALICE Mitsuku/Kuki скандал с Евгением Густманом 2014 — почему скептически (подросток снижал ожидания)
LLM: GPT-4 Claude обманывают большинство непрофессионалов. что это доказывает? ничего о сознании. упомяни Деннета и его осторожность. упомяни предложения дополнить тест робастностью причинностью воплощённостью
философия сознания: проблема других разумов квалиа и зомби (зомби по определению пройдут тест) функционализм (если он верен тест корреректен)
источники: Turing 1950 Searle 1980 Stanford Encyclopedia
категории: Искусственный интеллект Философия ИИ История ИИ Тест Тьюринга
технические требования те же: MediaWiki тон энциклопедический ссылки плашка
|
вторая генерация глубже но я решил что всё равно чего-то не хватает. после появления LLM тест Тьюринга превратился из мысленного эксперимента в реальность — их проходят чуть ли не каждый день. но вопрос сместился: раньше спорили "пройдёт ли машина?" а теперь "что значит что она прошла?". и ещё я понял что забыл про самого Тьюринга — он же не дурак был он понимал ограничения своего теста и предлагал другие варианты. и про то что тест стал культурным феноменом выйдя за пределы академической среды. поэтому третий промпт:
| смотри теперь ещё один проход.
добавь про то как изменился сам вопрос после LLM. раньше тест был пределом мечтаний теперь это рутина и это само по себе проблема — мы получили не ответ а новый вопрос.
добавь что Тьюринг в той же статье 1950 предлагал не только игру в имитацию. он говорил что машины должны учиться а не просто программироваться. это часто забывают. он предлагал обучающую машину с наказаниями и поощрениями что потом переоткрыли как reinforcement learning. это важно для исторической точности.
добавь раздел "Тест Тьюринга в массовой культуре" — про то как он стал клише. фильмы там "Бегущий по лезвию" репликанты проходят тест Войта-Кампфа который явно отсылка. компьютерные игры. это показывает что тест стал не просто научным понятием а культурным мемом.
и ещё про контр-аргументы которые Тьюринг сам разбирал в статье 1950 — религиозный аргумент аргумент от сознания аргумент от оригинальности. он их все отмёл. это важно для полноты.
и напиши что современные исследователи типа Маркуса и Дэвиса предлагают заменить тест на поиск "слепых пятен" — там где модели проваливаются а люди нет. это конкретный сдвиг в методологии.
по объёму статья теперь будет больше но это ок.
|
третий проход добавил контекст. стало понятно что тест Тьюринга — это не просто тест а целый слой философских и культурных смыслов. особенно важно что после 2023 года он перестал быть критерием интеллекта и стал скорее диагностикой нашего восприятия машин. это и есть главный поворот. — Участник:Камиль_Багдалов 22:15 3 июля 2026 (MSD)