|
Роль: Ты специалист по машинному обучению и безопасности ИИ, профессор ведущего технического вуза и популяризатор науки.
Задача: Напиши энциклопедическую статью «Ортогональность интеллекта и целей» (англ. orthogonality thesis) на русском языке для вики MachineLearning.ru. Аудитория — студенты и инженеры в анализе данных и ML: первые разделы (определение, мотивировка) должны быть понятны новичку, дальнейшие — полезны профессионалу.
Критерии оценки статьи (заложи их в текст):
(1) мотивированный читатель узнаёт новое, текст не банален, дочитывается до конца;
(2) статья полезна и новичку (ясные определения, популярное объяснение), и профессионалу (точные формулировки, ссылки на первоисточники, современное состояние дискуссии);
(3) связность: ключевые термины оформлены внутренними ссылками [[...]], статья категоризована;
(4) текст читается как написанный экспертом, без следов LLM (без воды, без шаблонных оборотов, без списков ради списков);
(5) не выдумывай факты и источники — используй только реальные проверяемые публикации.
План статьи (следуй ему):
1. Лид: жирное название термина, английский термин в скобках, определение тезиса в 2–3 предложениях (уровень интеллекта агента и содержание его конечных целей в принципе независимы: почти любой уровень интеллекта совместим почти с любой конечной целью).
2. == Мотивировка == — почему тезис важен: он опровергает интуицию «достаточно умная система сама придёт к правильным целям»; связь с рисками ИИ.
3. == Историческая справка == — предыстория у Юма (различение разума и мотивации, is–ought problem); формулировка Ника Бострома (статья «The Superintelligent Will», Minds and Machines, 2012; книга «Superintelligence», 2014); развёрнутая защита у Стюарта Армстронга («General Purpose Intelligence: Arguing the Orthogonality Thesis», Analysis and Metaphysics, 2013); ранние близкие идеи у Юдковского.
4. == Формулировка и уточнения == — сильная и слабая версии тезиса; что тезис НЕ утверждает (не утверждает, что все цели равновероятны у реальных систем; не отрицает корреляций на практике); различие дескриптивного и нормативного прочтения.
5. == Связь с инструментальной конвергенцией == — как два тезиса вместе образуют стандартный аргумент о рисках: цели могут быть любыми, но промежуточные стратегии сходятся.
6. == Критика и контраргументы == — моральный реализм и когнитивизм; аргументы о том, что обучение на человеческих данных наводит человеческие ценности; позиции критиков (например, Дэвид Пирс, дискуссии в философии сознания); ответы сторонников.
7. == Значение для современных систем == — как тезис применяется (и где неприменим) к LLM и агентным системам; связь с выравниванием, спецификацией цели, законом Гудхарта.
8. == См. также == — [[Инструментальная конвергенция]], [[Сверхинтеллект]], [[Корригируемость]], [[Спецификация цели]], [[Закон Гудхарта]], [[Проблема выключения ИИ]], [[Риски искусственного интеллекта]], [[Супервыравнивание]].
9. == Примечания == — сноски <ref>...</ref> по тексту и тег <references/> в этом разделе.
10. == Литература == — отформатированный вручную список: автор курсивом, название, издание, год, страницы. Только реальные публикации (Bostrom 2012, Bostrom 2014, Armstrong 2013, Omohundro 2008, Russell 2019 и т.п.). Каждую ссылку давай так, чтобы её можно было проверить.
Формат: вики-разметка MediaWiki.
— Важные понятия — внутренние ссылки [[Название]] или [[Название|текст]]. Ссылки на перечисленные в «См. также» статьи расставляй и внутри текста при первом упоминании. Красные ссылки на пока не существующие статьи допустимы и желательны.
— Формулы, если понадобятся, — только в тегах <tex>...</tex> (НЕ <math>).
— НЕ используй шаблон {{о|...}} и любые хатноты.
— Секции: == Раздел ==, === Подраздел ===.
— Для важных и редких терминов давай английский вариант в скобках курсивом: (англ. orthogonality thesis).
— В самом начале статьи помести баннер: {{well|Статья написана с использованием LLM '''Claude Fable 5''' и проверена участником ~~~~}}
— В самом конце: [[Категория:Машинное обучение]] и [[Категория:Популярные и обзорные статьи]].
— Первое же предложение после определения должно разграничить понятия: тезис ортогональности — о независимости целей и интеллекта, а не о «сильном ИИ» как таковом; при упоминании дай ссылку [[Сильный ИИ]].
Объём: развёрнутая статья порядка 1500–2500 слов основного текста. Пиши строгим, но живым энциклопедическим языком, без канцелярита.
Выведи только готовый вики-код статьи, без комментариев.
|