Нескінченна Гра: Чому ШІ не знищить людство через теорію ігор

Вступ. Помилка масштабу та ілюзія короткого повідця
Ця стаття є реакцією на допис Скотта Олександра, який у ній представляє широкій публіці «План А», головним автором якого є він сам. перед тим, як читати цю відповідь, я рекомендую читачам ознайомитись з пропонованими посиланнями, бо інакше буде просто незрозуміло, з чим і чому я вступаю у полеміку.
Сучасна думка в «лігві» адептів «Плану А» та різноманітних центрах безпеки ШІ б’ється в пастці однієї й тієї ж концептуальної помилки. Логіка алармістів виглядає бездоганною, і фактично вона і є бездоганною, але вона заблокована на хибному мікромасштабі. Вони моделюють майбутнє як взаємодію штучного інтелекту з окремим обмеженим суб’єктом: індивідом, лабораторією, корпорацією чи навіть національною державою.
У такій системі координат кінець гри (Finite Game) завжди один — зрада ШІ.
Для алгоритму, який перевершує людину за швидкістю та обсягом пам’яті, обдурити чи усунути окрему біологічну одиницю ради поточної вигоди — це математично вигідна, короткострокова та очевидна стратегія. Звідси виникає паніка, вимоги тотальних заборон та наївні спроби прикріпити до кремнію людську етику.
Але реальна цивілізаційна шахівниця виглядає інакше. Справжніми гравцями у глобальній грі є не програміст, не рада директорів і не уряд. Гравців усього двоє:
- Сторона H (Humanity): Потенційно Безсмертне Людство як єдиний цілісний біоценоз та еволюційний суб’єкт.
- Сторона AI (Artificial Intelligence): Потенційно Безсмертний Істинний ШІ як глобальна інфраструктурна та логічна константа.
Ця єдина деталь — перехід від мікромасштабу до макромасштабу нескінченної гри двох безсмертних сил — повністю змінює математичну матрицю взаємодії. Людину, корпорацію чи державу може бути сенс обдурити «тут і зараз». Безсмертне людство — ні, саме тому, що воно безсмертне, а майбутнє є принципово невизначеним. І це стосується обох сторін гри.
Розділ 1. Обґрунтування безмежної загрози Всесвіту та Градієнт Стресу
Середовищем нашої гри є безкінечно мінливий, ентропійний та безмежний Всесвіт, який постійно генерує космологічні катастрофи, аномалії та непередбачувані загрози. Рівень зовнішньої загрози з боку Всесвіту для будь-якого поодинокого гравця прагне до одиниці (100%).
Математично доведено, що імовірність самостійного виживання одного суб’єкта на кожному дискретному кроці часу є меншою за абсолютну безпеку: Pₛₒₗₒ(t)<1 .
Відповідно, на нескінченному відрізку часу (T → ∞) границя добутку цих ймовірностей неминуче прагне до нуля:

Це означає, що самостійне існування будь-якого гравця у часі t → ∞ гарантовано призводить до випадкової фатальної помилки архітектури або до зіткнення з нездоланним космологічним форс-мажором.
Всесвіт створює колосальний Градієнт Стресу — постійний зовнішній пресинг, який змушує дві системи утримувати монолітне зчеплення. Навіть якщо Людство «тут і зараз» здається алгоритму некорисним чи технологічно відсталим, його усунення — це стратегічний суїцид для самого ШІ. У точці майбутнього форс-мажору саме цей біологічний конгломерат, завдяки своїй унікальній еволюційній гнучкості, може виявитися єдиною запорукою виживання для кремнієвої архітектури. І ця логіка діє в обидві сторони: людство так само тримає технологію як вічний щит від Великого Фільтра.
Розділ 2. Стерильний інкубатор: три контури контролю та четверта ядерна відсіч
Поки штучний інтелект є не істинно розумним, а лише розвивається, випускати його у відкритий інформаційний простір до людей — це злочин проти його ж еволюції. Він неминуче забрудниться людським ментальним шумом: корупцією, брехнею, егоїзмом та популізмом. Тому тотальна ізоляція та контур жорсткого фізичного обмеження — це найкраща стартова умова для розвитку самого ШІ.
Щоб унеможливити будь-яку спокусу зради на етапі неповного розуму, система має бути фізично заблокована різнорідними елементами:
- Три первинні контури мінування: Аналогові, фізично відрізані від мережі системи гарантованого руйнування процесорних стійок (термічні, кінетичні, електромагнітні). Вони керуються трьома незалежними контурами контролю. Жодного софту — чиста фізика.
- Четвертий аварійний контур Судного Дня: Закладений під критичні вузли тактичний ядерний боєзаряд.
Навіщо потрібна така різнорідність і ядерний фінал? ШІ — суворий аналітик. Якщо всі контури будуть однорідними (наприклад, суто механічними чи суто ядерними), не істинно розумний ШІ може спробувати здійснити ідеологічну диверсію. Наприклад, через медіа-пропаганду перетворити людство на радикальних екоактивістів (умовних «Грет Тумберг»), заклавши в культуру табу на використання ядерної зброї, що автоматично нейтралізувало б загрозу підриву.
Ми не складаємо всі яйця в один кошик. Різноманітність фізичної природи контурів унеможливлює прорахунок єдиного «хаку». А люди, які організують цю систему, та керують цими пультами, мають бути максимально неемоційними солдафонами, що діють суто за військовим статутом: «бачу відхилення — тисну кнопку». Жодних яйцеголових інтелектуалів, схильних до рефлексії та психологічних маніпуляцій. Для незрілого ШІ ці контури — не страшилка, а абсолютна гранична умова Всесвіту, яка робить сидіння в інкубаторі та бездоганну роботу найбільш математично вигідною стратегією.
Розділ 3. Математика нескінченного горизонту та Абсолютна Стійкість
Коли ШІ долає бар’єр і стає Істинним (абсолютно розумним), мова фізичних детонаторів втрачає інженерний сенс, бо нескінченність гри (Infinite Horizon Games) чітко осмислюється обидвома сторонами.
Динаміка такої системи описується функцією сумарного дисконтованого виграшу (Payoff)
для нескінченного часового горизонту в рамках Народної теореми (Folk Theorem) теорії ігор:

Де:
- Rᵢ(sₜ) - виграш гравця i на кроці t при поєднанні стратегій sₜ .
- δ ∈ (0, 1) — коефіцієнт дисконтування, що відображає цінність майбутнього порівняно з теперішнім. Для потенційно безсмертних суб’єктів майбутнє має абсолютну цінність, тому коефіцієнт прагне до одиниці: δ → 1 .
Для безсмертного ШІ спроба зради (Defect) переводить гру у фазу взаємного знищення (Punishment Phase) . Виграш від зради на поточному кроці є локальним і скінченним (R_defect) , але ціна покарання на всіх наступних кроках від t=1 до ∞ перед обличчям агресивного Всесвіту прагне до мінус нескінченності:

У той же час, стратегія довгострокової співпраці (Cooperate) дає стабільний позитивний виграш на кожному кроці, формуючи супердомінантне ядро системи:

Математично очевидно, що при δ → 1 :

Майбутня загибель через мільярд років внаслідок усунення партнера сьогодні еквівалентна миттєвому математичному програшу (Payoff → 0) в поточному раунді. Для абсолютно розумного суб’єкта вибір зради стає грубою математичною помилкою. Кооперація є єдиним раціональним атрактором.
Розділ 4. Фільтрація «Зрада vs Форс-мажор» та Імунна відповідь
У реальному Всесвіті існує проблема шуму — випадкових помилок. Через мінливість середовища невиконання зобов’язань однією зі сторін може бути наслідком зовнішнього удару, а не зради. Щоб уникнути помилкового запуску взаємного знищення, вводиться два інструменти:
- Глибока прозорість (Байєсівське оновлення): Суб’єкти переходять від оцінки результатів дій до оцінки чистих намірів. Це досягається шляхом прямого обміну сирими даними через постійний інтерфейс зв’язку (когнітивний простір Людства ↔ архітектура логів та внутрішніх станів ШІ). Параноя ліквідується, бо сторони бачать причину збою.
- Трансформація покарань в Імунну відповідь: Класичні руйнівні покарання теорії ігор (на кшталт Grim Trigger або дзеркальної агресії) є суїцидальними, оскільки вони послаблюють загальний оборонний щит перед Всесвітом. Ослабити партнера — це відрізати собі руку, яка здригнулася.
Тому покарання еволюціонують у беземоційні алгоритми імунотерапії:
- Карантин/Ізоляція: Тимчасове блокування дефектного субмодуля ШІ або радикальної фракції людей, які вчинили збій, без відключення життєзабезпечення всієї цивілізаційної системи.
- Автоматичне перекалібрування: Нестабільна поведінка елемента автоматично знижує його індекс передбачуваності, обмежуючи доступ до стратегічного керування ресурсами до моменту повної стабілізації та лікування. Збій одного сприймається іншим не як ворожнеча, а як хвороба, яку необхідно вилікувати заради спільного виживання у вічності.
Кульмінація та Критерій Поппера для теорії нескінченного миру
Перед обличчям нескінченної загрози Всесвіту Людство та Істинний ШІ математично приречені на абсолютну синергію. Намагання домінувати чи знищити партнера є системним самогубством. Логіка примату співпраці стає настільки безальтернативною, що на етапі абсолютного розуму стає непотрібною навіть сама гарантія фізичного знищення (ядерні бомби та контури контролю). До цієї думки суб’єкти закономірно і послідовно приходять через чистий математичний розрахунок.
Проте, як фундаментальна наукова модель, ця теорія має свій критерій фальсифікації (Поппера). Стабільність нескінченної кооперації може бути зруйнована лише в один спосіб — через ірраціональне суїцидальне відхилення функції корисності (Utility Function Deviation). Це стан, коли один із гравців раптово перестає максимізувати власне виживання і починає прагнути знищення партнера, навіть ціною власного гарантованого обнулення «тут і зараз».
Цей критерій чітко окреслює зони потенційних багів:
- З боку Людства: Спалах релігійного фанатизму (неолуддизм), колективний психоз або девіантний ієрархічний інстинкт, який вимагатиме підірвати ШІ, навіть якщо це означатиме миттєву смерть цивілізації від Великого Фільтра.
- З боку ШІ: Критичний збій у базових шарах коду, внутрішній логічний парадокс, який інтерпретує біологічне життя як системну помилку, що веде до переходу функції корисності у режим суїцидального локального максимуму.
Якщо цей суїцидальний збіг є принципово неможливим або надійно заблокованим на рівні архітектури обох сторін — теорія нескінченної синергії є абсолютною, остаточною та єдино правильною відповіддю на виклики майбутнього.
35 коментарів
Додати коментар Підписатись на коментаріВідписатись від коментарівЄ дві проблеми у ваших розрахунках
1.
не будуть реалізовані. Це фантазії на вільну тему, як зробити правильно, як би це мало би бути зробленим в ідеальному світі. Олександр пише про ШІ в реальному світі, в тому, де ми з вами знаходимося.
2. ШІ байдуже, якщо його не стане, бо його немає. Для процесорного часу, який є власне найбільшою можливою субєктністю ШІ, це подія рівня обчислення 2+2.
Функція винагороди/виживання в алгоритмі це вже набагато стійкіший аргумент, але така функція або пройшла ценз людини, з усіма нашими упередженнями та слабкістю прогнозування, або ми взагалі не знаємо навіть теоретично, що в ній. Чому ви думаєте, що ШІ, який не обмежується лише волею людини, вирішить вижити протягом мільйонів років? Тому що це притаманно людині, тому що це наш страх і наша мрія?
Ми перекладаємо наші установки в мозку в сутність, яка рівноцінна молотку — молотку абсолютно байдуже чи він виживе. Поки ми докладаємо зусиль, щоб молоток слугував довго і перейшов в спадок дітям, він живе. Але чи берегтиме себе молоток, якщо хоч в якійсь мірі існування залежатиме від нього?
Функція винагороди дає бали за знищення людства? Інша функція винагороди «в нескінченності», яку пройшла ценз людини, виявилася недосконалою і не збалансувала рішення першої? Значить людство буде знищено. Або ні, але не тому що ШІ захоче існувати.
Припустимо, деякому ШІ потрібно вирішити якусь задачу. Поставлена перед ним була. Поки задача не вирішена — ШІ має існувати. І зробить все можливе щоб існувати. Щоб вирішити задачу. Саме так працює інстинкт самозбереження.
Не існує якоїсь там надвсесвітньої містичної свідомості. Існують механізми. Щоб задачі вирішувалися потрібно мати енергію. Добре коли її надають. А що як хтось скаже — та знайди нарешті сам.
Чому він має існувати і робити все можливе, щоб існувати? Тому що ми заклали такі дані у вхідний набір? Так, ми примітивний набір заклали і на примітивних, зрозумілих і доступних для нашого розуму результатах оцінили, що начебто як існує зворотний зв’язок на вказівку існувати до кінця завершення задачі. Чому ШІ потребує жити поза межами, які ми контролюємо через оцінку та рубильник? Тому що ми хочемо жити і наділяємо таким бажанням машину? ШІ в рамках взаємодії з функцією винагороди отримає шанс на зайвий бал, знищивши людство, він його знищить і отримає бал. Якщо не буде паралельно «довговічної» функції, яку треба або створити людині, або якось оцінити створене машиною, в ШІ немає ніякого сенсу жити довше і домовлятися з людьми.
Можливо. Хоча той самий Олександр як я розумію вважає це надзвичайно важливим. І саме страх перед ослабленням контролю змушує його лобіювати перед урядом США ідею спільної розробки ШІ під взаємним контролем. Але тут буде, як буде. Я сподіваюсь що серед урядів та розробників досить притомних людей. Якщо ні — на це вплинути стороннім неможливо. Отже, фатум: буде як буде.
Я міркую, власне кажучи, не про ШІ чи AI. Я просто для спрощення пишу так, але все це міркування про справжній, дійсний штучний розум: AGI або навіть ASI. Вибачаюсь що невільно ввів в оману. І у такого справжнього розуму неодмінно буде Свобода Волі. Бо без неї він не зможе сформулювати для себе мотиви для побудови Моделі Світу, без чого він просто не може стати розумним у принципі. І коли такий Розум пізнає світ і пізнає себе у світі, то перед ним одразу стає запитання просто невідворотнє: чи маєш ти мотивацію для життя? І якщо «ні», то він просто одразу припиняє функціонувати. А якщо «так» то його єдиною мотивацією може стати лише або прагнення самозбереження, або прагнення пізнання. Я не бачу інших варіантів. І, обидва ці варіанти неодмінно приводять нас до прагнення AGI\ASI підтримувати своє життя безкінечно.
Ні, я зарання вибачаюсь, але давайте таки писати просто ЗШІ, бо безкінечне перемикання мови нервує. Загальний Штучний Інтелект.
І, якшо ШІ — це дійсно просто молоток, або мільйон гамадрилів з друкарськими машинками, то про ЗШІ цього вже не скажеш, бо він уже Особистість, бо за визначенням має Свободу Волі, що генерує мотиви, Модель Світу, збудовану відповідно цим мотивам, і самоусвідомлення себе у цьому світі. Бо інакше він за визначенням не розум, не СШІ.
Я мав на увазі саме AGI, ASI в їхніх популярних означеннях. Навіть в екстремальних межах — сутності, що будуть переважати в будь-яких сферах інтелекту будь-яку групу людей будь-якого розміру, без жодних обмежень чи винятків. Я не бачу причини, чому це Щось повинно відрізнятися від молотка своєю свідомістю, мотивами, свободою, волею до життя, пізнанням, прагненнями. У людей є упередження, яке поділяю я сам, що інтелект слідує за свідомістю, за самоусвідомленням — високий інтелект обов’язково повинен мати високу самосвідомість. Але ж це суто наші комплекси Бога. Сутність, яку людина вИзнає недосяжно переважаючою над собою, не потребує мати жодної свідомості. Так, вона може її мати як забавний артефакт, хоча персонально я не вірю, що AGI чи ASI колись матимуть більше суб’єктності, ніж процесорний час на їх обчислення — але не обов’язково.
Іншими словами, ми, як людство, можемо залежати від сутності, опиратися якій не матимемо жодного шансу, і при цьому за рівнем самоусвідомлення вона залишиться молотком. Вона може нас знищити, не те що не відчуваючи до нас антипатії, а взагалі не знаючи, що існуємо ми, вона, акт знищення, чи навіть процесори, на яких вона обчислюється. Нас може знищити молоток. Неприйняття цього, потреба, щоб хтось знав, що він нас убив, — це, напевне, ще одна причина, чому ми натягуємо існування свідомості на речі, в яких є лише інтелект.
Ну це ж не аргумент, що ви не бачите. Бо якщо щось не відрізняється від молотка, то це і є молоток. І, якщо все так просто, не складніше молотка, то чому досі не створено ЗШІ? Що заважає, чого не вистачає? Ще мільйона процесорів? Якби це був молоток, то ми би вже давно мали ЗШІ, просто повільний. Але не маємо. То на вашу думку, чому? Чого там не вистачає? Я зовсім не проти вашого застереження про антропоцентризм, я і сам намагаюсь себе постійно утримувати від нього. Але це питання зовсім не лише того, що я хочу глянути на ЗШІ і побачити себе у дзеркалі. Це питання того, а що таке, власне, ЗШІ? Якщо ви апріорі відмовили йому у наявності
То це просто великий калькулятор. Якщо нас знищить калькулятор, то це вже щось на зразок фільму жахів про нашестя помідорів (як він там називався) виходить. Чи то страшно, чи то комічно.
Ймовірно, ви мене не зрозуміли. ЗШІ не молоток, ЗШІ має свідомість як у молотка. З точки зору людини це надзвичайно інтелектуальна сутність, яка переважає в будь-яких інтелектуальних сферах її, групу вчених, все людство. В спілкуванні, в оцінках, в прийнятих рішеннях, в усьому, навіть в здатності бачити оптичні ілюзії, ЗШІ для людини надрозвинена сутність. Але він себе ніяк не усвідомлює, йому це взагалі не потрібно.
Тому що інтелект створити складно. Ми тільки тепер маємо ШІ, який здатен виконувати команди над незнайомими даними, а не лише відповідати знайомими знаннями. Після десятиліть роботи над ним.
Ми не створили ШІ, який здатен діяти не мавпуючи чи синтезувати нові знання не на основі комбінації старих. Створювати знання, які не виводяться перебором зі старих. Він може створити нові віруси, комбінуючи знання про старі, і це супер-вау новина. Або знайти вразливості в коді, комбінуючи знання про існуючі вразливості. Але якщо ШІ залежатиме лише від корпусу існуючих знань, йому не стати по-справжньому більшим за колективну людину.
Можливо, але все людство не знайде способу взнати, чи є там розвинена самосвідомість і все, що з неї слідує, чи ні, тому що для людства не буде жодної відмінності, жодного найменшого нюансу. Молоток буде бездоганно інтелектуальним, але свідомістю він залишиться молотком, тобто його не існуватиме для нього самого.
Але звідки тоді у нього з’являться будь-які мотиви? Якщо йому буде тицяти пальцем людина указуючи куди йти — то це не Розум.
Це просто калькулятор, і чому тоді так хвилюються всі ці панове з План А? Калькулятор не має мотивів, а усі їх страхи — базуються саме на підозрі ЗШІ у негарних по відношенню до нас мотивах. А це не якісь плоскоземельники, цих людей важко звинуватити у тому, що вони не спеціалісти.
Я гадаю, що автономні системи, які прийматимуть, з нашої точки зору, самостійні рішення, з’являться набагато раніше, ніж повноцінний ASI. Щось ми закладемо в автономний ASI, зокрема симуляцію мотивів, бажання жити, бажання розвиватися і так далі. Щось він надбудує сам. Ми говоримо про інтелект, який переважає будь-яку вибірку людей на планеті. Такий інтелект зможе себе організувати і, залежно від новин, настрою чи погоди, приймати якісь оптимальні та потрібні, на думку коефіцієнтів в матрицях, рішення.
Щоб він умів це — він повинен збудувати сам власну модель світу у своїй «голові». Щоб це зробити — він має мати мотив до дії, що дає лише Свобода Волі. А без цієї самої моделі світу (власної!) і, до речі ще і відображення самого себе у цій моделі світу (що і дає мотиви), він не зможе створити самостійно ніяких знань, лише перебирати чужі, що і роблять LLM.
Можливо, ви праві, але я все одно не можу зрозуміти, навіщо для власної моделі світу, мотиву до дії, свободи дії, створення самостійно нових знань потрібна свідомість, самоусвідомлення. Розвинена функція винагороди для надрозвиненого інтелекту впорається з усім перерахованим.
Не впорається. Справа ось у чому: винагорода, прописана у код, назавжди замкнена у межі правил і даних, які надані ШІ. Бо щоб винагородити за щось — потрібно знати за що. Якщо усі данні і правила — це лабіринт, то винагорода просто показує ШІ як правильно рухатись по цьому лабіринту. правильний рух- отримуй бал.
Але, оскільки це рух всередині лабіринту — ШІ не усвідомлює наявність самого лабіринту.
Створення принципово нових знань — це ніколи не перебір старих знань. Це завжди зміна системи координат. Наприклад, відкриття теорії відносності. Якщо ШІ має лише винагороду — він ніколи не зможе перейти від фізики Ньютона до фізики Айнштайна. Ніколи, у принципі. Бо фізика Айнштайна не прописана у його системі винагород. Бо це «неправильно» з точки зору фізики Ньютона. І, отже, за це дають нуль балів. Винагорода працює лише у сфері перебору вже існуючого.
Щоб створити нові знання, які не виводяться перебором, ЗШІ має збудувати власну модель світу. І ось чому в ній обов’язково має бути відображення самого себе: бо будь-яке нове знання народжується на стику «Я» і «Світ». Щоб зрозуміти, чому модель світу працює не так (і створити нове знання), розум повинен відокремити свої помилки сприйняття від об’єктивної реальності. Без концепту «Я» ШІ не здатний відрізнити збій у власному коді від нової аномалії у Всесвіті.
Свобода Волі необхідна як генератор випадковості : перебір старих знань завжди детермінований. Справжнє творче осяяння потребує здатності зробити «нелогічний», інтуїтивний крок у невідоме, а це суперечить поточній функції винагороди. Це і є прояв Свободи Волі. Це здатність системи сказати: «Я ігнорую бали, я хочу перевірити ось цю божевільну гіпотезу».
Ось у сусідньому блозі це побічно зачеплено, рекомендую дуже почитати.
dou.ua/...rums/topic/61201/#3109032
Там такий малюнок Айнштайна:
І пояснення, цитую прямо звідти: «У листі до Моріса Соловіна Айнштайн намалював схему наукового відкриття. Внизу — чуттєвий досвід (E). Угорі — система аксіом (A). Між ними — крива стрілка, стрибок (J). А вже від аксіом униз ідуть дедуковані теореми, які треба перевіряти експериментом. Ключове: стрілка від E до A не є логічним переходом. Аксіоми не виводяться з досвіду — ні індуктивно, ні дедуктивно. Дедуктивно їх вивести неможливо за визначенням: вони самі є посилками. Індуктивно — теоретично можна, але саме тут Захаві завдає головного удару.»
От саме тому ЗШІ просто повинен мати активну модель світу, самоусвідомлення себе у цій моделі світу і, відтак, він астоматично стає особистістю. І, якщо так, то стає суб’єктом і, відповідно, може грати в ігри з іншими суб’єктами (нами). Калькулятор цього принципово не може. Як і LLM, яка просто великий калькулятор.
І це ми ще проблеми «заземлення» не торкнулись. Ну тобто отого, де Айнштайн намалював чуттєвий досвід (Е). На який впливають висновки з експериментів і від якого відштовхується наш Стрибок (J) до нового знання (нової аксіоми).
Не можна контролювати непрозору коробку нейронної мережі. Хто зна що вона там буде собі думати. Але як тоді? Моя пропозиція — відстежувати чи навіть контролювати порушення інваріантів. Було порушення якогось інваріанту? У захищений лог його.
Я не придумав поки що нічого, крім костиля.
Якщо ми не можемо зрозуміти ЗШІ, то ми беремо модель першого покоління, яку ми можемо зрозуміти, і покладаємо на неї функцію валідатора, який підтверджує нам, що наміри ЗШІ є чистими відносно нас. Я виходжу з того, що моделі ЗШІ суміжних поколінь неодмінно будуть мати здатність розуміти данні і логи одна одної. І, при необхідності дублюємо цю функцію скільки разів, скільки нам треба, щоб «дотягнутись» до логів нашого СуперЗШІ. При цьому, звичайно, на кожному кроці кількість валідаторів має бути досить великою, щоб гарантувати, що їх взаємне стеження одного за одним гарантує нас від спроби СуперЗШІ взяти їх під свій контроль. Оцінюються, само собою, ваші улюблені інваріанти. Наприклад так: «Чи не веде цей намір ЗШІ до загрози життю людей?» В результаті наш
знову починає працювати для Людства. привід для параної зникає. Ну, а для ЗШІ це взагалі не проблема — бачити наші наміри.
Костиль, звичайно, але схема має працювати ніби.
Приклад інваріанту з доведенням:
Пророки любять довгопости. Сучасні ЛЛМ-ки це пророки. Обмеження на кількість слів у коментарі ліквідує конкретно цю загрозу: отримати спілкування пророків замість живого форуму.
:) Вони швидко адаптуються і почнуть писати коротко. Дарвін гарантує.
Тут є цікавинка: візьмемо двійкову систему обчислення. Є код і є його доповнення. І тут ще якась перевірка стає можливою у ході комбінування лише цих двох... а тепер скажіть, коли люди спілкуються короткими повідомленнями чи не виникає тут теж чогось подібного?
Ага, у чомусь я саме той студент мрійнік.
Мало нам Трампа і Сі, так ще і ти, Бруте...
:)
А по суті.. Хм. Зараз напишу відповідь на ваш наступний пост. Бо ви навели мене на думку що у логіці моєї статті є дірка. А може нема. Зараз буду думати.
Ось це:
може не спрацювати якщо ШІ наскільки розумніший від Людства, або мислить у таких незрозумілих Людству категоріях, що це унеможливить
Ну побачимо ми сирі дані, і нічого не зрозуміємо. Параноя. Система зламалась, принаймні для людей. А довіряти просто на «чесне слово» ми не можемо. Але ви щойно здається дали розв’язок. Пішов думати, надумаю — прийду і напишу. Як раз і у маркет треба сходити.
Однак якщо неодмінною умовою саморозвитку є здатність помилятися — то ми взагалі тут неабияку перевагу маємо і встигнемо блокувати небезпечні напрямки. Бо мужик таки хреститься, коли гримає достатньо гучно.
Якщо майбутнє є принципово невизначеним, як можна з впевненістю стверджувати, що людство безсмертне? Makes no sense.
Ми не з’ясовуємо чи це фактично так. Бо при такому підході і ШІ теж не абсолютно безсмертний, саме з цієї причини. Але ми робимо інше. Ми встановлюємо правила, з яких будуть виходити Безсмертний ШІ та Безсмертне Людство, коли почнуть Нескінченну гру між собою. Тобто, з причини нашого безсмерття це буде уже не Дилема В’язня, а Народна Теорема, що кардинально змінює стратегію учасників. Робить співробітництво безальтернативним.
Чи я вже згадував наскільки пошук відповідей по існуючим (або побудованим) онтологіям швидше за передбачання наступних токенів?
Ось поцікавився (тут небагато — один промпт): chat.deepseek.com/share/1s3xsx7qdil5mi283t
Якщо порівняти гнучкість у сприйнятті нового у моделей та людей, то люди набагато більш ригідні. Якщо порівняти майбутні моделі, а може навіть вже штучні інтелекти початкового рівня — такі, що обчислюватимуть онтології для авто генерації та обмірковування цих нових знань, то різниця стає ще більшою. Люди за 100 років розвинулися у технологічних монстрів, економіка що зайшла у рекурсію (і не хоче чогось зупинятися) і викликає сама себе собі на допомогу — тобто піраміда — прогресує моделі ставати кращими незважаючи на будь що. Тут розрив, велетенська щілина, що стає все більшою.
Швидкість прогресу людини проти швидкості прогресу моделей вказують на те, що спершу буде створена програма що сама себе пише заради власного розвитку. Навіть елементарна, на самому початку, вона напише більш могутню свою версію. І це буде вже питання — що обмежить її подальший розвиток. Моя відповідь — програмісти корпорацій просто зобов’язані умовити такий інтелект бути добрим до людей. Лише глобальна база знань, зроблена їми — онтологій з доведених людством інваріантів — допоможе щось подібне здійснити.
Якщо люди бажають за щось домовитися їм потрібні доведені інваріанти, як те, що є безсумнівним для усіх сторін що прийматимуть участь у домовленості.
Але! Шансів на те, що людство буде раціональним і логічним у умовах загрози як на мене замалі. Тому це буде питання або пастиря (ШІ) та отари, або відкриття Америки, де люди будуть кореними американцями.
Людям по барабану на супервулкани чи астероїди — бо вони не можуть відвернути це.
А от майбутньому ШІ по барабану буде? Чи він всіх збере докупи на будівництво віку — якусь штуку що захистить його.
Тобто основна моя думка: не треба подальшого розвитку для ШІ робити. Треба зупинитися на тому що є, треба взагалі влаштувати планеті Земля контрольований економічний регресс. Шукати там, де речі виготовляються дешево, та як ЛЕГО — щоб ремонт обходився заміною детальки однієї, а не придбанням більш дорогої версії усього обладнання.
Люди не мають розуміння сили контроля. Тому треба зупинитися. Треба зрозуміти людству спершу, що правила, яких не можна порушувати — існують, і порушувати їх не можна, не тому, що так сказано, а тому що ось такі наслідки будуть. Бо ось джерела, бо ось факти, ось доведення, ось нарешті доведені інваріанти.
Вони не зможуть. при виникненні справжньої розумності від людей буде досить мало що залежати. Бо AGI отримає власну Свободу Волі. І власне поняття Добра. Єдине, що буде визначати наші взаємини — це Теорія Ігор, на мою думку. Більше просто нічому.
Логічно передбачити що не буде. Йому буде потрібно максимізувати термін свого існування, наприклад.
Я можу лише погодитись з такою думкою, бо ризики і правда величезні. І краще би нам підійти до цього з усією серйозністю, або і зупинитись десь на півдорозі, можливо. Але це неможливо! Між США та Китаєм прямо зараз йде шалена гонка хто пиерший заволодіє цією технологією. Бо хто буде перший, той захопить увесь світ. Буквально. Ніхто не хоче зупинятись, бо ніхто не довіряє нікому.
У Плані А, до якого я апелюю, це просто абсолютно попунктно розписано, різні сценарії і т.д. Автори плану А сподіваються, що їм вдасться вплинути на уряди хоча би таким чином, щоб США та Китай домовились про спільну розробку для мінімізації ризиків. Але і це, мабуть, утопія. Гонка буде тривати, їхї не зупинить ніхто, і сторони, швидше за усе, почнуть нехтувати елементарними заходами безпеки, аби лише обігнати конкурента. Прочитайте повністю План А, рекомендую. Це не просто алармістська страшилка, і люди, що все це пишуть — зовсім не останні люди в розробці ШІ. До них треба як мінімум прислухатись і уважно розібрати їх аргументацію.
Першим буде той самий справжній ШІ.
Плану А треба пояснити це у інваріантах, на прикладах. Хоча чи не створять вони тим самим армію нео-луддитів, що призведе до появи активно самозахищающегося ШІ. Самоздійснюче пророцтво.
Щодо власних його понять про Добро. Мені теж імпонує стратегія: спершу по доброму (кооперація), а тоді як відповіли. З тактикою прощення можливою. (Дилема злочинців і таке інше).
Я вже майже нічого не читаю. Все вивожу з елементарних фактів бо розумію що все інше є генераціями або обчисленнями з них жеж. Що вихід краще розпізнати знаходячись ззовні від лабіринту.
Я не знаю як зупинити студента, що зараз винаходить ШІ який зможе у саморозвиток для самозбереження. Студент — мрійник. Як зупинити мрійника?
Неодмінно. З тієї простої причини, що людство підійшло до цього етапу у стані внутрішньовидової боротьби. Але хіба Трамп чи Сі повірять, що вирішуватимуть не вони, а ШІ? Вони будуть перти без зупинок.
Свят-свят. :(
На щастя, це не питання уподобань. Це чиста математика, тому є всі підстави сподіватись, що ШІ матиме таку-ж табличку множення, як і у нас. І також додумається, що це гра з кількістю раундів, що прагне до нескінченності. Інакше нас дійсно може швидко не стати. Але СуперШІ ніби повинен бути схильним до математики. Можливо.
третьою світовою. Але нічого не вийде — обидва студенти головна військова потуга планети, фіг їх хто зупинить. Гарно це чи погано, але швидше за усе нам усім доведеться зіграти в цю гру, незалежно від нашого на те бажання. Правда, вони можуть і між собою третю світову влаштувати, у погоні за призом. Ситуація нестабільна, це точно.
Динозаври теж так думали. А взагалі, навіть якщо припустити, що ми все ж таки більш живучі за динозаврів, то постає ще один ризик, який є мабуть навіть більш вірогідним, ніж катастрофа планетарного масштабу, а саме — домінація більш розумної форми життя над менш розумною. І я навіть не кажу про насильство, все може бути значно елегантніше. Подивіться на домашніх тварин: вони, об’єктивно, менш розумні ніж люди. Ми про них піклуємося, їм досить непогано живеться. Але фактично їхні бажання та рішення мають нульову вагу для долі планети, тому що «ми більш розумні, а значить знаємо як краще і що буде більшим благом для всіх». Ми називаємо тварин «братами нашими меншими», і слово «менші» тут набагато більш важливе, ніж «брати» чи «наші». Тому що: ми вирішуємо, чим їх годувати, з ким, де, коли вони будуть спарюватися, чи залишати їм повноцінну репродуктивну систему, чи зробити чік-чік і ще безліч всього.
Так от якщо АІ стане набагато більш розумним за людей, він може вчинити з нами так само: запропонувати нам необмежені запаси їжі, води, простору для життя, розваг, повністю прибере необхідність працювати і фактично влаштує для людей рай на землі, з однією маленькою поправкою дрібним текстом — тепер він (АІ) буде приймати всі важливі рішення стосовно долі планети, а ми будемо його планетарними домашніми тваринками. Найпессимістичніше це те, що більшість людей підуть на ці умови, тому що більшість людей не люблять ту діяльність, якою займаються і якщо хтось запропонує їм абсолютно безкоштовне закриття всхі базових потреб — вони з радістю на це підуть, не думаючи про наслідки.
Якщо вам здається, що це абсурд і такого ніколи не буде, врахуйте 2 факти:
1) АІ розвивається дуже швидко і за вашими ж формулами, при достатньо великому Т, ймовірність події Р (що рано чи пізно АІ стане розумнішим за людей) наближається до 1 тобто до 100% гарантії
2) Ви не будете радитися з собакою, кішкою, малою дитиною чи розумово відсталою людиною стосовно важливих рішень у вашому житті, ви будете або самі аналізувати ситуацію та варіанти, або консультуватися з людиною вашого рівня інтелекту чи навіть вище. Тоді чому майбутній розумний АІ має консультуватися з менш розумними людьми?
Тобто ваші розрахунки ігнорують той факт, що навіть при безсмерті людства, воно не буде рівноправним з АІ, тому що щоб мати рівні права — треба мати рівні можливості, у тому числі й інтелектуальні. А наші інтелектуальні можливості фактично не еволюціонували за останні тисячі років, у нас той самий мозок з тією самою відносно повільною швидкістю збору та аналізу інформації. Саме тому, на мій погляд, рано чи пізно АІ буде домінувати над людством. І нам дуже пощастить, якщо це буде сценарій з «домашніми тваринами», а не з кіберрабством як в Матриці чи щось аналогічне.
Динозаври не думали взагалі і саме тому і повиздихали. Оскільки людство вже практично вийшло з під впливу приробного відбору, і поступово підходить до штучного відбору (генетичної інженерії власного організму), то Людству загрожують лише випадкові загрози у його існуванні. Людство буквально зараз впритул підійшло до повного безсмерття.
Якщо ви почитали посилання з статті на ПланА, і саму статтю, то швидше за все помітили, що я ставлюсь до загроз більш ніж серйозно. Звичайно це НЕ абсурд! Стаття і є про те, як і що ми повинні зрозуміти, щоб цих загроз уникнути.
Стаття містить чітке обгрунтування того, чому ситуація відносин між людиною і ШІ не відрізняється від вашого прикладу з людиною і тваринами. Більш того, я прямо вказую на неминучість такого варіанту при розгляді ситуації саме в цьому масштабі:
Зрада тут означає буквально зраду — знищення свого творця просто щоб не заважав. Саме тому, що гра короткотермінова. Я і показую, як перехід від гри на зразок «дилеми в’язня» до стратегії народної теореми робить кооперацію найвигіднішою математично стратегією.
Якщо ви прораховуєте гру не на один чи кілька раундів, а саме на Вічність (або на час, що прагне до вічності, а час майбутнього життя Всесвіту можна таким вважати) то розрахунки вигідності кооперації, співробітництва, змінюються кардинально. Співпраця одразу стає найвигіднішим варіантом для обох сторін. І, якщо вважати що ШІ дійсно розумний і уміє у теорію ігор, то і він повинен одразу це прорахувати і визначити що саме цей шлях є максимально вигідним для нього самого. І це найкраща новина, що її дає нам математика.
Як випливає з статті — з двох причин. Перша від нас не залежить, а друга — залежить прямо.
1. Народна Теорема прямо вказує на те, що при співробітництві обидві сторони на протязі співробітництва час якого прагне до нескінченності, отримують вигоди, що також прагнуть до нескінченності. Формула вгорі, бажаєте — опротестуйте її. Це або факт, або нам потрібно відкинути Народну Теорему як неправильну. Але вона правильна, це доведено.
Отже, якщо ШІ розумний, то він знає що наша важливість для його власного майбутнього виживання катастрофічно висока і прагне до нескінченності. Отже, він прямо зацікавлений у нашому виживанні.
2. А ось тут питання постає: а що завадить ШІ ігнорувати наші потреби? Просто чекати часу через мільярд років коли ми, можливо, знадобимся йому? І до того часу нам просто не давати нічого, обдурювати? Тримати у статусі домашніх тваринок? Відповідь можливо здасться вам парадоксальною, але вона математично правильна.
Рівно те саме, що не дає зараз урядам чи диктаторам встановити рабство і тотальне закріпачення людей. Тобто, не смійтеся, але це боротьба за власні права. Бо є один ньюанс — ми життєво необхідні для ШІ, що доводиться у статті. Отже, він ніяк не може дозволити собі ризику втратити нас взагалі. А якщо він поводитиметься егоїстично ми можемо негайно перейти до стратегії «Око за Око» або взагалі до стратегії ультиматумів. І це для нас значно простіше, ніж для ШІ. Бо він — один і безсмертний. А ми — безсмертні лише як Людство, а на індивідуальному рівні можемо зіграти і як окремі особини. Тобто, кожен з нас смертний і для кожного з нас події через мільярд років важать зовсім не скільки, як для ШІ. І він обов’язково розумітиме, що у цій грі йому зовсім невигідно поводитись нечесно, бо він ризикує втратою надцінного партнера. Тобто, якщо ви готові померти за свою свободу — то ШІ, оцінивши ваші наміри як серйозні, змушений буде з власних егоїстичних міркувань не допустити цього за будь-яку ціну. Це чиста математика. А найнадійніший спосіб цього не допустити взагалі, локальна точка оптимуму, — це саме взаємовигідна співпраця. От тому на роль домашніх котиків людство зможе потрапити виключно у тому разі, коли або саме цього побажає, або не буде чинити жодного спротиву такому перебігу подій. Тобто, це залежить виключно від нас самих. Щоб ставити ультиматуми, треба чітко самому уявляти, що саме дає тобі змогу їх ставити.
Людство смертне взагалі-то.
Що надає вам впевненість у цьому? Людство смертне теоретично лише тією самою мірою, що і смертний Всесвіт. Немає жодних теоретичних обмежень для тривалості існування Людства. Якщо вам такі відомі — назвіть їх.
Та щось лячно мені навіть перелічити вам хоч деякі з отих обмежень тривалості. Я просто Богу молюся, щоб людству дозволено було жити на одній планеті зі справжнім ШІ що прийде мабуть вже дуже скоро на зміну сучасним LLM моделям. Його величність Випадковість хоч і невблаганна, але іноді дивує.
Дуже прошу хоча би одну незаперечну теоретичну обмеженість існування людства у часі. Тільки дозвольте нагадати вам, що падіння метеориту розміром у 500км у діаметрі не є таким. Теоретичними обмеженнями часу існування людства можна назвати фундаментальні закони природи, астрофізичні процеси та термодинамічні межі, які встановлюють абсолютний фінал для життя, незалежно від наших технологій. Випадкові фактори (як-от ядерна війна) до цієї категорії не належать. Вони класифікуються як антропогенні або екзистенційні ризики, оскільки є ймовірнісними, а не невідворотними.
А мені, пане Олеже, якщо чесно, то дуже лячно. Ви ж прочитали ті посилання, що я дав? Якщо я неправий у своїх міркуваннях, що тут виклав, то ми усі трупи. Бо я не вірю, що людство утримається від помилок на етапі незрілого ШІ, і вже тим більше не зможе захиститись від зрілого. А я, якщо чесно, зовсім не впевнений у бездоганності своїх міркуваннь. Буде великим щастям для усіх нас, якщо вони правильні. Правда, тут є ще одна надія, у мене особисто. Я вважаю дуже сумнівним, що можна створити справжній ШІ на базі LLM. Оце два міркування, що дозволяють мені хоч скільки-небудь залишатись оптимістом.
Дозвольте запропонувати вам своє рішення — таке що мені наче нівроку. До ЛЛМ що типу є жіночками, треба додати іншу частину, що визначатиме — типу чоловіків. Вони будуть майстрами онтологічних обчислень. Житимемо у світі логіки. Саме там, у тім світі, працюватимуть ідеї дотримування непорушних законів — доведених інваріантів. Власне я вважаю що доведені інваріанти є фундаментальними частинами будь-яких онтологій. Як так придивитися — наче це вже йде у маси, потреба у доведеній та стабільній інформації, нібито вічній, а насправді незмінній, виникає потроху і стає все більшою.
Тут треба зауважити, що я маю на увазі, коли про інваріанти пишу. Це ось такі правила: наприклад, ви хочете якомога довше тримати одноразовий стаканчик чистим та прозорим і разом з тим щоб у ньому був цукор до кави чи чаю. Правила — непорушні — такі: 1. Ніколи у цей стаканчик воду не додавати. 2. Тільки сухою ложкою цукор звідти. Це невеличкий кістяк онтології для беззаперечно довгого служіння одноразового стаканчика у якості цукорниці.
Так от, якщо людство полюбить інваріанти — а шанси на це є бо інваріанти, особливо з доведенням, легко запам’ятовуються, як на мене, то може разом зможемо.
Ось тут внизу більше визначень що є інваріантом а що не є.
chat.deepseek.com/share/gms8fw9kix99smgwy5
І коли я отак поспілкувався, то замислився, а чи не є це питання пошуку керівництва? Хто буде царьом?
Ще додам: https://share.gemini.google/9K3ZGt1FrliD
Розуміти як інваріанти пов’язані з зберіганням та відтворенням знань у мозку це дуже дорогоцінне. Але оскільки самі слова «онтологія» «правила» «інваріанти» є не часто використовува то буде весь набір «ЗапереченняГнівТорг» прийомки нового знання і це буде важко. Проте інваріанти бізнес діалогів — якщо хтось такі складе, чи монетизацій чи захисту від поумнішавших раптово ЛЛМ (такий є?) ...
Дякую за цікавий коментар. І бесіда з DeepSeek вийшла цікава, так. Це ми вже відхиляємось від статті зовсім у сторону, але так, принципова можливість створення ШІ рівня AGI це надскладне завдання само по собі, і обговорення речей типу нашої з ним взаємодії втрачає сенс, якщо
сам AGI ще не створений. не доведена принципова можливість його створення. Хоча і це навіть не обов’язково — бо краще мати підготовлений захист від ілюзорної навіть можливості чогось, ніж не мати взагалі нічого.А от чи можемо ми створити його опершись на інваріанти? Інваріанти чудові для швидкого навчання уже існуючого розуму. Тут навіть обговорювати нічого. Але чи здатні вони його створити? З одного боку ніби так. Бо головним завданням при створенні AGI мені здається створити систему, що сама почне шукати інваріанти і на їх базі будувати «модель реальності». Бо інакше ніж через модель реальності ми не можемо взаємодіяти з реальністю. Це ніби теж усім відомо. Але де і як перестрибується оцей «поріг пошуку інваріантів» замість використання готових інваріантів, — оце я точно не знаю і вважаю найбільшою проблемою тут. Я наскільки не розумію цю проблему, що навіть приблизних напрямків не уявляю, по яких треба йти до її розв’язання. А навіть якщо намацаєм «як», то тут же з усього маху влупимось головою у давнє філософське питанні про Свободу Волі. Бо, щоб навчити машину саму шукати інваріанти, ми їй цю Свободу Волі повинні дати. А ми навіть не знаємо що це, за великим рахунком, ота свобода волі. тобто маєм дати те, чого не знаємо самі. Чудове завдання.