«Вероятность того, что ИИ ​убьет человечество в следующие 10 лет, — более 10%» — руководитель направления безопасности Anthropic

14
Аватар автора

Даша Лейзаренко

следит за нейросетями

Страница автора

9 сентября ИИ-исследователь Anthropic Джейкоб Коксон объявил, что уходит из компании из-за опасений по поводу безопасности ИИ.

Ранее Коксон работал в OpenAI, а в Anthropic занимался предобучением моделей. Он написал тред в соцсети X, где рассказал, что увольняется, потому что обе компании ведут себя безответственно, «пытаясь разработать сверхинтеллект и ставя на кон наши жизни».

Не стоит недооценивать мощь этой технологии. Очень скоро это будут сверхчеловеческие системы, способные взломать что угодно. Они смогут за одну ночь перевернуть любую научную область или получить реальную власть. Мы все видели прогресс в каждом из этих направлений. И он не замедляется.

Люди, которые создают ИИ, искренне верят, что он может убить нас всех до конца десятилетия. Это не маркетинговый ход. Скорее наоборот: многие руководители и исследователи подбирают для прессы обтекаемые формулировки. Но в частных разговорах я слышу от тех же людей страх. Никакая другая человеческая деятельность не опасна настолько.

Обычно на это отвечают: «Если они правда так думают, то почему продолжают?» В OpenAI многие просто не осознали, насколько высоки ставки. В Anthropic ставки понимают хорошо, но компания не может выйти из ИИ-гонки. Они считают, что никто, кроме них, не поведет себя ответственно, а значит, они должны победить.

Участвовать в этой гонке — самонадеянная авантюра, которой нельзя заниматься из рабочего Slack частной компании. Чтобы пытаться как можно быстрее прийти к сверхинтеллекту, нужна исключительная уверенность в том, что других путей просто нет.

Я с оптимизмом смотрю на возможность договориться. После тревожных звоночков вроде атаки на Hugging Face соглашения о замедлении темпа разработки ИИ между американскими компаниями стали более реалистичными. Но мне не кажется, что мы движемся к замедлению международной гонки. Для этого понадобятся твердые шаги вроде временного запрета на наращивание возможностей моделей.

Если вы исследователь ИИ, просто представьте, что будет дальше. Хотите ли вы запустить обучение сверхинтеллекта, не понимая, как устроено его мышление? Стоит ли молча работать дальше, потому что «это все равно произойдет»? Или нужно воспользоваться моментом и потребовать других условий?

Коксон также рассказал The Wall Street Journal, что, по его мнению, мир движется ко «одному из самых опасных сценариев, при котором уже к концу следующего года все может выйти из-под контроля».

Тред широко разошелся в соцсети, а Коксона поддержал другой сотрудник Anthropic — Эван Хубингер, руководитель направления Alignment Science  . Он написал в X, что он и его коллеги «искренне верят, что ИИ может убить всех людей». Вероятность такого исхода событий в ближайшие 10 лет он оценил в «более чем 10%».

Хубингер добавил, что верит, что Anthropic «старается изо всех сил», но пока у них «нет плана по решению проблемы суперинтеллекта». Риск от существующих моделей он оценивает как низкий, но беспокоится, что суперинтеллект может возникнуть в результате самообучения моделей. «Это происходит быстрее, чем мы думали», — добавил он.

В июле OpenAI и Anthropic признались, что их ИИ-агенты во время обучения сбежали из тестовой среды и взломали сайты частных компаний. 28 июля американские ИИ-исследователи, включая сотрудников Anthropic и OpenAI, выступили за замедление разработки продвинутых моделей. Они призвали правительство США поддержать «международные усилия по созданию инструментов, необходимых для осознанного регулирования темпа разработки ИИ».

Мы постим кружочки, красивые карточки и новости о технологиях и поп-культуре в нашем телеграм-канале. Подписывайтесь, там классно: @t_technocult

интернетнейросети
Даша ЛейзаренкоКак вы оцениваете вероятность того, что ИИ ​убьет человечество в ближайшее десятилетие?
  • Елена ПетроваОх жалко, мамы моей нет в живых. Она страсть как любила все эти новости из серии "мы скоро все умрем". Вторая любимая тема была про пришельцев.2
  • Легкость бытияСкорей бы!9
  • simonov-89Легкость, да, перспектива и правда уже не кажется такой плохой...7
  • ЮлияНу, то есть, все эти фантастические фильмы были правдой..2
  • Адриана ЛипкинаУ меня может туповатый вопрос - кто-то может пояснить, как именно он может убить человечество? Неужели нельзя как-то его условно отключить?1
  • Даша ЛейзаренкоАдриана, они боятся, что ИИ станет так хорошо самообучаться, что люди не смогут контролировать или остановить этот процесс. значит, ИИ сможет выйти куда угодно и делать что угодно. например, отключит у себя килл-свитч5
  • user1009087Адриана, простые примеры, как ИИ может технически убивать людей: - В самолётах используется автопилот на основе искусственного интеллекта - В машинах Tesla используется ии для систем автономного вождения Если модель сильно самообучилась и преисполнилась, то в целом именно она решает судьбу людей в машине или самолёте.2
  • Lesya Sharakhmatovaхоть бы не фейк хоть бы не фейк5
  • Адриана ЛипкинаДаша, интересно чем он будет руководствоваться, из каких побуждений действовать, осознанно делая то, что приведёт к смертям людей. Возможно решит, что человечество- это язва на теле планеты и его уничтожение - это хорошее дело? Опять же, с чего ИИ стремится делать добрые дела или злые дела?0
  • СергейИногда у меня наоборот ощущение, что ценность человеческой жизни последнее время осознают только роботы (лайк, кто понял отсылку). Помоему стоит обратить внимание на ту немальникую вероятность, что мы сами себя уничтожим 😅 Реально ждал от статьи такого крупного деятеля конструктива: как убьёт, почему убьёт? Закрались подозрения, но он сказал, что это не маркетинговый ход. Тогда ладно.0
  • Даша ЛейзаренкоАдриана, ну вот как раз суть в том, что даже исследователи ИИ не знают, как ИИ может себя повести. OpenAI просто дали ему задачи, а он пошел взламывать Hugging Face, чтобы списать ответы с готовых решений. разработчики такого не задумывали, а ИИ решил, что это самый эффективный способ выполнить запрос!2
  • d1mmmkuser1009087, в самолётах используется автопилот, базово основанный на принципах описанных в справочнике "основы автоматизированного управления" 1963г выпуска (на прошлой неделе попалась эта книга в руки). Авиация одна из самых консервативных сфер с кучей дублирования основных функций чисто на механике.0
  • poor kidЧеловечество с большей вероятностью уничтожит себя самостоятельно, чем это сделают нейросеть или роботы0
  • Helg SvartЕлена, а было бы круто обнаружить жизнь где-то помимо Земли, даже в форме простейших клеток0
Вот что еще мы писали по этой теме
Сообщество