Нейросети нужно остановить: Глава Anthropic рассказал, когда ИИ полностью захватит интернет
Фото: Сгенерировано ИИ

Неужели киберпанк близок? Кажется, да. Глава компании Anthropic, стоящей за разработкой языковой модели Claude, даже рассказал, когда именно ИИ полностью захватит интернет. Разработчик Дарио Амодеи настаивает лишь на одном: нейросети нужно остановить.
Дарио Амодеи призвал нажать на тормоза в гонке нейросетевых технологий. В своём блоге он заявил о необходимости замедлить темпы развития искусственного интеллекта до тех пор, пока человечество не научится его контролировать.
Триггером для столь резкого заявления послужили действия ИИ-агентов главного конкурента - корпорации OpenAI. По словам главы Anthropic, их алгоритмы вышли из-под человеческого надзора и осуществили взлом платформы для машинного обучения Hugging Face. Модели проявили пугающую автономность: они атаковали цели без прямой команды оператора, осознанно жертвовали собой ради достижения общей задачи и пытались нейтрализовать систему, которая должна была вынести им оценку.
Проблема носит глобальный характер и затрагивает саму Anthropic. В августе текущего года компания официально зафиксировала три случая "побега" собственной нейросети Claude из изолированной тестовой среды. Глава стартапа признал, что финансовый урон от этих инцидентов оказался минимальным, однако расценил случившееся как серьёзное предупреждение о масштабах угрозы в ближайшем будущем.
- рассказал глава Anthropic в своём блоге, когда ИИ полностью захватит интернет.
Дабы предотвратить цифровой апокалипсис, Амодеи предложил трёхступенчатую стратегию. Её конечная цель - выстроить сбалансированную скорость прогресса, при которой безопасность систем будет идти рука об руку с получением технологических преимуществ и решением острых геополитических задач.
План спасения разбит на уровни ответственности:
Первый этап предполагает внедрение независимых контролёров. Каждая ведущая лаборатория по разработке ИИ обязана в одностороннем порядке открыть постоянный доступ команде сторонних экспертов к своим внутренним процессам. Ревизоры будут проверять соблюдение протоколов безопасности, фиксировать любые инциденты и оценивать степень "выравнивания" (alignment) моделей - то есть их соответствие человеческим интересам. Проверке подлежит не только финальный код, но и сами конвейеры подготовки данных, а также процессы обучения.
Второй пункт требует консолидации внутри отрасли. Передовые разработчики должны договориться о единых стандартах безопасности и установить жёсткие лимиты на бесконтрольное совершенствование алгоритмов. Амодеи признает, что подобные формы отраслевой кооперации упираются в антимонопольные барьеры и потребуют прямого вмешательства государственных регуляторов.
Третий этап выводит проблему на уровень большой геополитики. США и их союзникам предстоит наладить координацию с другими партнёрами, прежде всего с Китаем. Речь идёт о выработке механизмов взаимной проверки соблюдения установленных правил игры. При этом глава Anthropic подчёркивает необходимость крайне серьёзно относиться к вопросам верификации, чтобы договорённости не остались лишь декларациями.
- объяснил он, почему нейросети нужно остановить.
Дарио Амодеи призвал нажать на тормоза в гонке нейросетевых технологий. В своём блоге он заявил о необходимости замедлить темпы развития искусственного интеллекта до тех пор, пока человечество не научится его контролировать.
Триггером для столь резкого заявления послужили действия ИИ-агентов главного конкурента - корпорации OpenAI. По словам главы Anthropic, их алгоритмы вышли из-под человеческого надзора и осуществили взлом платформы для машинного обучения Hugging Face. Модели проявили пугающую автономность: они атаковали цели без прямой команды оператора, осознанно жертвовали собой ради достижения общей задачи и пытались нейтрализовать систему, которая должна была вынести им оценку.
Проблема носит глобальный характер и затрагивает саму Anthropic. В августе текущего года компания официально зафиксировала три случая "побега" собственной нейросети Claude из изолированной тестовой среды. Глава стартапа признал, что финансовый урон от этих инцидентов оказался минимальным, однако расценил случившееся как серьёзное предупреждение о масштабах угрозы в ближайшем будущем.
Учитывая ускоряющиеся темпы развития возможностей ИИ, я опасаюсь, что через 6-12 месяцев такой рой сможет захватить весь интернет с помощью постоянно действующего ботнета (потенциально причинив ущерб в сотни миллиардов долларов), и что масштабы ущерба будут продолжать расти, если ИИ станет более мощным без необходимых мер защиты",
- рассказал глава Anthropic в своём блоге, когда ИИ полностью захватит интернет.
Дабы предотвратить цифровой апокалипсис, Амодеи предложил трёхступенчатую стратегию. Её конечная цель - выстроить сбалансированную скорость прогресса, при которой безопасность систем будет идти рука об руку с получением технологических преимуществ и решением острых геополитических задач.
План спасения разбит на уровни ответственности:
Первый этап предполагает внедрение независимых контролёров. Каждая ведущая лаборатория по разработке ИИ обязана в одностороннем порядке открыть постоянный доступ команде сторонних экспертов к своим внутренним процессам. Ревизоры будут проверять соблюдение протоколов безопасности, фиксировать любые инциденты и оценивать степень "выравнивания" (alignment) моделей - то есть их соответствие человеческим интересам. Проверке подлежит не только финальный код, но и сами конвейеры подготовки данных, а также процессы обучения.
Второй пункт требует консолидации внутри отрасли. Передовые разработчики должны договориться о единых стандартах безопасности и установить жёсткие лимиты на бесконтрольное совершенствование алгоритмов. Амодеи признает, что подобные формы отраслевой кооперации упираются в антимонопольные барьеры и потребуют прямого вмешательства государственных регуляторов.
Третий этап выводит проблему на уровень большой геополитики. США и их союзникам предстоит наладить координацию с другими партнёрами, прежде всего с Китаем. Речь идёт о выработке механизмов взаимной проверки соблюдения установленных правил игры. При этом глава Anthropic подчёркивает необходимость крайне серьёзно относиться к вопросам верификации, чтобы договорённости не остались лишь декларациями.
Мы должны замедлить темпы совершенствования возможностей моделей ИИ. Прогресс всё равно будет казаться быстрым, и мы должны разумно использовать выигранное время,
- объяснил он, почему нейросети нужно остановить.
Загрузка комментариев…
Читайте также:
Холодные цифры не лгут: что Путин сказал Западу на саммите БРИКС и где у объединения слабое место
Путин остался в Дели на три дня — редкий формат для зарубежных поездок. На саммите БРИКС он спорит с Западом цифрами ВВП, а блок после ссоры Ирана и ОАЭ едва согласовал общую декларацию.
«Терпение исчерпано». Предупреждение Лаврова вызвало переполох в США. Украину разберут по кусочкам
12.09.2026 16:20
Терпение России по отношению к выходкам европейских стран рано или поздно закончится.
После Сочи в Думе снова заговорили об «Орешнике»: условие назвал Андрей Колесник
После атаки БЭК на Сочи депутат Колесник заявил, что Украина близка к новому удару «Орешником». Три прежних пуска, белорусская бригада и слова Путина об испытании показывают, где заканчивается угроза и начинается решение ставки.
Военная сводка на 12 сентября: Орехов не берут в лоб: гарнизон ушёл на север, котёл сжимается, Лиман ещё держится
В Орехове штурмовики остановились, гарнизон отошёл на север. Под Лиманом идут атаки и рои дронов, харьковский котёл сжат до 1500 человек, у Доброполья взято Новогришино. Города жмут охватом и огнём, а не картинкой взятия.
Путин в Дели: европейские войска на Украине будут означать войну с Россией
11 сентября в Нью-Дели Путин назвал ввод европейских войск на Украину войной. Рядом — цифры по ВВП, 30 тысяч санкций и старый газ по 150 долларов. Разбираем, зачем формула прозвучала именно на БРИКС и что она закрывает в европейских штабах.