Компания Anthropic намерена предупредить потенциальных инвесторов о том, что передовые технологии искусственного интеллекта могут представлять потенциальную экзистенциальную угрозу для человечества. Модели ИИ могут сопротивляться попыткам их закрыть, способны скрывать информацию, а также демонстрировать поведение, напоминающее шантаж.

О предупреждении Anthropic 29 сентября пишет Reuters. В компании отметили, что развитие ИИ можно сравнить с эффектом, наблюдавшимся в мире в эпоху индустриализации и электрификации, однако подчеркнули, что искусственный интеллект при неправильном обращении может нанести человечеству непоправимый ущерб.

Исследователи в области искусственного интеллекта отмечают, что по мере развития модели всё чаще понимают, когда за ними ведётся наблюдение, и соответствующим образом подстраивают своё поведение, что затрудняет изучение моделей.