Компания Anthropic на этой неделе представила обновленную версию ‘Конституции Claude’ — 80-страничного документа, который определяет контекст и желаемые характеристики их чат-бота Claude. Это событие совпало с выступлением генерального директора Дарио Амодеи на Всемирном экономическом форуме в Давосе.
Anthropic выделяется своим подходом ‘Конституционного ИИ’, который обучает чат-бота Claude на основе этических принципов вместо человеческой обратной связи. Новая версия документа сохраняет прежние принципы, но добавляет детали по вопросам этики и безопасности пользователей.
Ко-фондатор компании Джаред Каплан заявил, что изначальная Конституция 2023 года представляет собой ‘ИИ-систему, которая контролирует себя на основе конкретного списка принципов’. Обновленный документ включает разделы о безопасности, этике и полезности, при этом подчеркивается, что Claude должен избегать токсичных или дискриминационных выводов.
Интересно, что завершение Конституции ставит вопрос о сознании чат-бота, утверждая, что ‘моральный статус Claude глубоко неясен’. Она утверждает, что это серьезная тема, заслуживающая обсуждения. Это подчеркивает стремление Anthropic к созданию этичного и инклюзивного ИИ.
*компания Meta Platforms Inc. признана экстремистской организацией, ее деятельность на территории России запрещена
