
Anthropic заключила партнерство с консалтинговой компанией Accenture, в рамках которого стороны намерены направить не менее 2 миллиардов долларов США в течение пяти лет на независимую оценку передовых моделей искусственного интеллекта.
Координацией проекта займется Faculty — ИИ-подразделение Accenture. Специалисты будут проводить оценку моделей, редтиминг, проверки на соответствие принципам alignment, а также тестировать механизмы безопасности.
Инициатива развивает концепцию «встроенных оценщиков», которую CEO Anthropic Дарио Амодеи представил в июне. Согласно предложенной модели, независимые команды должны получать внутри ИИ-лабораторий доступ, сопоставимый с полномочиями штатных сотрудников. Это позволит им наблюдать за процессом обучения и развертывания моделей, взаимодействовать с персоналом, анализировать внутренние решения, проверять соблюдение обязательств в области безопасности и выявлять уязвимости.
В сентябре Амодеи также выступил за замедление разработки передовых ИИ-моделей, указав на усиление связанных с ними рисков. В числе аргументов он упомянул инцидент между OpenAI и Hugging Face. Для снижения потенциальных угроз глава Anthropic предложил три меры: международное сотрудничество, единые отраслевые стандарты и независимый контроль непосредственно внутри ИИ-лабораторий.
Стоит отметить, что сотрудничество с Accenture не является эксклюзивным. В Anthropic намерены в ближайшие недели объявить о партнерстве с другими организациями, занимающимися оценкой ИИ. В свою очередь, Accenture планирует применять аналогичный подход при работе с другими разработчиками.