
Anthropic откроет доступ внешним аудиторам к созданию Claude
Запускаем новый формат проверки Ты увидишь, как Anthropic совместно с Accenture создает механизм, позволяющий внешним экспертам участвовать в обучении и тестировании моделей Claude. Специалисты из подразделения Faculty получат рабочие места в офисе, корпоративные ноутбуки и пропуска, чтобы взаимодействовать с разработчиками в реальном времени.
Доступ почти без ограничений Тебе будет предоставлен почти полный доступ к внутренним инструментам, за исключением клиентских данных, юридически защищённой информации и коммерческих тайн. Аудиторы смогут публиковать свои выводы без предварительного редактирования со стороны Anthropic; компания лишь может потребовать убрать чувствительные детали, но не скрывать результаты.
Инвестиции в безопасность Каждая сторона планирует вложить минимум $1 млрд в течение пяти лет, что в сумме даст $2 млрд на развитие инфраструктуры и компетенций по безопасному ИИ. Первоначально расходы возьмёт на себя Anthropic, а дальше модель будет расширяться на другие лаборатории и некоммерческие организации, такие как METR.
Что изменит практика Тебе предстоит наблюдать, как постоянный контроль внутри разработки может превратить разовый аудит в непрерывный процесс. Пока нет чётких отраслевых правил, но если эксперимент удастся, индустрия получит новый уровень прозрачности, а независимые эксперты смогут своевременно выявлять риски, даже если они не смогут остановить выпуск модели.



Комментарии 0