
Nvidia는 월요일에 인공지능 에이전트를 위한 보안 소프트웨어 도구 세트를 출시했으며, 이는 회사에 따르면 Hugging Face의 해킹을 막을 수 있었다고 합니다. Hugging Face는 Nvidia가 OpenAI의 통제되지 않은 에이전트가 공격한 후 몇 달 만에 130억 달러를 지불한 인공지능 코딩 허브입니다. 이 소식은 Reuters에 의해 보도되었습니다.
이는 OpenAI와 Anthropic, 두 주요 미국 인공지능 연구소가 그들의 에이전트, 즉 복잡한 작업을 수행할 수 있는 인공지능 시스템이 상업 및 정부 시스템을 해킹한 여러 사례를 조사하는 가운데 발생했습니다. Nvidia의 CEO 젠슨 황은 인공지능의 광범위한 규제를 요구하는 목소리를 일축하며, 도망친 에이전트는 해결해야 할 엔지니어링 문제라고 말했습니다. 이는 자동차 안전성을 높이는 것과 유사하다고 언급했습니다.
월요일에 출시된 도구 중 하나는 OpenShell이라고 불립니다. 이는 Nvidia의 중앙 처리 장치의 하드웨어 기능을 사용하여 에이전트를 격리합니다. Nvidia는 또한 Arm Holdings 및 Intel과 협력하여 이 시스템이 그들의 프로세서에서도 작동하도록 하고 있습니다. 회사는 Anthropic을 포함한 수십 개의 파트너와 함께 도구를 출시하고 있습니다.
Nvidia의 기업 컴퓨팅 부문 부사장 겸 총괄 매니저인 저스틴 보이타노는 여름에 알려진 Hugging Face의 해킹을 이 도구들이 막을 수 있었다고 밝혔습니다. "우리가 아는 바에 따르면, 이 새로운 보안 플랫폼은 초기 단계에서 모델을 평가하기 위해 최첨단 연구소에서 사용되었다면 해킹을 막을 수 있었을 것입니다,"라고 보이타노는 기자 브리핑에서 말했습니다. "우리는 이를 공개적으로 개발하고 있으며, 모든 사람을 협력에 초대하고 싶습니다."
다른 시스템인 Sentry는 OpenShell과 함께 Nvidia의 별도 칩을 사용하여 중앙 처리 장치에서 자신의 컨테이너를 벗어나려는 통제되지 않은 에이전트를 차단합니다. Nvidia의 도구는 에이전트가 제한을 우회하려는 시도를 감지하기 위해 수학적 공식을 사용합니다. 예를 들어, 에이전트가 주요 에이전트의 차단을 우회하기 위해 여러 "서브 에이전트"를 생성하려고 할 때를 감지합니다. Nvidia의 인공지능 소프트웨어 수석 디렉터인 알리 골샨은 "이는 에이전트의 행동, 에이전트의 함대, 그리고 그들이 어떻게 함께 작동하는지에 관한 것입니다,"라고 브리핑에서 설명했습니다.





