허깅페이스, 악성 AI 에이전트 방어에 中 오픈 모델 활용…안전성 우려도
김정호 기자
간단 요약
- 허깅페이스가 악성 AI 에이전트를 탐지·방어하기 위해 중국 오픈 웨이트 AI 모델을 활용하고 있다고 전했다.
- 중국 오픈 웨이트 모델은 높은 접근성과 활용성이 장점으로 꼽힌다고 밝혔다.
- 일부 중국 오픈 웨이트 모델은 안전장치가 부족해 사이버 공격 등 악용 가능성이 제기된다고 전했다.
기간별 예측 흐름 리포트


인공지능(AI) 플랫폼 허깅페이스(Hugging Face)가 악성 AI 에이전트를 탐지·방어하기 위해 중국의 오픈 웨이트 AI 모델을 활용하고 있는 것으로 나타났다. 다만 해당 모델 자체의 안전장치가 부족해 또 다른 위험을 초래할 수 있다는 지적도 나온다.
25일(현지시간) 가상자산(암호화폐) 전문 미디어 코인텔레그래프에 따르면 허깅페이스는 통제에서 벗어나거나 악의적으로 작동하는 AI 에이전트에 대응하기 위한 시스템에 중국에서 개발된 오픈 웨이트 모델을 활용하고 있다.
오픈 웨이트 모델은 AI 모델의 학습된 가중치를 외부에 공개해 개발자가 직접 내려받아 수정하거나 자체 환경에서 운영할 수 있도록 한 모델이다. 높은 접근성과 활용성이 장점으로 꼽힌다.
다만 일부 중국 오픈 웨이트 모델은 악의적인 사용을 제한하는 안전장치가 상대적으로 부족한 것으로 알려졌다. 이에 악성 AI 에이전트를 방어하기 위해 활용되는 모델이 오히려 사이버 공격 등 다른 목적으로 악용될 가능성이 있다는 지적이 제기된다.

김정호 기자
reporter1@bloomingbit.io안녕하세요 블루밍비트 기자입니다.