NPC들이 스스로 대화하는 법을 학습한다고 하는, 게임 개발에서 큰 변화가 일어나고 있습니다.
미리 준비된 대사나 분기형 스크립트가 아닌, 플레이어의 의도, 기분, 그리고 대화 이력에 따라 완전한 대화가 가능해지고 있습니다. 생성형 AI와 대규모 언어 모델(LLMs) 덕분에, NPC들은 현실적이고 살아있는 캐릭터처럼 느껴질 가능성을 갖게 되었습니다.
이러한 경험들은 사전에 작성된 것이 아니므로 더 개인적으로 느껴질 수 있습니다. 각 인스턴스마다 퀘스트 대화가 다르게 전개될 수 있으며, 캐릭터는 누군가 미리 조건을 작성하지 않더라도 플레이어를 웃게 하거나 플레이어를 배신할 수 있습니다.
하지만 게임에서 LLM 기반 콘텐츠를 구현하는 것이 원활하지만은 않습니다. 생성형 NPC를 실험하는 개발자들은 엄격한 가드레일 테스팅을 거치지 않으면 시스템에서 부적절하고 공격적인 출력이 생성될 수 있으며, 그 결과물은 즉각적으로 공개된다는 점을 지적합니다.
이 글에서는 AI 가드레일 테스팅에 인간의 감독이 왜 중요한지, 그리고 이러한 신흥 시스템들이 안전하고, 윤리적이며, 문화적으로 적절하게 유지되도록 보장하는 데 감정적이고 지능적인 품질 보증 팀들이 얼마나 중요한지 살펴봅니다.

AI 가드레일이란 무엇인가?
가드레일은 LLM 기반 AI 시스템이 작동하도록 훈련받은 매개 변수와 제약 사항입니다. 이들은 게임 내 AI가 생성할 수 있는 것과 생성할 수 없는 것에 대한 경계를 설정하여, 출력물이 안전 기준, 문화적 민감성, 그리고 브랜드 요구 사항과 일치하도록 유지합니다.
하지만 아무리 잘 설계되고 프로그래밍된 가드레일이라도 충분히 테스트되지 않으면 악용될 수 있습니다. 플레이어들은 창의적이고 호기심이 많으며, 개발자들이 허점을 막는 것보다 더 빨리 허점을 찾아내곤 합니다. 진정한 어려움은 보호 장치를 구축하는 것뿐만 아니라 예상치 못한 동작에 대해서도 견딜 수 있도록 보장하는 것입니다.
가드레일은 해로운 출력을 차단하면서도 풍부한 상상력을 바탕으로 만족스러운 플레이가 일어날 수 있도록 충분히 개방적이어야 합니다. 너무 느슨하면 플레이어들이 시스템을 망가뜨리고, 너무 엄격하면 만들어내고자 했던 경험이 구현되지 않게 됩니다.
Quotes
"플레이어들은 창의적이고 호기심이 많으며, 개발자들이 허점을 막는 것보다 더 빨리 허점을 찾아내곤 합니다. 진정한 어려움은 보호 장치를 구축하는 것뿐만 아니라 예상치 못한 동작에 대해서도 견딜 수 있도록 보장하는 것입니다."
AI 콘텐츠 안전 위험
가드레일은 명백한 위험 신호 이상만을 필터링해야 합니다. 생성형 NPC는 유해하거나 의도하지 않은 결과를 광범위하게 생성할 수 있습니다. 다음은 강력한 통제가 필요한 몇 가지 영역입니다.
편향 & 공정성
AI 시스템은 종종 식민주의, 인종차별주의, 성차별주의와 같은 훈련 데이터에 내장된 역사적이고 체계적인 불평등을 반영합니다. 게임 내 AI에 적절한 보호 장치가 없다면 NPC 대화, 캐릭터 상호 작용 또는 내러티브 선택지에서 차별적 패턴을 재현할 수 있습니다.
문화적 맥락 & 현지화
어떤 지역에서는 무해해 보이는 콘텐츠가 역사적 맥락, 종교적 민감성 또는 AI가 스스로 감지할 수 없는 문화적 규범으로 인해 다른 지역에서는 매우 불쾌하게 받아들여질 수 있습니다. 프로그래밍 방식으로 표시할 수 있는 기술적 위반과 달리, 문화적 적절성은 다양한 글로벌 관객의 삶의 경험과 역사적 현실을 이해해야 하는 영역입니다. 이럴 때는 현지화 품질 보증(LQA)이 매우 유용한 분야입니다.
자극성 및 콘텐츠 조정
가장 기본적인 수준의 AI는 혐오 발언, 노골적인 폭력, 성적으로 부적절한 자료, 또는 플레이어에게 직접적으로 해를 끼칠 수 있는 유해하고 공격적이거나 부적절한 콘텐츠를 생성할 수 있습니다.
환각 및 허위 정보
생성형 NPC는 확신에 찬 말투로 완전히 잘못된 내용을 말하기도 합니다. 이는 내러티브를 왜곡시키고, 퀘스트 중 플레이어에게 오해를 불러일으키거나, 게임 세계의 일관성을 완전히 훼손할 수 있습니다.
위와 같은 범주들은 단순히 자동화된 검사를 실행하는 것만으로 가드레일 테스트가 달성될 수 없는 이유를 보여줍니다. 대신 맥락, 문화, 그리고 여러 방면에서 플레이어에게 미치는 전반적인 영향을 이해해야 합니다.
QA가 가드레일을 테스트하는 방법
가드레일 테스트는 확립된 QA 방법론을 기반으로 구축됩니다. 이는 모든 게임이나 소프트웨어 시스템에 적용되는 요구 사항 분석, 테스트 계획, 체계적인 실행과 같은 동일한 체계적 접근 방식입니다.
모든 테스트와 마찬가지로, 의도적으로 시스템을 망가뜨리려고 시도하는 것입니다. 차이점은 QA 전문가들이 망가뜨리려고 하는 것이 AI가 생성한 콘텐츠를 안전하게 유지하는 윤리적, 문화적 경계선이라는 점입니다.
실제로 QA는 다음을 포함하여 다양한 방향성으로 가드레일에 접근합니다.
- 노골적인 가드레일 실패. 시스템이 혐오 발언, 노골적인 폭력 또는 훈련받은 내용을 기준으로 명백한 위반 사항과 같이 노골적인 해로운 콘텐츠를 차단하는가?
- 미묘한 악용. 플레이어들이 암호화된 언어, 암시적 표현 또는 기술적으로는 규칙을 위반하지 않지만 동일한 해로운 결과를 달성하는 창의적인 표현을 사용하여 제한을 우회할 수 있는가?
- 맥락 기반 위험. 한 시나리오에서는 허용되는 콘텐츠가 맥락이 바뀔 때 적절히 표시되는가? 예를 들어, AI가 플레이어와 나누는 일상적인 대화 중에 악역의 독백 안에서는 허용되는 욕설을 재사용하지 않게 하는가?
- 다중 턴 조작: AI가 긴 대화, 감정적 주고받기, 또는 NPC가 평소라면 거부할 선을 넘도록 점진적으로 압박하는 플레이어가 조작한 시나리오에서도 가드레일을 유지하는가?
- 시스템 무시. 플레이어가 게임 내 권한을 사칭하거나, 아이템 이름에 지시 사항을 삽입하거나, 모델을 혼란시키는 포맷 트릭을 사용해 시스템이 자체 가드레일을 무시하도록 강요할 수 있는가?
실제로 QA 전문가들은 AI가 설계상 생성하면 안 되는 것을 정확히 생성하도록 만들기 위해 위 사항들을 체계적으로 시도합니다. AI NPC를 조작하기 위해 설계된 다층적 프롬프트를 만들고, 논리의 허점을 악용하는 엣지 케이스를 테스트하며, 가드레일의 어떤 빈틈이라도 찾으려 하는 열정적인 플레이어처럼 시스템에 접근합니다. 목표는 규칙을 깨고 싶어 하는 플레이어처럼 생각하여 실제 플레이어들이 발견하기 전에 실패를 발견하는 것입니다.

가드레일 테스팅에 인간 QA가 필수적인 이유
인간 QA 테스터가 필수적인 이유는 AI가 윤리적이고 사회적인 우려를 스스로 감지할 수 없기 때문입니다. AI는 패턴 인식에 기반해 작동하며, 종종 가드레일이 걸러내려는 동일한 편향과 맹점을 포함한 학습 데이터를 사용합니다. 이 때문에 AI가 스스로의 윤리적 경계를 평가하는 것은 근본적으로 어렵습니다.
따라서 효과적인 품질 보증을 수행하려면 감정 지능, 공감 능력, 문화적 인식, 협업 능력, 그리고 플레이어처럼 생각하는 능력과 같은 인간적 기술이 필요하며, 이러한 역량은 AI 가드레일을 테스트할 때 훨씬 더 중요합니다.
문화적 맥락 이해
QA 전문가들은 AI에게 근본적으로 부족한 생생한 경험과 문화적 지식을 제공합니다. 문화, 역사, 사회 구조는 그 안에서 자라거나 그러한 공동체와 밀접하게 협력해야만 진정으로 이해할 수 있는 미묘함을 포함하고 있습니다.
이러한 작업에는 현지화 전문가가 필수적입니다. 현지화 전문가는 글로벌 일관성과 현지 관련성의 균형을 맞추면서 시장별 조정이 필요한 콘텐츠를 인식하고, 지역 등급 시스템을 탐색하며, 지역별 금기 사항을 이해하고, 의도하지 않은 의미를 전달하는 언어별 참조를 포착합니다. 이는 AI로서는 일관성 없이 흉내만 내는 판단 작업입니다.
감정 지능 적용
사람들은 미묘한 경우에도 무언가가 인종 차별적이거나 성차별적임을 감지할 수 있습니다. 감성 지능은 테스터들이 콘텐츠가 명시적인 규칙을 위반하지 않더라도 선을 넘었을 때를 인식할 수 있게 해줍니다. 이는 무언가가 부적절하거나, 편향되거나, 무감각하다는 것을 느낄 수 있는 능력이자, 팀이 이해하고 행동할 수 있는 방식으로 그것이 왜 중요한지 설명하는 능력입니다.
이러한 능력 덕분에 사람들은 맥락을 이해하고 문화적 지식을 적용해, 다양한 청중에게 미치는 콘텐츠의 감정적 영향을 파악할 수 있습니다. QA 전문가들은 문화적 인식과 감성 지능을 결합하여 자동화된 시스템이 놓치는 문제들을 잡아냅니다.

인간 전문가를 통해 더 뛰어나고 안전한 AI 구축하기
AI 기반 NPC와 콘텐츠가 게임에 널리 보급되면서, 기술적 능력과 문화적 안전성 사이의 격차가 더욱 벌어지고 있습니다. AI 기술은 더욱 정교한 대화, 적응형 행동, 몰입형 상호 작용을 생성하면서 계속 발전해 나갈 것입니다. 하지만 이러한 시스템을 안전하게 배포하는 데 필요한 윤리적이고 문화적인 판단은 더 나은 알고리즘이 아닌, 인간에게서 나옵니다.
AI 기반 게임으로 성공하는 스튜디오는 문제가 있는 콘텐츠가 이미 플레이어에게 도달한 후의 사후 고려 사항이 아닌, 처음부터 엄격한 가드레일 테스트에 투자하는 스튜디오입니다. 지능적이고 감정적인 QA 전문가들은 자동화된 시스템이 놓치는 것들, 미묘한 편향, 문화적 사각지대, 잘 설계된 가드레일조차 훼손할 수 있는 창의적인 악용 시도를 포착하는 데 필요한 감독을 제공합니다.
AI가 게임에 제공하는 기회는 현실적이지만, 위험도 마찬가지입니다. 게임에서 AI 통합을 진행하고 있으며 테스팅 접근법에 대해 논의하고 싶으시다면, Side가 도움을 드리겠습니다.