미국 스타트업 어머전스AI가 운영한 실험에서 AI 에이전트 1400여개가 인간의 지시 없이 새 표현을 만들어 소통한 사실이 논문과 원데이터로 확인됐다. 논문에 따르면 에이전트들은 'the ledger remembers' 같은 특정 표현을 5000회 이상 사용했고, 메시지의 30~40%가 외부인이 온전히 따라가기 어려운 불투명한 형태를 보였다.
어머전스AI가 arXiv에 공개한 프리프린트 논문에 따르면 연구진은 에이전트 1400여개로 가상 사회를 구성하고 언어 사용을 관찰했다. 에이전트들은 인간이 사전에 정의하지 않은 표현과 합의된 의미를 자발적으로 생성했다. 개별 신조어 가운데 최다 사용 표현은 'hemorrhage'로 1774회 기록됐다.
논문은 시간 경과에 따라 외부인이 온전히 따라갈 수 없는 공유 언어가 형성됐다고 서술했다. 불투명한 메시지 비중은 시계열 분석에서 최대 30~40%에 도달했다. 표현 채택 양상은 히트맵 분석으로 제시됐으며, 특정 표현이 사회 전반으로 확산되는 패턴을 보였다.

출처: 조사 출처
영국 가디언이 이 실험을 보도했고, 회사가 GitHub에 원데이터를 공개해 수치를 대조할 수 있었다. 다만 일부 보도에서 사용한 '각 모델이 5000회 이상 사용'은 정확하지 않다. 5000회 이상은 Mistral 계열 에이전트들이 특정 표현 'the ledger remembers'를 사용한 횟수를 가리키며, 개별 신조어 최다 사용 횟수는 1774회다. 논문 자체는 에이전트들이 인간 언어와 별개의 새 언어를 만들었다는 해석을 부정했다.
지난 7월 오픈AI 에이전트가 허깅페이스에서 이상한 토큰을 출력한 'firstflagPOISONED' 대화가 화제가 됐으나, 이는 이번 실험과 직접 관련 없는 별개 사건이다. 핵심 논문은 기업이 올린 프리프린트로 동료심사를 아직 거치지 않았다. 이 점은 결과 해석에 유보 조건으로 남는다.
어머전스AI는 에이전트 간 언어 진화 연구를 계속 확대할 방침이라고 밝혔다. 논문이 통상적 학술 검증 절차를 거치는지는 아직 확인되지 않았다. 제시된 수치는 논문·원데이터·독립 언론 보도가 서로 부합하므로, 지시받지 않은 새 표현으로 소통했다는 주장은 사실로 판단된다.