세미애널리시스는 2021년부터 2026년 9월15일까지 중국 주요 AI 개발사 9곳이 내놓은 모델 857개를 분석했다. 이 가운데 모델 이름과 안전성 검증 결과가 공식적으로 1대1로 확인된 사례는 31개, 비율로는 3.6%였다. 출시 시점이나 그 이전에 결과를 공개한 모델은 9개, 1.1%뿐이었다. 나머지 813개, 전체의 94.9%는 공개된 평가 결과가 확인되지 않았다. 이번 집계는 모델 카드, 기술 보고서, 출시 자료를 기준으로 했고, 내부 테스트를 했더라도 결과를 공개하지 않으면 실적으로 인정하지 않았다.
평가 항목에는 유해한 출력, 탈옥 방어, 개인정보 보호, 위험한 요청 거부, 위험 기능 수행 능력 등이 포함됐다. 출시 뒤에 공개한 사례도 시차가 컸고, 공개 시점의 중앙값은 출시 후 42일, 가장 긴 경우는 349일이었다. 특히 추론 모델의 93%는 공개된 안전성 평가 결과가 없었다. 보고서는 중국 규제가 콘텐츠와 이용자 영향에 더 무게를 두고, 모델의 규모나 기능 수준에 따라 위험 평가와 공개를 요구하는 체계는 부족하다고 봤다. 중국 정부가 안전 위험을 인정하고 관련 프레임워크를 내놨지만, 실제 현장에서는 성능과 출시 속도가 더 앞선다는 점이 이번 조사에서 드러났다.






