음악 및 오디오 법의학
AI 음악 및 음성 복제 모델은 방대한 데이터 세트를 기반으로 오디오 파형을 예측하여 작동합니다. 인간의 귀에는 믿을 수 없을 만큼 설득력이 있지만, SUS IT가 감지하도록 설계된 주파수 스펙트럼에 미세한 "디지털 지문"을 남기는 경우가 많습니다.
탐지 방법:
- 고주파 차단: 많은 AI 모델은 16kHz~20kHz 이상의 일관된 데이터를 생성하는 데 어려움을 겪으며 자연 녹음에서는 거의 존재하지 않는 부자연스러운 하드 쉘프 또는 스펙트로그램에 "공허"를 생성합니다.
- 위상 불일치: 자연의 소리는 주파수 사이에 물리적인 관계가 있습니다. AI 생성은 종종 주파수를 수학적으로 처리하지만 위상 정렬을 무시하므로 위상 보코더 아티팩트로 알려진 미묘한 "금속성" 또는 "번짐" 품질이 발생합니다.
- 일시적 번짐: 스네어 드럼이나 자음 't'와 같은 사운드의 초기 어택은 선명하고 실제 오디오에서 정의됩니다. AI 생성에서 이러한 과도 현상은 확산 프로세스로 인해 더 부드럽거나 "더 부드러운" 경우가 많습니다.