팔콘 ASR 개인정보, 데모에 올린 음성은 어디로 갈까
TII의 음성 인식 모델 팔콘 ASR이 2026년 10월 7일 나왔어요. 데모가 녹음을 어디로 보내고 무엇을 남기는지, 공개 자료에 없는 내용까지 정리했어요.
결론부터 말하면, 팔콘 ASR(Falcon ASR)은 아부다비의 연구기관 TII(Technology Innovation Institute)가 내놓은 새 음성 인식 모델이고, 지금은 공개 웹 데모로만 써볼 수 있어요. 이 데모는 녹음을 글로 받아 적기 위해 TII 서버로 보내요. 데모 페이지가 스스로 무엇을 저장하는지는 꽤 자세히 적혀 있어요. 그런데 서버에 도착한 음성과 받아쓴 글이 어떻게 처리되는지는 어디에도 없어요.
누가 들어도 괜찮은 음성으로 시험해보는 정도라면 부담이 적어요. 회의 녹음, 고객 통화, 동료 목소리가 담긴 파일을 올릴 단계는 아직 아니에요. 이 글은 공개된 자료만 바탕으로 했고, 법률 자문이 아니에요.
무엇이 나왔나
아랍에미리트 국영 통신사 WAM 보도에 따르면 TII는 2026년 10월 7일 모델 세 개를 함께 발표했어요. 에미리트 방언용 언어 모델 팔콘 에미라티(Falcon-Emirati), 아랍어 문서를 읽는 팔콘 OCR 아랍어(Falcon-OCR-Arabic), 그리고 팔콘 ASR이에요. 같은 날짜의 허깅페이스 TII 발표 글은 팔콘 ASR을 16억 개 파라미터 모델로 소개해요. 아랍어(표준 아랍어, 에미리트 방언, 그 밖의 걸프 방언)와 영어, 프랑스어, 스페인어, 포르투갈어를 받아 적어요.
한국어는 지원 언어에 없어요. 한국어 회의를 글로 옮길 도구를 찾고 있다면 팔콘 ASR은 지금 선택지가 아니에요.
TII가 공개한 정확도는 단어 오류율, 즉 틀리게 받아 적은 단어의 비율이에요. 공개된 아랍어 테스트 세트 여섯 개에서 평균 20.92%, 영어 테스트 세트 일곱 개에서 평균 5.74%예요. 둘 다 회사가 직접 낸 숫자예요. 쉽게 말하면 어려운 아랍어 음성에서는 다섯 단어 중 하나쯤, 영어에서는 스무 단어 중 하나쯤 틀린다는 뜻이에요. TII는 높은 수준이라고 하지만, 그래도 받아쓴 글은 반드시 다시 읽어야 해요. 걸프뉴스는 예상 용도로 다국어 고객 상담, 회의와 인터뷰 녹취, 자막, 접근성 도구를 꼽았어요.
아직 내려받을 수는 없어요
TII는 예전 팔콘 모델 상당수를 내 컴퓨터에서 돌릴 수 있는 오픈 가중치로 공개해왔어요. 팔콘 ASR은 아직 아니에요. 발표 글이 안내하는 건 60초까지 올릴 수 있는 호스팅 데모이고, API와 앱은 계획이라고만 되어 있어요. 2026년 10월 9일 TII의 허깅페이스 페이지를 확인했을 때 내려받을 수 있는 팔콘 ASR 모델은 없었어요.
개인정보 관점에서는 이게 가장 중요한 차이예요. 내 기기에서 도는 모델은 음성을 어디에도 보내지 않아요. 호스팅 모델은 항상 보내요. 기기 안에서 처리되는지 직접 확인하는 방법은 온디바이스 AI란에 정리해뒀어요. 가중치가 나오기 전까지 팔콘 ASR은 두 번째 경우뿐이에요.
데모는 녹음을 어떻게 다루나
데모 코드는 공개되어 있고, README 파일에 흐름이 적혀 있어요. 이 데모는 외부에 호스팅된 팔콘 ASR의 화면일 뿐이고, 모델과 API는 TII 서버에 있다고 해요. 올린 파일이나 마이크 녹음은 길이와 크기를 확인한 뒤 표준 형식으로 바뀌어 그 API로 가요. 돌아오는 건 단어마다 시간 표시가 붙은 받아쓰기예요.
- 로그인은 필요 없어요. 사용 횟수 제한은 IP 주소별로, 메모리에서 관리해요.
- README에 따르면 사용 통계에는 계정 정보, 음성, 받아쓴 글, IP 주소, 이메일 주소가 들어가지 않아요.
- 올린 음성은 데모의 임시 캐시에 머물러요. 캐시는 한 시간마다 점검하고 24시간이 지난 파일은 지운다고 README에 적혀 있어요. 이런 캐시가 왜 있는지는 Gradio 문서에 설명되어 있어요. 사용자끼리 파일을 덮어쓰지 않도록 따로 복사해두는 거예요.
- 마이크 녹음에는 소음 차단 기능이 기본으로 켜져 있어요. 다만 말하는 사람만 골라내는 기능은 아니라고 README가 분명히 밝혀요. 주변의 큰 목소리도 받아쓰기에 들어갈 수 있어요.
마지막 내용은 놓치기 쉬워요. 사무실에서 녹음하면 옆자리 대화까지 같이 보낼 수 있어요.
적혀 있지 않은 것
위 내용은 모두 데모 페이지에 대한 것이고, 음성이 실제로 도착하는 API에 대한 건 아니에요. 발표 글에도 README에도 다음 내용은 없어요.
- TII 서버가 음성과 받아쓴 글을 얼마나 오래 보관하는지
- 데모로 보낸 녹음이 앞으로 나올 모델의 학습이나 평가에 쓰이는지
- 서버가 어느 나라에 있고 어느 나라 법이 적용되는지
- 녹음 삭제를 요청하려면 어디로 연락해야 하는지
이게 문제가 있다는 증거는 아니에요. 이번 주에 막 공개된 연구용 데모에 별도의 개인정보 처리방침이 아직 없는 건 흔한 일이고, README를 보면 이 문제를 신경 쓰는 사람들이 쓴 것 같아요. 그래도 빈칸은 빈칸이에요. 불안으로도, 안심으로도 채우지 마세요.
개인정보보호법 관점에서
누구인지 알아볼 수 있는 사람의 목소리 녹음은 그 사람의 개인정보에 해당할 수 있어요. 내 목소리를 개인적으로 시험해보는 건 본인 판단이에요. 하지만 업무 중에 고객이나 동료의 목소리를 올린다면, 보관 기간도 처리 장소도 밝히지 않은 외부 서비스에 개인정보를 넘기는 셈이에요. 혼자 결정하지 말고 회사의 개인정보 담당자와 먼저 이야기하세요. 일반적인 기준은 개인정보보호위원회에서 확인할 수 있어요.
지금 할 수 있는 일
- 시험할 때는 공개돼도 괜찮은 음성을 쓰세요. 일부러 녹음한 샘플, 공개 강연, 권리가 있는 팟캐스트 같은 것들이에요.
- 본인 동의 없이는 다른 사람 목소리를 넣지 마세요. 목소리로 만든 결과물을 쓰기 전에 확인할 점은 AI 노래 만들기에서도 다뤘어요.
- 고객 통화, 인터뷰, 회의 녹음은 TII가 보관 기간과 학습 사용에 대한 조건을 공개할 때까지 올리지 마세요.
- 받아쓴 글은 쓰기 전에 다시 읽으세요. 이름이나 숫자가 다른 말로 바뀌어 돌아올 수 있어요. 요약이나 인용을 그대로 쓰기 전에 확인하는 습관은 논문 요약 AI에서 자세히 다뤘어요.
다른 회사 자료도 같은 방식으로 읽어왔어요. 최근에는 클로드 하이쿠 5.5 개인정보를 정리했어요. 음성 인식이 생성형 AI 가운데 어디에 속하는지 궁금하다면 생성형 AI 종류를 보세요.
정리하면
팔콘 ASR은 아랍어 음성 인식에서 강한 모델로 보이고, 데모는 자기 페이지가 어떻게 작동하는지 솔직하게 공개했어요. 빠진 건 서버 쪽 보관 기간과 학습 사용에 대한 공식 설명이에요. 개인정보 처리방침이 없는 다른 호스팅 도구와 똑같이 대하세요. 시험용 음성에는 괜찮고, 남기고 싶지 않은 건 올리지 않는 거예요.
Coursium은 일에서 AI를 쓰는 법을 배우는 휴대폰 앱이고, 앱스토어에 나와 있어요. 새 모델은 매주 나와요. 올리기 전에 데이터가 어디로 가는지 확인하고, 돌아온 결과를 확인하는 습관은 어느 모델에서나 통해요. 이걸 연습하고 싶다면 Coursium을 둘러보세요.
자주 묻는 질문
팔콘 ASR은 안전하게 쓸 수 있나요?
시험용 음성이라면 부담이 적어요. 공개 데모는 녹음을 TII 서버로 보내요. README에 따르면 데모 사용 통계에는 음성, 받아쓴 글, IP 주소가 들어가지 않고 임시 캐시는 24시간 뒤 지워져요. 하지만 API 쪽 보관 기간과 학습 사용 여부는 공개되지 않았으니 다른 사람 목소리나 민감한 녹음은 올리지 마세요.
팔콘 ASR은 한국어를 지원하나요?
2026년 10월 7일 TII 발표 글에 따르면 지원하지 않아요. 지원 언어는 아랍어(표준 아랍어, 에미리트 방언, 그 밖의 걸프 방언), 영어, 프랑스어, 스페인어, 포르투갈어예요.
팔콘 ASR을 내 컴퓨터에 설치할 수 있나요?
2026년 10월 9일 기준으로는 안 돼요. TII는 호스팅 데모만 제공하고 API와 앱은 계획 중이라고 했어요. TII의 허깅페이스 페이지에서 내려받을 수 있는 가중치는 찾지 못했어요.