Falcon ASR 安全性:デモに送った音声の行き先
TIIの音声認識モデルFalcon ASR(2026年10月7日発表)の安全性を公開資料で整理。デモが録音をどこへ送り、何を保存し、何が書かれていないかを解説。
先に結論です。Falcon ASRはアブダビの研究機関、Technology Innovation Institute(TII)が発表した新しい音声認識モデルで、今のところ試せるのは公開のWebデモだけです。このデモは、録音を文字に起こすためにTIIのサーバーへ送ります。デモのページ自体が何を保存するかは珍しいほど具体的に書かれています。一方で、サーバー側で音声や文字起こしがどう扱われるかは、どこにも書かれていません。
誰に聞かれても困らない音声で試すなら問題は小さいと言えます。会議の録音、顧客との通話、同僚の声が入った音声を送る段階ではまだありません。この記事は公開されている資料だけに基づいています。法的な助言ではありません。
何が発表されたのか
アラブ首長国連邦の国営通信WAMの報道によると、TIIは2026年10月7日に3つのモデルを同時に発表しました。首長国方言向けの言語モデルFalcon-Emirati、アラビア語文書を読み取るFalcon-OCR-Arabic、そしてFalcon ASRです。同じ日付のHugging Face上のTIIの発表記事は、Falcon ASRを16億パラメータのモデルと説明しています。対応するのはアラビア語(標準アラビア語、首長国方言、その他の湾岸方言)と、英語、フランス語、スペイン語、ポルトガル語です。
日本語は対応言語に入っていません。日本語の会議を文字にしたいなら、Falcon ASRは今のところ選択肢になりません。日本語の録音を議事録にする手順は議事録AIで、どのツールにも使える形でまとめています。
TIIが公表している精度は単語誤り率、つまり間違えた単語の割合です。公開されたアラビア語の6つのテストセットで平均20.92%、英語の7つのテストセットで平均5.74%。どちらもメーカー自身の数字です。言い換えると、難しいアラビア語音声ではおよそ5語に1語、英語ではおよそ20語に1語が誤りになります。TIIはこれを高い水準だとしていますが、それでも文字起こしは必ず読み直す必要があります。Gulf Newsは、想定用途として多言語のカスタマーサービス、会議やインタビューの文字起こし、字幕、アクセシビリティを挙げています。
まだダウンロードはできない
TIIはこれまで多くのFalconモデルを、自分のパソコンで動かせるオープンな重みとして公開してきました。Falcon ASRはまだそうなっていません。発表記事が案内しているのは、60秒までの音声を試せるホスト型のデモで、APIとアプリは「予定」とされています。2026年10月9日にTIIのHugging Faceページを確認した時点で、ダウンロードできるFalcon ASRのモデルは見つかりませんでした。
プライバシーの観点では、ここが一番大事な点です。手元のパソコンで動くモデルなら、音声はどこにも送られません。ホスト型のモデルは必ず送ります。重みが公開されるまでは、後者しか選べません。
デモは録音をどう扱うか
デモのコードは公開されていて、READMEに流れが書かれています。それによると、デモは外部でホストされたFalcon ASRの画面にすぎず、モデルとAPIはTIIのサーバー上にあります。アップロードしたファイルやマイクの録音は、長さとサイズを確認したうえで標準的な形式に変換され、そのAPIに送られます。返ってくるのは、単語ごとのタイムスタンプ付きの文字起こしです。
- ログインは不要です。利用回数の上限はIPアドレスごとに、メモリ上で管理されています。
- READMEによると、利用統計にはアカウント情報、音声、文字起こし、IPアドレス、メールアドレスのいずれも含まれません。
- アップロードした音声はデモの一時キャッシュに置かれます。キャッシュは1時間ごとに確認され、24時間より古いファイルは削除されるとREADMEにあります。こうしたキャッシュがある理由はGradioのドキュメントに説明があり、利用者同士がファイルを上書きしないようにコピーしておく仕組みです。
- マイク録音にはノイズゲートが初期設定でかかります。ただし話している本人だけを切り出すものではないと、READMEははっきり書いています。周りの大きな声は文字起こしに入ることがあります。
最後の点は見落としやすいところです。オフィスで録音すると、隣の席の会話まで一緒に送ってしまうことがあります。
書かれていないこと
ここまでの内容はすべてデモのページについてのもので、音声が送られる先のAPIについてではありません。発表記事にもREADMEにも、次のことは書かれていません。
- TIIのサーバーが音声と文字起こしをどれくらいの期間保存するか
- デモから送られた録音が、今後のモデルの学習や評価に使われるかどうか
- サーバーがどの国にあり、どの国の法律が適用されるか
- 録音の削除を依頼したいときの連絡先
これは問題がある証拠ではありません。今週公開されたばかりの研究デモに、専用のプライバシーポリシーがまだないのは珍しいことではなく、READMEからはこの点を気にかけている様子もうかがえます。それでも、書かれていないことは書かれていないことです。不安で埋めるのも、安心で埋めるのも避けてください。
個人情報保護法の観点から
特定の個人だとわかる声の録音は、その人の個人情報にあたり得ます。自分の声を個人的に試すのは本人の判断です。仕事で顧客や同僚の声を送るとなると、保存期間も処理場所も示されていない外部サービスに個人情報を渡すことになります。一人で決めずに、社内の情報管理の担当者に相談するのが筋です。個人情報保護委員会は生成AIサービスの利用に関する注意喚起を出しており、考え方の整理に役立ちます。会社が把握していないAIの利用がなぜ問題になるかは、シャドーAIとはで解説しています。
具体的にできること
- 試すときは、公開しても困らない音声を使う。試験用に自分で録った音声、公開されている講演、権利を持っているポッドキャストなどです。
- 本人の同意がない限り、他人の声は入れない。声を扱うAIで公開前に確認すべきことは声優AIとはで扱っています。
- 顧客との通話、インタビュー、会議の録音は、TIIが保存期間と学習利用についての条件を公表するまで送らない。
- 文字起こしは使う前に読み直す。固有名詞や数字が別の語に変わって返ってくることがあります。音声入力の誤変換を確認する手順はChatGPT音声入力にまとめています。
ほかのメーカーの資料も同じ方法で読んでいます。直近ではClaude Haiku 5.5の安全性を整理しました。AIエージェントに個人情報を渡すときの確認点はAIエージェントと個人情報にあります。
まとめ
Falcon ASRはアラビア語の音声認識では有力なモデルに見えますし、デモは自分のページの挙動を率直に公開しています。足りないのは、サーバー側での保存期間と学習利用についての公式な説明です。プライバシーポリシーのないホスト型ツールと同じように扱ってください。試験用の音声には使える、残ってほしくないものには使わない、ということです。
Coursiumは、仕事でのAIの使い方を学べるスマホアプリで、App Storeで公開されています。新しいモデルは毎週のように出てきます。送る前にデータの行き先を確かめ、返ってきた結果を確認する。その習慣はどのモデルにも通用します。練習してみたい方はCoursiumをご覧ください。
よくある質問
Falcon ASRは安全に使えますか?
試験用の音声なら問題は小さいと言えます。公開デモは録音をTIIのサーバーに送ります。READMEによると、デモの利用統計には音声も文字起こしもIPアドレスも含まれず、一時キャッシュは24時間で削除されます。ただし、API側の保存期間や学習への利用は公表されていないため、他人の声や機密を含む録音は送らないでください。
Falcon ASRは日本語に対応していますか?
2026年10月7日のTIIの発表記事によると、対応していません。対応言語はアラビア語(標準アラビア語、首長国方言、その他の湾岸方言)、英語、フランス語、スペイン語、ポルトガル語です。
Falcon ASRを自分のパソコンで動かせますか?
2026年10月9日時点ではできません。TIIが提供しているのはホスト型のデモで、APIとアプリは予定とされています。TIIのHugging Faceページに、ダウンロードできる重みは見つかりませんでした。