ブログ · 2026年10月9日 · 6 分で読めます

Falcon ASR 安全性:デモに送った音声の行き先

TIIの音声認識モデルFalcon ASR(2026年10月7日発表)の安全性を公開資料で整理。デモが録音をどこへ送り、何を保存し、何が書かれていないかを解説。

新しい音声認識。今はデモだけ。音声は外へ。

先に結論です。Falcon ASRはアブダビの研究機関、Technology Innovation Institute(TII)が発表した新しい音声認識モデルで、今のところ試せるのは公開のWebデモだけです。このデモは、録音を文字に起こすためにTIIのサーバーへ送ります。デモのページ自体が何を保存するかは珍しいほど具体的に書かれています。一方で、サーバー側で音声や文字起こしがどう扱われるかは、どこにも書かれていません。

誰に聞かれても困らない音声で試すなら問題は小さいと言えます。会議の録音、顧客との通話、同僚の声が入った音声を送る段階ではまだありません。この記事は公開されている資料だけに基づいています。法的な助言ではありません。

何が発表されたのか

アラブ首長国連邦の国営通信WAMの報道によると、TIIは2026年10月7日に3つのモデルを同時に発表しました。首長国方言向けの言語モデルFalcon-Emirati、アラビア語文書を読み取るFalcon-OCR-Arabic、そしてFalcon ASRです。同じ日付のHugging Face上のTIIの発表記事は、Falcon ASRを16億パラメータのモデルと説明しています。対応するのはアラビア語(標準アラビア語、首長国方言、その他の湾岸方言)と、英語、フランス語、スペイン語、ポルトガル語です。

日本語は対応言語に入っていません。日本語の会議を文字にしたいなら、Falcon ASRは今のところ選択肢になりません。日本語の録音を議事録にする手順は議事録AIで、どのツールにも使える形でまとめています。

TIIが公表している精度は単語誤り率、つまり間違えた単語の割合です。公開されたアラビア語の6つのテストセットで平均20.92%、英語の7つのテストセットで平均5.74%。どちらもメーカー自身の数字です。言い換えると、難しいアラビア語音声ではおよそ5語に1語、英語ではおよそ20語に1語が誤りになります。TIIはこれを高い水準だとしていますが、それでも文字起こしは必ず読み直す必要があります。Gulf Newsは、想定用途として多言語のカスタマーサービス、会議やインタビューの文字起こし、字幕、アクセシビリティを挙げています。

まだダウンロードはできない

TIIはこれまで多くのFalconモデルを、自分のパソコンで動かせるオープンな重みとして公開してきました。Falcon ASRはまだそうなっていません。発表記事が案内しているのは、60秒までの音声を試せるホスト型のデモで、APIとアプリは「予定」とされています。2026年10月9日にTIIのHugging Faceページを確認した時点で、ダウンロードできるFalcon ASRのモデルは見つかりませんでした。

プライバシーの観点では、ここが一番大事な点です。手元のパソコンで動くモデルなら、音声はどこにも送られません。ホスト型のモデルは必ず送ります。重みが公開されるまでは、後者しか選べません。

デモは録音をどう扱うか

デモのコードは公開されていて、READMEに流れが書かれています。それによると、デモは外部でホストされたFalcon ASRの画面にすぎず、モデルとAPIはTIIのサーバー上にあります。アップロードしたファイルやマイクの録音は、長さとサイズを確認したうえで標準的な形式に変換され、そのAPIに送られます。返ってくるのは、単語ごとのタイムスタンプ付きの文字起こしです。

  • ログインは不要です。利用回数の上限はIPアドレスごとに、メモリ上で管理されています。
  • READMEによると、利用統計にはアカウント情報、音声、文字起こし、IPアドレス、メールアドレスのいずれも含まれません。
  • アップロードした音声はデモの一時キャッシュに置かれます。キャッシュは1時間ごとに確認され、24時間より古いファイルは削除されるとREADMEにあります。こうしたキャッシュがある理由はGradioのドキュメントに説明があり、利用者同士がファイルを上書きしないようにコピーしておく仕組みです。
  • マイク録音にはノイズゲートが初期設定でかかります。ただし話している本人だけを切り出すものではないと、READMEははっきり書いています。周りの大きな声は文字起こしに入ることがあります。

最後の点は見落としやすいところです。オフィスで録音すると、隣の席の会話まで一緒に送ってしまうことがあります。

書かれていないこと

ここまでの内容はすべてデモのページについてのもので、音声が送られる先のAPIについてではありません。発表記事にもREADMEにも、次のことは書かれていません。

  • TIIのサーバーが音声と文字起こしをどれくらいの期間保存するか
  • デモから送られた録音が、今後のモデルの学習や評価に使われるかどうか
  • サーバーがどの国にあり、どの国の法律が適用されるか
  • 録音の削除を依頼したいときの連絡先

これは問題がある証拠ではありません。今週公開されたばかりの研究デモに、専用のプライバシーポリシーがまだないのは珍しいことではなく、READMEからはこの点を気にかけている様子もうかがえます。それでも、書かれていないことは書かれていないことです。不安で埋めるのも、安心で埋めるのも避けてください。

個人情報保護法の観点から

特定の個人だとわかる声の録音は、その人の個人情報にあたり得ます。自分の声を個人的に試すのは本人の判断です。仕事で顧客や同僚の声を送るとなると、保存期間も処理場所も示されていない外部サービスに個人情報を渡すことになります。一人で決めずに、社内の情報管理の担当者に相談するのが筋です。個人情報保護委員会は生成AIサービスの利用に関する注意喚起を出しており、考え方の整理に役立ちます。会社が把握していないAIの利用がなぜ問題になるかは、シャドーAIとはで解説しています。

具体的にできること

  1. 試すときは、公開しても困らない音声を使う。試験用に自分で録った音声、公開されている講演、権利を持っているポッドキャストなどです。
  2. 本人の同意がない限り、他人の声は入れない。声を扱うAIで公開前に確認すべきことは声優AIとはで扱っています。
  3. 顧客との通話、インタビュー、会議の録音は、TIIが保存期間と学習利用についての条件を公表するまで送らない。
  4. 文字起こしは使う前に読み直す。固有名詞や数字が別の語に変わって返ってくることがあります。音声入力の誤変換を確認する手順はChatGPT音声入力にまとめています。

ほかのメーカーの資料も同じ方法で読んでいます。直近ではClaude Haiku 5.5の安全性を整理しました。AIエージェントに個人情報を渡すときの確認点はAIエージェントと個人情報にあります。

まとめ

Falcon ASRはアラビア語の音声認識では有力なモデルに見えますし、デモは自分のページの挙動を率直に公開しています。足りないのは、サーバー側での保存期間と学習利用についての公式な説明です。プライバシーポリシーのないホスト型ツールと同じように扱ってください。試験用の音声には使える、残ってほしくないものには使わない、ということです。

Coursiumは、仕事でのAIの使い方を学べるスマホアプリで、App Storeで公開されています。新しいモデルは毎週のように出てきます。送る前にデータの行き先を確かめ、返ってきた結果を確認する。その習慣はどのモデルにも通用します。練習してみたい方はCoursiumをご覧ください。

よくある質問

Falcon ASRは安全に使えますか?

試験用の音声なら問題は小さいと言えます。公開デモは録音をTIIのサーバーに送ります。READMEによると、デモの利用統計には音声も文字起こしもIPアドレスも含まれず、一時キャッシュは24時間で削除されます。ただし、API側の保存期間や学習への利用は公表されていないため、他人の声や機密を含む録音は送らないでください。

Falcon ASRは日本語に対応していますか?

2026年10月7日のTIIの発表記事によると、対応していません。対応言語はアラビア語(標準アラビア語、首長国方言、その他の湾岸方言)、英語、フランス語、スペイン語、ポルトガル語です。

Falcon ASRを自分のパソコンで動かせますか?

2026年10月9日時点ではできません。TIIが提供しているのはホスト型のデモで、APIとアプリは予定とされています。TIIのHugging Faceページに、ダウンロードできる重みは見つかりませんでした。

Coursium

AI の一歩先へ — ツールはスマートフォンで学べます。

アプリを入手