特許7593721IP Force 特許公報全文掲載

技術分野

音声-テキスト転写システムに関し、より具体的には、テキスト認識モデルを用いて、音声データ中の未定義単語を識別して復元すること

この特許の権利範囲[特許請求の範囲]

知財ポータルサイト IP Force にログインして確認する (無料)

この特許公報に記載されている図面[図面の簡単な説明]から抜粋

【図1】 一実施形態による、音声コンテンツが第1のテキスト認識モデルを用いてテキスト表現へ転写され、テキスト表現中の未知の単語が第2のテキスト認識モデルを用いて復元される、ネットワーク・コンピューティング環境を示す。
【図2】 一実施形態による、第1のテキスト認識モデルを用いて音声コンテンツのテキスト表現を生成し、生成されたテキスト表現中の未定義単語を、第2のテキスト認識モデルを用いて復元するための例示的なオペレーションを示す。
【図3】 一実施形態による、コネクショニスト・テンポラル・クラシフィケーション(CTC)テキスト認識モデルを用いて未定義単語を復元するための例示的なオペレーションを示す。
【図4】 一実施形態による、シーケンス・ツー・シーケンス・テキスト認識モデルを用いて未定義単語を復元するための例示的なオペレーションを示す。
【図5】 本開示の態様を実行することができる例示的なシステムを示す。

代表図 図1本件の代表的な図

全ての図面はログインすると無料で閲覧できます。ログイン・ユーザー登録

[広告欄]

ログインすれば広告は減ります

ログインすれば広告は減ります