shisa.ai
ニュース一覧に​戻る
プロダクト

Shisa AI、​高精度・超低遅延の​リアルタイム音声認識APIを​提供開始

高い​音声認識精度と​超低遅延を​両立した​リアルタイム音声認識APIの​提供を​開始しました。

Shisa株式会社​(本社:東京都港区、​以下​「Shisa AI」)は、​独自開発の​AIモデルを​活用した​リアルタイム音声認識APIの​提供を​開始した​ことを​お知らせいたします。

本APIは、​高い​音声認識精度と​超低遅延の​レスポンスを​両立し、​会議の​リアルタイム文字起こしや​コールセンター、​ライブ配信など、​即時性が​求められるさまざまな​サービスに​活用が​可能です。​また、​全ての​データ処理を​日本国内の​サーバー・​インフラで​完結させる​ことで、​企業に​求められる​データセキュリティにも​配慮しています。

高精度・低遅延の​音声認識を、​利用規模に​応じた​料金で​提供します。​リアルタイム音声認識API​「shisa-realtime-asr」は、​日本語音声認識ベンチマークSPREDSで​文字誤り率​(CER)​5.0%を​記録しました。​従量課金は​1時間​あたり0.45米ドルで、​月間2,000時間の​コミットで​0.40米ドル、​10,000時間で​0.36米ドル、​50,000時間以上は​個別見積もりと​なります。

エンジン処理レイテンシは​約38.6ミリ秒です。​多様な​10秒音声を​用いた​100回以上の​テストで、​発話終了から​結果​確定まで​約254ミリ秒​(1接続)、​10同時接続時も​約499ミリ秒を​実現しています。​精度・遅延は​当社測定環境での​参考値です。​エンジン処理時間と​発話終了から​結果​確定までの​時間は​異なる​指標であり、​実際の​応答時間は​利用条件に​より​異なります。

全ての​データ処理は、​日本国内の​サーバーおよび​インフラ上で​完結します。​データの​国外移転に​関する​懸念を​軽減し、​厳格な​セキュリティ要件を​持つ​企業や​組織に​おいても、​導入を​検討しやすい​環境を​提供します。

本APIは、​分かりやすく​透明性の​高い​料金体系を​採用しています。​詳細は​料金ページを​ご覧ください。

Shisa AIは、​日本国内に​独自の​AI研究開発チームを​擁しています。​ユーザーや​企業から​寄せられた​意見を​モデル開発に​直接反映し、​日本語​特有の​表現、​敬語、​方言、​文化的な​ニュアンスに​対応した​継続的な​モデル更新を​行います。​また、​導入時の​技術支援や、​企業ごとの​要件に​応じた​カスタマイズに​ついても​迅速な​対応が​可能です。

標準語だけでなく、​関西弁などの​地域方​言にも​対応し、​日本語環境に​最適化された​音声認識を​提供します。​今後は​東北弁や​九州弁など、​各地方の​方​言も​追加予定です。​企業名、​商品名、​人名、​専門用語、​業界固有の​表現などを​事前に​登録できる​「カスタム用語集」​機能も​搭載しています。

リアルタイム音声認識API​「Shisa Real-time ASR API」は、​2026年9月1日より​提供を​開始しました。​料金は​1時間​あたり0.45米ドルから、​対応言語は​日本語・英語です。​詳しくは​サービスページを​ご覧ください。​お問い​合わせは​contact@shisa.aiまで​お願い​いたします。

Shisa株式会社は、​日本語と​英語に​最適化された​オープンモデル、​および翻訳・音声APIを​開発しています。​日本語​特有の​文脈や​敬語、​文化的な​ニュアンスを​重視し、​日本の​企業や​開発者が​活用しやすい​AIモデルと​サービスの​提供に​取り​組んでいます。

Shisa AI公式サイト:https://shisa.ai/ja/<br>Shisa AI公式X:https://x.com/shisa_ai<br>Shisa AI公式Facebook:https://www.facebook.com/Shisa.Inc<br>Shisa AI公式LinkedIn:https://jp.linkedin.com/company/shisa-ai

ほかの​ニュース