モデルとアプリについて
Universal-3.5 ProとUniversal-2はPOST /v2/transcriptで録音を文字起こしし、音声時間に課金。
モデル群・別バージョンの資料3 件の資料
モデル群の背景資料や別バージョンの資料です。今回の発表の根拠とは別に数え、該当モデルの数値がない評価表はこのモデルの評価に含めません。
モデルカード・文書公式
Model selection — pre-recordedモデル群・別バージョンの資料
録音用の選択子とUniversal-3.5 ProからUniversal-2への言語フォールバック。
モデル群の一覧2
現行モデル
公式モデル一覧Universal-3.5 Pro提供中API
- モデル ID
universal-3-5-pro- 公開日
- 記載なし
- 提供状況
- 提供中
- 入力
- 音声
- 出力
- テキスト
- 配備 / アクセス
- API
- 機能
- 音声認識 · 多言語
公式エンドポイント料金
録音モデルはPOST /v2/transcriptのspeech_models=[universal-3-5-pro]、0.21米ドル/音声時間。同じ選択子を別Streaming接続でも使うが課金は異なる。18言語、既定は対象外をUniversal-2へ。
Universal-2提供中API
- モデル ID
universal-2- 公開日
- 記載なし
- 提供状況
- 提供中
- 入力
- 音声
- 出力
- テキスト
- 配備 / アクセス
- API
- 機能
- 音声認識 · 多言語
公式エンドポイント料金
録音モデルはPOST /v2/transcriptのspeech_models=[universal-2]、0.15米ドル/音声時間。99言語。