Speechgenとは
Speechgenは5,000以上の音声・150言語に対応するAIテキスト読み上げサービス。音質はStandard・HD・PROの3段階から選べる。サブスクリプションではなくクレジット制で、必要な分だけ購入して使う料金体系が特徴。アカウント登録なしでも1,000文字まで無料で試せるほか、登録すると2,000クレジットが無料付与される。
主要機能
出力形式はMP3・WAV・FLACに加え、ogg・opus・m4a・webm_opusなどにも対応し、ビットレート・サンプルレート・チャンネル数まで細かく指定できる。SSMLタグでポーズや効果音を制御でき、<話者名>タグによる複数話者の割り当て、<cut>タグによる章ごとの音声ファイル自動分割が可能。直前と同一内容の再生成はクレジットを消費しないSmart Cacheや、BGMミックス、変換前の無料プレビューも備える。PDF・DOCX・SRTのアップロードからの読み上げのほか、音声・動画からの文字起こし(YouTube対応)、ボイスチェンジャー、REST APIも提供する。
想定ユーザー
動画ナレーション、eラーニング教材、IVR/電話音声、音声ガイド、産業安全のPA放送、多言語ローカライズなど、音声コンテンツを継続的に制作する担当者向け。クレジットの都度購入方式のため、制作量が月によって変動するチームに向く。


