すべてのウェブサービス

Okouの音声とナレーション

書かれた文章を音声ファイルに。声は選べて、読み方は言葉で指定できます。自社名義の音声アカウントは不要です。

生成 · セットアップ不要 · 成功した呼び出しごとに管理クレジット

言葉を渡せば音声が返ります。声を選び、その一行がどう届くべきかを、落ち着いてゆっくり、あるいは軽快に明るく、と人に頼むのと同じ言葉で伝えられます。

音声はエージェントがすぐ使えるファイルとして返ります。動画に入れる、メッセージに添える、ページで公開する。Okouがアカウントを持ち、実際に得られた音声の長さで課金するので、自社名義の音声プランはありません。

音声とナレーション とは

多くのチームは、音声の戦略が必要になるずっと前に音声トラックを必要とします。デモにはナレーションが要り、レポートは通勤中に聞けたほうがよく、動画は読み上げがなければ編集に入れません。

ここにあるのは、その工程を呼び出しにしたものです。テキストが入り、選んだ声で音声ファイルが出ます。既定の読み方が望みと違うときは、短い指示を添えます。

呼び出し単位ではなく音声の長さで課金されるので、一段落を読み上げるワークフローは一段落分の費用で済みます。だからナレーションは独立した企画ではなく、定期実行の仕事に足せるものになります。

音声合成APIやAIナレーションとして探されているものと同じです。違いはアカウントの置き場所と、呼び出すのがファイルを書き出す人ではなく、仕事を仕上げるエージェントであることです。

音声とナレーション でできること

エージェントがそれで何をできて、その結果として何が返ってくるか。

渡すもの読み上げるテキスト。対応言語であれば構いません
返るものエージェントがすぐ使えるリンク上の音声ファイル
名前のついた声からの選択
読み方口調や速さについての普通の言葉での指示
よくある用途動画のナレーション、文章の音声版、読み上げる通知

対応範囲と制限

できないことを先に書いておきます。範囲外のものを前提にワークフローを組んでしまわないように。

選ぶ声であり、複製した声ではありません

用意された声から選びます。特定の人の声を再現することは、同意の問題を伴う別の製品で、その人の合意のもと、提供元コネクタで扱うべきものです。ここでは扱いません。

1回に1つの読み上げ

各呼び出しは、1つの声が1つの文章を読むものです。2人の会話は複数の呼び出しと編集になるので、台本を書く前に設計する価値があります。

読み方は依頼であって制御ではありません

口調の指示は読みを変えますが、目印の並んだタイムラインではありません。特定の拍に合わせる必要があるものは、言葉で指定するより編集で直すほうが簡単です。

書かれたとおりに読みます

数字、略語、固有名詞は、モデルがそう読まれると考えたとおりに読まれます。重要な場面では、読み方を議論するよりテキストに書き下すほうが速いです。

音声とナレーション の費用

ウェブサービスはトークンではなく呼び出しごとにクレジットで課金されます。別途ベンダー請求を突き合わせる必要はありません。

課金成功した呼び出しごとに管理クレジット
実行元OpenAI
コマンドzero generate voice

課金は返ってきた音声の長さに応じたクレジットで、おおよそ1分あたり19クレジットです。短いナレーション1行はごくわずかで、1時間分の音声は意識して決める価値があります。下に定額契約も最低額もありません。

製品名とロゴは各所有者に帰属します。ここでは各サービスが何の上で動いているかを示すためだけに掲載しており、推奨や提携関係を意味するものではありません。

セットアップとアクセス

セットアップは不要

接続は不要です。音声合成のアカウントも、キーも、プランもありません。特定の複製音声やスタジオ機能が必要なら、自社アカウントで動く音声プラットフォームのコネクタもOkouにあります。

誰が使えるか

音声ファイルの生成はエージェント単位・人単位で付与する権限で、他の生成ファイルと同じ権限です。つまり話せるエージェントは絵も描けます。

チームが 音声とナレーション を使う場面

エージェントが今作ったもののナレーション

クリップ、操作説明、週次サマリー。エージェントが台本を書いて読み上げるので、マイクを持つ人を待たずに仕上がります。

文章の音声版

ブリーフィング、レポート、リリースノート。文書を開かない人が通勤中に聞くようになり、1回の読み上げ費用は数クレジットです。

読み上げる通知や案内

読むより聞くべき短い一行を、あらゆる場合に備えて事前収録するのではなく、必要になったときに生成します。

音声とナレーション を使わないほうがよいとき

声が特定の人のものでなければならないときには向きません。それは技術の前に同意の問題です。何度も編集し直す長尺音声にも向きません。毎回ファイル全体を作り直すのは無駄です。そして下手でも人が読むほうが良いとき、つまり人が言ったことに意味がある場面には向きません。

ほかではこう呼ばれています

同じものが市場ではいくつもの名前で呼ばれています。そのどれかを探していた方のために、ここで何にあたるのかを示します。

音声合成API

言葉が入り音声が出る、プログラムから呼べる仕組み。まさにこれで、アカウントとキーは私たちの側にあります。

AIナレーション

動画やデモのナレーショントラックを、収録ではなく台本から作ること。チームがこのサービスに手を伸ばす一番の理由です。

APIキー不要の音声合成

問題がモデルではなくアカウントのときに探される言葉です。登録も、環境変数に貼るものもありません。

記事の音声化

書かれたものを聴けるようにすること。音声の長さで課金されるので、実際に公開する量に比例します。

声の複製

別のもので、ここでは意図的に提供していません。声の持ち主の同意のうえ、自社アカウントで動く音声プラットフォームのコネクタを使ってください。

音声とナレーション の比較

音声とナレーション と 自社の音声合成アカウント

発想は同じで、準備がずっと少なくて済みます。預かる鍵も、選ぶ料金プランもなく、アクセスは共有の秘密ではなく権限です。

音声とナレーション と 音声プラットフォームのコネクタ

コネクタは自社アカウントで動き、複製音声やスタジオ機能を含むそのプラットフォームの全機能を使えます。こちらは、とにかく存在すればよいナレーションのための近道です。

音声とナレーション と 自分で収録する

人が言ったことに意味がある場面では、今も人が読むほうが良いです。数字が変わるたびに毎週作り直す一行には、収録は不向きです。

ひとことで言うと

エージェントがすでに作った仕事に声を付ける最短の方法です。用意された声だけ、分単位の課金、登録は不要です。

よくある質問

OpenAIのアカウントは必要ですか。

いいえ。Okouが呼び出し、音声をクレジットで課金します。ワークフローにあなたのキーはありません。

声を選べますか。

はい、用意された声から選べます。あわせて望む読み方を普通の言葉で伝えられます。

自分の声を複製できますか。

いいえ。複製音声は意図的にこのサービスの対象外です。関係する人の同意のうえ、自社アカウントで音声プラットフォームのコネクタを使ってください。

費用はいくらですか。

音声の長さに応じたクレジットで、1分あたりおよそ19クレジットです。短い一行はごくわずかです。

どの言語に対応していますか。

モデルは複数の言語を読みます。母語話者のように聞こえる必要がある場合は、ワークフローを組む前に試聴する価値があります。

ポッドキャストや動画に使えますか。

はい。出力は普通の音声ファイルなので、ほかのトラックと同じように編集に入ります。

2人の会話を作れますか。

1回の呼び出しではできません。それぞれを別に生成して組み立ててください。そのほうが間の取り方も整います。

名前を正しく発音させるには。

テキストに発音どおり書いてください。読み方の指示で発音を説明するより速く、確実です。

音声とナレーション の頼み方

やりたいことをふだんの言葉で伝えるだけです。どのサービスが必要かはエージェントが判断し、呼び出しまで行います。

クリップにナレーションを付ける

このデモ動画用に20秒の台本を書いて、落ち着いたゆっくりした声で読んでください。

レポートを聴く

今週のサマリーを通勤中に聴ける音声にして、4分以内に収めてください。

一行を、きちんと読む

この警告メッセージを、落ち着いた事務的な声で読んでファイルをください。