オトシゴ

日本語専用の音声合成サービス

読み間違えない。
息づかいまで。

日本語だけに集中した音声合成です。数字や日付の読みも、文末の余韻も自然に。1字=1クレジットなので、生成する前に費用が確定します。

近日公開 — 現在は申し込みを受け付けていません。

サンプルを聴く プリセット3声

海の底に、ちいさな灯りがひとつ。今夜も物語が、静かにはじまります。

33 字 = 50 クレジット
50字未満の生成は一律50クレジット

事前生成したサンプル音声です。ブラウザ上でのリアルタイム生成はβで公開します。

25.6秒の音声を約1秒で生成(自社実測)

基盤はMITライセンスの公開モデル

全生成音声に透かし・無効化不可

特定商取引法に基づく表記を公開済み

使い方

入力から書き出しまで、4ステップ。

下の画面はすべて実際のスタジオです。ログインしたあとも、この画面のまま作業が続きます。

01

テキストを入力する

オトシゴのスタジオの入力ブロック。話者チップ、本文のテキストエリア、下に感情の絵文字チップが並ぶ

読み仮名も、絵文字による表情の指示もそのまま書けます。消費クレジットは入力している最中に確定します。

02

声を選ぶ

右パネルの「声を選ぶ」。青波・こだま・ひなたの3声が並び、各行に試聴ボタンがある

プリセットの声か、登録した同意済みの声・デザイン声から選びます。試聴にクレジットは消費しません。

03

生成する

生成結果。「透かし入り・生成者まで追跡可能」のバッジ、再生プレーヤー、消費クレジットと残高、生成IDが並ぶ

25.6秒の音声を約1秒で生成します(自社実測)。生成に失敗したぶんのクレジットは自動で戻ります。

04

書き出す

右パネルの履歴タブ。生成時刻・声・本文の冒頭・消費クレジットと再生ボタンが1行に並ぶ

WAVでダウンロードします。履歴から聴き直して、言い回しの違いを並べて比べられます。

できること

日本語のためだけに作った音声合成

数字や日付の読み、イントネーション、文末の息づかい。日本語だけに集中したエンジンで作っています。

絵文字で、声の表情を指示する

「明るく」「ささやき」など45種の絵文字を文中に置くだけで、その場所から声の表情が変わります。指示に使った絵文字は課金文字数に含まれません。

本文中に置かれた絵文字と、その下の感情チップ(明るく・ささやき・吐息・しんみり・力強く)

同意済みの声で、しゃべらせる

数十秒の読み上げで声のクローンを作れます。登録できるのは、声の持ち主本人がその場で同意文を読み上げた「同意済みの声」だけです(スタンダード以上)。

声の一覧。1行に声の名前、種別タグ、短い説明、試聴ボタンが並ぶ

生成する前に、費用が確定する

1字=1クレジット。空白・改行と絵文字によるスタイル指示をのぞいた文字数がそのまま消費クレジットになり、押す前に金額がわかります(1回の最低課金は50字)。失敗した生成には課金しません。

スタジオ下部の文字数メーター。「54字 = 54クレジット 残9,410」と10文字ごとの目盛り、右に生成ボタン

話速も出力も、右のパネルで完結

話速、スタイルの言葉による指定、出力形式。設定は右のパネルにまとめてあり、書いている面を邪魔しません。

右パネルの読み上げ設定。話速のステッパー、スタイル指定の自由入力、出力形式

開発者向け

OpenAI互換API

既存の OpenAI SDK から、エンドポイントを差し替えるだけで動きます。長文向けの非同期ジョブAPIも用意します。

APIから生成した音声にも同じ透かしが入ります。生成IDは応答に含まれ、監査ログから生成者まで遡れます。

# OpenAI SDK のまま、URL を差し替えるだけ POST /v1/audio/speech { "model": "otoshigo-1", "voice": "aonami", "input": "こんにちは。オトシゴです。" }

料金

1字=1クレジットの明朗会計

月額プランに毎月クレジットが付与され、テキスト1文字が1クレジットを消費します。目安は約300字で音声1分です。

無料

まず声を試したい方に

¥0

登録時 3,000字+毎月 1,000字

  • プリセット音声で生成
  • 絵文字によるスタイル指示
  • ボイスクローン
  • 商用利用
クローン対応の最小プラン

スタンダード

自分の声で作りたい方に

¥2,980/月

毎月 30,000字(約100分)

  • 同意済みの声のクローンなど 保存3枠
  • API利用
  • 商用利用

プロ

制作・配信を仕事にする方に

¥9,800/月

毎月 150,000字(約500分)

  • 同意済みの声のクローンなど 保存10枠
  • API 高レート・優先キュー
  • 商用利用

5プランすべてと機能比較表を見る

声を預かるということ

機能を足すために、
曲げない3原則。

  1. 01

    同意なき声は、登録できない

    その場で生成された同意文を本人が読み上げ、読み上げ内容の照合と話者照合の両方に合格した声だけを有効化します。

  2. 02

    生成音声は、生成者まで遡れる

    全生成音声に透かしを埋め込み、監査ログとあわせて生成者・声・日時を特定できる状態を保ちます。無効化はできません。

  3. 03

    問題が起きたら、即時に止める

    通報・同意撤回・凍結の仕組みを常設し、問題のある声と生成を即時に停止します。通報の一次対応は24時間以内。

安全への取り組みを読む

よくある質問

はじめる前に

いつから使えますか?

公開に向けて準備中です。現時点では申し込みを受け付けていません。公開時期が決まったら、このサイトでお知らせします。

生成した音声は商用利用できますか?

ライト以上の有料プランで商用利用できます。無料プランの音声は商用利用できず、クレジット表記が必要です。

対応している言語は?

日本語だけです。日本語の読みとイントネーションの品質に集中するため、他の言語には対応しません。

ボイスクローンは誰の声でも登録できますか?

いいえ。登録できるのは「同意済みの声」だけです。自分の声のほか、声の持ち主本人が自分の端末でその場の同意文を読み上げるボイスチャレンジ(音声認識+話者照合)に合格した声だけが有効になり、持ち主はいつでも同意を撤回できます。詳しくは安全への取り組みをご覧ください。

利用に条件はありますか?

18歳以上で日本国内にお住まいの方に限定しています。無料プランの利用にはSMS認証が必要です。

短い文章でも1字=1クレジットですか?

1リクエストの最低課金は50字です。50字未満の入力は一律50クレジットを消費します。絵文字によるスタイル指示と読み仮名の指定は課金対象外です。

日本語の声づくりを、
まもなく。

日本語の読み間違いを徹底的に抑え、息づかいまで自然に。声は同意から預かり、すべての生成音声に透かしを入れます。

サンプルを聴く