OpenAI Realtime API を基盤にした、事務所向けのAI音声キャラクター構築プラットフォームです。 キャラクター設計、公開範囲、料金設定まで、貴社が主導して決められます。 当社は基盤の提供と運用を担当します。
Why Us
「AIと話せる」だけのサービスは、もう珍しくありません。 ファンが課金し続ける理由になるのは、下の3つが揃っているかどうかです。
POINT 01
静止画を置くだけのサービスとは違い、口の動きと表情が声に追従します。 「本人と話している」という感覚が、音声だけの場合とは決定的に変わります。 映像のON / OFFはユーザー側で切り替えられます。 現行のリアルタイム映像同期技術では方式上わずかな遅延(コンマ数秒程度)が生じるのが業界共通の現状ですが、 当社は現時点で最新世代の映像同期エンジンを採用しています。
実装済みPOINT 02
既製の声を使い回すのではなく、タレント本人の声で話すことを前提に設計しています。 ファンは声の主を知っているため、既製の声との差は即座に伝わります。 本人の声の再現には、ご本人の録音(目安30分〜数時間)と、音声サービス側の審査、ご本人・所属事務所の書面同意が必要です。 手続きが終わるまでは、話し方を作り込んだ既製の声で運用を始められます。
導入時に構築POINT 03
キャラクターは会話の中だけに閉じません。X・Instagram・TikTokで日常を発信し、 ファンとの接点をサービス外にも広げます。アカウント運用も当社が支援します。
運用中
Your Own Service Here
「グチってスッキリ」は、このプラットフォームを使って当社が独自ブランドとして立ち上げた一事例にすぎません。 サービス名も、サイトのデザインも、キャラクター設計も、料金設定も、事務所ごとに完全に独立してカスタマイズできます。 当社の中に間借りするのではなく、貴社だけの場所に、貴社だけのサービスを。
Case Study
グチってスッキリあかり・はるの2キャラクター運営
サービス名・サイトデザイン・料金プランはすべて独自設計。利用者向けの画面には「AI VOICE SERVICE」の名前を出していません。
貴社の番です
撮影は不要。写真と声の録音、同意の録画まで、すべてリモートで進められます。サービス名・サイトデザイン・キャラクター設計・料金設定まで、すべて貴社が主導して決められます。
Comparison
音声AIサービスは技術的な出自によって、得意なことが大きく異なります。 タレントIPを扱ううえで重要な項目で比較しました。
| 比較項目 | AI VOICE SERVICE (当社) |
汎用AI会話アプリ Cotomo / Character.AI 等 |
音声合成ツール ElevenLabs 等 |
アバター配信ツール HeyGen 等 |
|---|---|---|---|---|
| 会話の応答速度 | ◎ 音声から音声を直接生成 OpenAI Realtime API |
◎ 各社最適化済み | △ 文字起こしを挟むと遅延 | △ 映像処理ぶんの遅延 |
| 会話の記憶・継続 | ◎ 要約を保存し次回に注入 独自実装 |
○ サービスにより差 | × 標準機能になし | △ 別途実装が必要 |
| タレント本人の声 | ○ 導入時に構築 本人の録音+審査・同意 |
× 既製音声から選択 | ◎ 音声クローン可 | ○ 別途クローンが必要 |
| 映像と声の同期 | ◎ リアルタイム同期 ON / OFF 切替可 |
× 静止画・イラストのみ | × 音声のみ | ◎ 得意領域 |
| キャラクターのSNS運用 | ◎ 当社が運用を支援 | × 提供なし | × 提供なし | × 提供なし |
| 事務所による料金設定 | ◎ 貴社が自由に設定 | × 運営が一律に決定 | — | — |
| 権利保護・停止対応 | ◎ 契約で用途限定 申出により即時停止・削除 |
△ 利用規約に依存 | ○ ツール側の規約に依存 | ○ ツール側の規約に依存 |
| 危機対応(自傷等の検知) | ◎ 検知時に公的窓口を案内 | △ サービスにより差 | × 提供なし | × 提供なし |
※ 比較は2026年8月時点の公開情報および当社検証に基づく一般的な傾向であり、
各社の個別プランや最新仕様によって異なる場合があります。記載の社名・製品名は各社の商標です。
※ 当社は上記各社と資本関係・提携関係にはありません。
Technology
独自技術を謳うより、各領域で最良のものを組み合わせるほうが、品質も安定性も高くなります。 当社の役割は、それらを日本語の会話品質として成立させることです。
Layer 01 — Conversation
OpenAI Realtime API
音声を文字に変換せず、音声から直接音声を生成します。応答が速く、間の取り方や語尾のニュアンスまで自然に再現されます。 文字起こしを挟む方式(音声→テキスト化→LLM→音声合成)は、各段階でそれぞれ100〜300ミリ秒ほど遅延が積み重なりますが、 音声から音声への直接生成はその中間工程を持たないため原理的に有利です。OpenAI社は最新世代モデルでエンドツーエンドの 機械側レイテンシを200ミリ秒台まで短縮したと公表しています。なお映像つきで話す場合は、映像の処理のぶん、返事の始まりが少し遅れます。
Layer 02 — Voice
本人の声の再現エンジンは案件ごとに選定(OpenAI・ElevenLabs など)
収録した本人の声を再現します。日本語の品質と各社の利用条件を見て、案件ごとに最適な方式を選びます。手続きの完了までは、話し方を作り込んだ既製の声で運用します。 実在するご本人の声・容姿(顔画像)を使用するキャラクターは、プラットフォームの審査申請とご本人・所属事務所の書面同意が前提となります。オリジナルキャラクターとして展開する場合はこの申請は不要です。
Layer 03 — Video
HeyGen LiveAvatar(最新世代)
口の動きと表情を声に同期させます。会話エンジンと音声は当社側を使うため、話し方の品質は保たれます。 リアルタイム映像同期は現行技術では方式上わずかな遅延が避けられない領域で、これは当社固有の制約ではなく2026年時点の業界共通の限界です。当社は各社の技術を継続的に評価し、その時点で最も新しい・遅延の少ない方式に随時切り替えています。
Layer 04 — Memory
ONCE AGAIN 独自実装
通話ごとに内容を要約して保存し、次回の冒頭に読み込ませます。「前回の続き」から話せることが、継続率に直結します。
Your Control
当社は基盤を提供し、運用を代行します。 どんなキャラクターにするか、いくらで売るか、何を言わせないかは、貴社が決めてください。
年齢、性格、口調、口癖、話す速度まで指定できます。本人の素に近づけることも、演じた人格にすることも可能です。
月額の金額、無料枠の有無、追加クレジットの単価を貴社が決められます。ファン層に合わせた価格設計が可能です。
言わせたくない話題を個別に追加できます。標準で性的な話題、特定個人への攻撃、会う約束は禁止しています。
音声のみで提供するか、映像同期を有効にするかを選べます。上位プラン限定の特典として設計することもできます。
実名で展開するか、キャラクター名のみで運用するかを選べます。SNSアカウントの開設有無も貴社判断です。
1名から始めて、反応を見てから増やせます。所属タレント複数名を同一サービス内に並べることも可能です。
Case Study
当社が自社で企画・運用している検証サービスです。 同じ基盤を使い、コンセプト・キャラクター・料金をすべて独自に設計しました。 貴社の場合も、この形でカスタマイズできます。
Powered by AI VOICE SERVICE
グチってスッキリ「アドバイスも、励ましも、解決策も返さない。ただ聞くだけ」という一点に用途を絞った音声サービスです。 機能を足すのではなく、あえて禁止事項を増やすことで独自性を作りました。 これは基盤側の「禁止事項の追加」機能で実現しています。
20歳 / 賑やかに聞くタイプ
専用SNS 運用中
22歳 / 静かに聞くタイプ
専用SNS 運用中
この事例で設定したこと
Recording
声は、静かな部屋で台本を読み上げて録ります。録音の方法・機材は当社がご案内し、ご都合のよい時間に何回かに分けて録ることもできます。 映像は、ご本人から預かった写真をもとに当社が制作します。撮影はありません。
Step 01
当社が用意した台本をお送りします。読み上げる内容はこちらで設計します。
Step 02
静かな室内で読み上げます。所要は30分〜数時間で、分けて録れます。まず試し録りで音質を確認し、必要なら当社で収録環境を用意します。
Step 03
録音ファイルを送信いただければ完了です。以降の追加収録は原則ありません。
Optional
ご本人の写真(許諾済み)から、当社が背景・衣装を整えた映像を制作します。ご本人には、お送りするリンクからスマートフォンで同意の録画を一度だけお願いします。季節ごとの衣装・背景の変更も、撮り直しなしで対応できます。映像サービス側の審査があります。
Process
所属タレントの規模、想定するファン層、実現したい体験をお聞かせください。 この時点では何も確定しません。条件と概算費用をご説明します。
どんなサービスにするか、誰をキャラクター化するかを一緒に設計します。 人格、口調、禁止事項、料金プランをこの段階で決めます。
利用範囲・期間・報酬形態を書面で取り決めます。用途は本サービス内の会話に限定し、 第三者への提供・再販売は明確に禁止します。停止手順も明記します。
声は、台本を読み上げて録ります(所要30分〜数時間・分けて録れます)。録音の方法・機材は当社がご案内します。 映像同期を使う場合は、ご本人の写真(許諾済み)から当社が映像を制作します。撮影や来社は不要で、ご本人にはお送りするリンクから同意の録画を一度だけお願いします(海外からも可能)。季節ごとの衣装・背景の変更にも対応します。
当社がキャラクターを構築し、限定公開でテストします。 話し方の調整はこの段階で詰めます。ご本人にも聞いていただき、納得のうえで公開します。
サービスの公開後は、当社が運用・保守・SNS運用支援を担当します。 利用状況と収益は定期的にレポートします。
Rights & Safety
取得した音声・映像は、契約で定めたサービス内の会話生成にのみ使用します。広告、楽曲、他社サービスへの転用、第三者への提供・再販売は一切行いません。
ご本人またはご所属先のお申し出により、キャラクターの公開を停止します。停止後は音声・映像モデルを速やかに削除し、完了を書面でご報告します。違約金はありません。
ユーザーとの会話は、次回の会話をつなぐための要約としてのみ保存します。音声モデルの再学習には使用せず、外部の事業者にも学習用途では提供しません。
自傷や希死念慮の兆候を検知した場合、キャラクターは会話を続けず、公的な相談窓口を案内します。演者の声が不適切な場面で使われることを防ぎます。
FAQ
Contact
この時点で何も確定しません。サービス概要資料と、実際の音声サンプルをお送りします。
担当者より3営業日以内にご返信いたします。