kling-audio-text-to-audio の技術仕様
| 仕様 | 詳細 |
|---|---|
| モデル ID | kling-audio-text-to-audio |
| モデルタイプ | 音声生成 |
| 入力 | テキストプロンプト |
| 出力 | 生成された音声 |
| モダリティ | テキストから音声 |
| 短い説明 | Kling テキストから音声 |
kling-audio-text-to-audio とは?
kling-audio-text-to-audio は、CometAPI を通じて利用可能なテキストから音声へのモデルです。記述されたプロンプトを入力として受け取り、提供された説明に基づいて音声出力を生成するよう設計されています。これにより、自然言語の指示から自動的にサウンドを生成する必要があるワークフローに有用です。
本モデルは、クリエイティブなオーディオプロトタイピング、サウンドトラックのアイデア出し、効果音生成、その他テキスト駆動の音声合成が必要なプロダクト体験などのアプリケーションで利用できます。CometAPI を介して、開発者は一貫した API インターフェースで kling-audio-text-to-audio にアクセスし、独自のツール、アプリ、パイプラインに統合できます。
kling-audio-text-to-audio の主な機能
- テキストから音声生成: 自然言語のプロンプトを音声出力に変換します。
- シンプルなプロンプトベースのワークフロー: 開発者が簡潔なテキスト指示で音声を作成できます。
- API 連携に対応: アプリケーションやバックエンドサービスで利用するために CometAPI 経由でアクセスできます。
- クリエイティブなユースケース: メディア、プロトタイピング、インタラクティブな体験に向けた実験を支援します。
- 統一プラットフォームによるアクセス: CometAPI の標準化されたモデルアクセスパターンに適合し、導入を容易にします。
kling-audio-text-to-audio へのアクセスと統合方法
ステップ 1: API キーの取得にサインアップ
CometAPI にサインアップし、ダッシュボードから API キーを作成します。キーを取得したら安全に保管し、CometAPI プラットフォームへのリクエスト認証に使用してください。
ステップ 2: kling-audio-text-to-audio API にリクエストを送信
CometAPI の Kling オーディオエンドポイント POST /kling/v1/audio/text-to-audio を使用します。
curl https://api.cometapi.com/kling/v1/audio/text-to-audio \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $COMETAPI_API_KEY" \
-d '{
"prompt": "Gentle rain on a tin roof with distant thunder.",
"duration": 10
}'
ステップ 3: 結果を取得して検証する
API はタスク ID を返します。音声生成が完了したタイミングを確認するためにタスクステータスのエンドポイントをポーリングし、出力 URL を取得します。