期間限定:対象パックにボーナスクレジット
Studio Mode

画像から音声

画像の内容や雰囲気を読み取り、場面に合う効果音や環境音をAIで生成します。

Drop image file

or click to browse

Optional

AI will analyze your image and combine it with your preferences

Negative PromptOptional
SeedOptional (0 = Random)

Your image to audio AI result will appear here—generate and replay anytime.

Inspiration

View All

How it Works

01

内容を入力

作りたい内容を言葉で具体的に入力します。

02

AIが生成

入力内容と設定をもとに、AIがコンテンツを生成します。

03

確認して保存

生成結果を確認し、必要なファイルをダウンロードします。

画像から音声へのFAQ

当社のAIは、お客様の画像の雰囲気、構図、被写体を分析し、そのシーンに合致する音声を生成します。また、スタイルや楽器をプロンプトで指定することで、生成される音声を調整することも可能です。

MMAudio(2クレジット)は、一般的な用途向けにバランスの取れた音声生成を提供します。SFX(3クレジット)は効果音に特化しています。ThinkSound(10クレジット)は、より豊かなディテールを備えた高度な合成機能を提供します。

はい。「オーディオ設定」フィールドに希望するムードや楽器を記述すると、モデルがそれを画像分析とブレンドします。

PNG、JPG、JPEG、WEBP、GIF形式に対応しています。最適な結果を得るには、画像サイズは最大10MBまでを推奨します。

生成時間は、モデルと長さにより、通常30秒から60秒程度です。

もちろんです。異なるモデルやプロンプトを使用して、複数のバージョンを生成できます。各生成にはクレジットが消費されます。

もっと制作を続けますか?

買い切りクレジットを追加すると、必要なときに動画・画像・音声の生成を続けられます。