Spesifikasi Teknikal mj-turbo-pic-reader
| Atribut | Butiran |
|---|---|
| ID Model | mj-turbo-pic-reader |
| Penyedia / keluarga model | Aliran kerja pembacaan prompt imej berasaskan Midjourney, tersedia pada CometAPI di bawah pengecam mj-turbo-pic-reader. |
| Keupayaan utama | Membaca dan mentafsir prompt imej supaya ia boleh digunakan untuk memandu penjanaan imej Midjourney. |
| Jenis input | Input prompt imej, lazimnya digabungkan dengan arahan prompt teks pilihan untuk kawalan komposisi dan kandungan yang lebih kukuh. |
| Jenis output | Kefahaman prompt / konteks penjanaan berpandukan imej yang digunakan untuk penciptaan imej gaya Midjourney hiliran. |
| Konteks mod penjanaan | Dikaitkan dengan aliran kerja Midjourney Turbo, di mana Turbo Mode direka untuk menjana imej sehingga empat kali lebih pantas berbanding Fast Mode, sambil menggunakan Fast time dua kali ganda. |
| Konteks Midjourney yang serasi | Turbo Mode tersedia untuk Midjourney versi 5 dan ke atas; versi Midjourney yang lebih baharu menambah baik ketepatan untuk prompt teks dan imej. |
| Kes penggunaan biasa | Analisis imej rujukan, prompt berkondisikan imej, pengawalan gaya, panduan komposisi, dan iterasi kreatif pantas. |
| Kaedah akses | Melalui API bersatu CometAPI menggunakan ID model mj-turbo-pic-reader. |
Apakah mj-turbo-pic-reader?
mj-turbo-pic-reader ialah pengecam platform CometAPI untuk aliran kerja pembaca prompt imej berorientasikan Midjourney. Berdasarkan tingkah laku prompt imej Midjourney, model ini paling tepat difahami sebagai alat untuk menganalisis imej yang dibekalkan dan menggunakan elemen visual terasnya sebagai panduan untuk penjanaan baharu, khususnya apabila digandingkan dengan prompt teks. Midjourney menerangkan prompt imej sebagai cara untuk memandu kandungan, komposisi, dan warna dengan membolehkan sistem melihat elemen teras sesuatu imej dan menggunakannya sebagai inspirasi untuk output baharu.
Bahagian “turbo” pada pengecam tersebut sangat menunjukkan penjajaran dengan aliran kerja Midjourney Turbo dan bukannya nama model asas Midjourney awam yang berasingan. Dokumentasi rasmi Midjourney menerangkan bahawa Turbo Mode ialah mod GPU berkelajuan tinggi yang boleh menjana imej sehingga empat kali lebih pantas daripada Fast Mode, walaupun ia menggunakan lebih banyak masa GPU yang dibilkan. Ini menjadikan mj-turbo-pic-reader sesuai secara praktik untuk talian paip kreatif berpaksikan imej yang memerlukan pusing balik yang lebih pantas.
Dalam praktiknya, ID model ini paling sesuai apabila anda mahu menghantar imej sebagai rujukan visual, mengekstrak atau memanfaatkan isyarat gaya dan komposisinya, dan memacu aliran penjanaan gaya Midjourney melalui CometAPI tanpa perlu menangani perbezaan integrasi khusus penyedia secara langsung. Huraian ini ialah inferens daripada dokumentasi rasmi Midjourney tentang prompt imej dan Turbo yang digabungkan dengan pengecam model CometAPI.
Ciri utama mj-turbo-pic-reader
- Tafsiran prompt imej: Menerima imej sebagai input panduan supaya aliran kerja penjanaan boleh menggunakan isyarat visual seperti komposisi, subjek, dan arah warna.
- Prompt teks dan imej: Berfungsi paling baik dalam aliran kerja di mana imej rujukan digabungkan dengan teks deskriptif, memberikan anda kawalan yang lebih jelas terhadap output akhir.
- Profil kelajuan sejajar Turbo: Sesuai untuk iterasi kreatif yang lebih pantas kerana Turbo Mode Midjourney direka untuk penjanaan imej yang jauh lebih cepat berbanding Fast Mode.
- Eksperimen pantas: Berguna untuk pasukan yang menguji pelbagai arah visual dengan cepat, khususnya dalam kerja konseptual, moodboarding, dan penerokaan gaya. Ini ialah inferens praktikal daripada Turbo Mode digabungkan dengan mekanik prompt imej Midjourney.
- Kesetiaan prompt yang lebih kukuh dalam versi Midjourney yang lebih baharu: Dokumentasi Midjourney menyatakan bahawa versi terkini menambah baik pengendalian prompt teks dan imej, yang menguntungkan aliran kerja gaya pembaca-imej.
- Panduan kreatif dan bukannya pengekstrakan tepat: Prompt imej Midjourney digunakan sebagai inspirasi berdasarkan elemen teras, jadi aliran kerja ini paling sesuai untuk penjanaan berpanduan dan bukannya penghuraian imej deterministik atau pembacaan gaya OCR.
Cara mengakses dan mengintegrasikan mj-turbo-pic-reader
Langkah 1: Daftar untuk Kunci API
Daftar di CometAPI dan buat kunci API daripada papan pemuka anda. CometAPI menyediakan lapisan API bersatu, jadi anda boleh mengakses mj-turbo-pic-reader menggunakan corak pengesahan yang sama yang anda gunakan untuk model lain yang disokong.
Langkah 2: Hantar Permintaan ke API mj-turbo-pic-reader
Gunakan titik akhir CometAPI yang serasi dengan Midjourney pada POST /mj/submit/describe.
curl https://api.cometapi.com/mj/submit/describe \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $COMETAPI_API_KEY" \
-d '{
"prompt": "a futuristic cityscape at sunset --v 6.1",
"botType": "MID_JOURNEY",
"accountFilter": {
"modes": ["TURBO"]
}
}'
Langkah 3: Dapatkan dan Sahkan Keputusan
API mengembalikan objek tugas dengan ID tugas. Lakukan permintaan berkala ke GET /mj/task/{task_id}/fetch untuk menyemak status penjanaan dan mendapatkan URL imej output apabila tugas mencapai keadaan terminal.