Penjual di marketplace Tiongkok dan global
Qwen Image menempatkan teks Mandarin dan Inggris yang benar pada foto produk dan banner, serta mengedit teks label saat listing berpindah ke pasar baru.

Keluarga Qwen Image dari Alibaba dalam satu ruang kerja: 3.0 untuk pembuatan dan pengeditan sehari-hari dengan 5 credits, 3.0 Pro untuk tata letak padat dan teks multibahasa, 2.0 untuk pekerjaan native-2K yang cepat. Akun baru mendapat 20 credits gratis, dan satu gambar Qwen Image 3.0 berharga 5.



GALERI






KEMAMPUAN
Fitur 01
Qwen Image adalah lini pembuatan gambar dari tim Qwen Alibaba, kelompok yang sama di balik model bahasa Qwen. Lini ini dimulai pada Agustus 2025 sebagai model dasar berbobot terbuka dan sejak itu berkembang melalui 2.0 hingga generasi 3.0 saat ini. Keluarga ini mencakup orang, alam, dan arsitektur fotorealistis, ilustrasi bergaya, komik, serta karya desain seperti poster dan slide bergaya PPT. Jelaskan adegan dalam bahasa Inggris atau Mandarin, pilih salah satu dari lima rasio aspek, dan model menghasilkan bingkai jadi pada 1K atau 2K. Karena dilatih dengan penekanan besar pada teks dan tata letak, bahkan prompt foto biasa cenderung menghasilkan komposisi yang masuk akal dan ruang kosong yang bersih untuk teks.

Fitur 02
Sejak rilis pertama, tim Qwen menyebut pengeditan gambar yang presisi sebagai salah satu dari dua hal yang paling dikuasai model ini. Anda mengunggah gambar dan menjelaskan perubahannya: ganti latar belakang, tambah atau hapus objek, ubah gaya seluruh bingkai, atau sesuaikan pose seseorang. Model mempertahankan apa yang tidak Anda sebutkan. Versi 2.0 menyatukan pembuatan dan pengeditan menjadi satu alur kerja, bukan dua jalur model, sehingga pengeditan lanjutan berjalan melalui sistem yang sama yang menggambar aslinya. Di Ricebowl, 3.0 dan 3.0 Pro menerima hingga tiga gambar referensi per permintaan, dan 2.0 menerima satu.


Fitur 03
Teks adalah bidang yang membuat keluarga model ini dikenal. Kartu model aslinya menyebut kemampuan rendering teks yang luar biasa, terutama untuk bahasa Mandarin, dengan tipografi yang menyatu di dalam adegan alih-alih mengambang di atasnya. Versi 3.0 melangkah lebih jauh: dokumentasi API-nya menyatakan dapat mereproduksi teks sekecil 10 piksel, dan daftar 3.0 Pro menambahkan rendering native dalam 12 bahasa. Itu menjadikannya pilihan kuat untuk menu, kemasan, papan nama toko, infografis, kertas ujian, dan tata letak bergaya surat kabar, apa pun yang gambarnya rusak karena satu kata yang salah eja. Tuliskan kata-kata persisnya dalam tanda kutip di prompt Anda.

Fitur 04
Versi 3.0 menerima prompt hingga sekitar 4.500 token, cukup panjang untuk menentukan setiap panel storyboard atau setiap bagian infografis. Model ini menata banyak elemen dalam satu bingkai dan mengikuti instruksi tata letak seperti kolom, header, dan callout. API Qwen juga menawarkan opsi prompt-extend yang menulis ulang deskripsi singkat menjadi lebih kaya, plus negative prompt untuk mencantumkan apa yang tidak boleh muncul; generator Ricebowl saat ini hanya menerima satu prompt, jadi tuliskan detailnya sendiri. Dalam uji buta AI Arena publik, rilis 2.0 sebelumnya menempati peringkat ketiga di papan peringkat text-to-image dengan skor Elo 1029, menurut daftar API-nya.

Fitur 05
Mengedit gambar yang sudah ada dengan Qwen Image lebih andal daripada menghasilkan dari awal dan berharap hasilnya bagus. Ketika komposisi, wajah, atau produk sudah tepat, edit mengunci bagian itu dan hanya mengubah bagian yang Anda sebutkan, sementara generasi baru mengacak ulang semuanya. Qwen Image Edit mencakup tugas-tugas yang benar-benar dibutuhkan orang: mengubah latar belakang, memperbarui objek, menyesuaikan gaya, dan menulis ulang teks di dalam gambar, termasuk memperbaiki salah ketik pada papan nama. Jalur edit 2.0 berjalan pada arsitektur 7 miliar parameter yang lebih ringan untuk hasil lebih cepat, dan 3.0 Pro menawarkan image-to-image pada 1K atau 2K.


CONTOH PROMPT
Prompt
Pintu masuk kedai kopi dengan papan tulis kapur bertuliskan "Morning Brew · 早安咖啡 · $3 per cup" dalam tulisan kapur tangan, pohon zaitun dalam pot di samping pintu, cahaya pagi lembut, foto 35mm.
Referensi

Hasil

Prompt
Pertahankan produk dan pencahayaan. Ganti teks label bahasa Inggris dengan "绿茶精华 GREEN TEA ESSENCE", ubah latar belakang menjadi hutan bambu, biarkan semua lainnya tidak berubah.
Referensi

Hasil

KASUS PENGGUNAAN
Qwen Image menempatkan teks Mandarin dan Inggris yang benar pada foto produk dan banner, serta mengedit teks label saat listing berpindah ke pasar baru.
Prompt panjang dan teks kecil yang terbaca membuatnya praktis untuk menghasilkan lembar kerja, tata letak bergaya ujian, dan diagram berlabel dalam satu kali proses.
Generasi 2.0 dan 3.0 dibuat untuk visual yang padat teks seperti slide bergaya PPT, poster, dan komik dengan struktur yang jelas.
Pengeditan dengan bahasa alami menangani penggantian latar belakang, penghapusan objek, dan penyesuaian pose tanpa mask atau layer.
Daftar 3.0 Pro menyebut aset game, antarmuka realistis, dan adegan livestream sebagai target penggunaannya.
KATA PENGGUNA
01
Pujian yang paling sering diulang adalah karakter Mandarin keluar dengan benar, yang masih sering salah pada banyak model gambar.
02
Pengguna suka bahwa pengeditan teks atau latar belakang tidak mengubah wajah dan produk, bukan menggambar ulang seluruh gambar.
03
Versi 3.0 adalah salah satu model termurah saat ini di Ricebowl, sehingga pengguna bebas melakukan iterasi pada tata letak.
04
Tiga gambar referensi per permintaan lebih sedikit daripada yang diizinkan Seedream atau FLUX.2, sehingga set multi-karakter besar beralih ke tempat lain.
YANG MANA
Jadikan 3.0 sebagai pilihan utama; Pro hanya layak untuk halaman yang padat teks. Daftar Pro menjelaskan rendering 12 bahasa dan tata letak padat informasi, jadi keluarkan Credits tambahan saat poster atau infografis sebagian besar berisi kata. Pertahankan 2.0 untuk kesinambungan dengan karya lama.
5 Credits untuk text-to-image dan 6 dengan gambar input, output 1K atau 2K, hingga 3 gambar referensi. Pilihan sehari-hari untuk pembuatan dan pengeditan.
7 Credits di 1K dan 13 di 2K, hingga 3 gambar referensi. Dibuat untuk tata letak padat, infografis, dan teks asli dalam 12 bahasa.
6 Credits, output native-2K yang cepat, 1 gambar referensi. Berguna saat Anda perlu mencocokkan karya yang dibuat dengan versi sebelumnya.
YANG MEMBEDAKAN
01
Banyak model bisa menggambar teks; lebih sedikit yang bisa mengubahnya setelahnya. Qwen Image mencantumkan pengeditan teks dalam gambar sebagai tugas pengeditan inti, sehingga Anda bisa memperbaiki salah ketik pada papan nama atau menerjemahkan label tanpa membuat ulang gambar.
02
Bobot asli Qwen Image tersedia untuk publik di bawah lisensi Apache 2.0 di Hugging Face dan ModelScope, dengan laporan teknis yang diterbitkan. Keluarga yang Anda jalankan di sini tumbuh dari basis terbuka tersebut.
PENDAPAT KAMI
Hanya saat gambar sebagian besar berisi teks. Dengan 7 Credits untuk 1K dibandingkan 5 untuk 3.0 standar, Pro sepadan untuk infografis, poster multibahasa, dan tata letak bergaya surat kabar. Untuk foto dan grafik sederhana, 3.0 standar memberi tampilan yang sama dengan biaya lebih rendah.
Ya, ini keahlian terkuatnya. Tim Qwen membangun model ini dengan rendering teks yang luar biasa, terutama untuk bahasa Mandarin, dan versi 3.0 merender teks sekecil 10 piksel. Untuk gambar dengan teks Mandarin ini pilihan pertama yang kuat; untuk satu judul bahasa Inggris GPT Image 2 adalah pilihan yang lebih stabil, dan untuk penempatan teks yang presisi Ideogram 4.
Qwen Image untuk pengeditan yang menyentuh teks atau satu subjek; Seedream untuk pengeditan yang menggabungkan banyak referensi. Qwen menerima hingga 3 gambar referensi di Ricebowl, sedangkan Seedream 5.0 Lite menerima hingga 14.
PERBANDINGAN
| Fitur | Qwen Image 3.0 | Qwen Image 3.0 Pro | Seedream 5.0 Lite |
|---|---|---|---|
| Pembuat | Tim Alibaba Qwen | Tim Alibaba Qwen | ByteDance |
| Credits di Ricebowl | 5 (6 dengan gambar input) | 7 di 1K, 13 di 2K | 6 di resolusi apa pun |
| Resolusi output | 1K / 2K | 1K / 2K | 2K / 3K / 4K |
| Gambar referensi | Hingga 3 | Hingga 3 | Hingga 14 |
| Rasio aspek | 5 | 5 | 8, termasuk 21:9 |
| Kekuatan teks | Teks kecil, kuat untuk bahasa Mandarin | 12 bahasa, tata letak padat | Teks multibahasa yang padat |
| Terbaik untuk | Gambar dan edit yang sadar teks dengan biaya murah | Infografis dan poster padat teks | Kumpulan multi-referensi dan 4K |
Pilihan kami: pilih Qwen Image untuk teks bahasa Mandarin, edit teks dalam gambar, dan iterasi berbiaya rendah. Pilih Seedream saat Anda butuh 4K atau lebih dari tiga referensi. Keduanya ada di pemilih model Ricebowl yang sama.
Coba Qwen Image Gratis01
Generator di bagian atas halaman ini menjalankan Qwen Image 3.0 secara default. Beralih ke 3.0 Pro atau 2.0 di pemilih model. Akun baru mendapat 20 credits gratis saat mendaftar, cukup untuk empat gambar 3.0 dengan 5 credits per gambar.
02
Jelaskan adegan dan letakkan kata apa pun yang muncul di gambar dalam tanda kutip, dalam bahasa Inggris, Mandarin, atau bahasa lain. Untuk mengedit, unggah hingga tiga gambar referensi dan sebutkan apa yang ingin diubah.
03
Pilih salah satu dari lima rasio aspek dan 1K atau 2K. Hasil Qwen Image muncul di feed di bawah dan dapat diunduh langsung dari kartunya.
ULASAN
Kata mereka yang menjalankan Qwen Image di Ricebowl.
Tulisan Mandarin di banner saya akhirnya benar. Saya perbaiki slogan bahasa Inggrisnya dengan mengedit, bukan dengan membuat ulang.
Operator toko Tmall
Saya menjelaskan tata letak lembar kerja dalam satu prompt panjang dan mendapatkan halaman bersih dengan label yang terbaca.
Guru SMA
Versi 3.0 Pro menangani infografis bergaya slide dengan baik, dan harganya memungkinkan saya mencoba banyak tata letak.
Desainer presentasi
Ganti latar dan hapus objek cukup dengan kata-kata biasa. Tanpa mask, dan wajahnya tetap persis sama.
Retoucher lepas
Kami membuat overlay stream dengan judul berbahasa Mandarin. Lima kredit per gambar berarti kami bisa mencoba dua puluh versi.
Artis studio livestream
Satu saldo, semua model. Kredit berlaku di seluruh 20 model video — tanpa watermark, tanpa model yang dikunci paket, dan penggunaan komersial di setiap paket berbayar.
Hemat 30% dengan pembayaran tahunan
Bayar tahunan dan hemat lebih banyak.
Harga terendah untuk memulai. Semua model, anggaran bulanan untuk mencoba.
US$7,99/bln
Diperbarui setiap bulan, batalkan kapan saja.
200 kredit
≈ 0–10 video, tergantung modelnya
≈ 14–66 gambar, tergantung modelnya
4.00¢ / kredit
Cara termurah untuk memulai. Semua model, anggaran bulanan yang kecil.
US$12,99/bln
Diperbarui setiap bulan, batalkan kapan saja.
400 kredit
≈ 1–20 video, tergantung modelnya
≈ 28–133 gambar, tergantung modelnya
3.25¢ / kredit
Cukup untuk mencoba semua model dan menyelesaikan beberapa klip setiap bulan.
US$29,9/bln
Diperbarui setiap bulan, batalkan kapan saja.
1.000 kredit
≈ 3–50 video, tergantung modelnya
≈ 71–333 gambar, tergantung modelnya
2.99¢ / kredit
2 tugas paralel
Produksi stabil untuk kreator solo yang mulai serius — semua model, anggaran yang lega.
US$49,9/bln
Diperbarui setiap bulan, batalkan kapan saja.
2.000 kredit
≈ 6–100 video, tergantung modelnya
≈ 142–666 gambar, tergantung modelnya
2.50¢ / kredit
3 tugas paralel
Produksi volume tinggi untuk kreator produktif dan tim kecil.
US$89,9/bln
Diperbarui setiap bulan, batalkan kapan saja.
5.000 kredit
≈ 15–250 video, tergantung modelnya
≈ 357–1666 gambar, tergantung modelnya
1.80¢ / kredit
5 tugas paralel
Langganan bulanan yang fleksibel.
Cukup untuk mencoba semua model dan menyelesaikan beberapa klip setiap bulan.
US$19,9/blnUS$29,9
Ditagih tahunan sebesar $238.8. Diperbarui setiap tahun, batalkan kapan saja.
Hemat $120/thn vs bulanan
12.000 kredit
≈ 38–600 video, tergantung modelnya
≈ 857–4000 gambar, tergantung modelnya
1.99¢ / kredit
2 tugas paralel
Produksi stabil untuk kreator solo yang mulai serius — semua model, anggaran yang lega.
US$34,9/blnUS$49,9
Ditagih tahunan sebesar $418.8. Diperbarui setiap tahun, batalkan kapan saja.
Hemat $180/thn vs bulanan
24.000 kredit
≈ 76–1200 video, tergantung modelnya
≈ 1714–8000 gambar, tergantung modelnya
1.75¢ / kredit
3 tugas paralel
Produksi volume tinggi untuk kreator produktif dan tim kecil.
US$62,9/blnUS$89,9
Ditagih tahunan sebesar $754.8. Diperbarui setiap tahun, batalkan kapan saja.
Hemat $324/thn vs bulanan
60.000 kredit
≈ 190–3000 video, tergantung modelnya
≈ 4285–20000 gambar, tergantung modelnya
1.26¢ / kredit
5 tugas paralel
Isi ulang kredit berlaku selama 12 bulan.
Isi ulang satu kali untuk kebutuhan sesekali.
US$49,9
Pembelian satu kali, berlaku 12 bulan.
1.000 kredit
≈ 3–50 video, tergantung modelnya
≈ 71–333 gambar, tergantung modelnya
4.99¢ / kredit
Isi ulang satu kali yang lebih besar dengan harga satuan yang lebih baik.
US$198
Pembelian satu kali, berlaku 12 bulan.
4.800 kredit
≈ 15–240 video, tergantung modelnya
≈ 342–1600 gambar, tergantung modelnya
4.13¢ / kredit
5 tugas paralel
Apa itu Qwen Image, berapa biaya setiap versi, dan bagaimana cara mengeditnya.
Coba Qwen Image GratisYa, Anda bisa mulai gratis. Buat akun Ricebowl dan Anda mendapat 20 kredit gratis saat mendaftar tanpa perlu kartu. Setelah itu, Qwen Image 3.0 berbiaya 5 kredit per gambar (6 dengan gambar masukan), 3.0 Pro berbiaya 7 pada 1K atau 13 pada 2K, dan 2.0 berbiaya 6. Qwen Image versi open-weight asli juga gratis diunduh di bawah Apache 2.0 jika Anda menjalankannya sendiri.
Qwen Image adalah keluarga model pembuatan dan penyuntingan gambar milik Alibaba, yang dibangun oleh tim Qwen. Model ini dikenal karena rendering teks yang rumit, terutama bahasa Mandarin, dan penyuntingan bahasa alami yang presisi. Generasi saat ini adalah 3.0, dengan versi standar dan Pro.
Gunakan saat gambar memuat kata-kata atau perlu penyuntingan yang cermat. Model ini merender teks kecil dengan terbaca, menangani karakter Mandarin dengan andal, mengikuti prompt terstruktur yang panjang, dan memungkinkan Anda mengubah teks atau objek di dalam gambar yang ada. Model ini juga termasuk yang termurah di antara model terkini di Ricebowl.
Keduanya menghasilkan 1K atau 2K dan menerima hingga tiga referensi di sini. Pro adalah tingkat yang dijelaskan untuk rendering asli di 12 bahasa dan tata letak padat informasi seperti koran dan infografis, dan berbiaya 7 atau 13 kredit dibandingkan 5 untuk 3.0 standar.
Ya. Unggah foto, jelaskan perubahannya, dan model akan mengganti latar belakang, menambah atau menghapus objek, mengubah gaya bingkai, atau menulis ulang teks di dalamnya sambil mempertahankan sisanya. Di Ricebowl, 3.0 dan 3.0 Pro menerima hingga tiga gambar referensi.
Cukup cepat untuk iterasi dalam satu sesi; waktu tunggu bergantung pada versi dan ukuran yang Anda pilih. 3.0 standar pada 1K paling cepat; 3.0 Pro pada 2K dengan teks padat paling lama. Hasil muncul di feed Anda, jadi Anda bisa terus menulis prompt berikutnya selagi proses berjalan.
Prompt berfungsi dalam bahasa Inggris dan Mandarin di seluruh keluarga model. Untuk teks yang digambar di dalam gambar, daftar 3.0 Pro menyebut rendering asli di 12 bahasa.
Ricebowl tidak menerbitkan kunci API; Anda menggunakan model di browser dengan kredit. Platform API pihak ketiga menjual akses Qwen Image 3.0 per gambar, dan bobot Qwen Image asli terbuka untuk self-hosting.
Di sini, di Ricebowl. Generator di bagian atas halaman ini menjalankan Qwen Image 3.0 di browser Anda untuk membuat maupun menyunting, dengan kredit gratis saat mendaftar, dan Anda bisa membandingkannya dengan Seedream, FLUX.2, dan Z-Image Turbo pada prompt yang sama.
TERKAIT
MODEL LAINNYA
Teks yang terbaca dalam bahasa Mandarin dan lainnya, penyuntingan yang mempertahankan yang Anda suka, dan 5 kredit per gambar di Ricebowl.
Coba Qwen Image Gratis20 KREDIT GRATIS SAAT MENDAFTAR · MULAI 5 KREDIT PER GAMBAR · QWEN IMAGE 3.0 & PRO · 1K / 2K
Mulai Menggunakan Qwen Image
Coba Qwen Image Gratis