Terjemahan disediakan oleh mesin penerjemah. Jika konten terjemahan yang diberikan bertentangan dengan versi bahasa Inggris aslinya, utamakan versi bahasa Inggris.
Model Pembuat Gambar Amazon Titan G1
Amazon Titan Image Generator G1 adalah model pembuatan gambar yang memungkinkan pengguna menghasilkan dan mengedit gambar dengan cara serbaguna. Pengguna dapat membuat gambar yang sesuai dengan deskripsi berbasis teks mereka hanya dengan memasukkan petunjuk bahasa alami. Selain itu, mereka dapat mengunggah dan mengedit gambar yang ada, termasuk menerapkan petunjuk berbasis teks tanpa perlu topeng, atau mengedit bagian tertentu dari gambar menggunakan topeng gambar. Model ini juga mendukung pengecatan, yang memperluas batas gambar, dan inpainting, yang mengisi area yang hilang. Ini menawarkan kemampuan untuk menghasilkan variasi gambar berdasarkan prompt teks opsional, serta opsi penyesuaian instan yang memungkinkan pengguna untuk mentransfer gaya menggunakan gambar referensi atau menggabungkan gaya dari beberapa referensi, semua tanpa memerlukan penyempurnaan.
Amazon Titan Image Generator G1 v2 menambahkan beberapa kemampuan canggih. Ini memungkinkan pengguna untuk menggunakan gambar referensi untuk memandu pembuatan gambar, di mana gambar output sejajar dengan tata letak dan komposisi gambar referensi sambil tetap mengikuti prompt tekstual. Ini juga termasuk fitur penghapusan latar belakang otomatis, yang dapat menghapus latar belakang dari gambar yang berisi banyak objek tanpa input pengguna. Model ini memberikan kontrol yang tepat atas palet warna gambar yang dihasilkan, memungkinkan pengguna untuk mempertahankan identitas visual merek tanpa persyaratan untuk penyempurnaan tambahan. Selain itu, fitur konsistensi subjek memungkinkan pengguna untuk menyempurnakan model dengan gambar referensi untuk mempertahankan subjek yang dipilih (misalnya, hewan peliharaan, sepatu, atau tas tangan) dalam gambar yang dihasilkan. Rangkaian fitur komprehensif ini memberdayakan pengguna untuk melepaskan potensi kreatif mereka dan mewujudkan visi imajinatif mereka.
Untuk informasi selengkapnya tentang pedoman rekayasa prompt model Amazon Titan Image Generator G1, lihat Praktik Terbaik Rekayasa Prompt Generator Gambar Amazon Titan.
Untuk terus mendukung praktik terbaik dalam penggunaan AI yang bertanggung jawab, Titan Foundation Models (FM) dibangun untuk mendeteksi dan menghapus konten berbahaya dalam data, menolak konten yang tidak pantas dalam input pengguna, dan menyaring keluaran model yang mengandung konten yang tidak pantas (seperti ujaran kebencian, kata-kata kotor, dan kekerasan). Titan Image Generator FM menambahkan tanda air yang tidak terlihat dan metadata
Anda dapat menggunakan fitur deteksi tanda air di konsol Amazon Bedrock atau memanggil API deteksi tanda air Amazon Bedrock (pratinjau) untuk memeriksa apakah gambar berisi tanda air dari Titan Image Generator. Anda juga dapat menggunakan situs seperti Veri fikasi Kredensi Konten
Ikh tisar Amazon Titan Image Generator v2
Model ID —
amazon.titan-image-generator-v2:0Maks karakter masukan - 512 karakter
Ukuran gambar input maksimal - 5 MB (hanya beberapa resolusi tertentu yang didukung)
Ukuran gambar maksimal menggunakan in/outpainting, penghapusan latar belakang, pengkondisian gambar, palet warna - 1,408 x 1,408 px
Ukuran gambar maksimal menggunakan variasi gambar - 1,408 x 1,408 px (gambar input diubah ukurannya agar sesuai dengan batas ini)
Bahasa - Bahasa Inggris
Jenis keluaran - gambar
Jenis gambar yang didukung - JPEG, JPG, PNG
Jenis inferensi — On-Demand, Throughput yang Disediakan
Kasus penggunaan yang didukung - pembuatan gambar, pengeditan gambar, variasi gambar, penghapusan latar belakang, konten yang dipandu warna
Fitur
-
Text-to-image Generasi (T2I) - Masukkan prompt teks dan buat gambar baru sebagai output. Gambar yang dihasilkan menangkap konsep yang dijelaskan oleh prompt teks.
-
Finetuning model T2I — Impor beberapa gambar untuk menangkap gaya dan personalisasi Anda sendiri dan kemudian menyempurnakan model inti T2I. Model yang disetel dengan baik menghasilkan gambar yang mengikuti gaya dan personalisasi pengguna tertentu.
-
Opsi pengeditan gambar - termasuk: mengecat, mengecat, menghasilkan variasi, dan pengeditan otomatis tanpa topeng gambar.
-
Inpainting — Menggunakan gambar dan topeng segmentasi sebagai input (baik dari pengguna atau diperkirakan oleh model) dan merekonstruksi wilayah di dalam topeng. Gunakan inpainting untuk menghapus elemen bertopeng dan menggantinya dengan piksel latar belakang.
-
Outpainting — Menggunakan gambar dan topeng segmentasi sebagai input (baik dari pengguna atau diperkirakan oleh model) dan menghasilkan piksel baru yang memperluas wilayah dengan mulus. Gunakan pengecatan yang tepat untuk mempertahankan piksel gambar bertopeng saat memperluas gambar ke batas. Gunakan pengecatan default untuk memperluas piksel gambar bertopeng ke batas gambar berdasarkan pengaturan segmentasi.
-
Variasi gambar — Menggunakan 1 hingga 5 gambar dan prompt opsional sebagai input. Ini menghasilkan gambar baru yang mempertahankan konten gambar input, tetapi memvariasikan gaya dan latar belakangnya.
-
Pengkondisian gambar — (Hanya V2) Menggunakan gambar referensi input untuk memandu pembuatan gambar. Model menghasilkan gambar keluaran yang selaras dengan tata letak dan komposisi gambar referensi, sambil tetap mengikuti prompt tekstual.
-
Konsistensi subjek — (khusus V2) Konsistensi subjek memungkinkan pengguna untuk menyempurnakan model dengan gambar referensi untuk mempertahankan subjek yang dipilih (misalnya, hewan peliharaan, sepatu, atau tas tangan) dalam gambar yang dihasilkan.
-
Konten yang dipandu warna - (Hanya V2) Anda dapat memberikan daftar kode warna hex bersama dengan prompt. Kisaran 1 hingga 10 kode hex dapat disediakan. Gambar yang dikembalikan oleh Titan Image Generator G1 V2 akan menggabungkan palet warna yang disediakan oleh pengguna.
-
Penghapusan latar belakang - (Hanya V2) Secara otomatis mengidentifikasi beberapa objek dalam gambar input dan menghapus latar belakang. Gambar output memiliki latar belakang transparan.
-
Asal konten — Gunakan situs seperti Veri fikasi Kredensi
Konten untuk memeriksa apakah gambar dihasilkan oleh Titan Image Generator. Ini harus menunjukkan gambar dihasilkan kecuali metadata telah dihapus.
catatan
jika Anda menggunakan model yang disetel dengan baik, Anda tidak dapat menggunakan fitur inpainting, outpainting atau palet warna dari API atau model.
Parameter
Untuk informasi tentang parameter inferensi model Amazon Amazon Titan Image Generator G1, lihat parameter inferensi model Amazon Titan Image Generator G1.
Fine-tuning
Untuk informasi lebih lanjut tentang menyempurnakan model Amazon Titan Image Generator G1, lihat halaman berikut.
Penyetelan dan harga model Amazon Titan Image Generator G1
Model menggunakan rumus contoh berikut untuk menghitung harga total per pekerjaan:
Harga Total = Langkah-langkah * Ukuran batch * Harga per gambar yang terlihat
Nilai minimum (otomatis):
-
Langkah minimum (otomatis) - 500
-
Ukuran batch minimum - 8
-
Tingkat pembelajaran default - 0,00001
-
Harga per gambar yang terlihat - 0.005
Fine-tuning pengaturan hyperparameter
Langkah — Jumlah kali model diekspos ke setiap batch. Tidak ada set jumlah langkah default. Anda harus memilih angka antara 10 - 40.000, atau nilai String “Auto.”
Pengaturan langkah - Otom atis - Amazon Bedrock menentukan nilai yang wajar berdasarkan informasi pelatihan. Pilih opsi ini untuk memprioritaskan kinerja model daripada biaya pelatihan. Jumlah langkah ditentukan secara otomatis. Jumlah ini biasanya antara 1.000 dan 8.000 berdasarkan dataset Anda. Biaya pekerjaan dipengaruhi oleh jumlah langkah yang digunakan untuk mengekspos model ke data. Lihat bagian contoh harga pada detail harga untuk memahami bagaimana biaya pekerjaan dihitung. (Lihat contoh tabel di atas untuk melihat bagaimana jumlah langkah terkait dengan jumlah gambar saat Otomatis dipilih.)
Pengaturan langkah - Kustom - Anda dapat memasukkan jumlah langkah yang Anda inginkan Bedrock untuk mengekspos model kustom Anda ke data pelatihan. Nilai ini bisa antara 10 dan 40.000. Anda dapat mengurangi biaya per gambar yang dihasilkan oleh model dengan menggunakan nilai jumlah langkah yang lebih rendah.
Ukuran batch — Jumlah sampel yang diproses sebelum parameter model diperbarui. Nilai ini antara 8 dan 192 dan merupakan kelipatan dari 8.
Tingkat pembelajaran — Tingkat di mana parameter model diperbarui setelah setiap batch data pelatihan. Ini adalah nilai float antara 0 dan 1. Tingkat pembelajaran diatur ke 0,00001 secara default.
Untuk informasi selengkapnya tentang prosedur penyempurnaan, lihat Mengi rimkan pekerjaan kustomisasi model.
Output
Model Amazon Titan Image Generator G1 menggunakan ukuran dan kualitas gambar keluaran untuk menentukan harga gambar. Model ini memiliki dua segmen harga berdasarkan ukuran: satu untuk 512* 512 gambar dan satu lagi untuk gambar 1024* 1024. Harga didasarkan pada ukuran gambar tinggi* lebar, kurang dari atau sama dengan 512* 512 atau lebih besar dari 512* 512.
Untuk informasi selengkapnya tentang harga Amazon Bedrock, lihat Harga Amazon Bedrock.
Deteksi tanda air
catatan
Deteksi tanda air untuk konsol dan API Amazon Bedrock tersedia dalam rilis pratinjau publik dan akan mendeteksi tanda air yang dihasilkan dari Titan Image Generator G1 dan Canvas. Amazon Nova Fitur ini saat ini hanya tersedia di us-west-2 dan Wil us-east-1 ayah. Deteksi tanda air adalah deteksi tanda air yang sangat akurat yang dihasilkan oleh model ini. Gambar yang dimodifikasi dari gambar asli dapat menghasilkan hasil deteksi yang kurang akurat.
Model-model ini menambahkan tanda air tak terlihat ke semua gambar yang dihasilkan untuk mengurangi penyebaran informasi yang salah, membantu perlindungan hak cipta, dan melacak penggunaan konten. Deteksi tanda air tersedia untuk membantu Anda mengonfirmasi apakah gambar dihasilkan oleh Titan Image Generator G1 atau Amazon Nova Canvas, yang memeriksa keberadaan tanda air ini.
catatan
API Deteksi Tanda Air ada dalam pratinjau dan dapat berubah. Kami menyarankan Anda membuat lingkungan virtual untuk menggunakan SDK. Karena API deteksi tanda air tidak tersedia di SDK terbaru, sebaiknya Anda menghapus versi terbaru SDK dari lingkungan virtual sebelum menginstal versi dengan API deteksi tanda air.
Anda dapat mengunggah gambar Anda untuk mendeteksi apakah tanda air dari Titan Image Generator G1 atau Amazon Nova Canvas ada pada gambar. Gunakan konsol untuk mendeteksi tanda air dengan mengikuti langkah-langkah berikut.
Untuk mendeteksi tanda air:
Buka konsol Amazon Bedrock di konsol Amazon Bedrock
-
Pilih I khtisar dari panel navigasi di Amazon Bedrock. Pilih tab Build and Test.
-
Di bagian Pengawasan, buka deteksi tanda air dan pilih Lihat deteksi tanda air.
-
Pilih Unggah gambar dan cari file yang dalam format JPG atau PNG. Ukuran file maksimum yang diizinkan adalah 18 MB.
-
Setelah diunggah, thumbnail gambar ditampilkan dengan nama, ukuran file, dan tanggal terakhir diubah. Pilih X untuk menghapus atau mengganti gambar dari bagian Unggah.
-
Pilih Analisis untuk memulai analisis deteksi tanda air.
-
Gambar dipratinjau di bawah Hasil, dan menunjukkan apakah tanda air terdeteksi dengan Watermark terdeteksi di bawah gambar dan spanduk di seluruh gambar. Jika tidak ada tanda air yang terdeteksi, teks di bawah gambar akan mengatakan Watermark TIDAK terdeteksi.
-
Untuk memuat gambar berikutnya, pilih X di thumbnail gambar di bagian Unggah dan pilih gambar baru untuk dianalisis.
Pedoman Rekayasa yang Cepat
Prompt topeng — Algoritma ini mengklasifikasikan piksel menjadi konsep. Pengguna dapat memberikan prompt teks yang akan digunakan untuk mengklasifikasikan area gambar untuk ditutupi, berdasarkan interpretasi prompt topeng. Opsi prompt dapat menafsirkan prompt yang lebih kompleks, dan menyandikan topeng ke dalam algoritma segmentasi.
Image mask — Anda juga dapat menggunakan image mask untuk mengatur nilai topeng. Masker gambar dapat dikombinasikan dengan input yang cepat untuk masker untuk meningkatkan akurasi. File image mask harus sesuai dengan parameter berikut:
-
Nilai gambar topeng harus 0 (hitam) atau 255 (putih) untuk gambar topeng. Area topeng gambar dengan nilai 0 akan diregenerasi dengan gambar dari gambar and/or input prompt pengguna.
-
Bid
maskImageang harus berupa string gambar yang dikodekan base64. -
Gambar topeng harus memiliki dimensi yang sama dengan gambar input (tinggi dan lebar yang sama).
-
Hanya file PNG atau JPG yang dapat digunakan untuk gambar input dan gambar topeng.
-
Gambar topeng hanya boleh menggunakan nilai piksel hitam putih.
-
Gambar topeng hanya dapat menggunakan saluran RGB (saluran alfa tidak didukung).
Untuk informasi selengkapnya tentang rekayasa prompt Amazon Titan Image Generator, lihat Amazon Titan Image Generator G1 model Prompt Engineering Best Practices
Untuk pedoman rekayasa cepat umum, lihat Pedoman Rekayasa Prompt.