Generasi Media 🇷🇺 02.08.2026 04:01

Cara Saya Mengotomatiskan Pembuatan Stiker Media Sosial: Melatih LoRA Gaya Secara Lokal untuk SD 1.5 pada 30 Gambar

Stability AIStability AI Google/DeepMindGoogle/DeepMind OpenAIOpenAI SalesforceSalesforce
Seorang penggemar membangun pipeline terkontrol untuk melatih LoRA gaya pada Stable Diffusion 1.5 menggunakan 30 stiker VK yang dipilih sendiri, bertujuan menciptakan persiapan paket stiker yang konsisten. Mereka menggunakan token pemicu khusus 'vkstckrs' dan mengotomatiskan penggantian latar belakang serta pembuatan caption dengan skrip Python yang dihasilkan AI dari Gemini 3.1 Pro dan ChatGPT 5.6.
Penulis menghadapi masalah bahwa menghasilkan ilustrasi yang konsisten untuk paket stiker dengan rekayasa prompt itu sulit, sehingga mereka memutuskan untuk melatih LoRA gaya pada Stable Diffusion 1.5. SD 1.5 dipilih karena kebutuhan perangkat kerasnya yang rendah dan ekosistemnya yang luas, meskipun keterbatasannya dalam memahami deskripsi yang kompleks. Dataset terdiri dari 30 stiker yang dipilih secara manual dari stickersvk.com, dengan satu stiker per paket untuk menghindari model menghafal karakter atau penulis tertentu; gambar dengan teks, pose yang kompleks, atau gaya yang menyimpang dikeluarkan. Mereka menggunakan token pemicu 'vkstckrs' untuk mengaktifkan fitur yang dipelajari selama pembuatan. Gemini 3.1 Pro menulis skrip Python untuk mengganti latar belakang transparan dengan putih dan menyimpannya sebagai JPG, sementara ChatGPT 5.6 menghasilkan keterangan menggunakan BLIP, model pemberi keterangan gambar yang telah dilatih sebelumnya. Penulis menekankan bahwa model dilatih hanya untuk tujuan pendidikan, gambar dihapus setelah pelatihan, dan tidak ada penggunaan komersial yang dimaksudkan.
Sumber: Habr — хаб ИИ — asli
Postingan kami sebelumnya tentang topik ini ↓
Berita terbaru