Halaman ini diterjemahkan oleh Cloud Translation API.

Penyesuaian gambar

Halaman ini memberikan prasyarat dan petunjuk mendetail untuk meningkatkan kualitas Gemini pada data gambar menggunakan pembelajaran dengan pengawasan.

Kasus penggunaan

Dengan fine-tuning, Anda dapat menyesuaikan model Gemini dasar untuk tugas khusus. Berikut beberapa kasus penggunaan gambar:

Peningkatan kualitas katalog produk: Mengekstrak atribut utama dari gambar (misalnya, merek, warna, ukuran) untuk membuat dan memperkaya katalog produk Anda secara otomatis.
Moderasi gambar: Menyesuaikan model untuk mendeteksi dan melaporkan konten yang tidak pantas atau berbahaya dalam gambar, sehingga memastikan pengalaman online yang lebih aman.
Pemeriksaan visual: Melatih model untuk mengidentifikasi objek atau kerusakan tertentu dalam gambar, yang mengotomatiskan proses pemeriksaan atau kontrol kualitas.
Klasifikasi gambar: Meningkatkan akurasi klasifikasi gambar untuk domain tertentu, seperti medical imaging atau analisis citra satelit.
Rekomendasi berbasis gambar: Menganalisis gambar untuk memberikan rekomendasi yang dipersonalisasi, seperti menyarankan produk serupa atau item pelengkap.
Ekstraksi konten tabel: Mengekstrak data dari tabel dalam gambar dan mengonversinya menjadi format terstruktur seperti spreadsheet atau database.

Batasan

Gambar maksimum per contoh: 30
Ukuran file gambar maksimum: 20 MB

Untuk mempelajari persyaratan sampel gambar lebih lanjut, lihat halaman Pemahaman gambar.

Format set data

fileUri untuk set data Anda dapat berupa URI untuk file di bucket Cloud Storage, atau dapat berupa URL HTTP atau HTTPS yang tersedia secara publik.

Untuk melihat contoh format generik, lihat Contoh set data untuk Gemini.

Berikut adalah contoh set data gambar.

{
  "contents": [
    {
      "role": "user",
      "parts": [
        {
          "fileData": {
            "mimeType": "image/jpeg",
            "fileUri": "gs://cloud-samples-data/ai-platform/generative_ai/gemini-2_0/image/longcap100/100.jpeg"
            }
        }, 
        {
          "text": "Describe this image in detail that captures the essence of it."
        }
      ]
    }, 
    {
      "role": "model",
      "parts": [
        {
          "text": "A man stands on a road, wearing a blue denim jacket, tan pants, and white sneakers. He has his hands in his pockets and is wearing a white t-shirt under his jacket. The man's pants are cuffed, and his shoes are white. The road is dark grey, and the leaves are green. The man is standing in the shade, and the light is shining on the ground."
        }
      ]
    }
  ]
}

Contoh set data

Anda dapat menggunakan set data contoh berikut untuk mempelajari cara menyesuaikan model Gemini. Untuk menggunakan set data ini, tentukan URI dalam parameter yang berlaku saat membuat tugas penyesuaian yang diawasi model teks.

Untuk menggunakan set data penyesuaian sampel, tentukan lokasinya sebagai berikut:

"training_dataset_uri": "gs://cloud-samples-data/ai-platform/generative_ai/gemini-2_0/image/sft_train_data.jsonl",

Untuk menggunakan set data validasi contoh, tentukan lokasinya sebagai berikut:

"validation_dataset_uri": "gs://cloud-samples-data/ai-platform/generative_ai/gemini-2_0/image/sft_validation_data.jsonl",

Langkah berikutnya

Untuk mempelajari lebih lanjut kemampuan pemahaman gambar Gemini, lihat dokumentasi Pemahaman gambar kami.
Untuk mulai menyesuaikan, lihat Menyesuaikan model Gemini menggunakan fine-tuning yang diawasi
Untuk mempelajari cara penyesuaian tersupervisi dapat digunakan dalam solusi yang membuat pusat informasi AI generatif, lihat Solusi Praktis: Pusat informasi AI generatif.

Penyesuaian gambar Tetap teratur dengan koleksi Simpan dan kategorikan konten berdasarkan preferensi Anda.