# Pilih model berdasarkan bukti

Taiga Learning · Lembar kerja
https://taiga.training/id/lessons/evaluate-models/

Gunakan informasi fiktif atau yang disetujui. Jangan masukkan secret dalam lembar kerja ini.

## Tujuan pembelajaran
- Buat kumpulan evaluasi kecil dari jenis tugas yang benar-benar dikerjakan.
- Pisahkan kualitas model dari pengaruh alat dan konteks.
- Catat kondisi yang mengharuskan evaluasi ulang.

## Latihan
Buat lembar evaluasi untuk tiga jenis tugas: cacat yang sudah diketahui, fitur kecil, dan penjelasan repositori. Tetapkan kriteria penerimaan sebelum membandingkan model. Sertakan satu kasus kegagalan untuk setiap tugas. Catat versi model, konteks, izin alat, jumlah percobaan, biaya, dan upaya peninjauan.

## Jawaban Anda
- Skenario dan cakupan:
- Asumsi dan pertanyaan yang belum terjawab:
- Jawaban atau keputusan yang diusulkan, beserta alasan:

## Verifikasi jawaban Anda
| Klaim atau kriteria | Bukti atau pengujian | Hasil atau kekurangan | Penanggung jawab |
| --- | --- | --- | --- |
| | | | |
| | | | |
| | | | |

## Tindakan berikutnya
- Tindakan, penanggung jawab, dan tanggal:
- Kapan Anda akan meninjau jawaban ini?

## Prinsip yang perlu dipertahankan
Pilih model untuk tugas dan lingkungan tertentu. Periksa kembali keputusan ketika model, alat, atau persyaratan berubah.

## Sumber
- [NIST: Generative AI Profile](https://doi.org/10.6028/NIST.AI.600-1)
- [METR: Developer productivity study methodology](https://metr.org/blog/2025-07-10-early-2025-ai-experienced-os-dev-study/)

Lembar kerja ini mendukung pembelajaran. Menyelesaikannya tidak dengan sendirinya mengizinkan perubahan produksi.
