---
title: "Perombakan Harga dan Kecepatan OpenAI GPT-5.6 serta Strategi Pemilihan Model"
locale: id
category: ai_data
category_name: "Data AI"
translation_status: reviewed
license: cc_by
author: "injoys"
source_url: https://injoys.com/en/articles/openai-gpt-5-6-price-performance-model-routing
published_at: 2026-08-01T07:15:42+09:00
---

# Perombakan Harga dan Kecepatan OpenAI GPT-5.6 serta Strategi Pemilihan Model

> Mulai 30 Juli 2026, OpenAI menurunkan harga API GPT-5.6 Luna dan Terra masing-masing sebesar 80% dan 20%, serta memperkenalkan Fast mode pada Sol. Perombakan ini berfokus pada strategi menekan biaya per hasil dengan menempatkan model sesuai tahap perencanaan, eksekusi, dan verifikasi, alih-alih menggunakan model teratas untuk semua pekerjaan.

## Key Points

- Harga API GPT-5.6 Luna diturunkan menjadi 0.20 dolar per 1 juta token input dan 1.20 dolar per 1 juta token output.
- Harga API GPT-5.6 Terra diturunkan menjadi 2 dolar per 1 juta token input dan 12 dolar per 1 juta token output.
- Menurut pengumuman, Fast mode GPT-5.6 Sol hingga 2.5 kali lebih cepat daripada pemrosesan Standard, dengan harga 2 kali lipat, sekaligus mempertahankan tingkat kecerdasan model.
- Perusahaan dapat menerapkan konfigurasi berjenjang dengan Sol untuk pertimbangan dan perencanaan yang kompleks, serta Luna atau Terra untuk menangani eksekusi dan verifikasi berulang.
- OpenAI menjelaskan bahwa optimalisasi bersama atas model, infrastruktur penalaran, dan harness agen memungkinkan penurunan harga serta peningkatan throughput.

OpenAI menghubungkan peningkatan efisiensi operasional lini produk GPT-5.6 dengan penurunan harga API dan peningkatan kecepatan pemrosesan. Intinya bukan menerapkan satu model terkuat untuk semua pekerjaan, melainkan mengombinasikan Sol, Terra, dan Luna berdasarkan tingkat risiko, kompleksitas, latensi, serta keterverifikasian pekerjaan untuk menurunkan biaya per hasil.

Angka harga dan kinerja mengacu pada pengumuman OpenAI tanggal 30 Juli 2026. Tolok ukur pelanggan dan angka peningkatan efisiensi merupakan hasil pengukuran OpenAI atau perusahaan yang dikutip dalam pengumuman, sehingga tidak dapat dianggap akan direproduksi secara identik di semua lingkungan.

## Perubahan harga API pada 30 Juli 2026

Harga API GPT-5.6 Luna dan Terra yang telah diubah adalah sebagai berikut.

| Model | 1 juta token input | 1 juta token output | Besaran penurunan | Peran utama |
|---|---:|---:|---:|---|
| GPT-5.6 Luna | 0.20 dolar | 1.20 dolar | 80% | Pemrosesan massal, pekerjaan berulang, tugas eksekusi yang jelas |
| GPT-5.6 Terra | 2 dolar | 12 dolar | 20% | Pekerjaan sehari-hari yang memerlukan keseimbangan kualitas, biaya, dan kecepatan |
| GPT-5.6 Sol | Tidak berubah dalam pengumuman | Tidak berubah dalam pengumuman | Tidak ada | Penalaran kompleks, perencanaan, pengambilan keputusan penting |

Harga langganan berbayar ChatGPT dan Codex maupun keseluruhan anggaran kuota tidak berubah akibat pengumuman ini. Namun, kredit yang dikurangi saat menggunakan Terra dan Luna menjadi lebih sedikit. OpenAI menjelaskan bahwa perubahan harga melalui AWS akan diterapkan secara bertahap mulai akhir 30 Juli.

### Contoh perhitungan biaya API

Biaya token dapat dihitung sebagai berikut.

`Total biaya = jumlah token input ÷ 1,000,000 × tarif input + jumlah token output ÷ 1,000,000 × tarif output`

Sebagai contoh, jika memproses 10 juta token input dan 2 juta token output, biaya berdasarkan tarif token sederhana adalah sebagai berikut.

| Model | Biaya input | Biaya output | Total |
|---|---:|---:|---:|
| Luna | 2 dolar | 2.40 dolar | 4.40 dolar |
| Terra | 20 dolar | 24 dolar | 44 dolar |

Jumlah tagihan sebenarnya dapat dipengaruhi oleh ketentuan setiap layanan, seperti penerapan cache, metode pemrosesan yang dipilih, dan struktur pemanggilan alat.

## Peran lini produk GPT-5.6

GPT-5.6 bukan satu model tunggal, melainkan lini produk berjenjang dengan biaya dan kinerja yang berbeda.

### GPT-5.6 Sol

Sol menangani penalaran tingkat tertinggi dan penyelesaian masalah yang kompleks. Model ini cocok untuk keputusan dengan persyaratan ambigu atau biaya kegagalan tinggi, perencanaan jangka panjang, serta peninjauan hasil penting.

### GPT-5.6 Terra

Terra bertujuan menyeimbangkan kinerja, biaya, dan kecepatan respons. Model ini cocok untuk pekerjaan yang membutuhkan kemampuan penilaian lebih tinggi daripada Luna, tetapi tidak selalu perlu menggunakan Sol, seperti tanya jawab internal organisasi, tugas agen dengan cakupan tertentu, serta analisis dan coding umum.

### GPT-5.6 Luna

Luna adalah jenjang yang paling cepat dan murah. Selain pembuatan kalimat pendek yang sederhana, model ini mendukung pemanggilan alat dan alur kerja multilangkah, sehingga dapat digunakan sebagai model eksekusi untuk mengulangi pekerjaan yang didefinisikan dengan jelas dalam skala besar.

Contoh pekerjaan penerapannya adalah sebagai berikut.

- Klasifikasi dokumen dan pertanyaan pelanggan dalam jumlah besar
- Ekstraksi data terstruktur
- Modifikasi kode berulang
- Penulisan dan pelaksanaan pengujian
- Pembuatan dokumen dengan aturan yang jelas
- Peninjauan konten dalam skala besar
- Otomatisasi agen latar belakang
- Bantuan riset berulang

OpenAI mengklaim Luna memberikan tingkat kinerja yang serupa dengan model yang dinilai sebagai model mutakhir satu tahun lalu, dengan biaya sekitar 6% per pekerjaan yang diperkirakan dan kecepatan hampir 9 kali lipat. Angka 6% di sini bukan perbandingan langsung tarif token, melainkan nilai perbandingan perkiraan biaya untuk memperoleh hasil pekerjaan yang sama.

## Karakteristik Fast mode Sol

Fast mode untuk API diperkenalkan pada GPT-5.6 Sol. Mode ini menggantikan Priority Processing yang sudah ada dan merupakan konsep yang sepadan dengan fitur `/fast` pada Codex.

| Item | Fast mode |
|---|---|
| Kecepatan | Hingga 2.5 kali lebih cepat daripada pemrosesan Standard |
| Kecerdasan model | Sama dengan Standard menurut pengumuman OpenAI |
| Harga | 2 kali harga pemrosesan Standard |
| Kompatibilitas sebelumnya | Permintaan dengan tag `priority` diproses secara otomatis sebagai Fast mode |

Pernyataan hingga 2.5 kali lebih cepat pada Fast mode bukan jaminan bahwa latensi semua permintaan akan berkurang dengan rasio yang persis sama. Kecepatan yang benar-benar dirasakan dapat berbeda bergantung pada panjang prompt, panjang output, beban layanan, dan jumlah pemanggilan alat.

### Kondisi yang cocok untuk Fast mode

- Layanan waktu nyata ketika pengguna menunggu respons
- Lingkungan pengembangan yang mengulangi modifikasi dan pemeriksaan kode dengan cepat
- Pekerjaan ketika pemanggilan Sol menentukan latensi keseluruhan agen
- Situasi ketika keterlambatan beberapa menit pun penting, seperti respons insiden atau analisis gangguan
- Pekerjaan ketika biaya akibat keterlambatan pemrosesan lebih besar daripada biaya API tambahan

Untuk pekerjaan yang waktu penyelesaiannya tidak mendesak, seperti batch latar belakang, analisis malam hari, dan pemrosesan asinkron, pemrosesan Standard mungkin lebih ekonomis.

## Kriteria pemilihan model yang berorientasi pada hasil

Pemilihan model bukan sekadar memilih model dengan posisi tertinggi di papan peringkat. Pertanyaan berikut perlu ditinjau untuk setiap pekerjaan.

| Faktor penilaian | Pertanyaan yang perlu diperiksa |
|---|---|
| Dampak kegagalan | Apa dampak kesalahan terhadap pelanggan, pendapatan, keamanan, atau kepatuhan regulasi? |
| Toleransi kesalahan | Dapatkah manusia meninjau atau aturan otomatis mendeteksi kesalahan? |
| Latensi | Apakah pengguna menunggu secara waktu nyata, atau dapatkah diproses secara asinkron? |
| Volume pemrosesan | Berapa banyak kasus yang harus diproses per hari atau per bulan? |
| Kejelasan masalah | Apakah input, aturan, dan output yang diharapkan telah didefinisikan dengan memadai? |
| Nilai penalaran | Apakah penalaran yang lebih kuat benar-benar meningkatkan kualitas hasil secara signifikan? |
| Keterverifikasian | Dapatkah hasil dinilai melalui pengujian, skema, atau pemeriksaan silang? |

Pekerjaan yang jelas dan dapat diverifikasi secara otomatis kemungkinan besar cocok untuk Luna. Jika memerlukan kemampuan penilaian tertentu, Terra dapat dipertimbangkan. Sol cocok untuk mengatasi ambiguitas, mengambil keputusan berisiko tinggi, atau meninjau secara final konsekuensi kegagalan.

## Struktur perencanaan dengan Sol dan eksekusi dengan Luna

Dalam satu pekerjaan agen pun, model yang berbeda dapat ditempatkan pada setiap tahap. Sebagai contoh, agen coding dapat disusun sebagai berikut.

1. Sol menemukan ambiguitas persyaratan dan menyusun pertanyaan.
2. Sol menentukan rencana implementasi, cakupan perubahan, dan faktor risiko.
3. Luna mengimplementasikan perubahan yang telah diperjelas menjadi kode.
4. Luna menulis dan menjalankan pengujian.
5. Luna atau Terra mengevaluasi hasil pengujian dan perbedaan kode.
6. Sol meninjau kembali hanya kesimpulan penting atau yang memiliki kemungkinan kegagalan tinggi.

Struktur ini dapat menurunkan biaya dibandingkan penggunaan Sol pada semua tahap, sekaligus memusatkan kemampuan penalaran tinggi pada keputusan penting. Namun, jika model dipisahkan, aturan perutean, penanganan kesalahan, pelacakan log, dan sistem evaluasi harus dirancang secara terpisah.

## Tiga lapisan efisiensi yang mendukung penurunan harga

OpenAI menjelaskan bahwa penghematan biaya bukan sekadar kebijakan harga, melainkan berasal dari peningkatan teknis pada tiga lapisan.

1. Efisiensi token model itu sendiri
2. Efisiensi perangkat keras pada sistem inferensi
3. Efisiensi harness agen yang menghubungkan model, alat, dan konteks

Penjelasan ini didasarkan pada materi teknis yang dipublikasikan OpenAI, dan keseluruhan rincian struktur biaya tidak diungkapkan kepada publik. Karena itu, sulit untuk memastikan dari luar seberapa besar kontribusi efisiensi teknis dan kebijakan harga strategis terhadap penurunan harga.

## Optimalisasi model dan sistem inferensi

### Peningkatan jumlah pekerjaan per token

Menurut penjelasan OpenAI, GPT-5.6 dilatih untuk mengoptimalkan bukan hanya tingkat keberhasilan pekerjaan, tetapi juga efisiensi pemrosesan. Artinya, model ini dirancang untuk mengurangi penalaran atau pengulangan yang tidak perlu dan mencapai hasil yang dibutuhkan dengan lebih sedikit token, sehingga meningkatkan kecerdasan dan jumlah pekerjaan per token.

### Penyeimbangan beban dan perutean permintaan

Sistem inferensi mendistribusikan permintaan ke pusat data dan klaster berdasarkan wilayah, kapasitas yang tersedia, dan jenis akselerator. Di dalam klaster, instans model dipilih dengan mempertimbangkan beban saat ini, panjang konteks input, kemungkinan penggunaan cache, dan karakteristik permintaan.

OpenAI menyatakan telah menggunakan GPT-5.6 Sol dan Codex untuk menganalisis lalu lintas produksi, menelusuri penyebab ketidakseimbangan beban, menguji strategi perutean, dan menyesuaikan heuristik.

### Optimalisasi kernel GPU

Kernel GPU adalah kode inti yang menjalankan operasi matematis model pada perangkat keras. Biaya pemrosesan dapat berbeda bahkan pada GPU yang sama, bergantung pada perpindahan memori, sinkronisasi, susunan data, dan metode paralelisasi.

Menurut OpenAI, GPT-5.6 Sol berpartisipasi dalam penulisan dan optimalisasi kernel produksi menggunakan Triton dan Gluon di lingkungan Codex. Perusahaan menyatakan bahwa gabungan peningkatan kernel dan optimalisasi terkait menurunkan biaya menyeluruh penyediaan model sebesar 20%.

Biaya menyeluruh berarti biaya seluruh proses penanganan permintaan aktual, termasuk perutean, perpindahan data, eksekusi model, dan pembuatan output, bukan hanya satu operasi tertentu.

### Verifikasi akurasi kernel

Kernel yang cepat tidak dapat digunakan jika menghasilkan keluaran yang salah secara numerik. OpenAI menjelaskan bahwa perusahaan berinvestasi dalam alat verifikasi, termasuk FpSan, untuk memeriksa akurasi kernel yang ditulis AI. FpSan adalah singkatan dari Floating-Point Sanitizer, sebuah alat sumber terbuka untuk mendeteksi kesalahan terkait operasi bilangan floating-point.

Hal ini menunjukkan bahwa ketika AI menghasilkan kode infrastruktur produksi, diperlukan bukan hanya tolok ukur kinerja, tetapi juga verifikasi numerik, pengujian regresi, dan prosedur pemulihan saat terjadi kegagalan.

## Decoding spekulatif dan cache KV

### Decoding spekulatif

Decoding spekulatif adalah metode ketika model draf kecil terlebih dahulu mengusulkan token yang akan dihasilkan berikutnya, lalu model utama yang lebih besar memverifikasi beberapa kandidat secara paralel. Jika usulan diterima, jumlah komputasi sekuensial yang mahal pada model utama dapat dikurangi.

OpenAI menyatakan bahwa GPT-5.6 Sol merancang dan menjalankan ratusan eksperimen yang mengubah ukuran serta struktur model draf, lalu memantau pelatihannya. Hasilnya, efisiensi pembuatan token meningkat setidaknya 15%.

### Cache KV dan konfigurasi per beban kerja

Saat memproses input, model membuat cache Key-Value, yaitu cache KV. Konfigurasi optimal berbeda-beda bergantung pada panjang input dan output, ukuran batch, tingkat cache hit, jumlah permintaan simultan, kapasitas memori, serta metode sharding model.

OpenAI menjelaskan bahwa perusahaan menganalisis beban kerja aktual dengan Sol dan Codex, mengevaluasi kandidat konfigurasi, lalu menyempurnakan konfigurasi mesin berdasarkan jenis pekerjaan. Tujuannya adalah memproses lebih banyak permintaan pada perangkat keras yang sama.

## Harness agen dan biaya konteks

Agen memanggil model dan alat beberapa kali untuk menyelesaikan satu permintaan pengguna. Dalam pekerjaan yang membutuhkan 30 pemanggilan model, jika setiap pemanggilan mengalami latensi tidak perlu selama 1 detik, total latensi dapat bertambah sekitar 30 detik.

OpenAI menjelaskan lapisan orkestrasi berbasis Rust yang menghubungkan model, alat, dan lingkungan pengguna sebagai harness agen.

### Mengekspos hanya alat yang diperlukan secara tertunda

Jika informasi tentang alat, plugin, skill, dan integrasi MCP dimasukkan seluruhnya ke dalam prompt sejak awal, jumlah token input dan latensi akan meningkat. Harness menggunakan metode pencarian tertunda yang mengekspos informasi alat terkait hanya saat diperlukan. OpenAI menyatakan bahwa output alat secara default dibatasi hingga 10 ribu token, kecuali jika model meminta batas terpisah.

### Mempertahankan prefiks yang tepat dan cache prompt

Caching prompt menggunakan kembali bagian awal identik dari input yang sebelumnya telah diproses untuk mengurangi komputasi berulang. Agar cache dapat digunakan kembali, prefiks prompt harus sama persis.

Harness OpenAI mengelola riwayat dengan struktur append-only dan menambahkan pesan baru serta hasil alat di bagian akhir. Alat disajikan dalam urutan deterministik, sedangkan konfigurasi eksekusi seperti kebijakan persetujuan diterapkan saat runtime tanpa mengubah definisi alat itu sendiri. Metode ini bermanfaat untuk meningkatkan tingkat cache hit dalam loop agen berulang.

## Cara membaca angka studi kasus perusahaan

Pengumuman resmi OpenAI mencakup evaluasi dari Replit, Notion, Ramp, Blitzy, Cognition, Dust, dan lainnya.

- Notion menyatakan bahwa dalam evaluasi internalnya, Terra memberikan kualitas serupa dengan GPT-5.5 dengan setengah biaya per pekerjaan dan waktu 60% lebih singkat.
- Blitzy menjelaskan bahwa setelah menerapkan Luna, tingkat penggunaan kembali cache prompt meningkat dari 24% menjadi 90%, sedangkan biayanya 87% lebih rendah dibandingkan model default sebelumnya.
- Dust menyatakan bahwa untuk pekerjaan agen yang sama, Luna 40% lebih cepat dan 40% lebih murah dibandingkan model default sebelumnya.
- Ramp menyatakan bahwa pihaknya menggunakan Luna sebagai model default untuk otomatisasi agen latar belakang.

Angka-angka ini merupakan kasus yang diukur berdasarkan pekerjaan internal, prompt, kriteria evaluasi, dan struktur sistem masing-masing perusahaan. Karena bukan tolok ukur umum yang independen, angka tersebut tidak boleh diterapkan begitu saja pada pekerjaan organisasi lain. Sebelum penerapan, diperlukan evaluasi mandiri yang mencerminkan data aktual dan biaya kesalahan.

## Daftar periksa verifikasi sebelum penerapan

1. Siapkan sampel pekerjaan yang representatif beserta jawaban benar atau kriteria evaluasinya.
2. Bandingkan tingkat keberhasilan dan tingkat percobaan ulang Luna, Terra, dan Sol dalam kondisi yang sama.
3. Sertakan bukan hanya biaya token, tetapi juga pemanggilan alat, tenaga peninjau, dan biaya pemulihan kegagalan.
4. Ukur latensi persentil ke-95 atau ke-99 bersama dengan latensi rata-rata.
5. Klasifikasikan tahap yang memungkinkan pengujian otomatis atau validasi skema sebagai kandidat untuk model berbiaya rendah.
6. Terapkan kebijakan persetujuan dan pencatatan terpisah untuk pekerjaan yang berkaitan dengan informasi pribadi, keamanan, dan regulasi.
7. Tetapkan kriteria perutean untuk meningkatkan hasil dengan tingkat kepercayaan rendah ke Terra atau Sol.
8. Verifikasi dengan lalu lintas aktual apakah nilai pengurangan latensi lebih besar daripada biaya tambahan Fast mode.

## Makna dan keterbatasan

Perombakan ini menunjukkan bahwa tolok ukur persaingan model AI sedang bergeser dari satu skor tertinggi menuju biaya per hasil. Dengan menempatkan Luna untuk pekerjaan berulang dalam skala besar, Terra untuk pekerjaan pengetahuan sehari-hari, dan Sol untuk keputusan yang ambigu serta penting, kecerdasan, kecepatan, dan biaya dapat dikombinasikan sesuai jenis pekerjaan.

Namun, berdasarkan informasi yang dipublikasikan saja, sulit memisahkan seberapa besar penurunan harga sebesar 80% berasal dari peningkatan efisiensi teknis dan seberapa besar berasal dari strategi pasar. Selain itu, keekonomisan model berbiaya rendah tidak hanya ditentukan oleh harga token. Jika tingkat kesalahan tinggi sehingga percobaan ulang dan peninjauan manusia meningkat, total biaya pekerjaan dapat naik.

Karena itu, metrik utamanya bukan harga satu kali pemanggilan model, melainkan total biaya untuk menghasilkan satu hasil yang lolos verifikasi. Tingkat keberhasilan setiap model, jumlah percobaan ulang, latensi, dan biaya peninjauan harus diukur bersama-sama untuk menilai apakah penurunan harga GPT-5.6 benar-benar menghasilkan nilai bisnis.

## FAQ

### Berapa harga API GPT-5.6 Luna yang telah diubah?
Per 30 Juli 2026, harga Luna adalah 0,20 dolar per 1 juta token input dan 1,20 dolar per 1 juta token output. Besaran penurunan dibandingkan harga sebelumnya yang diumumkan OpenAI adalah 80%.

### Berapa harga API GPT-5.6 Terra yang telah diubah?
Harga Terra adalah 2 dolar per 1 juta token input dan 12 dolar per 1 juta token output. Besaran penurunan harga yang diumumkan OpenAI adalah 20%.

### Apakah harga GPT-5.6 Sol juga diturunkan?
Tidak. Dalam pengumuman OpenAI kali ini, harga pemrosesan Standard untuk Sol tidak berubah. Sebagai gantinya, Fast mode ditambahkan, yang hingga 2,5 kali lebih cepat daripada Standard dan harganya 2 kali lipat.

### Apakah kualitas jawaban model menurun jika menggunakan Fast mode?
OpenAI menjelaskan bahwa Fast mode meningkatkan kecepatan pemrosesan tanpa menurunkan tingkat kecerdasan Sol. Namun, kecepatan hingga 2,5 kali merupakan batas atas, dan latensi aktual dapat berbeda tergantung pada panjang permintaan, jumlah output, pemanggilan alat, dan beban sistem.

### Apakah permintaan Priority Processing yang sudah ada perlu diubah?
Menurut pengumuman OpenAI, tag `priority` pada permintaan API yang sudah ada akan terus berfungsi dan secara otomatis terhubung ke pemrosesan Fast mode. Dalam lingkungan operasional, lebih aman untuk memeriksa secara terpisah waktu penerapan dan detail tagihan aktual.

### Untuk pekerjaan apa penggunaan Luna cocok?
Luna cocok untuk pekerjaan bervolume besar dan berulang dengan aturan serta output yang diharapkan jelas dan dapat diverifikasi secara otomatis. Contoh utamanya adalah klasifikasi dokumen, ekstraksi data, modifikasi kode berulang, pelaksanaan pengujian, peninjauan konten, dan otomatisasi latar belakang.

### Model mana yang sebaiknya dipilih antara Terra dan Luna?
Jika biaya rendah dan throughput tinggi menjadi prioritas serta pekerjaannya jelas, Luna dapat dievaluasi terlebih dahulu. Jika diperlukan pemahaman konteks dan kemampuan penilaian yang lebih tinggi, tetapi tidak memerlukan penalaran tingkat lanjut setara Sol, Terra mungkin cocok.

### Apakah Sol tidak boleh digunakan untuk semua tahap agen?
Sol dapat digunakan, tetapi efisiensi biayanya dapat menurun. Dengan memisahkan tugas sehingga Sol menangani perencanaan dan penilaian berisiko tinggi, sedangkan Luna atau Terra menangani pelaksanaan dan pengujian yang jelas, ada kemungkinan untuk mengurangi biaya keseluruhan sambil mempertahankan kualitas pada tahap-tahap penting.

### Apakah biaya pekerjaan Luna sebesar 6% merupakan perbandingan harga per token?
Tidak. Sekitar 6% yang disebutkan OpenAI adalah estimasi biaya per pekerjaan yang diperlukan untuk memperoleh hasil pekerjaan serupa dengan pembanding. Angka ini bukan hasil pembagian langsung harga per token saja dan harus dipahami sebagai perbandingan yang mencakup tugas evaluasi dan tingkat keberhasilan.

### Bagaimana cara menilai keekonomisan aktual model API?
Penilaian harus mencakup bukan hanya harga token, tetapi juga tingkat keberhasilan, jumlah percobaan ulang, biaya pemanggilan alat, latensi respons, waktu peninjauan manusia, dan biaya pemulihan kesalahan. Metrik yang paling berguna adalah total biaya per satu hasil yang lolos verifikasi.

## Sources

- [Memajukan batas terdepan antara harga dan performa dengan GPT-5.6 | OpenAI](https://openai.com/index/advancing-the-price-performance-frontier-with-gpt-5-6/)
- [Bagaimana GPT-5.6 memadukan kecerdasan terdepan dengan efisiensi terdepan | OpenAI](https://openai.com/index/gpt-5-6-frontier-intelligence-efficiency/)

## Images

![Alur pemilihan model dengan puzzle, chip AI bertingkat, konveyor tugas, dan tumpukan koin yang menyusut](https://injoys.com/rails/active_storage/blobs/proxy/eyJfcmFpbHMiOnsiZGF0YSI6NDY2OSwicHVyIjoiYmxvYl9pZCJ9fQ==--5c50f46b468b0057808eb3e6351730cbce2f4b78/ai-4f6037ef.webp)
![Infografik perbandingan alur, kecepatan, biaya, dan infrastruktur perangkat keras model AI](https://injoys.com/rails/active_storage/blobs/proxy/eyJfcmFpbHMiOnsiZGF0YSI6NDY3NSwicHVyIjoiYmxvYl9pZCJ9fQ==--920476799a53738205d619a3a057685b5af9d05d/ai-334533bc.webp)