Back to all posts

GPT-5.6 kini terintegrasi ke dalam Zero

GPT-5.6 kini terintegrasi ke dalam Zero sebagai keluarga tiga model: Sol untuk pekerjaan multi-agen paling berat, Terra untuk eksekusi harian yang seimbang, dan Luna untuk alur kerja cepat bervolume tinggi.

Bagi tim yang mengarahkan beragam beban kerja agen, ini bisa lebih berguna daripada satu model unggulan baru. Alih-alih membayar untuk penalaran maksimal di setiap langkah, Anda dapat menyesuaikan model dengan tugasnya sambil mempertahankan lingkungan Zero yang sama di sekelilingnya: alat yang terhubung, berkas, akses peramban, eksekusi terisolasi, keterampilan, dan tindak lanjut hingga tuntas.

Pilih rute Built-in dan VM0 mengelola akses model serta menagih penggunaan dalam bentuk kredit. Jika tim Anda sudah menggunakan kunci API OpenAI atau langganan ChatGPT/Codex, Zero juga mendukung rute-rute tersebut.

Satu keluarga, tiga titik operasi

OpenAI merancang GPT-5.6 berdasarkan tingkatan kemampuan yang tahan lama. Angkanya menunjukkan generasi; Sol, Terra, dan Luna menggambarkan kompromi antara kecerdasan, kecepatan, dan biaya.

Perbandingan GPT-5.6 Sol, Terra, dan Luna berdasarkan penggunaan terbaik, penalaran, keunggulan, konteks, tingkat VM0, dan harga daftar OpenAI

GPT-5.6 Sol: pekerjaan tersulit

Sol adalah model unggulan. Andalkan model ini ketika sebuah tugas cukup sulit sehingga rencana yang lebih baik, pemeriksaan yang lebih banyak, atau pekerjaan paralel dapat mengubah hasil secara signifikan.

Integrasi GPT-5.6 Sol di Zero menggunakan penalaran Ultra secara bawaan. OpenAI menggambarkan Ultra sebagai pengoordinasian empat agen secara paralel, lalu menyintesis hasil kerja mereka. Hal ini membuat Sol sangat cocok untuk penugasan dengan beberapa alur kerja independen, seperti:

  • Memigrasikan basis kode besar sembari menguji kompatibilitas dan mendokumentasikan hasilnya.
  • Meneliti sebuah pasar dari banyak sumber, menantang temuan-temuannya, dan menghasilkan ringkasan yang siap dijadikan dasar keputusan.
  • Mengubah brief produk menjadi antarmuka yang rapi, memeriksa hasil render, dan memperbaiki masalah visual atau fungsional.
  • Menyelidiki insiden produksi lewat log, kode, tiket, dan status peramban sebelum mengusulkan perbaikan.

Sol berada di tingkat VM0 Built-in $$$. Gunakan pada situasi ketika salah langkah berbiaya mahal, bukan untuk setiap balasan singkat.

GPT-5.6 Terra: kuda beban yang seimbang

Terra adalah titik awal yang masuk akal untuk pekerjaan profesional yang berulang. OpenAI memposisikannya sebagai tingkat yang seimbang dan melaporkan kinerja yang kompetitif dengan GPT-5.5 pada separuh harga daftar per token API.

Gunakan Terra untuk pekerjaan yang masih membutuhkan penalaran dan penggunaan alat tetapi tidak memerlukan komputasi maksimal Sol:

  • Riset harian, pemantauan pesaing, dan ringkasan multisumber.
  • Perubahan kode rutin, analisis pull request, dan investigasi masalah.
  • Penyusunan laporan, rencana peluncuran, ringkasan pelanggan, dan dokumen operasional.
  • Alur kerja agen yang membutuhkan penanganan konteks panjang yang kuat dengan biaya lebih moderat.

Terra berada di tingkat VM0 Built-in $$. Model ini tidak dipaksakan sebagai bawaan universal; ia hanyalah tingkat yang akan kami uji lebih dulu untuk banyak alur kerja serbaguna.

GPT-5.6 Luna: kecepatan dan volume

Luna adalah anggota keluarga yang paling cepat dan paling terjangkau. Model ini dibuat untuk pekerjaan yang lebih mengutamakan throughput dan waktu respons daripada kedalaman maksimal.

Beban kerja yang cocok untuk Luna mencakup:

  • Mengklasifikasikan atau mengarahkan tiket, prospek, atau pesan dalam jumlah besar.
  • Mengekstraksi bidang terstruktur dari dokumen yang konsisten.
  • Menjalankan triase awal sebelum menaikkan kasus ambigu ke Terra atau Sol.
  • Menghasilkan ringkasan singkat atau transformasi dalam volume tinggi.

Luna berada di tingkat VM0 Built-in $. Ia bukan pilihan tepat untuk setiap tugas murah: evaluasi konteks panjang milik OpenAI sendiri menunjukkan jurang besar antara Luna dan dua tingkat yang lebih besar dalam pengambilan informasi pada masukan yang sangat besar. Arahkan konteks yang dalam dan ambigu ke Terra atau Sol.

Apa yang dikatakan — dan tidak dikatakan — oleh tolok ukur

OpenAI melaporkan hasil yang kuat di seluruh keluarga, tetapi kisah yang berguna adalah bentuk kompromi itu, bukan satu posisi papan peringkat.

Perbandingan tolok ukur yang dilaporkan OpenAI untuk GPT-5.6 Sol Ultra, Sol, Terra, Luna, dan GPT-5.5 pada Terminal-Bench, BrowseComp, dan pengambilan konteks panjang OpenAI MRCR v2 8-jarum

Pada Terminal-Bench 2.1, yang mengevaluasi alur kerja agen baris perintah, OpenAI melaporkan 91,9% untuk Sol Ultra, 88,8% untuk Sol, 87,4% untuk Terra, dan 84,7% untuk Luna. Pada BrowseComp, skor yang dilaporkan adalah 92,2% untuk Sol Ultra, 90,4% untuk Sol, 87,5% untuk Terra, dan 83,3% untuk Luna.

Hasil konteks panjang adalah sinyal perutean yang lebih penting. Pada OpenAI MRCR v2, 8-jarum, 256K–512K, Sol meraih 91,5% dan Terra 89,6%, sementara Luna meraih 41,3%. Luna tetap bisa sangat baik untuk pekerjaan singkat yang berulang; ia hanya tidak boleh diperlakukan sebagai Sol versi kecil untuk setiap beban kerja.

Ini adalah evaluasi yang dilaporkan oleh vendor, bukan peringkat universal. Tolok ukur mengukur harness, alat, pengaturan penalaran, dan anggaran tertentu. Alur kerja Anda sendiri bisa membalik urutannya, jadi jalankan ulang tugas yang representatif sebelum mengubah agen produksi.

GPT-5.6 vs GPT-5.5 dan Claude Fable 5

Perbandingan praktisnya bukan "model mana yang menang?". Melainkan "perilaku mana yang layak dibayar pada tahap eksekusi ini?".

ModelKecocokan terbaik di ZeroYang menonjolTingkat VM0 Built-in
GPT-5.6 SolPekerjaan sulit bertahap ganda ketika perencanaan, eksekusi paralel, pertimbangan desain, atau validasi dapat mengubah hasilZero memakai Ultra secara bawaan; tingkat GPT-5.6 terkuat untuk koding, penggunaan komputer, desain, riset, dan konteks mendalam$$$
GPT-5.6 TerraAlur kerja profesional sehari-hari yang tetap membutuhkan penalaran dan alat yang andalKualitas, kecepatan, dan biaya yang seimbang; kecocokan keluarga yang kuat untuk pekerjaan konteks panjang$$
GPT-5.6 LunaPekerjaan cepat bervolume tinggi dengan masukan konsisten dan eskalasi yang mudahLatensi dan biaya terendah dalam keluarga; ideal untuk triase, ekstraksi, dan pemrosesan massal$
GPT-5.5Alur kerja OpenAI yang sudah ada, sudah tervalidasi, dan belum perlu diukur ulangPerilaku frontier yang familier dan titik pembanding yang stabil untuk agen saat iniKetersediaan bergantung pada konfigurasi ruang kerja
Claude Fable 5Alur kerja Anthropic dan Claude Code yang paling mendalam, terutama ketika tim sudah selaras dengan perilakunyaPenalaran horizon panjang kelas premium dan profil penyedia/perkakas yang khas$$$$

OpenAI melaporkan bahwa Sol mengungguli Fable 5 pada Agents' Last Exam dan Artificial Analysis Coding Agent Index, sementara Fable 5 tetap sedikit unggul pada GDPval-AA v2. Itulah tepatnya mengapa "model terbaik" adalah klaim yang terlalu luas. Sol menarik ketika Anda menginginkan perilaku agentik terkuat OpenAI untuk koding, penggunaan komputer, desain, dan multi-agen. Fable tetap menjadi pilihan yang valid untuk pekerjaan Anthropic kelas atas dan alur kerja yang sudah dikalibrasi di sekitar Claude Code.

Terra adalah kandidat peningkatan yang lebih langsung untuk banyak beban kerja GPT-5.5: OpenAI menyatakan ia kompetitif dengan GPT-5.5 pada separuh harga daftar per token API. Luna memiliki target optimasi yang berbeda — kecepatan dan skala — jadi bandingkan ia berdasarkan pekerjaan yang selesai per dolar atau per menit, bukan hanya skor tolok ukur puncaknya.

Apa arti Built-in di Zero

Built-in menjadikan GPT-5.6 sebuah pilihan perutean alih-alih proyek kredensial. Pilih penyedia VM0 Managed dan Zero menangani akses sambil menagih tingkat kredit VM0 yang sesuai. Anda tidak perlu membuat atau memelihara kunci API OpenAI terpisah untuk rute tersebut.

Tim yang lebih menyukai hubungan penyedia mereka sendiri tetap dapat menggunakan kunci API OpenAI atau menghubungkan langganan ChatGPT/Codex. Nama modelnya tetap sama; yang berubah adalah jalur penagihan dan konfigurasi penyedia. Tingkat kredit VM0 ($, $$, $$$) tidak sama dengan harga per token API publik OpenAI.

Cara mengaktifkan GPT-5.6 di Zero

GPT-5.6 dipilih di pengaturan model, bukan dengan menulis "gunakan GPT-5.6" di dalam prompt.

  1. Buka Settings dan pilih Models dari bilah sisi.
  2. Di bagian Personal, tambahkan GPT 5.6 Sol, GPT 5.6 Terra, atau GPT 5.6 Luna.
  3. Pilih Built-in untuk menggunakan perutean VM0 Managed, atau pilih penyedia API OpenAI atau ChatGPT/Codex Anda yang terhubung.
  4. Mulai obrolan atau eksekusi, buka pemilih model, dan beralih ke tingkat yang Anda inginkan.
  5. Setelah sebuah alur kerja stabil, tetapkan model yang sesuai di tingkat agen atau keterampilan agar pekerjaan rutin secara konsisten menggunakan rute yang dimaksud.

Panduan perutean yang praktis

Mulailah dengan mengajukan tiga pertanyaan:

  1. Seberapa mahal jawaban yang salah? Gunakan Sol ketika kesalahan menimbulkan pengerjaan ulang, risiko, atau dampak lanjutan yang berarti.
  2. Seberapa dalam dan ambigu konteksnya? Gunakan Terra atau Sol untuk masukan besar yang berantakan yang memerlukan pemeriksaan silang dan sintesis.
  3. Seberapa sering ini akan berjalan? Gunakan Luna untuk pekerjaan bervolume tinggi yang dapat diprediksi, lalu eskalasikan pengecualiannya.

Pola perutean campuran layak diuji: Luna menyaring dan menstrukturkan masukan, Terra menyelesaikan bagian utama pekerjaan, dan Sol menangani sedikit keputusan yang memang membutuhkan penalaran maksimal. Anda tidak butuh satu model untuk melakukan segalanya; Anda butuh setiap tahap menggunakan model yang cukup.

GPT-5.6 membuat pilihan itu menjadi luar biasa jelas. Sol, Terra, dan Luna memberi Zero tiga titik operasi di dalam lingkungan agen yang sama — sehingga Anda dapat meningkatkan kapabilitas ketika pekerjaan menuntutnya dan menurunkan biaya ketika tidak.

Sumber

Stay in the loop

// Get the latest insights on AI teammates and collaboration.

SubscribeJoin Discord