Semua model

GPT 5.6 Sol di VM0. Model reasoning unggulan terbaru dari OpenAI

Tingkatan unggulan dari generasi preview GPT-5.6 milik OpenAI. Pilihan terkuat untuk agentic coding, reasoning mendalam, dan loop computer-use panjang di sisi OpenAI.

400K tokens · Text / Vision / Code · Prompt cache

GPT 5.6 Sol adalah tingkatan tertinggi dari generasi preview GPT-5.6 milik OpenAI dan model yang Anda pilih ketika pekerjaan membutuhkan sekaligus reasoning mendalam dan tool use yang andal: mengorkestrasi loop agen multi-langkah, penyuntingan kode yang harus berhasil pada percobaan pertama, dan alur kerja computer-use yang mencakup banyak aksi GUI.

Harga daftar vendor adalah $5 / $30 per 1M token dengan input yang di-cache seharga $0.50 / 1M. Ia berada di tingkatan kredit ×2 di VM0 — pita harga frontier-flagship — sehingga pola yang hemat biaya adalah menjadikan GPT 5.6 Terra atau Claude Sonnet 4.6 sebagai default di mana-mana dan hanya mengalurkan langkah tersulit ke Sol. GPT-5.6 saat ini adalah keluarga preview di VM0; GPT-5.5 tetap menjadi model OpenAI default hingga Sol lulus dari preview.

Apa itu GPT 5.6 Sol?

Preview Juli 2026 (tingkatan tertinggi dari keluarga GPT-5.6) · Tingkatan unggulan dari keluarga GPT-5.6, di atas GPT 5.6 Terra dan GPT 5.6 Luna. Model frontier terbaru dari OpenAI untuk agentic coding dan reasoning.

GPT-5.6 adalah generasi GPT terbaru dari OpenAI, diperkenalkan pada Juli 2026 sebagai keluarga tiga tingkat — Sol, Terra, dan Luna — alih-alih model tunggal. Sol adalah unggulannya: tingkatan yang diposisikan OpenAI untuk pekerjaan agentic-coding, reasoning, dan computer-use yang paling sulit. Jendela konteks 400K token dan parameter reasoning_effort diwariskan dari GPT-5.5 tanpa perubahan, sehingga agen Codex yang sudah ada bisa langsung dipakai tanpa penulisan ulang.

Dibandingkan GPT-5.5 (unggulan sebelumnya), Sol menghabiskan lebih banyak komputasi per token untuk reasoning dan, dalam materi preview OpenAI, menghasilkan patch percobaan-pertama yang lebih kuat pada refactor multi-file, lebih sedikit tool call yang salah alur pada loop panjang, serta meningkat pada reasoning sains tingkat pascasarjana dan matematika kompetisi. Konsekuensinya adalah ia berbagi harga daftar GPT-5.5 ($5 / $30 per 1M token) dan pengali kredit ×2 di VM0, itulah mengapa OpenAI memposisikan Sol sebagai tingkatan perencana atau eskalasi alih-alih default di mana-mana.

Karena GPT-5.6 adalah keluarga preview, angka yang dipublikasikan masih awal dan akan berubah. OpenAI telah menandai kontaminasi data pelatihan pada SWE-bench Verified di seluruh model frontier, jadi anggap setiap skor absolut sebagai indikasi arah saja. Sinyal yang bertahan adalah perilaku terstruktur: akurasi tool-call, keandalan computer-use, dan kualitas patch percobaan-pertama, yang semuanya menurut data preview meningkat dibanding GPT-5.5.

Apa yang menonjol dari GPT 5.6 Sol

Fitur arsitektur dan kapabilitas utama.

GPT 5.6 Sol mempertahankan jendela konteks 400K token dari lini GPT-5, ditagih dengan harga input standar di seluruh jendela. Ia mendukung parameter reasoning_effort, prompt caching di mana input yang di-cache ditagih sepersepuluh dari tarif input ($0.50 / 1M) ditambah biaya cache-write ($6.25 / 1M), serta permukaan Responses API yang digunakan codex CLI secara default. Tool-use, output terstruktur, dan computer-use diwariskan dari GPT-5.5. Input bersifat multimodal mencakup teks, vision, dan kode; tidak ada pembangkitan gambar native (gunakan Images API).

Spesifikasi sekilas

KeluargaGenerasi GPT-5.6 (preview)
ModalitasText, Vision, Code
BahasaMengutamakan bahasa Inggris, multibahasa
Prompt cachingSupported (OpenAI)
Jendela konteks400K token
Output maksimumHingga 128K token
Reasoning effortMinimal / Low / Medium / High
Harga daftar vendor$5 input / $30 output per 1M

Benchmark GPT 5.6 Sol

Angka preview dari materi GPT-5.6 Sol milik OpenAI, ditampilkan berdampingan dengan angka publik GPT-5.5. Anggap semua persentase sebagai indikasi arah: keluarga ini dalam preview dan OpenAI telah menandai kontaminasi data pelatihan pada SWE-bench Verified di seluruh model frontier.

SWE-bench Verifiedpreview; naik dari ~82% milik 5.5
~84%
Terminal-Bench 2.0tool use preview
~72%
AIME 2025 (no tools)matematika kompetisi preview
~97%
GPQA Diamondsains pascasarjana preview
~90%
OSWorld (computer use)preview
~77%
MMMU (multimodal)preview
Memimpin keluarga GPT-5.6
Speedeffort medium, perkiraan awal
~70 tokens/sec

Harga GPT 5.6 Sol

Harga daftar vendor, per 1J token.

Input$5.00
Output$30.00
Cache read$0.50
Cache write$6.25

Bagaimana GPT 5.6 Sol berperilaku dalam praktik

Perilaku yang diamati dari eksekusi agen produksi.

Perutean tool

Tingkat tool call salah-alur terendah di keluarga GPT-5.6. Selisih terhadap GPT-5.5 muncul pada edge case yang sulit: pemilihan tool bersyarat, argumen yang bersarang dalam, dan tool call yang dikirim setelah rentang reasoning yang panjang.

Penyuntingan kode percobaan-pertama

Kualitas patch terkuat di keluarga ini. Pilihan tepat ketika sebuah agen harus mengubah kode yang harus tetap terkompilasi dan lulus tes, terutama saat patch mencakup banyak file. SWE-bench Verified preview mencerminkan hal ini secara langsung.

Computer use

Lebih andal dibanding GPT-5.5 pada urutan GUI multi-langkah, yang justru ditangkap oleh selisih OSWorld. Andalkan ketika agen mengendalikan browser atau aplikasi desktop selama puluhan langkah dan tergelincir di tengah proses akan mahal.

Kecepatan

Lebih lambat dari Terra dan jauh lebih lambat dari Luna. Sekitar 70 tokens/sec pada effort medium dalam pengujian awal. Simpan untuk langkah yang benar-benar membutuhkan kedalaman reasoning ekstra dan jalankan tingkatan yang lebih ringan secara paralel.

Perilaku halusinasi

Sol membawa kalibrasi yang lebih ketat dari lini GPT-5 dan cenderung mengakui ketidakpastian alih-alih mengarang, itulah mengapa tim tetap membayar premi untuk reasoning berisiko tinggi bahkan saat model yang lebih murah menyusul dalam benchmark.

Tugas agen terbaik untuk GPT 5.6 Sol

Orkestrator yang menjalankan rencana multi-tool

Gunakan Sol sebagai perencana yang memecah sebuah permintaan menjadi sepuluh langkah, mengirim masing-masing ke sub-agen bertingkatan Terra atau Luna, lalu menyatukan kembali hasilnya. Menjalankan Sol hanya pada lapisan perencana menelan sebagian kecil biaya dibanding menjalankannya dari ujung ke ujung, dengan sebagian besar kualitas tetap terjaga.

Penyuntingan kode sekali-jadi yang tidak membuang jalannya CI

Minta Sol memigrasikan basis kode 50 file dari satu ORM ke ORM lain, merapikan modul yang kusut, atau menerapkan perbaikan keamanan di seluruh repo. Patch berhasil diterapkan dengan bersih pada percobaan pertama lebih sering daripada tingkatan lain di keluarga ini — persis seperti yang tercermin pada tagihan CI Anda.

Agen computer-use yang harus menyelesaikan alur kerja

Ketika agen mengendalikan browser melewati alur pemesanan multi-langkah, aplikasi desktop, atau UI admin legasi, skor OSWorld Sol yang lebih tinggi berarti lebih sedikit tergelincir di tengah proses dan lebih sedikit pengambilalihan manual.

Langkah riset matematika atau sains yang sulit

Berikan set matematika kelas kompetisi atau penurunan fisika pascasarjana, dan Sol menyelesaikannya tanpa keliru satu langkah seperti yang Anda lihat pada tingkatan yang lebih ringan. AIME 2025 dan GPQA Diamond menangkap tepat perilaku ini.

Kapan melewatkan GPT 5.6 Sol

Lewati Sol pada pekerjaan rutin bervolume tinggi di mana GPT 5.6 Terra mencapai standar kualitas yang sama dengan setengah biaya kredit, pada balasan chat sensitif-latensi di mana GPT 5.6 Luna jauh lebih cepat, dan pada pekerjaan klasifikasi atau ekstraksi massal di mana Luna adalah opsi yang didukung dengan biaya lebih murah.

GPT 5.6 Sol vs model lain

GPT 5.6 Sol vs GPT 5.6 Terra

Terra adalah kuda pekerja seimbang di keluarga GPT-5.6 dan pilihan tepat untuk sebagian besar agen. Naikkan ke Sol hanya ketika Terra terlihat gagal pada reasoning sulit, loop agen panjang, atau penyuntingan kode percobaan-pertama — biasanya sebagai orkestrator yang mendelegasikan ke bawah ke Terra dan Luna.

GPT 5.6 Sol vs GPT-5.5

Peran sama, generasi lebih baru. Sol adalah penerus preview dari GPT-5.5 pada harga daftar dan tingkatan kredit yang sama, dengan skor preview yang lebih kuat pada agentic coding dan computer use. Hingga GPT-5.6 lulus dari preview, GPT-5.5 tetap menjadi model OpenAI default di VM0; andalkan Sol ketika Anda menginginkan kedalaman reasoning terbaru.

GPT 5.6 Sol vs Claude Opus 4.8

Unggulan setara di keluarga yang berbeda: orkestrator berisiko tinggi yang Anda eskalasi ketika tingkatan yang lebih murah gagal. Opus 4.8 memiliki jendela konteks 1M token dan profil keamanan Anthropic; Sol memiliki ekosistem Codex dan skor computer-use OpenAI. Pilih berdasarkan framework mana yang menjadi target agen Anda saat ini.

Kesimpulan: haruskah Anda menggunakan GPT 5.6 Sol?

GPT 5.6 Sol adalah tingkatan eskalasi terbaru di sisi OpenAI. Jadikan Terra sebagai default; naikkan ke Sol hanya pada langkah spesifik di mana Terra terlihat kurang, dan bersiaplah skor preview akan terus berubah.

Pertanyaan yang sering diajukan

Berapa jendela konteks GPT 5.6 Sol?

400.000 token, dengan output hingga 128K token per respons. Seluruh jendela ditagih dengan tarif standar.

Apakah GPT-5.6 sudah tersedia umum di VM0?

Masih dalam preview. Ketiga tingkatan — Sol, Terra, dan Luna — dapat dipilih, tetapi GPT-5.5 tetap menjadi model OpenAI default hingga keluarga GPT-5.6 lulus dari preview. Angka benchmark preview masih awal dan akan berubah.

Kapan saya harus memilih Sol dibanding GPT 5.6 Terra?

Ketika (a) agen adalah perencana dan keputusannya berjenjang, (b) proses cukup panjang hingga Terra mulai salah mengalurkan tool call, atau (c) output harus diterapkan dengan bersih pada percobaan pertama — penyuntingan kode, payload terstruktur, alur kerja computer-use.

Apakah GPT 5.6 Sol mendukung prompt caching?

Ya. Input yang di-cache ditagih $0.50 per 1M token — diskon 10× pada porsi yang di-cache — dengan biaya cache-write $6.25 per 1M. Layak digunakan setiap kali system prompt atau skema tool Anda stabil antar-panggilan.

Framework apa yang digunakan GPT 5.6 Sol di VM0?

Codex. VM0 mengalurkan GPT-5.6 melalui permukaan Responses API dari framework Codex, yang digunakan codex CLI secara default. Agen berbasis framework Claude Code tidak kompatibel dengan model GPT-5 di VM0.

Alternatif

Menggunakan GPT 5.6 Sol di VM0

Dua cara mengakses GPT 5.6 Sol di VM0

VM0 mendukung GPT 5.6 Sol sebagai model Built-in yang ditagih dalam kredit VM0, dan melalui bring-your-own dengan OpenAI API key. Jalur Built-in menggunakan routing VM0 Managed dan pengali kredit yang dijelaskan di bawah; jalur bring-your-own menagih Anda langsung ke vendor hulu dan sepenuhnya melewati konversi kredit VM0.

Rekomendasi VM0

VM0 memposisikan GPT 5.6 Sol sebagai model agen inti, direkomendasikan bersama Claude Opus 4.7, Claude Opus 4.6, dan Claude Sonnet 4.6 untuk langkah-langkah yang menggerakkan hasil aktual dari sebuah eksekusi agen. Inilah model yang akan kami pilih untuk peran orkestrator, untuk agen yang menyentuh kode, dan untuk langkah apa pun di mana jawaban yang salah berbiaya mahal.

Kredit dan pengali ×2

Setiap model Built-in di VM0 dihargai sebagai kelipatan dari Claude Sonnet 4.6, yang berada di baseline kredit ×1. GPT 5.6 Sol ditagih pada ×2 kredit. Pengali inilah yang muncul di invoice VM0 Anda; harga daftar vendor di tabel harga di atas adalah yang dikenakan penyedia hulu sebelum VM0 mengonversinya menjadi kredit.

GPT 5.6 Sol ditagih pada ×2, yang berarti satu langkah di sini berbiaya 2× kredit dari langkah setara pada Sonnet 4.6 (baseline ×1). Ini tier premium di VM0, jadi pola yang hemat biaya adalah menggunakan model yang lebih murah sebagai default dan mengarahkan ke GPT 5.6 Sol hanya langkah yang benar-benar membutuhkan kedalaman reasoning ekstra.

Tersedia di VM0 sejak July 2026 (preview).