GORONTALO — OpenAI resmi membuka pratinjau (preview) untuk lapisan layanan baru bernama Ultrafast pada model GPT-5.6 Sol. Klaim utama fitur ini adalah peningkatan kecepatan dramatis yang disebut mampu memproses permintaan hingga 14 kali lebih cepat dibandingkan mode standar, dengan kecepatan generasi mencapai 750 token per detik.
Kecepatan ini menjadi krusial untuk skenario di mana latensi (waktu tunggu respons) sama pentingnya dengan kualitas jawaban model. Bagi pengembang, perbedaan kecepatan ini bisa berarti transisi dari proses batch yang memakan waktu berjam-jam menjadi interaksi yang terasa instan.
Dukungan Infrastruktur Cerebras
Untuk mencapai kecepatan tersebut, OpenAI menggandeng Cerebras sebagai penyedia infrastruktur. Teknologi wafer-scale engine milik Cerebras memungkinkan pemrosesan data dalam jumlah besar secara paralel, yang menjadi kunci utama untuk menekan waktu respons.
Layanan Ultrafast tahap awal ini hanya tersedia melalui OpenAI API. Ini berbeda dengan akses model GPT-5.6 Sol yang sudah bisa dinikmati pengguna umum melalui platform ChatGPT maupun Codex sejak Juli lalu.
Target Penggunaan dan Skenario Produksi
OpenAI membidik segmen pengguna enterprise dan developer yang membutuhkan performa tinggi untuk tugas-tugas live atau mendekati produksi. Beberapa skenario yang disebutkan secara spesifik meliputi:
- Layanan suara (voice) dan dukungan pelanggan real-time.
- Platform e-commerce dan transaksi finansial.
- Agen pengembang (developer agents) yang membutuhkan iterasi cepat.
- Riset pasar dan respons keamanan siber.
Tim internal OpenAI sendiri disebut telah menggunakan mode ini untuk menganalisis log dan jejak data saat terjadi insiden, serta memadatkan siklus riset yang biasanya berjalan semalaman menjadi beberapa iterasi di jam kerja.
Ketersediaan Terbatas dan Daftar Tunggu
Saat ini akses Ultrafast masih dibatasi untuk sekelompok pelanggan terpilih. OpenAI ingin mengevaluasi bagaimana tambahan kecepatan ini mengubah produk dunia nyata sebelum memperluas kapasitas secara masif.
Bagi bisnis yang tertarik, OpenAI membuka waitlist. Calon pengguna diminta untuk mengisi detail kebutuhan seperti jenis workload, persyaratan latensi, perkiraan penggunaan, dan informasi lain yang relevan untuk proses kurasi.
Kehadiran mode Ultrafast ini menegaskan arah kompetisi AI yang tidak hanya fokus pada kecerdasan model, tetapi juga pada efisiensi dan kecepatan eksekusi. Untuk pengembang di Indonesia yang membangun aplikasi berbasis AI dengan tuntutan respons cepat, teknologi ini berpotensi menjadi game changer meski masih menunggu ketersediaan akses yang lebih luas.