OpenAI menghadirkan GPT-6 Sol dan Luna ke ChatGPT serta menambahkan Intelligent UI untuk jawaban berformat campuran
GPT-6 Sol tiba lebih dulu di paket ChatGPT berbayar, disusul GPT-6 Luna untuk pengguna Free dan Go. Kartu sistem OpenAI menilai kedua model memiliki kemampuan tingkat High di domain keamanan siber serta domain biologi dan kimia.
Poin penting
- 1GPT-6 Sol sedang diluncurkan ke ChatGPT Plus, Pro, Business, dan Enterprise; GPT-6 Luna menyusul untuk pengguna Free dan Go, menurut 9to5Mac.
- 2Intelligent UI memungkinkan ChatGPT menggabungkan teks dengan bagan, formulir, tombol yang dapat diketuk, dan elemen interaktif lainnya, tergantung pada pertanyaannya; ChatGPT juga dapat membuat alat kecil seperti kalkulator.
- 3OpenAI mengatakan ChatGPT kini dapat mulai menjawab saat masih bernalar, sambil terus menambah balasannya.
- 4Model Oktober menggantikan versi GPT-5.6 di ChatGPT; Codex dan ChatGPT Work masih menjalankan versi September.
- 5OpenAI menilai kedua model memiliki kemampuan tingkat High di Keamanan Siber serta di Biologi dan Kimia berdasarkan Preparedness Framework miliknya; temuan keamanannya dilaporkan sendiri.
Berita selengkapnya
OpenAI mengumumkan pada 7 Oktober bahwa pihaknya menghadirkan model GPT-6 baru ke ChatGPT, menyusul model GPT-6 pertama yang diperkenalkannya pada bulan September. Menurut 9to5Mac, pelanggan paket Plus, Pro, Business, dan Enterprise mendapatkan GPT-6 Sol lebih dulu, sementara GPT-6 Luna dijadwalkan mulai menjangkau pengguna Free dan Go keesokan harinya. OpenAI menggambarkan versi-versi ini sebagai versi yang disetel untuk percakapan sehari-hari. Dalam kartu sistem untuk rilis ini, perusahaan tersebut mengatakan bahwa GPT-6 hadir untuk paket gratis dan berbayar di seluruh dunia dan bahwa model Oktober menggantikan versi GPT-5.6 dari Sol dan Luna di ChatGPT.
Perubahan yang paling terlihat adalah apa yang disebut OpenAI sebagai Intelligent UI. Alih-alih menjawab hanya dengan teks, ChatGPT kini dapat memadukan teks dengan elemen visual dan interaktif, dengan memilih format yang sesuai dengan pertanyaan dan isi jawabannya. OpenAI menyebutkan grafik, tombol yang dapat diketuk, formulir, bagan, dan pengalaman interaktif yang digunakan di dalam obrolan. Sebuah perbandingan dapat disajikan berdampingan dan sebuah penjelasan dapat hadir sebagai diagram interaktif, sementara balasan teks biasa tetap menjadi pilihan ketika itu paling bermanfaat bagi pengguna. Untuk prompt yang lebih kompleks, ChatGPT dapat membuat widget yang memungkinkan orang menjelajahi suatu konsep atau mengubah masukan dan melihat hasilnya diperbarui, dan ChatGPT dapat membuat alat kecil seperti kalkulator, pembagi tagihan, dan gim di dalam percakapan.
OpenAI juga mengatakan bahwa GPT-6 memungkinkan ChatGPT mulai merespons sebelum penalarannya selesai, dengan menambahkan informasi ke balasan langkah demi langkah alih-alih menahan semuanya hingga proses berpikir berakhir. Pembaruan ini belum menjangkau setiap produk OpenAI. Kartu sistem menyebutkan bahwa orang yang menggunakan model tersebut di Codex atau melalui ChatGPT Work masih menggunakan rilis sebelumnya. OpenAI memberi label model berdasarkan bulan rilis: Oktober untuk versi yang kini ada di ChatGPT, September untuk versi yang tetap berada di Codex dan Work.
Klaim keamanan dalam kartu sistem berasal dari pengujian OpenAI sendiri. Perusahaan tersebut mengatakan bahwa model Oktober lebih tahan terhadap jailbreak dibandingkan model GPT-5.6, termasuk serangan yang beradaptasi selama beberapa giliran, serta menunjukkan lebih sedikit ketidakjujuran dan penipuan. Perusahaan itu mengatakan telah memperbarui pelatihan keamanannya untuk melindungi dengan lebih baik dari penyalahgunaan berisiko tinggi yang melibatkan siber, biologi, dan kekerasan. OpenAI juga melaporkan regresi yang signifikan secara statistik pada beberapa kategori konten, seperti melukai diri sendiri dan konten berdarah (gore), serta pada beberapa evaluasi untuk pengguna di bawah 18 tahun; perusahaan itu mengatakan bahwa tinjauan manual dan red-teaming menemukan kegagalan tersebut umumnya berkeparahan rendah dan bahwa pengaman tambahan, seperti pengklasifikasi, beroperasi di lingkungan produksi. Pada pengujian hierarki instruksinya untuk prompt injection, OpenAI memberikan skor ketahanan 99.99% untuk GPT-6 Sol dan 99.79% untuk GPT-6 Luna.
Penilaian Preparedness Framework OpenAI menempatkan kedua model Oktober pada kemampuan tingkat High di domain Keamanan Siber serta di domain Biologi dan Kimia. Perusahaan tersebut mengatakan bahwa tidak satu pun model mencapai ambang High untuk Peningkatan Diri AI dan bahwa keduanya tetap berada di bawah tingkat Critical dalam keamanan siber. Hal itu sesuai dengan penilaiannya terhadap model GPT-5.6, dan OpenAI mengatakan menerapkan pengaman yang sama dengan yang dijelaskannya dalam kartu sistem GPT-5.6. Dalam evaluasi sibernya sendiri, perusahaan itu melaporkan bahwa GPT-6 Sol berada kira-kira setara dengan pendahulunya tanpa peningkatan yang jelas, sementara GPT-6 Luna mendapat skor di bawah GPT-6 Sol.
Mengapa ini penting
Rilis ini mengubah apa yang dilihat pengguna ChatGPT: jawaban yang dapat hadir sebagai bagan, formulir, atau alat kecil, bukan hanya teks, dan balasan yang dimulai sebelum model selesai bernalar. Rilis ini juga menghadirkan model yang oleh OpenAI sendiri dinilai memiliki kemampuan tingkat High di domain keamanan siber serta domain biologi dan kimia kepada pengguna gratis di seluruh dunia, sehingga pengaman yang dijelaskan dalam kartu sistemnya menjadi lebih penting. Hasil keamanan tersebut berasal dari evaluasi OpenAI sendiri, bukan dari pengujian independen.
Linimasa
· Diterbitkan
Topik#OpenAI#ChatGPT#GPT-6#Intelligent UI#Keamanan AI
Sumber
Berita ini bersumber dari rujukan berikut. Bacalah untuk konteks selengkapnya.
