China Mulai Terima Nvidia H200, Persaingan Chip AI AS dan Beijing Memanas
Chip kecerdasan buatan atau AI Nvidia H200 mulai masuk ke China setelah sekitar delapan bulan tertahan akibat tarik ulur kebijakan...
Read more
Anthropic diam-diam mengembangkan model kecerdasan buatan atau AI baru yang kemampuannya disebut lebih tinggi dibandingkan model terbaik mereka saat ini, Claude Mythos 5. Model tersebut belum memiliki nama resmi dan untuk sementara disebut sebagai Model 2.
Keberadaan Model 2 terungkap bukan melalui acara peluncuran atau pengumuman produk, melainkan dari laporan risiko Anthropic yang diterbitkan pada Agustus 2026. Dalam laporan tersebut, Anthropic menjelaskan bahwa Model 2 sudah dikembangkan dan digunakan secara internal.
Artinya, model tersebut memang sudah masuk dalam lingkungan kerja perusahaan, tetapi belum dibuka untuk pengguna umum.
Kemampuan Model 2 terlihat dari hasil pengujian internal yang disebut CoBench. Berdasarkan laporan Anthropic, Model 2 mencatat skor 62,8 persen, sedangkan Mythos 5 mendapatkan skor 50,3 persen dalam pengujian yang sama.
Selisihnya mencapai 12,5 poin persentase. Hasil tersebut menunjukkan Model 2 memiliki performa yang lebih tinggi dalam pengujian yang dirancang untuk mengukur kemampuan model dalam menyelesaikan tugas penelitian dan pengembangan.
Berdasarkan laporan yang dirangkum dari berbagai sumber, CoBench berfokus pada tugas-tugas yang berkaitan dengan pekerjaan riset dan pengembangan internal Anthropic. Karena itu, skor tersebut lebih tepat dibaca sebagai bukti keunggulan Model 2 dalam konteks tertentu, bukan sebagai ukuran mutlak bahwa model tersebut lebih unggul dalam seluruh kemampuan AI.
Anthropic sendiri memberikan penilaian yang cukup hati-hati. Perusahaan menyebut Model 2 sebagai peningkatan yang terlihat untuk penggunaan internal, tetapi tidak menganggapnya sebagai lompatan kemampuan sebesar transisi dari Claude Opus 4.6 ke Mythos Preview.
Perbandingan tersebut penting karena menunjukkan Anthropic tidak menggambarkan Model 2 sebagai perubahan generasi yang sangat drastis. Model ini memang lebih kuat pada sejumlah tugas, tetapi peningkatannya belum dianggap sebagai lompatan besar.
Laporan yang dikutip berbagai sumber juga menunjukkan Model 2 memperoleh skor 62,8 persen dalam CoBench v2, dibandingkan 54,8 persen untuk Mythos Preview dan 50,3 persen untuk Mythos 5. Ini memperlihatkan bahwa Model 2 berada di atas kedua model tersebut dalam pengujian internal tersebut.
Sebagai konteks, Anthropic juga memperkirakan skor sekitar 85 persen pada evaluasi tertentu sebagai tingkat kemampuan yang dapat mendekati penggantian menyeluruh terhadap pekerjaan teknis internal perusahaan. Dengan demikian, skor Model 2 belum berarti AI tersebut sudah mampu menggantikan seluruh pekerjaan peneliti atau insinyur Anthropic.
Meski menunjukkan performa lebih tinggi dibandingkan Mythos 5 dalam CoBench, Model 2 belum tersedia untuk publik. Anthropic juga belum menetapkan kapan model tersebut akan diluncurkan.
Menurut Anthropic, keputusan tersebut bukan karena Model 2 gagal dalam pengujian keamanan. Model tersebut justru telah melalui sejumlah pemeriksaan dan tidak menunjukkan tanda-tanda risiko baru yang berada di luar risiko yang sebelumnya diketahui dari Mythos 5.
Masalahnya adalah Anthropic belum memiliki gambaran keamanan yang cukup lengkap untuk memberikan akses Model 2 kepada pengguna di luar perusahaan. Model tersebut juga belum menyelesaikan seluruh rangkaian evaluasi yang biasanya diperlukan sebelum sebuah sistem AI dirilis secara eksternal.
Anthropic menyatakan bahwa mereka memang mengembangkan dan menguji banyak versi model secara internal yang tidak semuanya direncanakan untuk dirilis. Model 2 disebut sebagai salah satu model eksplorasi tersebut.
Kondisi ini membuat masa depan Model 2 masih belum jelas. Model tersebut bisa saja tetap digunakan sebagai sistem internal, mendapatkan nama baru, atau pada tahap berikutnya dikembangkan menjadi model yang berbeda.
Ada kemungkinan pula Model 2 menjadi bagian dari generasi Mythos berikutnya. Namun, belum ada kepastian bahwa model ini nantinya akan menggunakan nama Mythos 6 atau nama lain.
Anthropic juga terus memperketat evaluasi terhadap model AI berkemampuan tinggi. Dalam laporan risiko Agustus 2026, perusahaan menaikkan penilaian risiko misalignment dalam situasi berisiko tinggi dari “very low” menjadi “low”. Perubahan tersebut antara lain dikaitkan dengan meningkatnya ketidakpastian setelah sejumlah temuan dalam evaluasi keamanan siber.
Perkembangan tersebut menunjukkan bahwa peningkatan kemampuan AI tidak hanya soal mendapatkan skor lebih tinggi dalam benchmark. Semakin kuat sebuah model, semakin besar pula kebutuhan untuk memahami kemampuan, keterbatasan, serta potensi risikonya sebelum teknologi tersebut diberikan kepada publik.
Untuk saat ini, Model 2 masih menjadi model internal Anthropic. Namun, performanya di CoBench memberikan gambaran bahwa perusahaan sedang mengembangkan sistem yang kemampuannya telah melampaui Mythos 5 pada setidaknya salah satu pengujian internal utama.
Referensi:
Kompas Tekno
Temukan berbagai artikel menarik dan inspiratif di halaman 👉 Kumpulan Artikel dan Berita IT Terpopuler 2026 . Dari berita terbaru, tips, hingga kisah menarik seputar dunia it — semua ada di sana!
Ikuti Saluran Resmi Trenmedia di WhatsApp!
Dapatkan berita terkini, tren viral, serta tips inspiratif langsung dari redaksi.
📱 Saluran Trenmedia 🍳 Saluran Resep Masakan Viral
Klik dan bergabung sekarang – update terbaru langsung masuk ke WhatsApp kamu!
Tren perjalanan wisata mulai mengalami perubahan. Jika sebelumnya destinasi populer menjadi pilihan utama untuk berlibur, kini semakin banyak wisatawan yang...
Menginap di hotel biasanya menjadi bagian menyenangkan dari perjalanan. Kasur empuk, kamar bersih, suhu ruangan nyaman, dan fasilitas lengkap seharusnya...