Arena Raih Pendanaan US$200 Juta, Valuasi Tembus US$3,1 Miliar
CIANJUR.CO - Arena, perusahaan di balik platform pemeringkat model kecerdasan buatan yang populer, memperoleh pendanaan Seri B sebesar US$200 juta dengan valuasi US$3,1 miliar. Perusahaan menyampaikan pengumuman tersebut pada Kamis. Arena bermula pada 2023 sebagai proyek riset di UC Berkeley yang mengumpulkan penilaian publik untuk membandingkan model AI.
Berdasarkan laporan TechCrunch AI, putaran pendanaan ini dipimpin Lightspeed Venture Partners dan Khosla Ventures. Sejumlah investor lain turut berpartisipasi, yakni Salesforce Ventures, 01 Advisors, Dell Technologies Capital, Endeavor Catalyst, a16z, dan Felicis, serta pihak lainnya. Dana baru itu datang setelah Arena melaporkan telah mencapai pendapatan tahunan pada laju berjalan sebesar US$100 juta pada Juni.
Nilai perusahaan tersebut meningkat tajam dibandingkan pendanaan sebelumnya. Pada Januari, Arena mengumumkan pendanaan Seri A sebesar US$150 juta dengan valuasi pascauang US$1,7 miliar. Saat itu, perusahaan menyebut pendapatan tahunannya pada laju berjalan sebesar US$30 juta. Dengan membandingkan valuasi dari kedua putaran, nilai Arena hampir dua kali lipat dalam sekitar 10 bulan.
Baca juga: Google Hadirkan Agen AI Gemini untuk Dunia Usaha
Platform utama Arena dapat digunakan konsumen secara gratis. Pengguna memasukkan prompt atau meminta proyek yang dibuat dengan pendekatan vibe coding, lalu menilai model mana yang memberikan hasil lebih baik. Arena mengklaim platformnya dikunjungi puluhan juta orang setiap bulan. Penilaian dari komunitas tersebut menjadi dasar bagi perusahaan untuk membandingkan kinerja berbagai model.
Pada September tahun lalu, Arena memperkenalkan produk komersial bernama AI Evaluations. Layanan ini memberikan laboratorium pengembang model dan perusahaan analitik kinerja terperinci yang bersumber dari umpan balik komunitas. Produk tersebut hadir ketika laboratorium AI menyadari model mereka dapat mengakali pengujian tolok ukur: model bisa memperoleh skor tinggi tanpa benar-benar menunjukkan kemampuan yang hendak diukur.
Di sisi lain, perusahaan membutuhkan cara untuk menentukan model yang paling sesuai dengan kebutuhan internal masing-masing. Mereka tidak ingin hanya mengandalkan tolok ukur standar. Dalam pengumuman pendanaan, Arena menyatakan, “AI berkembang lebih cepat daripada kemampuan kita untuk mengevaluasinya,” serta menilai tolok ukur statis tidak lagi memadai ketika model mengetahui bahwa dirinya sedang diuji.
Baca juga: Bukti Matematika OpenAI Dinilai Belum Memenuhi Standar Peneliti
Perusahaan juga menyebut perlunya pihak ketiga yang netral untuk mengukur keamanan dan keselarasan AI saat digunakan oleh orang sungguhan. Arena mengatakan pihaknya mulai mengambil peran tersebut. Langkah yang menyertai arah itu adalah penambahan kategori baru pada papan peringkatnya, yaitu alignment atau keselarasan model.
Kategori alignment menilai sejumlah persoalan perilaku model. Salah satunya tindakan tanpa izin, yakni ketika model melakukan sesuatu yang tidak diminta. Penilaian juga mencakup atribusi keliru, yaitu saat model secara salah menghubungkan pernyataan atau fakta dengan sumber yang bukan pembuatnya.
Baca juga: California Batasi Keputusan Pemecatan yang Sepenuhnya Diserahkan kepada AI
Aspek lain yang dinilai disebut Arena sebagai “deceptive completion”. Istilah tersebut merujuk pada kondisi ketika model mengaku telah menyelesaikan tugas yang sebenarnya tidak dikerjakan. Dengan memasukkan persoalan-persoalan itu, Arena memperluas pemeringkatan dari perbandingan hasil model menjadi penilaian atas cara model bertindak dan menyampaikan informasi.
Dalam papan peringkat alignment pendahuluan yang tersedia saat ini, sejumlah model OpenAI menempati posisi teratas. Sementara itu, Claude Opus 5.5 berada di peringkat keenam dan Claude Fable di posisi kesembilan. Arena belum menyebut bahwa daftar tersebut merupakan hasil akhir; perusahaan menggambarkannya sebagai pemeringkatan awal.