Papan peringkat Arena gandakan valuasi jadi 3,1 miliar dolar AS dalam 10 bulan
Arena mengumpulkan 200 juta dolar AS pada ronde Seri B dengan valuasi 3,1 miliar dolar AS, hampir dua kali lipat valuasi Januari lalu. Ronde dipimpin Lightspeed Venture Partners dan Khosla Ventures, diikuti Salesforce Ventures, 01 Advisors, Dell Technologies Capital, Endeavor Catalyst, a16z, dan Felicis. Arena mencatat pendapatan berulang tahunan 100 juta dolar AS pada Juni.
Arena mengumumkan pendanaan Seri B sebesar 200 juta dolar AS pada valuasi 3,1 miliar dolar AS. Ronde tersebut dipimpin Lightspeed Venture Partners dan Khosla Ventures, dengan Salesforce Ventures, 01 Advisors, Dell Technologies Capital, Endeavor Catalyst, a16z, Felicis, dan beberapa investor lain ikut berpartisipasi. Arena sebelumnya mengumumkan Seri A senilai 150 juta dolar AS pada Januari dengan valuasi pasca-uang 1,7 miliar dolar AS, sehingga valuasinya hampir berlipat dua hanya dalam sekitar 10 bulan.
Perusahaan ini berawal pada 2023 sebagai proyek riset di UC Berkeley yang mengumpulkan penilaian model AI secara ramai-ramai. Sampai sekarang platformnya gratis bagi konsumen: pengguna memasukkan perintah atau meminta proyek yang dibangun dengan bantuan AI, lalu menilai model mana yang lebih baik. Arena mengklaim memiliki puluhan juta pengunjung setiap bulan. Sisi bisnisnya adalah AI Evaluations, layanan yang diluncurkan September tahun lalu untuk memberi lab model dan perusahaan analitik performa rinci berdasarkan umpan balik komunitas tersebut. Pada Januari, saat valuasinya masih 1,7 miliar dolar AS, pendapatan tahunan Arena baru sekitar 30 juta dolar AS; pada Juni angka itu sudah menembus 100 juta dolar AS.
Waktu peluncuran produk komersialnya dinilai tepat. Sepanjang 2026, lab AI menyadari model mereka bisa menaklukkan uji benchmark tanpa benar-benar menguasai kemampuan yang diuji, sementara perusahaan butuh cara menilai model sesuai kebutuhan internal, bukan hanya mengandalkan tolok ukur standar. Dalam pengumuman pendanaannya, Arena menyatakan bahwa AI berkembang lebih cepat daripada kemampuan industri menilainya dan bahwa benchmark statis rusak begitu model menyadari sedang diuji, sehingga dunia memerlukan pihak ketiga netral untuk mengukur seberapa aman dan selaras AI ketika sudah dipakai orang sungguhan.
Arena juga menambahkan kategori baru di papan peringkatnya, yaitu alignment. Kategori ini memberi peringkat model berdasarkan masalah seperti tindakan tanpa izin, atribusi salah ketika pernyataan atau fakta disematkan ke sumber yang keliru, serta penyelesaian menipu, yaitu mengaku menyelesaikan tugas yang sebenarnya tidak dikerjakan. Pada papan awal itu, sejumlah model OpenAI berada di posisi teratas, sementara Claude Opus 5.5 dan Claude Fable masing-masing ada di peringkat keenam dan kesembilan. Artinya, penilaian model kini bergeser dari sekadar skor kecerdasan ke perilaku model di tangan pengguna, dan itu pula alasan investor mau membayar valuasi dua kali lebih tinggi dalam waktu kurang dari setahun.
Sumber asli
TechCrunch (8 Oktober 2026)techcrunch.comFakta, angka, nama, dan kutipan dalam naskah ini telah dicocokkan dengan sumber-sumber di atas. Naskah ditulis ulang oleh redaksi, bukan salinan. Laporkan kesalahan