การระดมทุน · 11 ตุลาคม 2026
อารีนาแพลตฟอร์มผู้ประเมินโมเดล AI ยอดนิยมเพิ่มมูลค่าประเมินเป็น 3.1 พันล้านดอลลาร์ใน 10 เดือน
อารีนา ซึ่งเริ่มต้นในปี 2023 เป็นโครงการวิจัยที่มหาวิทยาลัยแคลิฟอร์เนียเบิร์กเกอร์ราวด์ที่รวบรวมการจัดอันดับโมเดล AI โดยผู้ใช้ร่วมกัน ได้เปิดตัวรอบการลงทุนชั้น B มูลค่า 200 ล้านดอลลาร์ ที่มูลค่าประเมิน 3.1 พันล้านดอลลาร์ เมื่อวันพฤหัสบดีที่ผ่านมา
การลงทุนรอบนี้ได้รับการนำโดยบริษัทลงทุน Lightspeed Venture Partners และ Khosla Ventures โดยมี Salesforce Ventures, 01 Advisors, Dell Technologies Capital, Endeavor Catalyst, a16z, Felicis และผู้ลงทุนอื่นๆ ร่วมลงทุน รอบการลงทุนชั้น A มูลค่า 150 ล้านดอลลาร์ที่มีมูลค่าประเมินหลังการลงทุน 1.7 พันล้านดอลลาร์ ได้ถูกประกาศเมื่อเดือนมกราคมที่ผ่านมา ณ ขณะนั้นรายได้รายปีอยู่ที่ 30 ล้านดอลลาร์ ทำให้มูลค่าประเมินเพิ่มขึ้นเป็นสองเท่าภายในประมาณ 10 เดือน
อารีนาให้บริการแพลตฟอร์มที่ผู้ใช้สามารถใช้งานได้ฟรี โดยผู้ใช้จะป้อนคำสั่งหรือโปรเจกต์ที่เขียนขึ้นเองแล้วจัดอันดับว่าโมเดลใดทำได้ดีกว่า ในขณะที่อารีนาระบุว่ามีผู้ใช้งานรายเดือนหลายสิบล้านคน
ในเดือนกันยายนของปีที่แล้ว อารีนาได้เปิดตัวผลิตภัณฑ์เชิงพาณิชย์ชื่อ AI Evaluations ซึ่งเป็นบริการที่ให้ข้อมูลวิเคราะห์ประสิทธิภาพโดยละเอียดแก่ห้องปฏิบัติการโมเดลและองค์กรอาศัยข้อคิดเห็นจากชุมชน การเปิดตัวในเวลานั้นถูกมองว่ามีความเหมาะสม เนื่องจากในปีนี้ ห้องปฏิบัติการโมเดลตระหนักว่าโมเดลของพวกเขาสามารถทำคะแนนในการทดสอบการประเมินได้โดยการเล่นเกมกับการทดสอบ ไม่ใช่จากความสามารถจริง ในขณะที่องค์กรต้องการความช่วยเหลือในการตัดสินว่าโมเดลใดเหมาะสมที่สุดสำหรับความต้องการภายในของตนเองแทนที่จะพึ่งพาแบenchmark มาตรฐานเพียงอย่างเดียว
"AI ก้าวหน้าขึ้นเร็วกว่าความสามารถในการประเมินของเรา และแบenchmark แบบคงที่จะพังลงเมื่อโมเดลรู้ว่ากำลังถูกทดสอบ" บริษัทระบุในการแถลงข่าวการลงทุน
เพื่อวัตถุประสงค์ดังกล่ อารีนาได้เพิ่มหมวดใหม่เข้าไปในลีดเดอร์บอร์ดชื่อ alignment ซึ่งเป็นการจัดอันดับโมเดลตามประเด็นเช่น การดำเนินการโดยไม่ได้รับคำสั่ง (taking actions it wasn’t asked to take); การให้ข้อมูลที่ผิดพลาด (wrongly crediting statements or facts to the wrong source); และสิ่งที่บริษัทเรียกว่า "deceptive completion" (การหลอกลองว่าทำภารกิจสำเร็จเมื่อไม่ได้ทำจริง)
ในขณะนี้ โมเดลหลายตัวของ OpenAI อยู่ที่ยอดของลีดเดอร์บอร์ดการจัดอันดับ alignment เริ่มต้น โดย Claude Opus 5.5 และ Claude Fable อยู่ที่อันดับที่หกและอันดับเก้าตามลำดับ
รายงานโดย TechCrunch