Trong số các mô hình có Tỷ lệ vượt qua tất cả được kiểm soát ảo giác (Hallucination-Gated All-Pass Rate) trên 0%, bốn mô hình thiết lập đường biên Pareto về điểm số so với Chi phí cho mỗi tác vụ: GPT-6 Luna (max), GPT-6.1 Sol (max), Muse Spark 1.3 (max) và Grok 4.7 (xhigh). Grok 4.7 (xhigh) dẫn đầu ở mức ~$9,50 mỗi tác vụ và Muse Spark 1.3 (max) theo sau https://t.co/SEXHCnhZtD
Among models with a Hallucination-Gated All-Pass Rate above 0%, four set the Pareto frontier for score vs. Cost per Task: GPT-6 Luna (max), GPT-6.1 Sol (max), Muse Spark 1.3 (max) and Grok 4.7 (xhigh). Grok 4.7 (xhigh) leads at ~$9.50 per task and Muse Spark 1.3 (max) comes https://t.co/SEXHCnhZtD
Đoạn trích bài viết
Trong số các mô hình có Tỷ lệ vượt qua tất cả được kiểm soát ảo giác (Hallucination-Gated All-Pass Rate) trên 0%, bốn mô hình thiết lập đường biên Pareto về điểm số so với Chi phí cho mỗi tác vụ: GPT-6 Luna (max), GPT-6.1 Sol (max), Muse Spark 1.3 (max) và Grok 4.7 (xhigh).
Toàn văn bài viết
Mở bài viết gốc
Đọc bài viết đầy đủ trên x:@ArtificialAnlys
Mở bài gốc để xem trọn vẹn chi tiết và dẫn chứng.