MAZE BENCH
모델 리더보드
KO
EN
☾
리더보드
리플레이
미로 크기
불러오는 중
공개 결과를 읽고 있습니다.
모델 순위
Github/hehee9
순위
모델명
점수
비용
총 토큰
↑
순위
↑
?
모델명
↕
?
점수
↕
비용
↕
총 토큰
↕
표시할 모델 결과가 없습니다.
주요 모델 미로 크기별 성적
Github/hehee9
모델 선택
0
전체 미로 성적
Github/hehee9
모델 선택
0
비용-성적
선형
로그
Github/hehee9
모델 선택
0
모든 모델은 추론 활성화 상태입니다.
추론 강도 조절을 지원할 경우, medium 또는 8K 예산을 가집니다.
표의 점수는 선택 범위 내 개별 미로 점수의 평균입니다.
개별 점수 = 100 × P × E
P = m/(m+r) · E = D/(m+r)
D
최소 명령 수
m
성공한 명령 수
r
남은 최소 명령 수