구글이 안드로이드 앱을 만들기 위한 최상위 AI 모델을 선정했는데, 제미니가 GPT에 뒤처졌다
구글이 안드로이드 벤치(Android Bench) 순위를 업데이트했습니다
구글은 안드로이드용 개발을 위한 최상위 인공지능 모델 목록을 다시 검토했습니다. 새 리스트에는 많은 공개 가중치와 각 모델 사용 시 토큰 수 및 비용에 대한 상세 통계가 포함되었습니다.
테스트에서 새로운 내용
- 평균 지연 – 10번 실행 중 100개의 과제를 해결하는 데 걸린 시간.
- 총 토큰 수 – 한 번 실행당 평균 토큰 소비량(10번 실행 합계).
- 비용 – 하나의 벤치마크를 실행할 때 발생하는 미국 달러 비용.
이 지표들은 결과를 더 투명하게 만들고, 속도뿐 아니라 모델의 경제적 효율성까지 비교할 수 있게 합니다.
최우수 모델
순위 모델 주요 데이터
1 OpenAI GPT 5.5 (2024년 5월 18일) 약 2% 빠르지만 Gemini 3.1 Pro보다 운영 비용이 더 높음
2 Google Gemini 3.1 Pro 리더 중 가장 경제적; GPT 5.5의 거의 두 배 저렴함
3 OpenAI GPT 5.4 Gemini 3.1 Pro와 동일 수준이지만 GPT 5.5에 비해 속도가 느림
4 GLM 5.1 (오픈 모델) 공개 가중치 중 최고 성능
다음 기대
구글은 최근 Gemini 3.5 Flash를 발표했으며, 곧 더 강력한 Gemini 3.5 Pro가 출시될 예정입니다. 이들이 현재 리더 GPT 5.5와 어떻게 경쟁하고 비용 및 속도 지표가 얼마나 변할지 주목됩니다.
따라서 안드로이드 벤치는 이제 어떤 모델이 빠른지를 보여줄 뿐 아니라, 안드로이드 앱 개발 시 인공지능 활용의 경제적 측면을 평가하는 데에도 도움을 줍니다
댓글 (0)
의견을 남겨 주세요. 예의를 지키고 주제에서 벗어나지 말아 주세요.
댓글을 남기려면 로그인