스페이스XAI, 새 AI모델 그록4.5 출시…"클로드 오퍼스급" | 연합뉴스
오퍼스보다 3∼4배 낮은 가격으로 경쟁…머스크 "속도 두배 이상 늘릴것"
일론 머스크의 인공지능(AI) 기업 스페이스XAI가 커서와 공동으로 개발한 AI 모델을 내놨다.
스페이스XAI는 코딩, 에이전트 작업, 사무 업무에 최적화한 '그록 4.5'를 선보인다고 8일(현지시간) 밝혔다.
지금까지 그록은 클로드·GPT·제미나이 등 선도 AI 모델보다 다소 뒤처진다는 평가를 받았으나, 이날 발표한 그록4.5는 이들 모델에 필적하는 수준으로 성능을 끌어올렸다.
성능지표(벤치마크)로 보면 터미널 환경 코딩 능력을 재는 '터미널-벤치 2.1'에서 83.3%의 점수를 얻어 클로드 오퍼스4.8(78.9%)보다 높고 GPT-5.5(83.4%)와 유사한 수준을 보였다.
파이선·자바·C 등 언어 코딩 성능을 측정하는 'SWE-벤치 프로'와 'SWE-벤치 멀티링구얼'에서는 반대로 오퍼스4.8보다는 낮았지만 GPT-5.5보다는 높은 성적표를 받았다.
스페이스XAI는 그록이 이외에도 복잡한 엑셀 모델을 구축할 수 있으며, 파워포인트와 워드에서도 활용할 수 있다고 소개했다.
머스크 최고경영자(CEO)는 사회관계망서비스(SNS) 엑스(X·옛 트위터)에 "내부 평가 결과로 그록4.5는 오퍼스4.7과 대략 비슷한 수준이지만 속도는 훨씬 빠르다"며 "우리는 성능지표가 아니라 실제 활용 가치를 중심으로 개발하고 있다"고 강조했다.
이어 "속도를 현재의 2배 이상으로 높이는 것도 가능할 것으로 보인다"고 예고했다.
AI 모델 평가업체이느 아티피셜 애널리시스는 그록4.5를 54점으로 평가해, 클로드 페이블5(60점), 오퍼스4.8(56점), GPT-5.5(54점)에 이어 4번째로 높은 순위에 올렸다.
이는 클로드 소넷5(53점), 제미나이3.5 플래시(50점), 제미나이3.1 프로(46점)보다 높은 순위다.
https://twitter.com/elonmusk/status/2074740539874775163
https://twitter.com/elonmusk/status/2074893922812252354
Introducing Grok 4.5 | SpaceXAI
https://twitter.com/SpaceXAI/status/2074915721684086811
https://twitter.com/SpaceXAI/status/2074915723487678904
https://twitter.com/elonmusk/status/2074955486441492823
https://twitter.com/SpaceXAI/status/2074915724972441845
https://twitter.com/SpaceXAI/status/2074915726155211036
https://twitter.com/elonmusk/status/2074956673630793891
https://twitter.com/ArtificialAnlys/status/2074942097158021371
https://twitter.com/elonmusk/status/2074948489792860456
https://twitter.com/elonmusk/status/2074969374843154500
https://twitter.com/elonmusk/status/2074970378682724661
https://twitter.com/elonmusk/status/2074971866662359519
Grok 4.5 (high) - Intelligence, Performance & Price Analysis
https://twitter.com/ArtificialAnlys/status/2074956932289282087
https://twitter.com/elonmusk/status/2074963933199282491
https://twitter.com/ArtificialAnlys/status/2074956935800259045
https://twitter.com/ArtificialAnlys/status/2074956939554156617
https://twitter.com/ArtificialAnlys/status/2074956943517725151
https://twitter.com/ArtificialAnlys/status/2074956948831924402
https://twitter.com/ArtificialAnlys/status/2074956952271225248
https://twitter.com/ArtificialAnlys/status/2074956955618005072
Separating signal from noise in coding evaluations | OpenAI
https://twitter.com/OpenAI/status/2074972179385720836
https://twitter.com/OpenAI/status/2074972180769907186
https://twitter.com/OpenAI/status/2074972182640492731
https://twitter.com/OpenAI/status/2074972185895342084