스페이스XAI가 개발자용 차세대 음성 에이전트 모델 '그록 보이스 싱크 패스트 2.0'을 출시했다. 음성과 동시에 추론을 수행하면서도 효율을 높여 응답 지연 없이 복잡한 질문을 처리할 수 있으며, 24개 언어 평가에서 딥그램 노바3와 일레븐랩스 스크라이브 v2보다 1.5~2배 높은 음성 인식 정확도를 기록했다. 아티피셜 애널리시스 음성 AI 벤치마크 종합 점수는 82.9%로 이전 버전(75.7%)과 GPT-리얼타임-2.1(79.1%), 제미나이 3.1 플래시(69.5%)를 모두 앞섰으며, 첫 응답 시간도 1.25초에서 0.70초로 단축됐다. 오디오 1분당 0.08달러로 제공되며, 8월 5일부터 기본 모델 'grok-voice-latest'가 자동으로 이 모델로 전환된다.
- •스페이스XAI, 차세대 음성 에이전트 모델 '그록 보이스 싱크 패스트 2.0' 출시
- •음성 인식 정확도가 딕그램 노범3·일레무랜프 스크라이브 v2보다 1.5~2배 높음
- •음성 AI 벤치마크 종합점수 82.9%로 GPT-리얼타임-2.1(79.1%)·제미나이 3.1 플래시(69.5%) 상회
- •첫 응답 시간 1.25초→0.70초로 단축, 오디오 1분당 0.08달러
- •8월 5일부터 기본 모델 'grok-voice-latest'가 자동으로 신모델로 전환
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
스페이스XAI, 차세대 음성 모델 '그록 보이스 싱크 패스트 2.0' 출시
본문 미리보기
스페이스XAI는 29일(현지시간) 개발자용 차세대 음성 에이전트 모델인 '그록 보이스 싱크 패스트 2.0(Grok Voice Think Fast 2.0)'을 출시했다.이 모델은 기존 1.0 버전을 바탕으로 지능과 음성 전사 정확도, 자연스러운 대화 능력, 도구 호출 신뢰성을 크게 향상한 것이 특징이다.음성과 동시에 추론을 수행하는 구조를 유지하면서도 추론 효율을 크게 높였다. 이를 통해 응답 지연을 늘리지 않으면서도 복잡한 질문을 처리할 수 있으며, 실제 서비스에서는 에이전트가 첫 문장을 끝내기 전에 필요한 외부 도구 호출을 완료하
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 11:30AI 초안
