IT뉴스모아news terminal

article detail

인셉션, 초당 1107토큰 생성하는 ‘머큐리 2.5’ 공개..."지능·비용 다 잡았다"

AI타임스
2026. 9. 9. 오후 6:11
인셉션, 초당 1107토큰 생성하는 ‘머큐리 2.5’ 공개..."지능·비용 다 잡았다"

AI 요약

인셉션 랩스는 8일(현지시간) 생성 품질을 크게 높이면서도 초저지연·저비용 특성을 유지한 확산 LLM ‘머큐리 2.5’를 공개했으며, 이전 버전인 머큐리 2보다 지능 성능이 40% 향상되고 엔비디아 GPU에서 초당 1107토큰을 생성하면서 최대 26만 토큰의 컨텍스트를 지원한다고 발표했습니다. 정식 가격은 입력 토큰 100만개당 0.20달러, 출력 토큰 100만개당 0.75달러이며 출시 초기에는 80% 할인된 입력 0.04달러, 출력 0.15달러로 제공되고 조절 가능한 추론 기능, 병렬 도구 호출, 스키마 기반 JSON 출력 등을 지원한다고 밝혔습니다. 실제 적용 사례로 오픈콜은 응답 지연시간 중앙값을 약 170밀리초로 낮췄고 어그먼트 코드는 컨텍스트 압축 전환으로 지연을 약 150초에서 27초로 줄이며 비용을 90% 절감했으며, 머큐리 보이스와 머큐리 라우터 프리뷰가 공개되고 인셉션 API, 베이스텐, 오픈라우터를 통해 이용 가능하다고 전했습니다.

원문보기