스타트업 뉴스AI타임스2026년 8월 23일
리퀴드 AI ‘디스파크’, 메모리 병목 뚫었다…소형 모델이 미리 쓰고 대형 모델이 검증
대형언어모델(LLM)의 성능 경쟁이 모델 규모와 정확도를 넘어 실제 추론 속도와 비용 효율성을 높이는 방향으로 확대되고 있다. 특히 AI 에이전트와 온디바이스 AI의 활용이 늘면서 매 토큰 생성 과정에서 발생하는 메모리 병목을 줄이는 기술이 주목받는 가운데, 리퀴드AI가 새로운 추론 가속 기술을 선보였다.리퀴드 AI는 20일(현지시간) LLM의 추론 과정에서 발생하는 병목을 줄이기 위한 ‘디스파크(DSpark)’ 추론 기술을 공개했다.약 3억개 매개변수의 경량 모델이 생성한 토큰을 대형 모델이 한꺼번에 검증하는 방식으로, 모델의 출