전체기사 최신뉴스 GAM
KYD 디데이
글로벌·중국 글로벌경제

속보

더보기

[중국 특징주] 딥시크, 추론 속도 최대 85% 높인 'DSpark' 공개

기사입력 :

최종수정 :

※ 본문 글자 크기 조정

  • 더 작게
  • 작게
  • 보통
  • 크게
  • 더 크게

※ 번역할 언어 선택

AI 핵심 요약

beta
분석 중...
  • 중국 AI 업체 딥시크가 29일 LLM 가속 프레임워크 디스파크와 도구 딥스펙을 공개했다.
  • 디스파크는 병렬 생성과 부하 인지 검증을 결합해 지연을 줄이고 처리량을 유지하며, 기존 모델 대비 속도와 수용 길이를 크게 높였다.
  • 딥스펙 오픈소스 공개로 투기적 디코딩 구현이 표준화돼 연구자와 엔지니어가 자체 LLM 추론 가속 인프라를 효율적으로 구축할 수 있게 됐다.

!AI가 자동 생성한 요약으로 정확하지 않을 수 있어요.

이 기사는 6월 29일 오전 08시33분 '해외 주식 투자의 도우미' GAM(Global Asset Management)에 출고된 프리미엄 기사입니다. GAM에서 회원 가입을 하면 9000여 해외 종목의 프리미엄 기사를 보실 수 있습니다.

이 기사는 AI 번역에 기반해 생산된 콘텐츠로 중국 유력 경제매체 월스트리트견문(華爾街見聞)의 6월 26일자 기사를 인용했다.  

[서울=뉴스핌] 배상희 기자 = 중국 인공지능(AI) 대형언어모델(LLM) 개발사 딥시크(DeepSeek∙深度求索∙선두추숴)가 V4 버전을 업데이트하면서 추측형 디코딩(Speculative Decoding) 프레임워크 디스파크(DSpark)를 출시하고, 동시에 해당 버전을 지원하는 풀스택 도구 딥스펙(DeepSpec)을 오픈소스로 공개했다.

디스파크는 병렬 생성과 적응형 부하 인지 검증을 결합하여 동일한 처리량을 유지하는 조건에서 사용자 생성 속도를 최대 85%까지 향상시켰으며, 평균 수용 길이도 Eagle3와 DFlash를 전면적으로 초과했다.

DeepSeek-V4-Pro-DSpark는 완전히 새로운 아키텍처 모델이 아니라, DeepSeek-V4-Pro를 기반으로 투기적 디코딩 모듈을 도입한 것이다. 이번 업데이트의 핵심은 모델 성능 자체의 반복이 아니라 엔지니어링 적용에 있다.

디스파크는 이미 DeepSeek-V4(Flash 및 Pro)의 실제 온라인 트래픽에 배포되어, 대형 언어 모델(LLM)의 추론 속도를 크게 가속했다.

디스파크의 핵심 목표는 생산 환경(특히 고동시성 시나리오)에서 LLM 추론이 직면하는 지연과 처리량 병목 문제를 해결하는 데 있다. 간단히 말해, 디스파크는 높은 처리량을 가진 '병렬 생성'과 적응형 '부하 인지 검증'을 성공적으로 결합했다.

추측형 디코딩은 모델 출력 분포를 변경하지 않으면서 대형 언어 모델의 추론을 가속하는 기술이다. 핵심 아이디어는 경량 '초안 모델(draft model)'을 도입하여 여러 개의 후보 토큰을 미리 생성한 뒤, 목표 모델(target model)이 이 후보들을 일괄 검증 및 수용함으로써, 토큰 단위의 순차 생성 방식을 병렬 배치 검증으로 전환하고 종단 간 지연을 크게 줄이는 것이다.

[AI 이미지 = 배상희 기자]

디스파크의 혁신은 반자기회귀 생성 아키텍처(Semi-Autoregressive Generation)를 도입한 데 있다. 병렬 초안 모델의 높은 처리량 장점을 유지하면서, 경량 직렬 모듈을 추가해 블록 내 토큰 간 의존 관계를 모델링함으로써, 병렬 초안 모델이 후반 위치에서 수용률이 감소하는 문제를 완화한다.

이 외에도 하드웨어 인지 기반의 신뢰도 스케줄링 검증(Confidence-Scheduled Verification)이 있다. 기존 추측형 디코딩은 생성된 초안 토큰을 모두 검증에 넘기는 방식이 일반적이었는데, 시스템 부하가 높을 때는 대부분 거절될 가능성이 큰 후반부 토큰이 귀중한 배치 연산 자원을 낭비하게 된다.

디스파크는 신뢰도 헤드(Confidence Head)를 도입해 각 토큰의 생존 확률을 평가한다. 여기에 하드웨어 인지 전용 프리픽스 스케줄러를 결합해, 시스템이 실시간 엔진 처리량 특성에 따라 각 요청별 최적 검증 길이를 동적으로 설정하고, 기대 수익이 높은 토큰에만 연산 자원을 배분한다.

수학 추론, 코드 생성, 일상 대화 등 다양한 분야의 테스트에서 디스파크는 기존 최첨단 자기회귀 모델(Eagle3)과 병렬 초안 모델(DFlash)을 크게 능가했다. 예를 들어 Qwen3 계열(4B, 8B, 14B) 목표 모델에서 평균 수용 길이는 Eagle3 대비 26.7%에서 30.9% 증가했고, 디플래시(DFlash) 대비 16.3%에서 18.4% 증가했다.

이전 세대 단일 토큰 생성 기준(MTP-1)과 비교하면, 동일한 전체 처리량을 유지하는 조건에서 디스파크는 사용자 생성 속도를 각각 60%에서 85%(Flash 모델), 57%에서 78%(Pro 모델)까지 향상시켰다.

디스파크와 함께 오픈소스로 공개된 딥스펙은 투기적 디코딩 초안 모델을 학습하고 평가하기 위한 전 스택 코드베이스다. 이는 해당 솔루션과 기타 최첨단 알고리즘 구현을 담는 '오픈소스 인프라'로, 데이터 준비 도구, 초안 모델 구현, 학습 코드 및 평가 스크립트를 포함한다.

딥스펙은 전체 프로세스를 데이터 준비, 학습, 평가의 세 단계로 나누며, 세 단계는 순차적으로 실행되어야 하고 이전 단계의 출력이 다음 단계의 입력으로 사용된다.

딥스펙의 오픈소스 공개는 그 동안 각 연구팀 내부에 흩어져 있던 투기적 디코딩 엔지니어링 실천을 재현 가능하고 확장 가능한 표준화된 도구 체인으로 통합했다는 의미가 있다. 자체 대형 모델의 추론 가속을 원하는 연구자와 엔지니어에게는, 성숙한 프레임워크 위에서 맞춤형 초안 모델을 직접 학습할 수 있게 되어, 대량의 기초 인프라 구축 작업을 생략할 수 있는 기반을 제공한다.

pxx17@newspim.com

[뉴스핌 베스트 기사]

사진
국회, 한성숙 청문보고서 채택 [서울=뉴스핌] 송기욱 기자 = 한성숙 국무총리 후보자에 대한 국회 인사청문 심사경과보고서가 30일 더불어민주당 주도로 채택됐다. 국민의힘은 회의에 불참했다. 국회 국무총리 임명동의에 관한 인사청문특별위원회는 이날 오전 제5차 회의를 열고 한 후보자 임명동의안 심사경과보고서 채택의 건을 의결했다. [서울=뉴스핌] 이건주 기자 = 26일 오전 서울 여의도 국회에서 한성숙 국무총리 후보자의 인사청문회가 열리고 있다. 2026.06.26 kunjoo@newspim.com 백혜련 위원장은 "전날까지가 청문보고서 채택 마감일이었다"며 "계속해서 국민의힘 의원님들을 설득하고 함께 합의 채택하기를 요청드렸지만 오늘 이 자리까지도 오시지 않았다"고 말했다. 특위는 보고서 종합의견 일부 문구를 수정한 뒤 한 후보자 임명동의안 심사경과보고서를 채택했다. 보고서에는 한 후보자가 국무총리로서 적합하다는 다수 의견과 함께, 국민의힘이 청문 과정에서 제기한 부적격 의견도 함께 담겼다. 한 후보자 임명동의안은 이날 오후 본회의 표결 절차를 밟을 전망이다. 국무총리 임명동의안은 본회의에서 재적의원 과반 출석과 출석의원 과반 찬성으로 의결된다. 민주당이 과반 의석을 확보하고 있는 만큼 국민의힘이 표결에 불참하거나 반대표를 던지더라도 인준안 처리는 가능한 구조다. oneway@newspim.com 2026-06-30 11:58
사진
골드만삭스 "금 랠리 안 끝났다" [시드니=뉴스핌] 권지언 특파원 = 최근 4개월간 부진했던 금 가격이 올해 랠리의 종료를 의미하는 것은 아니라는 분석이 나왔다. 골드만삭스 원자재 리서치 공동 헤드 사만다 다트는 지난 주말 보고서에서 "금은 아직 끝나지 않았다(Gold is not done)"고 주장했다. 다트와 연구팀은 금이 2022년 이후 123% 상승했다는 점을 짚으면서 "구조적 요인과 향후 경기순환적 요인 모두에 힘입어 추가 상승 여력이 있다고 본다"고 설명했다. 금 선물 가격 1년 추이 [AI 일러스트=권지언 기자] ◆ "2026년 말 온스당 4,900달러"…중앙은행 자산 다변화가 핵심 동력 연초 대비 금 가격은 6% 이상 하락한 상태로, 지난 1월 말 사상 최고치를 기록한 이후 조정이 이어지고 있다. 다트는 "구조적으로는 2022년 러시아 외환보유액 동결 이후 이어지고 있는 신흥국(EM) 중앙은행의 자산 다변화가 2026년 말 금 가격 전망치 4,900달러/온스의 근간"이라고 말했다. 연구팀은 또 세계금협회(World Gold Council) 조사에서 올해 2~5월 사이 조사 대상 중앙은행 76곳 중 45%가 향후 12개월 내 금 보유량을 늘릴 계획이라고 응답했다며, 이는 사상 최고 수준이라고 덧붙였다. ◆ 단기 변수는 매파적 연준…ETF 수요는 점진적 회복 전망 다만 경기순환적 측면에서는 단기 역풍도 존재한다. 매파적인 연준 기조가 통화가치 희석(디베이스먼트) 우려를 잠재우고 있는 데다, 시장이 인플레이션 우려 속에 올해 연준의 금리 인상 가능성을 가격에 반영하면서 금리에 민감한 상장지수펀드(ETF) 수요가 압박받고 있다는 설명이다. 다트는 "이러한 역풍은 시간이 지나며 적어도 부분적으로는 반전될 것으로 본다"고 밝혔다. 연구팀은 ETF 포지션이 점차 늘어날 것으로 예상했는데, 이는 연준이 올해는 금리를 동결하고 인하 사이클은 내년 하반기로 미룰 것이라는 골드만삭스 이코노미스트들의 전망과도 일치한다. 다트는 "중기적으로는 서구권의 재정 건전성 우려를 포함한 거시적 변화가 결국 민간 부문의 금 분산투자를 가속화하면서, 금 가격 전망 리스크는 여전히 상방으로 기울어져 있다"고 강조했다. 귀금속 가격은 지난 2월 말 이란 전쟁 발발 이후 급락세를 보이며 금값은 약 24% 떨어졌다. 유가 상승에 따른 인플레이션 지표 악화로 매도세는 더욱 가팔라졌다. 원유 가격이 일부 후퇴했음에도 불구하고, 끈질긴 인플레이션과 견조한 노동시장이 연준으로 하여금 금리를 더 오래 동결하거나 연내 추가 인상에 나서게 할 수 있다는 우려가 투자자들 사이에서 커지고 있다. kwonjiun@newspim.com 2026-06-30 11:21
기사 번역
결과물 출력을 준비하고 있어요.
종목 추적기

S&P 500 기업 중 기사 내용이 영향을 줄 종목 추적

결과물 출력을 준비하고 있어요.

긍정 영향 종목

  • Lockheed Martin Corp. Industrials
    우크라이나 안보 지원 강화 기대감으로 방산 수요 증가 직접적. 미·러 긴장 완화 불확실성 속에서도 방위산업 매출 안정성 강화 예상됨.

부정 영향 종목

  • Caterpillar Inc. Industrials
    우크라이나 전쟁 장기화 시 건설 및 중장비 수요 불확실성 직접적. 글로벌 인프라 투자 지연으로 매출 성장 둔화 가능성 있음.
이 내용에 포함된 데이터와 의견은 뉴스핌 AI가 분석한 결과입니다. 정보 제공 목적으로만 작성되었으며, 특정 종목 매매를 권유하지 않습니다. 투자 판단 및 결과에 대한 책임은 투자자 본인에게 있습니다. 주식 투자는 원금 손실 가능성이 있으므로, 투자 전 충분한 조사와 전문가 상담을 권장합니다.
안다쇼핑
Top으로 이동