뉴스
-
디노티시아, AI 병목 'KV 캐시' 20배 압축하는 기술 공개
디노티시아는 새로운 KV 캐시 압축 기술 'STAR-KV' 논문과 소스코드를 공개했다고 2일 밝혔다. AI가 진화하면서 모델이 처리해야 하는 정보가 커지면서 KV 캐시도 함께 늘어나 GPU 메모리 사용량과
www.etnews.com · 2026.07.02
-
디노티시아, 메모리 병목 해결할 KV 캐시 20배 압축기술 'STAR-KV' 공개
공개된 STAR-KV는 저랭크 압축만으로 KV 캐시를 최대 75% 줄였으며, 혼합정밀도 양자화 기법을 결합해 전체 용량을 최대 20배까지 압축하는 데 성공했다. 특히 용량 압축에 그치지 않고 맞춤형 GPU 커널을 활용한 실행 최적화를 통해 연산 속도까지 끌어올렸다.
zdnet.co.kr · 2026.07.02
-
STARTRADER, 반도체-광네트워킹-원자력 분야 31개 신규 미국 주식 및 ETF CFD로 AI 상품군 확대
Cerebras Systems, CoreWeave, Vertiv Holdings는 각각 AI 칩 아키텍처, GPU 클라우드 인프라, 데이터센터 전력 관리 분야를 다룹니다. STARTRADER 소개 STARTRADER는 MetaTrader, STARTRADER APP, STAR Copy를 비롯한 다양한 플랫폼을 통해 개인 및 기관 파트너가 글로벌 시장에
zdnet.co.kr · 2026.08.14
-
기가바이트, 몰입형 게이밍 플레이그라운드로 게임스컴 2026에서 AORUS INFINITY 선보인다
AORUS MASTER 16 AI 게이밍 노트북은 기가바이트의 독자적인 AI 에이전트 지메이트(GiMATE)를 기반으로 실시간 튜닝을 지원하며, GPU 셀렉터가 탑재된 AORUS RTX Fighter 6)'와 '프라그마타(PRAGMATA)', 마이크로소프트(Microsoft)의 '포르자 호라이즌 6(Forza Horizon 6)', 그리고 스타워즈 제로 컴퍼니™(Star
zdnet.co.kr · 2026.08.20
-
'삼전닉스'가 1000조 투자하는 HBM, 딥시크 논문 한 편의 균열
대규모 언어 모델 추론의 병목은 GPU 연산력이 아니라 HBM 대역폭에 있습니다. GPU는 연산보다 HBM에서 데이터를 가져오는 데 더 많은 시간을 소비합니다. 더욱 중요한 것은 이 스케줄링 로직이 전적으로 GPU 내부에서 실행되며 CPU 개입이 전혀 필요 없다는 점입니다.
www.ohmynews.com · 2026.07.03