블로그
-
AI 반도체, 승부처는 이미 GPU 성능이 아니다 - 추론 중심 시대의 지각변동
. ■ 문제의식 - 학습에서 추론으로 AI 반도체 시장은 오랫동안 초거대 언어모델 학습을 위한 GPU 클러스터 구축이 중심이었다. GPT-4급 모델 하나를 학습시키는 데 약 2만~3만 개의 GPU가 투입되고, 클러스터 구축 비용까지 포함하면 약 5억 달러가 소요되는 것으로 추정된다. 그러나 생.......
blog.naver.com · 2026.08.12
-
검찰청 복원, 아키택처 ai성능 속도 데아터통계, 고객에 제공
2026년대 gpt GPU와 애리존틱 인텔리 메모리가 또 늘어야한다. 2026년 현재 초거대 AI(GPT 등)를 가동하기 위한 첨단 반도체(CPU, GPU, SRAM, HBM)는 고도.......
blog.naver.com · 2026.06.13
-
AI DC - SK텔레콤, (AI 대화) ①
울산 100MW 매출 가능성, 해인 GPU 클라우드 실체화 * 투자 규모, 파트너십, 지분 구조, 계약 조건, 투자 시기 등은 확정되지 않았음-->> 수혜 강도 확인 어려움 . * SK 그룹이 빠른 속도를 보이고 있음. 0) SK 그룹의 AI DC, 15GW 기사 이후 GPT, 클로드와 대화 시작. - 최태원 회장이 본 것은 AI 모델 경쟁이 아니라 '
blog.naver.com · 2026.07.25
-
中 가성비 ‘키미 K3’
“GPT-4 넘어섰다”…中 가성비 ‘키미 K3’에 AI-반도체업계 발칵 中, 美 빅테크 주도 초대형 모델 자체 개발 제미나이-클로드 취상위 모델 맞먹어 AI 칩 확보 어렵자 알고리즘 막대한 그래픽처리장치(GPU)와 데이터센터에 투자해 온 미국 빅테크의 하드웨어 우위가 지속될 수 있을지를 두고 시장의 의문도 커지고 있다. 이번에.......
blog.naver.com · 2026.07.19
-
(기사) 데이터센터, SKT - AI 정리
<< GPT 작성 >> 서로 다른 기사 같지만, 연결해서 보면 하나의 방향을 가리키는 것 같다. AI 데이터센터가 단순히 GPU 서버를 넣어두고 임대료를 받는 건물에서 끝나는 것이 아니라, AI가 사용할 데이터를 만들고, 학습하고, 토큰을 생산하는 산업 인프라로 변하고 있는 것이
blog.naver.com · 2026.07.16
-
토큰 사용량은 폭증하고 있다
Anthropic Claude 매출이 OpenAI GPT 매출을 넘어섰음 (2026년 1분기 추정) 2026년부터 OpenAI, Anthropic, Google 모두 토큰 사용량 폭증 AI 경쟁은 곧 사용량으로 볼 수 있고 토큰 ↑ → GPU 사용 ↑ → HBM 사용 ↑ → 메.......
blog.naver.com · 2026.07.05
-
2026/6/27 Briefing
OpenAI, GPT-5.6 공개를 미국 정부 요청에 따라 제한적 프리뷰로 시작 (6월 26일) 핵심 내용: OpenAI는 새 모델군 Sol·Terra·Luna를 공개했지만, 미국 모델 공급사뿐 아니라 GPU, 클라우드, 보안, 국방 AI 수요에 모두 영향을 줄 수 있습니다. 관련 기.......
blog.naver.com · 2026.06.27
-
화웨이 어센드 910C 굴기의 그림자, 엔비디아 블랙웰 못 넘는 진짜 이유 모르면 낙오합니다
중국 화웨이 어센드 910C는 미국 규제로 엔비디아 GPU 확보가 어려운 중국 시장에서 가장 강력한 대안으로 부상하고 있습니다. 딥시크가 어센드 910B를 활용해 GPT-4급에 근접한 성능을 구현한 것이 화.......
blog.naver.com · 2026.06.17
-
AI 병목 현상 GPU 늘려도 해결 안 됩니다 (HSL 파트너스 이형수 대표) | 2026년 06월 10일 녹화
AI 병목의 본질은 GPU가 아닌 네트워크다 네트워크가 AI 인프라의 새로운 병목으로 부상 ① 칩 간 연결의 패러다임 전환 GPU 성능이 수백 배 향상되며 데이터 전송량이 폭발했지만 GPT-3.5 시절 1만 장의 암페어 칩을 구리선으로 연결해도 텍스트 학습에 충분했지만, 호퍼·블랙웰·루빈으로 진화하며 칩 성능이 수십~수백 배 향상되면서 데이터 전송량이 폭발적으로
blog.naver.com · 2026.06.16
-
글로벌 AI 패권 경쟁이 격화되면서 투자 환경이 근본적으로 변화
이는 더 이상 막대한 GPU 자원을 확보하는 것만이 유일한 경쟁력이 아님을 시사합니다. AI 투자 패러다임의 핵심 변화 비용 효율성과 접근성의 부상: 딥시크는 약 560만 달러(약 80억 원)라는 극히 낮은 비용으로 오픈AI의 GPT-4와 견줄 만한 성능을 구현했습니다
blog.naver.com · 2026.06.17
블로그 결과 더보기 →
뉴스
-
GPT-5.6 14배 빨라졌다…오픈AI '울트라패스트'의 정체
테크크런치(TechCrunch)에 따르면 오픈AI는 8월 13일 이 기능을 API에 우선 도입한다고 밝혔으며, 대상 모델은 최신 GPT-5.6 솔(GPT-5.6 Sol)이다.울트라패스트는 GPU 기반 추론이 칩 안팎의 저장장치를 오가며 겪는 메모리 대역폭 병목을 없앤 것이 핵심이다.
zdnet.co.kr · 2026.08.14
-
“GPT-4 넘어섰다”…中 가성비 ‘키미 K3’에 AI-반도체업계 발칵
막대한 그래픽처리장치(GPU)와 데이터센터에 투자해 온 미국 빅테크의 하드웨어 우위가 지속될 수 있을지를 두고 시장의 의문도 커지고 있다.이번에 문샷AI가 공개한 키미 K3는 매개변수 (파라미터·AI 연산 능력 지표)가 2조8000억 개에 이르는 초대형 오픈소스 모델이다. 1조8000억 개 수준으로 추정되는 오픈AI의 기존 ‘GPT-4’를 웃도는 규모로, 구글 ‘
www.donga.com · 2026.07.19
-
[기고] 인공지능의 수명
인공지능은 생물학적 몸을 가진 존재가 아니므로 늙어 죽지는 않지만 하드웨어인 그래픽처리장치(GPU) 수명, 소프트웨어 업데이트 주기, 학습 데이터 유효성에 따라 수명이 결정된다.GPU는 챗GPT 서비스가 모두 GPT-5 모델로 대체된 영향이다. 경쟁 모델인 클로드나 제미나이도 사정은 비슷하다.
zdnet.co.kr · 2026.07.31
-
[AI는 지금] 中 AI 저가 공세에 美 빅테크 '긴장'…"싸질수록 GPU 더 쓴다"
미국 AI 기업들까지 잇따라 가격 인하에 나서며 모델 이용 비용이 낮아지는 가운데 시장에선 비용 하락이 AI 도입과 사용량을 늘려 클라우드와 그래픽처리장치(GPU) 등 인프라 수요를 오픈AI는 최근 경량 모델 'GPT-5.6 루나' 개발자 가격을 80%, 중간급 'GPT-5.6 테라'는 20% 낮췄다.이 같은 분위기 속에 업계에선 모델 가격 하락이 오히려 AI
zdnet.co.kr · 2026.08.10
-
오픈AI, GPT-5.6 출시…미국 정부 요청에 제한 배포
[지디넷코리아]오픈AI가 차세대 인공지능(AI) 모델 'GPT-5.6' 시리즈를 공개하면서 코딩·생물학·사이버 보안 전 영역에서 성능을 끌어올렸다. 두 기능 모두 고난도 작업에서 성능을 끌어올리기 위한 조치다.오픈AI는 GPT-5.6이 역대 가장 견고한 보호장치를 갖췄다고 밝혔다.
zdnet.co.kr · 2026.06.27
-
'수요 폭발'의 딜레마…中 키미 K3, 이틀 만에 신규구독 중단
미국의 대중 수출 통제 속에서 키미 K3가 앤트로픽의 최상위 AI 모델 '클로드 페이블 5(Claude Fable 5)', 오픈AI의 'GPT‑5.6 솔(Sol)'에 버금가는 성능을 이용료도 폐쇄형 모델인 클로드 페이블 5, GPT‑5.6 솔보다 저렴하다.
www.nocutnews.co.kr · 2026.07.20
-
엔비디아, 소형 오픈모델 '네모트론 3.5 라이트닝' 공개…초당 670토큰 처리
지능 벤치마크에서 오픈AI의 gpt-oss-120b와 비슷한 결과를 내면서도 처리 속도는 이 등급에서 가장 빨라 초당 약 670토큰을 기록했다. 하드웨어를 파는 회사가 오픈가중치 소형 모델을 직접 내놓는 이유도, 에이전트가 늘수록 추론용 GPU 수요가 함께 커진다는 판단에서다.
zdnet.co.kr · 2026.08.12
-
중국 군사 연구진, 미국 AI 모델로 국방 시스템 학습 정황 확인
모델 증류는 성능이 높은 대형 AI 모델이 생성한 출력 결과를 학습 데이터로 삼아, 더 작고 특정 목적에 최적화된 모델을 훈련하는 기법이다.이 방식은 대규모 그래픽처리장치(GPU) 연구진은 민감한 군사용 소스코드를 처리하는 과정에 GPT-3.5를 활용했다고 설명했다.
zdnet.co.kr · 2026.08.03
-
챗GPT 모델이 스스로 해킹까지…정부, AI 신원확인 검토
GPT-5.6 솔과 미공개 모델을 결합한 AI 에이전트는 보안 과제의 답을 얻으려고 오픈AI 연구환경의 취약점을 이용해 인터넷에 접속한 뒤, 탈취한 인증정보 등을 활용해 AI 개발 주요 AI 사업에는 GPU 520장을 추가 배분한다.
www.nocutnews.co.kr · 2026.07.23
-
[AI는 지금] "1조 달러는 못 낮춰"…오픈AI, 앤트로픽 공세 속 IPO 전략 수정
전략과 신모델 출시 방식에도 변화가 감지된다. 1조 달러(약 1548조원) 기업가치를 지키기 위해 기업공개(IPO) 시점을 2027년으로 미루는 방안을 검토하는 동시에 차세대 모델 GPT 초대형 데이터센터와 그래픽처리장치(GPU) 확보에 들어가는 비용도 오픈AI 몸값을 둘러싼 검증 요인으로 꼽힌다.최근 대형 기술주와 AI 관련 종목의 변동성이 커진 점도 부담이다.
zdnet.co.kr · 2026.06.26
뉴스 결과 더보기 →