소형 언어모델(sLLM)의 시대: 프론티어급 지능이 딥가젯 서버 한 대 값까지 내려왔다
2026년 여름 한 달 남짓 사이에 오픈웨이트 AI 모델이 쏟아졌습니다. 수백 B 규모인데도 저렴하고 빠르게 서비스되는 이유, 그리고 직접 구축할 때 필요한 GPU 장수를 정리했습니다.
AI의 기억은 저장한 뒤부터 어려워진다
컴퓨터는 기록을 정확히 저장하는데 AI는 왜 오래된 기록을 현재 값처럼 사용할까요? AI 장기기억의 구조, RAG의 한계와 GPU 비용을 살펴봅니다.
AI 토큰 한 개가 데이터센터를 통과하는 길
엔터를 누른 뒤 첫 토큰이 화면에 나타나기까지, 시간과 돈과 전기는 어디에 쓰일까
펠리컨 한 마리로는 부족했다
그래서 누군가는 AI 마을을 통째로 만들었다