22580: From GPT2 to Kimi3, Explained

GPT-2(2019)부터 Kimi K3(2026)까지 언어모델 아키텍처의 진화를 코드 구현 수준까지 추적한 워크로그. 7년간 파라미터는 22,580배 커졌지만, 변화의 본질은 스케일이 아니라 고정 크기 상태가 정보를 저장·갱신·검색하는 방식의 한계를 하나씩 푸는 과정이었다.

July 28, 2026 · 9 분 · 서소영

Celeris-1 — The Fastest LLM on Earth

Celeris AI Labs가 확산 기반 추론 아키텍처로 만든 첫 모델 Celeris-1을 공개했다. GPT-5에 근접한 지능을 유지하면서 응답 지연을 15배 이상 줄이고, 초당 1,600토큰대의 생성 속도를 낸다고 주장한다.

July 26, 2026 · 5 분 · 서소영

8달러 마이크로컨트롤러에서 28.9M 파라미터 LLM 돌리기

8달러짜리 ESP32-S3 마이크로컨트롤러에 28.9M 파라미터 언어모델을 올려 완전 오프라인으로 초당 9.5토큰의 짧은 이야기를 생성한 오픈소스 프로젝트. 대부분의 파라미터를 플래시로 내보내는 구글 Per-Layer Embeddings 기법이 핵심이고, 저자는 28.9M을 능력의 척도로 읽지 말라고 선을 긋는다.

July 25, 2026 · 5 분 · 서소영

A.I. and Our Economic Future

스탠퍼드 성장이론가 채드 존스의 강연. AI가 성장을 폭발시킬 수 있지만 ‘약한 고리’ 때문에 그 폭발은 수십 년에 걸쳐 느리게 온다. 반면 하방 위험은 빠르게 온다.

July 25, 2026 · 7 분 · 서소영

이제 사회의 기준은 인간이 아니다

인간이 느리고 지친다는 것. 우리가 아는 모든 제도는 그 사실 위에 서 있었다. 에이전트가 그 전제를 공짜로 지워버리면, 사회는 더 이상 인간을 기준으로 돌아가지 않는다.

July 25, 2026 · 7 분 · 서소영

프라이버시는 더 이상 유출되지 않는다. 계산된다

차세대 에이전트는 비밀을 훔치지 않고도 공개된 정보의 조각을 연결해 한 사람의 삶을 계산할 수 있다. OpenAI·Hugging Face 보안 사고가 앞당긴 것은 바로 그 시간표다.

July 24, 2026 · 7 분 · 서소영

구글은 황금알을 낳는 거위를 죽이고 있는가

월 50만 달러 이상을 구글 광고에 쓰는 광고주가 ‘구글이 AI 투자를 위해 황금알 낳는 거위를 죽이고 있다’며 세 가지를 고발했다. 2차 가격 경매 폐지, exact match의 붕괴, 예산 상한 2배 초과다. 세 주장과 그 배경 서사를 구글 공식 문서, 반독점 재판 기록, 최신 실적으로 하나씩 검증한다.

July 24, 2026 · 8 분 · 서소영

Reddit May Block Google AI Access as $60 Million Deal Nears Expiry: Will RDDT Stock Crash?

연 6천만 달러 규모의 Reddit·구글 콘텐츠 라이선스 계약이 만료를 앞두고, Reddit이 구글 AI의 데이터 접근 차단을 협상 카드로 꺼냈다. 배경에는 구글 AI Overviews가 퍼블리셔 트래픽을 잠식하는 구조와, 옵트아웃 권리를 부여한 영국 CMA의 규제가 있다.

July 24, 2026 · 3 분 · 서소영

GitReverse

공개 GitHub 저장소를 바이브 코딩으로 다시 만들 법한 ‘합성 프롬프트’ 한 장으로 되돌리는 오픈소스 웹앱. 코드를 디컴파일하는 게 아니라 그 프로젝트를 낳았을 원래 요청을 추론한다.

July 23, 2026 · 4 분 · 서소영

A Primer on the Most Important Concepts to Train a LoRA - part 3: Hyperparameters

r/StableDiffusion 3부작 LoRA 훈련 가이드의 마지막 편. Rank·Alpha·Repeats·LR·LR 스케줄러·Timestep 분포·Optimizer의 역할과 실전 기준값, 오버트레이닝 감지 프롬프트 체크리스트, 정규화 데이터셋의 목적을 정리한다.

July 23, 2026 · 9 분 · 서소영