스팀 상반기 매출과 신작 비중을 정리한 한국경제 기사 대표 이미지

"AI로 만든 건 재미없어"…더 잘나가는 옛날 게임

스팀 상반기 매출이 반기 사상 최대인데 신작이 가져간 몫은 21%로 떨어졌다. 한국경제 안정훈 기자의 관찰을 축으로 알리니아·SteamDB·Gamalytic·Valve GDC 발표·넥슨 어닝레터를 대조해 본다.

July 21, 2026 · 8 분 · 서소영
Figure 1. 완료 태스크당 모델 비용 — Fable 5는 OpenAI 및 오픈 모델 대비 약 3배 비싸다. (출처: Artificial Analysis, 원문 재인용)

최고의 모델만으로는 왜 부족한가

Emerging Trajectories의 Wojciech Gryc는 Anthropic의 약점이 모델 성능이 아니라 그 성능에 너무 많은 것을 걸고 있다는 데 있다고 진단한다. Kimi K3·Qwen 3.8·GLM 5.2가 그 위험을 드러냈다는 관점의 다이제스트.

July 21, 2026 · 4 분 · 서소영
Figure 1 — LOTUS는 백본이 커져도 명시적 CoT의 정확도 상한을 따라간다

Bridging the Gap Between Latent and Explicit Reasoning with Looped Transformers

앞으로 에이전트는 생각을 굳이 말로 하지 않아도 될 수 있다. LOTUS 논문은 언어 모델의 추론을 사람이 읽는 문장이 아니라 모델 내부의 계산 상태에서 진행하는 방향이, 3B 규모에서 실제로 통한다는 첫 증거를 제시한다. Chain-of-Thought가 사라지는 미래가 성능·효율의 필연으로 다가온다.

July 21, 2026 · 6 분 · 서소영

야코비안 추측이 깨졌다 — 프론티어 AI가 푼 수학 난제들 (2025-2026)

2026년 7월 20일, 야코비안 추측이 87년 만에 반례로 깨졌다. Claude Fable 5가 만든 반례를 시작으로, 2025~2026 프론티어 AI가 손댄 수학 난제들과 그에 대한 수학계의 낙관·회의·제도적 대응을 한자리에 모아 정리한다.

July 20, 2026 · 10 분 · 서소영
원문 커버 이미지

「돌려차기 해」라고 쓰기만 하면 캐릭터가 움직인다 — HY-Motion × Codex × BlenderMCP 파이프라인 전체 해설

본직 3D 크리에이터 하야시몬(@hayashimon1)이 X에 올린 워크플로우 해설. 텍스트 프롬프트만으로 15초 격투 신을 만들었고, Codex는 모션을 만들지 않고 파이프라인 자체를 설계·자동화한다는 것이 핵심이다.

July 20, 2026 · 6 분 · 서소영

OpenMMO: 에이전트와 인간이 동등한 MMORPG

리니지의 아버지 송재경이 혼자서, AI 코딩 에이전트를 협력자로 삼아 만들고 있는 오픈소스 MMORPG. AI 에이전트와 인간 플레이어가 같은 프로토콜로 접속해 서버가 둘을 구분하지 못하는 세계를 지향한다. 중간 공백을 뺀 실작업 약 7개월에 1,152커밋, 약 12만 줄. 그 코드 곳곳에 30년 MMO 운영의 상흔이 남아 있다.

July 20, 2026 · 6 분 · 서소영

Agents-A1-4B

상하이 AI 연구소 InternAgent 팀이 공개한 롱 호라이즌 에이전트 모델 Agents-A1의 4B dense 버전. ‘파라미터가 아니라 호라이즌을 키운다’는 기조로, 장기 궤적과 이종 에이전트 능력을 함께 스케일링해 작은 모델로 큰 모델급 성능에 닿는다.

July 20, 2026 · 5 분 · 서소영
코드는 얼추 스스로 써지지만, 그것을 검토·지시·교정하는 인간은 더 힘들어진다

The Human-in-the-Loop is Tired

LLM으로 코드를 짜는 일은 생산성을 끌어올리는 동시에 개발자를 소진시킨다. Pydantic의 Laura Summers가 ‘감독의 피로’와 ‘인간 보상 함수 문제’를 이름 붙이고, 병목은 처음부터 코드가 아니라 인간의 주의력이었다고 진단한다.

July 20, 2026 · 6 분 · 서소영
Figure 1. 2026년 3월~7월 ARC-AGI-3 RHAE 결과. 채워진 마커는 ARC Prize 검증, 빈 마커는 Public set 자가보고. 마젠타색이 Schema이며 두 점 모두 자가보고다.

Schema — 올바른 하니스만으로 프론티어 모델이 ARC-AGI-3 Public에서 99%에 닿다

모델 가중치는 그대로 두고 ‘쓰는 방식’만 바꾼 에이전트 하니스 Schema가 ARC-AGI-3 Public에서 자가보고 98.98%를 기록했다. 핵심은 세계 모델을 읽고 diff할 수 있는 실행 가능한 프로그램으로 만들어, 기록된 현실 전체에 대해 검증하고, 그 안에서 계획을 탐색하는 것이다.

July 19, 2026 · 8 분 · 서소영
터레인 뷰로 본 같은 세션

mindwalk

Claude Code·Codex의 세션 로그를 코드베이스의 3D ‘밤의 지도’ 위에서 빛의 이동으로 재생하는 로컬 시각화 도구. 에이전트가 무엇을 했는가가 아니라 태스크를 어떻게 이해했는가를 한눈에 보여준다.

July 19, 2026 · 5 분 · 서소영