너도나도 돈방석 앉은 줄 알았더니…쏟아지는 AI숏폼의 반전, 98.7%가 '쪽박'

더우인에 상반기에만 AI 마이크로 드라마 22만 편이 올라와 누적 조회 5157억 회를 넘겼지만, 손익분기선을 넘긴 작품은 77편당 1편꼴로 추산됐다. 중국은 투자액별 3분류 심사와 AI 표시 의무를 담은 「미니 드라마 발전 관리 방법」을 9월 1일 시행했다.

September 1, 2026 · 7 분 · 서소영

WikiSkill: Compiling Agent Experience into Persistent Knowledge for Skill Evolution

Google Research가 에이전트 스킬을 자동으로 고쳐 나갈 때, 실행 경험을 영속 위키에 먼저 정리하고 그 위에서 스킬을 손보게 했다. 다섯 모델과 다섯 벤치마크에서 기존 스킬 진화 기법을 모두 앞섰고, 위키를 떼어내면 그 평균이 48.7%에 그친다.

September 1, 2026 · 11 분 · 서소영

Automata from Agent Traces: Failure and Next-Step Prediction

LLM 에이전트의 실행 로그 전체를 상태 7개에서 43개짜리 유한 상태 기계 한 대로 압축하면, 다음 행동 예측과 실패 예측과 런타임 감시가 같은 구조물 위에서 동시에 해결된다. 그리고 그 구조물의 모양은 모델이 아니라 배포 하네스가 정한다.

September 1, 2026 · 8 분 · 서소영

[인터뷰] "BM이 게임을 결정한다는 관점, 한국에서 얻었습니다"

<일본 게임의 역사> 저자 이와사키 히로마사는 ‘무엇을 어떻게 파느냐가 게임의 형태를 결정한다’는 관점으로 50년을 정리했다. 그 관점은 2008~2011년 한국에서 정액제 게임을 F2P로 바꾸는 일을 맡으며 얻은 것이다.

September 1, 2026 · 9 분 · 서소영

4DAnyone: Create Anyone in 4D from a Casual Monocular Video

휴대폰으로 대충 찍은 단안 영상 한 편에서 자유 시점 4D 인간을 복원한다. 시점 수를 수십 개로 늘리면 일관성이 무너지던 원인을 어텐션 컨텍스트 용량 한계로 규명하고, 참조 컨텍스트 압축과 타깃 그룹 회전이라는 두 설계로 푼다.

August 31, 2026 · 10 분 · 서소영

yanliudesign/mono-color-skill: Monocolor Editorial Print

한 판 또는 두 판의 잉크로 편집 인쇄물을 만드는 Claude Code 스킬. 34KB 산문 지침과 기계 판독 카탈로그 7종, 16개 평가 케이스로 인쇄 디자인의 취향을 결정론적 계약으로 옮겼다.

August 31, 2026 · 9 분 · 서소영

Running a Software Factory Efficiently at Uber Scale

우버가 사내 AI 코딩 사용량을 7배로 키우면서 요청 1,000건당 비용을 34% 낮춘 기록. 지출을 여섯 항의 곱으로 분해하고, 사람이 요청한 일이 아니라 에이전트가 자기 편의로 쓰는 토큰만 골라 깎았다.

August 31, 2026 · 10 분 · 서소영

Engine-Native Editable 3D World Reconstruction with Objects and Lighting

사진 한 장에서 UE5나 Blender가 그대로 불러올 수 있는 오브젝트와 광원을 뽑아내는 벤치마크 Lumera. 3D 박스 파싱은 기존 방법을 크게 앞섰지만, 개별 광원의 위치 추정은 F1 0.209에 머물러 있다.

August 31, 2026 · 9 분 · 서소영

There's no such thing as Just a Tool

엔지니어가 습관처럼 쓰는 ‘그건 그냥 도구일 뿐’이라는 반박을, 하이데거의 손안에 있음 개념으로 해체한 기술 비평. 도구는 사람과 하나의 게슈탈트를 이루고 그 사람의 세계관을 바꾸며, 그 도구를 만드는 쪽은 다름 아닌 우리 업계다.

August 31, 2026 · 10 분 · 서소영

MemTrapBench: Benchmarking Cognitive Traps in LLM Memory Use

기억이 정확하게 저장되고 정확하게 검색되어도 모델의 추론을 망가뜨릴 수 있다. 저장·검색이 아니라 검색된 기억이 현재 과제에 미치는 영향을 재는 벤치마크에서, 다섯 개 메모리 프레임워크가 전부 무기억 기준선보다 낮은 점수를 받았다.

August 30, 2026 · 7 분 · 서소영