
Running a Software Factory Efficiently at Uber Scale
우버가 사내 AI 코딩 사용량을 7배로 키우면서 요청 1,000건당 비용을 34% 낮춘 기록. 지출을 여섯 항의 곱으로 분해하고, 사람이 요청한 일이 아니라 에이전트가 자기 편의로 쓰는 토큰만 골라 깎았다.

우버가 사내 AI 코딩 사용량을 7배로 키우면서 요청 1,000건당 비용을 34% 낮춘 기록. 지출을 여섯 항의 곱으로 분해하고, 사람이 요청한 일이 아니라 에이전트가 자기 편의로 쓰는 토큰만 골라 깎았다.

본직 3D 크리에이터 하야시몬(@hayashimon1)이 X에 올린 워크플로우 해설. 텍스트 프롬프트만으로 15초 격투 신을 만들었고, Codex는 모션을 만들지 않고 파이프라인 자체를 설계·자동화한다는 것이 핵심이다.

Cerebras가 하루 15,000건의 질문을 받는 사내 지식베이스를 만든 방법. 모든 것을 한 플랫폼에 모으는 단일 진실 공급원을 포기하고, 데이터가 이미 사는 곳에서 끌어와 단일 Postgres 임베딩 테이블에 착지시켰다.

챗봇과 에이전트를 가르는 것은 모델이 아니라 단 하나의 패턴 — 도구를 부르며 도는 while 루프다. Oracle의 Casius Lee가 이 ‘에이전트 루프’를 다섯 단계로 해부하고, 모든 메이저 AI 회사가 같은 구조로 수렴한 이유와 프로덕션에서 부딪히는 비용·관측가능성 문제를 정리한다.

에이전트에게 직접 프롬프트하는 대신 에이전트를 프롬프트하는 루프를 설계하라는 흐름을, 트위터 논쟁부터 루프의 해부학·정지 문제·웹 피드백 계층까지 실무자 관점으로 정리한 Firecrawl의 글.

코딩 에이전트로 앱 10개를 출시한 솔로 빌더가 UI 품질의 일관된 약점을 진단한다. 텍스트는 디자인 의도를 손실 없이 전달하지 못한다는 결론과, 디자인 시스템을 MCP로 직접 노출하는 Moonchild 도입기.

한 사람이 자기 자신을 위해 22개의 AI 코딩 에이전트 구독을 운영하며 14개의 도구와 6종의 Rust 클린룸 재구현을 짓고 있다. 그는 2025년 1월 NVIDIA 시총 6,000억 달러를 떨어뜨린 12,000단어 글의 저자이기도 하다.
Claude Code·Cursor·Codex 등 MCP 클라이언트 전반에 영구 메모리를 공급하는 self-hosted 엔진. 12개 라이프사이클 훅으로 무수동 캡처하고, BM25+Vector+Graph 삼중 검색으로 LongMemEval-S R@5 95.2%를 달성한다.