Cloudflare Monetization Gateway

Announcing the Monetization Gateway: charge for any resource behind Cloudflare via x402

Cloudflare가 자사 뒤에 있는 모든 리소스(웹 페이지·데이터셋·API·MCP 툴)에 사용량 기반으로 과금하는 Monetization Gateway 대기자 명단을 연다. 정산은 x402 오픈 프로토콜과 스테이블코인으로 이뤄지며, 에이전트가 웹의 주 구매자가 되는 시대에 맞춘 결제 인프라다.

July 8, 2026 · 6 분 · 서소영
134개 태스크 평균 학습 곡선 — 로그-시그모이드 정합

EdgeBench: Unveiling Scaling Laws of Learning from Real-World Environments

ByteDance Seed가 공개한 EdgeBench는 6개 능력군에 걸친 134개 실세계 태스크로 프론티어 에이전트의 12시간 이상 환경 학습을 측정한 벤치마크다. 약 38,000시간의 상호작용을 분석한 결과, 환경 학습 성능은 로그-시그모이드 스케일링 법칙(R²=0.998)을 따르고 학습 속도는 대략 3개월마다 두 배가 된다.

July 6, 2026 · 7 분 · 서소영

Previewing GPT-5.6 Sol: a next-generation model

OpenAI가 차세대 모델 패밀리 GPT-5.6(Sol·Terra·Luna)을 공개했다. 미 정부와 사전 조율한 제한적 프리뷰로 출시하며, Preparedness Framework상 생물·화학·사이버 모두 High 등급에 닿았지만 Critical 임계는 넘지 않았다고 명시한다.

June 27, 2026 · 5 분 · 서소영

How Agents Are Transforming Work

OpenAI가 사내 Codex 사용 데이터로 에이전트형 AI의 업무 침투를 수치화한 공식 보고서. 부서별 사용량은 1년 새 최대 56배 늘었고, 비개발자 사용자는 137배 증가했다. 단, 모든 데이터는 OpenAI 자체 보고이며 외부 검증은 없다.

June 26, 2026 · 4 분 · 서소영

The 4 arguments for the death of software, ranked from worst to best

SignalFire CTO Ilya Kirnos가 소프트웨어 종말론의 4가지 논거를 약→강으로 평가한다. ‘바이브 코딩으로 다 대체된다’는 가장 약한 논거이고, ‘코드가 싸져서 기능 해자가 무너진다’가 가장 진지한 논거다. 진짜 해자는 셋만 남는다 — 고정확도 워크플로우, 독점 데이터 루프, 깊이 자리잡은 시스템 오브 레코드.

June 15, 2026 · 7 분 · 서소영

How the Open Knowledge Format can improve data sharing

Google Cloud의 Data Cloud 팀이 LLM-wiki 패턴을 휴대 가능한 상호운용 포맷으로 정형화한 Open Knowledge Format(OKF) v0.1을 공개했다. YAML frontmatter가 붙은 마크다운 파일 디렉토리로 지식을 표현하며, 벤더·플랫폼·에이전트 프레임워크에 종속되지 않는 형식만으로 에이전트 간 컨텍스트 공유를 가능하게 한다.

June 15, 2026 · 6 분 · 서소영

The path from Fable to superintelligence

Anthropic이 Fable을 출시한 직후 zero_goliath가 쓴 짧은 에세이. 컴퓨트가 아니라 데이터 파이프라인이 진짜 병목이며, RLVR이 한계에 닿으면 AI가 운영하는 실제 회사들의 손익이 다음 보상 신호가 된다고 본다.

June 14, 2026 · 8 분 · 서소영
모델과 도구 사이에서 로그가 중심에 놓인 다이어그램

The Log Is the Agent

Omnara의 Ishaan Sehgal이 쓴 X 아티클. 에이전트의 정체는 모델도 런타임도 아닌 이벤트 로그이며, 로그를 1급 시민으로 다루면 신뢰성과 확장성과 포크와 마이그레이션이 구조적으로 따라온다고 주장한다.

June 13, 2026 · 6 분 · 서소영
AI가 만들어 낸 인터랙티브 isochronic 지도. 클릭하면 인터랙티브 버전으로 이동한다

What it feels like to work with Mythos

와튼 스쿨의 Ethan Mollick이 Mythos급 신모델(Claude 5 Fable) 사전 사용기를 정리했다. 한 번의 큰 지시로 9시간 30분을 자율 실행하는 모델 앞에서, 사용자의 자리는 조종자에서 후원자로 옮겨간다.

June 10, 2026 · 5 분 · 서소영
Figure 1. Taxonomy of code as agent harness.

Code as Agent Harness: 실행 가능하고 검증 가능하며 상태를 지닌 에이전트 시스템을 향하여

UIUC·Meta·Stanford 합동 서베이(2026.05). 코드를 LLM이 생성하는 산출물이 아니라, 에이전트가 추론·행동·환경 모델링·검증을 수행하는 운영 매개체로 다시 잡는 통합적 시각을 제시한다. Harness Interface / Mechanisms / Scaling 세 층으로 문헌을 정리하고, PEV(Plan-Execute-Verify) 루프와 다섯 응용 영역(코드 어시스턴트, GUI/OS, 과학, 개인화, 임베디드)을 짚는다.

June 9, 2026 · 9 분 · 서소영