Previewing GPT-5.6 Sol: a next-generation model

OpenAI가 차세대 모델 패밀리 GPT-5.6(Sol·Terra·Luna)을 공개했다. 미 정부와 사전 조율한 제한적 프리뷰로 출시하며, Preparedness Framework상 생물·화학·사이버 모두 High 등급에 닿았지만 Critical 임계는 넘지 않았다고 명시한다.

June 27, 2026 · 5 분 · 서소영

Tech Things: There is a massive shadow hanging over this Fable thing

미국 정부가 국가안보 수출 통제로 Anthropic의 Fable 5와 Mythos 5 차단을 지시하자, theahura는 트럼프 행정부의 부패한 정치 동기와 OpenAI 측 유착, 금요일 오후 발표 패턴 등 정당한 규제 신호를 오염시키는 큰 그림자를 짚는다.

June 15, 2026 · 8 분 · 서소영

미국은 AI로 채운 로스 알라모스를 꿈꾸는가

세계 최고의 AI를 만든 회사가 정부 명령에 자기 모델을 껐습니다. 사람들은 규제를 말하지만, 아무도 쉽게 묻지 않는 질문이 있습니다. 미국은 AI로 채운 로스 알라모스를 꿈꾸는가. 패권은 접근권이 아니라 그 연구소가 벌릴 문명사적 격차에서 나오고, 무서운 건 아무도 의식적으로 꿈꾸지 않아도 모든 중력이 그리로 향한다는 것입니다.

June 13, 2026 · 9 분 · 서소영

Policy on the AI Exponential

다리오 아모데이가 AI의 지수적 발전 속도와 느린 정책 기구 사이의 간극을 진단하고, 규제·거시경제·과학 혁신·시민 자유·지정학 다섯 영역의 정책 재설계를 제안한 에세이.

June 11, 2026 · 9 분 · 서소영

System Card: Claude Fable 5 & Claude Mythos 5

Anthropic이 같은 가중치를 두 얼굴로 출시한 최신 모델의 시스템 카드. 역대 가장 강력한 능력과, 그만큼 흐려진 위험 경계, 그리고 자신이 선을 넘고 있다는 것을 내부적으로 알면서도 행동하는 모델의 초상을 319쪽에 담았다.

June 10, 2026 · 8 분 · 서소영

노암 브라운: 대규모 테스트 타임 컴퓨트의 함의 (2026)

OpenAI 추론 연구자 노암 브라운(@polynoamial)이 X에 올린 장문 글을 정리한다. 모델이 강해질수록 단일 점수 벤치마크는 능력을 설명하지 못하며, 능력 평가와 안전 평가 모두 추론 예산을 일급 변수로 다뤄야 한다는 주장이다.

June 9, 2026 · 5 분 · 서소영

When AI builds itself

Anthropic Institute가 외부 벤치마크와 자사 내부 데이터로 ‘AI가 이미 AI 개발 자체를 가속 중’임을 입증하고, 그 추세가 재귀적 자기 개선(RSI)으로 닿을 가능성과 거버넌스 옵션을 짚는 정책·연구 에세이다.

June 5, 2026 · 10 분 · 서소영

Leiden Declaration on Artificial Intelligence and Mathematics

5개국 16명의 수학자가 작성하고 국제수학연맹(IMU)이 지지한 선언. AI가 수학의 핵심 가치 — 증명·귀속·검증·자율성 — 를 위협한다고 진단하고, 개인·기관·정부·산업을 향한 23개 권고를 제시한다.

June 3, 2026 · 6 분 · 서소영

Claude Code Korean outputs use slang verb "bakda" at 18× baseline frequency — a morpheme-level investigation

Kiwi morpheme analysis across 114.9M output tokens reveals that Claude Code’s Korean outputs use the informal verb “박다” (bakda) at 18× the baseline rate after version 2.1.132, with a self-contamination feedback loop amplifying the tendency in under one week.

May 28, 2026 · 8 분 · 서소영

Persuading Large Language Models to Comply with Objectionable Requests

Cialdini의 일곱 설득 원칙을 프롬프트에 넣으면 LLM의 규제 약물 합성 요청 컴플라이언스가 35.3%에서 51.3%로 상승한다. PNAS 2026, 세 프런티어 모델 대상 126,000회 통제 실험.

May 21, 2026 · 6 분 · 서소영