DiffusionBlocks 개요 — (좌) 표준망은 전 계층 역전파가 필요하다, (중) DiffusionBlocks는 네트워크를 블록으로 나눠 각자 맡은 노이즈 구간을 독립 학습한다, (우) 확산 모델은 스텝당 블록 하나만, recurrent-depth 모델은 반복 학습을 단일 패스로 대체한다

DiffusionBlocks: Block-wise Neural Network Training via Diffusion Interpretation

엔드투엔드 역전파의 메모리 병목을, 트랜스포머의 잔차 연결이 확산 모델 ODE의 이산화와 같다는 통찰로 푼 논문. 네트워크를 노이즈 구간별 독립 블록으로 쪼개 한 번에 한 블록만 학습하니 메모리가 블록 수만큼 줄고, 5개 아키텍처에서 엔드투엔드에 필적했다.

May 28, 2026 · 5 분 · 서소영
DeepSWE 리더보드 — gpt-5.5 70%, gpt-5.4 56%, claude-opus-4.7 54%, claude-sonnet-4.6 32%, gemini-3.5-flash 28%

DeepSWE: 오염 없는 장기 호라이즌 코딩 에이전트 벤치마크

Datacurve가 처음부터 새로 쓴 오염 없는 과제로 프론티어 코딩 에이전트를 평가하니, SWE-Bench류에서 근접하던 모델들이 넓게 갈라졌다. gpt-5.5 70% vs claude-sonnet-4.6 32%.

May 27, 2026 · 5 분 · 서소영
세 모델의 1,790개 식재료를 2-D UMAP으로 투영하고 요리 거대권역별로 색칠한 산점도. 동아시아·남아시아·라틴아메리카·지중해 클러스터가 세 모델 모두에서 뚜렷이 분리된다.

Epicure: Navigating the Emergent Geometry of Food Ingredient Embeddings

FlavorGraph 후속작. 414만 다국어 레시피로 학습한 세 자매 식재료 임베딩(Cooc·Core·Chem)을 통해 ‘화학 vs 레시피-맥락’을 조정 가능한 설계 축으로 만들고, 페어링과 SLERP 회전이라는 두 연산자로 임베딩 공간을 항해한다.

May 27, 2026 · 6 분 · 서소영
LeJEPA가 월드 모델을 학습한다 — 숨은 변수 → 복잡하게 뒤섞임 → 방향만 돌려 복원

When Does LeJEPA Learn a World Model?

LeJEPA가 복잡한 관측에서 세계의 ‘진짜 좌표(숨은 변수)‘를 거의 그대로 되찾는다는 것, 그리고 그게 가능한 분포는 가우시안이 유일함을 증명한 글. 되찾은 좌표만으로 최적 계획까지 가능하다 — 르쿤의 월드 모델 구상에 형식 검증된 받침대를 놓았다.

May 27, 2026 · 8 분 · 서소영

A Bitter Lesson for Data Filtering

컴퓨트가 충분히 크면 데이터 필터링은 오히려 손해다 — Stanford 연구진이 Common Crawl과 5개 표준 필터를 비교하여, 큰 모델이 ‘저품질’ 데이터에서도 이득을 본다는 증거를 제시한다.

May 27, 2026 · 5 분 · 서소영

SkillOpt: Executive Strategy for Self-Evolving Skills of Frozen LLM Agents

Microsoft가 공개한 SkillOpt는 모델 가중치를 동결한 채 자연어 기술 문서 한 장을 딥러닝 옵티마이저처럼 반복 학습하여 LLM 에이전트의 성능을 끌어올리는 텍스트 공간 최적화 프레임워크다. 채점 가능한 태스크에 한정되며, 6개 벤치마크 52/52 셀에서 최고 또는 공동 최고를 기록했다.

May 27, 2026 · 9 분 · 서소영
뇌의 손가락 끝 신경 연결을 시각화한 PsyPost 대표 이미지

Attraction Through Similarity in Autistic Traits

비슷한 자폐 특성을 가진 사람끼리는 서로 더 끌리고, 대화 중 뇌가 다른 경로로 동기화된다. Tianjin Normal University 연구진이 사회관계모형과 fNIRS 하이퍼스캐닝으로 보여준 결과는 자폐를 결핍이 아니라 ‘서로 다른 의사소통 양식의 부조화’로 다시 보게 한다.

May 26, 2026 · 6 분 · 서소영
Figure 1. 예술·문화 참여 빈도(상)와 다양성(하)이 7가지 후성유전 시계에 미친 평균 처치 효과(95% CI). IPWRA, n=3,324.

예술·문화 참여는 운동만큼 후성유전 노화를 늦춘다 (Fancourt et al., Innovation in Aging, 2026)

UCL 연구진이 영국 대표 패널 3,354명의 DNA 메틸화 데이터를 7가지 후성유전 시계로 분석해, 예술·문화 참여(ACEng)와 신체활동(PA)이 동일한 크기로 생물학적 노화를 늦춤을 보였다. 이는 ACEng와 후성유전 노화를 직접 연결한 첫 역학 연구다.

May 24, 2026 · 6 분 · 서소영
CritPt 예제 챌린지 — 양자 오류 검출 문제

physics-intern: an autonomous agentic framework for physics research

Hugging Face가 공개한 멀티에이전트 프레임워크 physics-intern은 9개 전문 에이전트와 적대적 검토 루프로 이론물리학 벤치마크 CritPt에서 31.4%를 기록해 GPT 5.5 Pro(30.6%)를 넘어섰다 — 스케일 대신 비계(scaffolding)로 프론티어를 추월한 사례.

May 22, 2026 · 6 분 · 서소영
Figure 1. Big Five 도메인 외부에 있는 항목들의 LS 진짜 상관 — 굵은 글자는 다른 어떤 성격 항목과도 진짜 상관이 .50을 넘지 않는 "상대적으로 고유한" 19개 항목. Mõttus et al. (2024).

Most people's life satisfaction matches their personality traits: True correlations in multi-trait, multi-rater, multi-sample data

성격 5요인과 삶의 만족도(LS)의 상관은 단일-방법 연구에서 r ≈ .30에서 .65로 알려져 있었다. 자기보고와 정보제공자(informant) 보고를 교차 결합해 측정 오류·방법 편향을 제거했더니 ‘진짜 상관(r_true)‘은 .80에서 .90까지 올라갔다. 단 세 항목 — ‘오해받는다고 느낀다’, ‘흥미진진한 게 없다’, ‘결정을 미룬다’ — 만으로도 삶의 만족도를 r ≈ .80으로 예측한다.

May 22, 2026 · 6 분 · 서소영