AI 튜터가 '2시그마의 벽'을 넘본다 — 다트머스 강의에서 나온 효과크기 0.71~1.30의 진짜 의미
다트머스 강의에서 AI 튜터가 효과크기 0.71~1.30 SD를 기록했습니다. 40년 묵은 교육학의 성배 '블룸의 2시그마'를 AI가 정말 넘볼 수 있을지, 숫자 뒤에 숨은 진짜 이야기를 풀어봤습니다.
다트머스 강의에서 AI 튜터가 효과크기 0.71~1.30 SD를 기록했습니다. 40년 묵은 교육학의 성배 '블룸의 2시그마'를 AI가 정말 넘볼 수 있을지, 숫자 뒤에 숨은 진짜 이야기를 풀어봤습니다.
React 개발자라면 한 번쯤 써봤을 shadcn/ui가 기본 컴포넌트 엔진을 Radix에서 Base UI로 갈아탔습니다. 조용해 보이는 이 결정이 왜 프런트엔드 판을 흔드는지 짚어봅니다.
AI 에이전트를 만들 때 우리는 코드를 짭니다. 그런데 '진짜 에이전트는 실행 로그 그 자체'라는 발상이 조용히 퍼지고 있습니다. 왜 로그가 본체인지, 이 관점이 무엇을 바꾸는지 풀어봤습니다.
잘 짜주던 GPT-5.5 Codex가 어느 날부터 삽질을 시작했다는 제보가 이어집니다. 범인으로 지목된 '추론 토큰 뭉침' 현상을 벤치마크 숫자 뒤에서 뜯어봤습니다.
20년 넘은 RTS 명작 커맨드앤컨커 제너럴이 AI의 손을 거쳐 macOS와 iPhone, iPad 네이티브로 이식됐습니다. AI 코딩이 '함수 몇 개'를 넘어 '게임 한 벌 통째'까지 다다른 지금, 이게 진짜 실력 …
최신 AI 모델은 계속 강해지는데 정작 코딩 경험은 나아지지 않는다는 역설. 문제는 모델이 아니라 그 모델을 감싸는 하네스(도구)에 있다는 이야기입니다.
워크스페이스 인스턴스와 개인 계정 사이에서 Claude Code 세션 캐시가 새어나갈 수 있다는 우려가 제기됩니다. AI 코딩 도구의 계정 격리 신뢰가 왜 중요한지 짚어봅니다.
AI의 물 사용 논쟁은 과장이라던 목소리가 컸는데, 메타 샤이엔 데이터센터의 방류수가 재이용 상수원을 오염시켜 공급이 중단됐습니다. 반전이 던지는 질문을 짚어봅니다.
오후 3시만 되면 머리가 멍해지는 이유가 CO2 농도일 수 있습니다. 실내 이산화탄소가 의사결정력을 갉아먹는다는 불편한 과학을 정리했습니다.
전 세계에 수십억 개가 깔린 SQLite에서 16년간 아무도 못 찾은 WAL 버그가 TLA+ 형식 검증으로 발견됐습니다. AI가 코드를 쏟아내는 시대에 왜 다시 '수학적 증명'이 주목받는지 짚어봅니다.