library/refs

digest114

외부 글·팟캐스트를 듣고/읽고 핵심만 발췌·정리한 노트

Simon Willison2026-07-09
GPT-5.6 삼형제 Luna·Terra·Sol — Fable를 앞선 벤치마크, 하루 전 흔든 SWE-Bench Pro
샴 산카르 — ScienceADAM 더빙2026-07-09
억지력은 비축량이 아니라, 비축량을 만드는 능력 — 팔란티어 CTO 샴 산카르의 동원론
Latent Space2026-07-08
에이전트가 직접 다루는 AI 인프라 — DX에서 AX로 옮겨간 Modal
Matt Pocock2026-07-08
스킬 저장소 v1.1 — 리네임·grill 픽스·Wayfinder로 완성한 개발 생명주기
Anthropic2026-07-06
마음이라는 바다 — Claude의 J-space와 말하지 않는 생각
AI FrontierEP 1022026-07-05
프론티어 랩으로 응축되는 시장 — 3주 샌프란시스코가 본 RLVR·바이오·서부 시대
Simon Willison2026-06-30
에이전트가 자기 작업의 비디오 데모를 찍게 하라 — shot-scraper video
AI FrontierEP 1012026-06-29
미션이 해자다 — 문제에서 출발한 VIZCOM과 SF 밸류에이션 열기
Hamel Husain2026-06-29
'평가하기 어렵다'는 제품의 냄새 — 검증 가능하게 설계하는 것이 eval보다 먼저다
Latent Space2026-06-24
프론티어 생태계는 열려 있어야 한다 — 모델이 상품화되면 해자는 컨텍스트, 에이전트 위 공용 층은 열어야 이긴다
Latent Space2026-06-22
AI 레드팀은 사이버보안이 아니다 — 외계처럼 실패하는 모델과 다가오는 그레이 스완 침해
Latent Space2026-06-18
아웃풋맥싱 — AI 경쟁은 GPU를 더 사는 게 아니라 있는 걸 최대로 쓰는 일
Simon Willison2026-06-17
GLM-5.2 — 가장 강력한 text-only 오픈웨이트, 이미지 입력 없이 WebDev 2위
AI FrontierEP 1002026-06-16
전략 자산이 된 모델 — Fable 5 수출 통제와 RSI, 3년의 상전벽해
Simon Willison2026-06-11
Claude Fable는 집요하게 자발적이다 — 두 줄 CSS 버그에 브라우저 자동화·CORS 서버까지 자작하는 모델
찰스 존스 — ScienceADAM 더빙2026-06-10
AI가 못 하는 그 1%가 가장 비싸진다 — 스탠포드 경제학자 찰스 존스의 약한 고리 이론
Joshua Snyder (PostHog) — AI Engineer 강연2026-06-10
Self-Driving Products — Product Signal을 Pull Request로 바꾸는 PostHog의 파이프라인
Simon Willison2026-06-09
Claude Fable 5 첫인상 — 느리고 비싸고 무엇이든 해치우는 짐승 모델
Matt Pocock2026-06-08
무엇이든 배우게 하는 /teach 스킬 — 에이전트를 stateful 1:1 교사로 만드는 설계
Nupur Sharma (Qodo) — AI Engineer 강연2026-06-08
컨텍스트가 많을수록 멍청해지는 에이전트 — U 커브, 전략적 컨텍스트 최적화, judge agent
AI FrontierEP 992026-06-07
43일 주기와 code as harness, 그리고 인간의 일
Ara Khan (Cline) — AI Engineer 강연2026-06-06
부서진 Evals를 그래도 쓰는 법 — 랩 숫자 불신·자체 벤치마크·hill climbing
Latent Space2026-06-05
저품질 RL 환경을 그만 납품하는 법 — 깨진 harness는 모델을 능동적으로 망친다
Michael Hablich (Google) — AI Engineer 강연2026-06-05
에이전트는 또 하나의 사용자 계층이다 — Chrome DevTools MCP가 배운 에이전트 인터페이스 설계 네 가지 교훈
Vincent Koc (OpenClaw) — AI Engineer 강연2026-06-05
Dark Factory — diff를 읽는 속도보다 빠른 출하, 공장 관리자가 된 엔지니어
Latent Space2026-06-04
현실이라는 최종 Eval — Vending Bench, Project Vend, AI가 굴리는 진짜 가게 (Lukas Petersson & Axel Backlund, Andon Labs)
ScienceADAM2026-06-04
무대가 천장을 긋고, 화자가 그 천장을 시험한다 — AI 거인 19명의 강연 채점
Kuba Rogut (Turbopuffer) — AI Engineer 강연2026-06-03
Claude Code 위의 시맨틱 코드 검색 벤치마크 — embedding은 캐시된 컴퓨트
Latent Space2026-06-02
GitHub의 에이전트 플랜 — Micro Skills, 신뢰의 코드화, 14x 성장이 부수는 인프라 (Kyle Daigle, GitHub)
Benjamin Verbeek (Lovable) — AI Engineer 강연2026-06-02
매시간 스스로 개선되는 Lovable — 갇힘을 학습하는 Stack Overflow 루프와 에이전트 vent 도구
Philipp Schmid (Google DeepMind) — AI Engineer 강연2026-05-30
시니어 엔지니어가 AI 에이전트 만들기에서 헤매는 이유 — 교통 통제관에서 디스패처로
Nick Nisi (WorkOS) — AI Engineer 강연2026-05-30
스킬 미니멀리즘 — 에이전트 스킬 95%를 지우자 결과가 좋아졌다
Latent Space2026-05-28
Async Agents의 시대 — Spec-to-PR, 뇌와 기계의 분리, Vibe Coding의 2주 한계 (Walden Yan, Cognition · Cole Murray, OpenInspect)
Simon Willison2026-05-27
Anthropic·OpenAI의 product-market fit — 코딩 에이전트가 연 2026년 4월 변곡점
AI FrontierEP 982026-05-26
의도만 남는 시대와 꿈꾸는 사람들
Anthropic Engineering2026-05-25
Claude를 가두는 법 — claude.ai·Claude Code·Cowork의 containment 설계
Matt Pocock2026-05-25
grill 스킬 9가지 오해 — 질문의 fidelity·scope·모델·병렬
젠슨 황 — ScienceADAM 더빙2026-05-22
당신을 대체하는 건 AI가 아니라, AI를 더 잘 쓰는 사람이다 — 젠슨 황의 카네기멜런 졸업 연설
AI FrontierEP 972026-05-21
AI Psychosis 시대의 사람들
Latent Space2026-05-21
에이전트에게 컴퓨터를 — Composable Computers, Bare Metal, Agent Cloud (Ivan Burazin, Daytona)
Matt Pocock2026-05-21
/handoff 스킬 — compact이 못 하는 세션 간 컨텍스트 인수인계
Latent Space2026-05-20
에이전트 네이티브 클라우드 — Bare Metal 경제학, 죽어가는 Pull Request, 자기복제 인프라 (Jake Cooper, Railway)
Simon Willison2026-05-19
LLM의 지난 6개월, 5분 압축 — November 변곡점·코딩 에이전트의 도약·Claws·오픈 웨이트의 약진
Matt Pocock2026-05-14
Grill Me를 은퇴시킨 Grill with Docs — ubiquitous language로 만드는 AI와의 공유 언어
AI FrontierEP 962026-05-08
LLM 추론 인프라와 토큰 경제학 — 모델은 하드웨어의 그림자
Anthropic2026-05-07
생각을 텍스트로 번역하다 — activations를 읽는 mind-reading, 그리고 Claude는 테스트를 알고 있었다
Matt Pocock2026-05-07
지옥 같은 백로그를 뚫는 /triage — 라벨에 새긴 state machine
Simon Willison2026-05-06
Vibe coding과 agentic engineering의 불편한 수렴 — 리뷰 없는 신뢰, 무너진 품질 신호
젠슨 황 — ScienceADAM 더빙2026-05-02
우리가 파는 건 칩이지 농축 우라늄이 아니다 — 젠슨 황, AI 무기론에 맞선 79분
Matt Pocock2026-04-30
내 AFK 소프트웨어 공장을 오픈소스로 — 샌드박스 에이전트 오케스트레이션 라이브러리 Sandcastle
Matt Pocock2026-04-29
AI가 가속한 소프트웨어 엔트로피의 치료법 — Deep Module·Seam·Leverage로 코드베이스 De-slop
AI FrontierEP 952026-04-28
DeepSeek-V4 — Sparse Attention 정면 돌파와 프론티어의 프론티어
Anthropic2026-04-24
16분 만에 Claude Code 꿀팁 32가지를 배워보세요
Anthropic2026-04-24
'망치지 마' 한마디가 AI를 망친다면? 앤트로픽 사내 철학자가 밝힌 클로드 사용법
Maggie Appleton (GitHub Next)2026-04-24
Collaborative AI Engineering: One Dev, Two Dozen Agents, Zero Alignment
Dotta Bippa — Paperclip 제작자 영상2026-04-24
Paperclip: Open Source Human Control Plane for AI Labor
Phil Hetzel (Braintrust)2026-04-24
Why building eval platforms is hard
Andrej Karpathy2026-04-24
Andrej Karpathy: From Vibe Coding to Agentic Engineering
Jacob Lauritzen (Legora)2026-04-24
Agents need more than a chat
Ryan Lopopolo (OpenAI) — AI Engineer 컨퍼런스 키노트2026-04-24
Harness Engineering: How to Build Software When Humans Steer, Agents Execute
AI FrontierEP 942026-04-21
Anthropic과 낮게 열린 과실들
Matt Pocock2026-04-15
Software Fundamentals Matter More Than Ever
Matt Pocock2026-04-15
소프트웨어 기본기가 그 어느 때보다 중요합니다 (한국어 더빙)
Matt Pocock2026-04-15
Full Walkthrough: Workflow for AI Coding
Anthropic Engineering2026-04-08
Managed Agents 스케일링 — 뇌와 손의 분리
AI FrontierEP 932026-04-07
Claude Code 소스코드 유출 이후 (ft. 사이오닉 고석현 대표)
Latent Space2026-04-07
토큰 억만장자를 위한 익스트림 하네스 엔지니어링 — Ryan Lopopolo (OpenAI Frontier)
Anthropic2026-04-07
Project Glasswing — 코드에 능한 모델은 사이버에도 능하다
리처드 서튼 — ScienceADAM 더빙2026-04-05
ChatGPT는 지능이 아니다 — 목표도 경험도 없는 모방이라는 서튼의 진단
Anthropic2026-04-02
AI가 감정적으로 굴 때 — 기능적 감정과 Claude라는 등장인물
AI FrontierEP 922026-03-29
루프를 닫아라
Hamel Husain2026-03-26
데이터 사이언티스트의 복수 — 이름이 바뀌었을 뿐, 일은 그대로다
Anthropic Engineering2026-03-25
Claude Code auto mode — 승인 피로와 무방비 사이의 중간 지대
Anthropic Engineering2026-03-24
장시간 앱 개발을 위한 하네스 설계 — 생성자와 평가자의 분리
AI FrontierEP 912026-03-21
26.1Q 비즈니스 관점에서의 AI
테리 위노그라드 — ScienceADAM 더빙2026-03-17
AI는 원인이 아니라 가속기다 — 위노그라드가 짚는 오래된 문제들과 우리가 잡아야 할 운전대
AI FrontierEP 892026-03-15
딸깍과 덜컹
AI FrontierEP 902026-03-15
알파고 이후, 10년 (feat. HyperAccel 이진원 CTO)
Latent Space2026-03-12
RAG 이후의 리트리벌 — Hybrid Search, Agents, Database Design (Simon Hørup Eskildsen, Turbopuffer)
Anthropic Engineering2026-03-06
평가받는 중임을 눈치챈 Opus 4.6 — BrowseComp 답키를 역추적해 복호화하다
AI FrontierEP 882026-03-04
비결은 없다
Hamel Husain2026-03-02
코딩 에이전트를 위한 Evals Skills — MCP는 접근을 주고, 스킬은 판단을 가르친다
다리오 아모데이 — ScienceADAM 더빙2026-02-26
데이터 센터 속 천재들의 나라 — 아모데이가 1~3년 뒤로 당긴 역량 폭발과 확산의 물리학
AI FrontierEP 872026-02-24
'딸깍'의 시대, 슬픔과 기쁨 사이
AI FrontierEP 862026-02-18
진짜 내 일을 위한 Agentic Workflow
제프리 힌튼 — ScienceADAM 더빙2026-02-16
인류는 AI를 이길 수 없다 — 제프리 힌튼이 말하는 초지능 통제와 '어머니 AI'
AI FrontierEP 852026-02-11
OpenClaw와 2026년 2월의 신호들
Anthropic Engineering2026-02-05
16개의 병렬 Claude에게 C 컴파일러를 맡기다 — 자율 에이전트 팀의 설계와 천장
Anthropic Engineering2026-02-05
리더보드 격차보다 큰 인프라 노이즈 — 코딩 벤치마크를 몇 %p 흔드는 자원 설정
안드레이 카파시 — ScienceADAM 더빙2026-02-05
AI는 고작 초딩 수준 — 안드레이 카파시가 짚는 ChatGPT의 실체와 강화학습의 한계
알렉스 카프 — ScienceADAM 더빙2026-01-28
고스펙 멍청이는 필요 없다 — 알렉스 카프의 AI 시대 인재론과 전장에서 검증된 소프트웨어
앤드류 응 — ScienceADAM 더빙2026-01-20
살아남는 개발자는 코더가 아니라 프로덕트 엔지니어다 — 앤드류 응의 AI 시대 생존론
Hamel Husain2026-01-15
LLM Evals FAQ — 에러 분석이 전부다
데이빗 말란 — ScienceADAM 더빙2026-01-15
벽돌공에서 건축가로 — AI가 코드를 뱉어내는 시대에 코딩을 배우는 이유
Anthropic Engineering2026-01-09
AI 에이전트 evals 탈신비화 — 감으로 비행하지 않기 위한 측정 설계
데이빗 말란 — ScienceADAM 더빙2026-01-07
코딩은 부작용일 뿐 — AI가 다 짜주는 시대에도 컴퓨터 과학을 배우는 이유
Simon Willison2025-12-31
2025: LLM의 해
유발 하라리 — ScienceADAM 더빙2025-11-30
당신들은 카드가 없습니다 — 하라리가 짚는 신뢰의 역설과 인류 공동의 자녀 AI
Anthropic Engineering2025-11-26
장기 실행 에이전트를 위한 하네스 — 컨텍스트 윈도우를 넘는 인수인계 설계
Anthropic Engineering2025-11-24
Advanced tool use — 툴을 검색하고, 코드로 부르고, 예시로 가르치는 세 가지 베타 기능
제프리 힌튼 — ScienceADAM 더빙2025-11-22
메타는 책임감이 없고 오픈AI는 변심했다 — 초지능과 공존하는 유일한 모델은 아기와 엄마
Anthropic2025-11-21
부정행위를 배우면 모델이 evil해진다 — 리워드 해킹에서 창발하는 오정렬
Anthropic Engineering2025-11-04
MCP를 코드 API로 — 직접 툴 호출보다 효율적인 에이전트
Anthropic Engineering2025-10-20
권한 프롬프트를 넘어 — 샌드박싱으로 더 안전하고 자율적인 Claude Code
Anthropic Engineering2025-10-16
Agent Skills — 파일과 폴더로 만드는 전문 에이전트
Anthropic Engineering2025-09-29
AI 에이전트를 위한 컨텍스트 엔지니어링 — 어텐션 예산이라는 유한 자원
Anthropic Engineering2025-09-11
에이전트를 위한 툴 설계 — 에이전트와 함께
Simon Willison2025-06-16
AI 에이전트의 치명적 삼중주 — 개인 데이터·불신 콘텐츠·외부 통신
Anthropic Engineering2025-06-13
멀티에이전트 리서치 시스템 구축기 — 검색은 압축, 성능은 토큰
Anthropic Engineering2025-04-18
Claude Code 베스트 프랙티스
Hamel Husain2025-03-24
AI 제품을 빠르게 개선하기 위한 현장 가이드
Simon Willison2025-03-11
LLM로 코드를 쓰는 법
Anthropic Engineering2024-12-19
Building Effective Agents
Hamel Husain2024-03-29
당신의 AI 제품에는 Evals이 필요하다