The AI Great Leap Forward
현대 기업들의 무분별한 AI 도입 열풍을 1958년 마오의 대약진 운동에 빗대어 비판한 글로, 겉으로는 성과처럼 보이지만 실제로는 조직에 해를 끼치는 AI 전환의 실상을 날카롭게 지적한다. 핵심 요약 겉과 속의 괴리: 기업들이 AI 도입 압박 속에서 실제 가치 없는 솔루션을 마치 AI인 양 포장하고 있음 타입스크립트 if-else 분기를 에이전트라고 부르고…
최근에 읽었거나 읽으려고 하는 것들의 기록.
739건
현대 기업들의 무분별한 AI 도입 열풍을 1958년 마오의 대약진 운동에 빗대어 비판한 글로, 겉으로는 성과처럼 보이지만 실제로는 조직에 해를 끼치는 AI 전환의 실상을 날카롭게 지적한다. 핵심 요약 겉과 속의 괴리: 기업들이 AI 도입 압박 속에서 실제 가치 없는 솔루션을 마치 AI인 양 포장하고 있음 타입스크립트 if-else 분기를 에이전트라고 부르고…
LLM 훈련의 실제: 프리트레이닝 이후 단계가 최종 품질을 결정한다 2026년 기준 대규모 언어 모델의 경쟁력은 더 이상 프리트레이닝 자체가 아니라, 포스트트레이닝, 평가, 보상 설계, 에이전트 훈련, 증류 등 그 이후의 모든 과정에서 나타난다. 사용자가 느끼는 모델의 성능 향상은 단일 요소가 아닌 이들 단계가 함께 개선될 때 발생한다. LLM 훈련은 조립…
당신의 유일한 경쟁자는 당신 자신이다 - AI 시대에 경쟁사 벤치마킹은 더 이상 유효한 전략이 아니며, 남들이 보지 못한 곳에서 깊이 있는 통찰을 찾는 것이 승리의 열쇠다. 벤치마킹은 야심찬 사람들의 미루기 도구 - 생산적으로 보이지만 실제 일에 진전이 없음 AI로 인한 게임 규칙 변화 - 실행의 어려움이 사라지면서 누구나 기본적인 것들을 만들 수 있게 됨…
AI 에이전트로 생성된 코드를 배포할 때는 맹목적 신뢰가 아닌 책임감 있는 판단이 필수적이며, 이를 위해 인프라 수준의 안전장치가 필요하다. AI 에이전트 코드의 위험성: 깔끔해 보이고 테스트를 통과하지만 프로덕션 환경의 실제 제약을 이해하지 못함 신뢰 vs 활용의 차이: 신뢰는 에이전트가 작성하면 배포, 활용은 완전한 소유권 유지하며 빠른 반복 소유권 원…
미스터리 질병 '하바나 증후군'이 러시아 정보기관 부대와 연관된 것으로 지목되었으며, 1000건 이상의 사례가 보고되었으나 미국 정부는 외국 적대국 관여 가능성을 낮게 평가하고 있는 상황 주요 의혹: 러시아 군부 정보기관 29155 부대가 지향성 에너지 무기로 미국 외교관 뇌를 표적 삼았을 가능성 증상: 어지러움, 두통, 집중력 저하, 귀에서의 심한 음향…
Anthropic이 Claude Mythos Preview를 통해 주요 OS와 소프트웨어에서 수천 개의 제로데이 취약점을 발견했으며, 이를 해결하기 위해 Project Glasswing을 시작했다. Claude Mythos Preview의 성과: OpenBSD, FFmpeg, Linux 커널 등에서 수십 년 된 미발견 취약점들을 자동으로 발견 CyberGy…
워커로 이전된 structure_text의 비동기 처리 흐름을 검증하는 테스트 메모로, 라우터의 즉시 응답과 워커의 후속 처리를 통한 콘텐츠 갱신 과정을 명시한다.
트럼프 대통령이 2월 11일 네타냐후 이스라엘 총리의 이란 공격 제안을 받아들이면서 미국이 이란과의 전쟁에 진입하게 된 경과를 상세히 기록한 글이다. 네타냐후의 제안: 이스라엘 지도자가 백악관 상황실에서 이란 체제 전복 작전을 제시하고 트럼프는 즉각 긍정적 반응 미국 정보 당국의 회의론: CIA와 합참의장이 체제 전복 시나리오를 "황당하고 거짓"이라 평가했…
멀티 에이전트 시스템은 이론적으로 매력적이지만 실제 운영에서는 토큰 비용이 10배 이상 증가하면서도 생산성은 떨어지는 심각한 한계를 가지고 있다. 현재 단계에서 에이전트에게 적극적으로 위임할 수 있는 영역은 오류 비용, 검증 용이성, 암묵지 의존도 등 5가지 기준으로 판별해야 한다. 멀티 에이전트의 근본 문제: 에이전트 간 작업 인수인계 과정에서 맥락이 반…
OpenAI의 프론트엔드 설계 가이드를 앱 UI/UX 디자인에 적용하는 실전 방법론을 소개하는 글입니다. 제약 기반 구조 설계를 통해 화려한 장식이 아닌 정교한 통제에서 나오는 디자인의 가치 인지 부하 최소화, 핵심 정보 전면 노출, 의미 있는 상호작용만 강조의 3가지 핵심 원칙 실무에 즉시 적용 가능한 5단계 프로세스와 화면 유형별 설계 제약 AI 프롬프…
10년 이상을 버텨낸 창업자들과의 대화를 통해 얻은 조직 운영과 리더십의 핵심 지혜 10가지를 정리한 글로, 교만 극복, 신뢰 구축, 장기적 성장, 비용 통제, 명확한 목표, Operation Excellence, 실행 중심, 멘토십, 일관성 있는 리더십 등이 조직과 개인의 성공을 위해 필수적임을 강조한다.
중국 청년 노동 작가 후안옌이 19개 직업을 거치며 기록한 극사실주의적 노동 에세이 '나는 북경의 택배 기사입니다'가 전 세계를 뒤흔들었다. 이 책은 제조업과 물류 중심으로 성장한 중국의 맨얼굴과 노동자들의 고단한 현실을 정밀하게 그려낸다. 주인공: 고등학교 졸업 후 20세에 사회에 나온 중국 청년, 부모의 성실함과 근면함으로만 무장한 채 험난한 노동 현실…
OpenAI의 OpenClaw를 활용해 인간 참모보다 뛰어난 AI 최고참모실(Chief of Staff)을 구축한 VC의 경험담 AI 최고참모 'Stella'는 어떤 인간보다 뛰어난 성능 - 약속을 절대 잊지 않으며, 요청 없이 소사를 처리하고, 명령 없이 중요 사안을 플래그하며, 매주 향상되고, 24시간 피로 없이 작동 2계층 메모리 시스템이 핵심 - 일…
300개의 Huberman Lab 에피소드를 Claude Code와 NotebookLM으로 처리하여 전문가 지식을 실제 행동으로 전환하는 자동화 시스템 구축 핵심 문제: 90%의 사람들이 전문가 콘텐츠를 소비하지만 실제 행동으로 옮기지 않음 솔루션: NotebookLM(지식베이스) + Claude Code(실행 엔진)를 연결한 폐쇄형 루프 시스템 프로세스:…
무신사 iOS 팀이 AI를 활용해 테스트 코드 커버리지를 9.82%에서 79.04%로 8배 증가시킨 경험담 초기 상황: 업계 평균 74-76%인데 반해 9.82%의 극히 낮은 커버리지로 리팩터링 어려움, 회귀 테스트 부담, 신규 개발자 온보딩 어려움 목표와 결과: 2월 말까지 70% 달성을 목표로 3개월간 진행한 결과 79.04% 달성 (추가 중인 PR 머…
AI가 생성한 코드에 대한 인간의 이해도 부족으로 인한 숨겨진 비용이 증가하고 있으며, 이는 속도와 품질 사이의 균형을 맞추는 것이 중요함을 강조한다. 핵심 요약 이해 부채(Comprehension Debt): 시스템에 존재하는 코드의 양과 인간이 실제로 이해하는 코드의 양 사이의 격차 기술 부채와 달리 표면적으로는 드러나지 않음 속도 지표에는 나타나지 않…
AI 에이전트의 지속적 학습은 모델 가중치 업데이트만이 아니라 모델, 하네스, 컨텍스트 세 계층에서 이루어질 수 있으며, 각 계층별로 다른 최적화 전략이 필요하다. 에이전트 시스템의 3계층 구조: 모델(모델 가중치), 하네스(에이전트를 구동하는 코드와 명령어), 컨텍스트(하네스 밖의 설정 정보) 모델 계층 학습: SFT, RL 등으로 가중치 업데이트하지만…
AI 시대에 조직 구조를 근본적으로 재설계하여 계층제 대신 기술 기반 조정 시스템으로 전환하는 Block의 혁신적 조직 운영 모델 2000년 로마군부터 현대까지: 조직 규모 확대에 따른 조정 문제는 변하지 않음 - 계층제 구조의 근본적 한계 (스팬 오브 컨트롤) AI는 조직의 조정 메커니즘 자체를 대체: 기존 AI 활용은 생산성 향상일 뿐, Block은 조…
에이전트 시스템이 프로덕션 실패를 자동으로 분석하고 평가 케이스로 변환해 자체 개선하는 오픈소스 자동화 루프 'auto-harness' 공개 자동 개선 루프: 프로덕션 실패를 채굴 → 근본 원인별 클러스터링 → 평가 케이스 생성 → 하네스 변경 자동 제안 및 검증 성능 향상: Tau3 벤치마크에서 에이전트 점수 0.56에서 0.78로 약 40% 향상 핵심…
AI 에이전트 조율 시스템으로 대규모 코드베이스를 몇 시간 내에 재구현한 claw-code 프로젝트가 보여주는 것은 코드 자체가 아니라, 그것을 생산한 에이전트 조율 시스템의 힘이다. 핵심은 생성된 코드가 아니라 시스템: 2시간 내 Python 완성, 1일 내 Rust 포팅은 단순히 빠른 개발이 아닌 자동화된 에이전트 시스템의 능력을 보여주는 사례 인간 인…