Your harness, your memory
에이전트 하네스는 에이전트 개발의 표준 방식이 되었으며, 메모리 관리와 밀접하게 연결되어 있다. 폐쇄형 하네스를 사용하면 메모리 소유권을 제3자에게 넘기게 되어 심각한 플랫폼 종속성이 발생한다. 에이전트 하네스는 계속 존재할 기술: 모델이 더 발전해도 스캐폴딩 필요성은 사라지지 않으며, Claude Code 같은 최고급 모델도 512K 줄의 하네스 코드에…
최근에 읽었거나 읽으려고 하는 것들의 기록.
690건
에이전트 하네스는 에이전트 개발의 표준 방식이 되었으며, 메모리 관리와 밀접하게 연결되어 있다. 폐쇄형 하네스를 사용하면 메모리 소유권을 제3자에게 넘기게 되어 심각한 플랫폼 종속성이 발생한다. 에이전트 하네스는 계속 존재할 기술: 모델이 더 발전해도 스캐폴딩 필요성은 사라지지 않으며, Claude Code 같은 최고급 모델도 512K 줄의 하네스 코드에…
에이전트 하네스는 AI 에이전트 구축의 필수 요소이며, 메모리 관리와 긴밀하게 연결되어 있기 때문에 폐쇄형 하네스를 사용하면 제3자에게 에이전트의 메모리 소유권을 넘기게 된다. 에이전트 하네스는 계속 중요해질 것 - 모델이 발전해도 하네스는 필수이며, 클로드 코드의 경우 512K 라인의 코드로 구성됨 하네스는 LLM과 도구/데이터 소스 사이의 상호작용을 조…
AI 코딩 에이전트의 생산성 차이는 모델의 지능이 아닌 아키텍처 설계에서 비롯된다. 100배의 생산성 향상은 모델을 감싸는 '하니스'와 '스킬'의 구조적 우월성으로 만들어진다. 핵심은 모델이 아닌 하니스: 더 똑똑한 AI가 아닌 올바른 맥락 전달 구조가 생산성 차이를 만듦 얇은 하니스, 두터운 스킬: 복잡한 도구 정의보다 전문화된 마크다운 기반의 스킬 설계…
무신사가 AI 시대에 맞는 신입 엔지니어 채용 기준을 새롭게 정의하고, AI를 자유롭게 활용하는 지원자를 평가하는 철학과 실제 구현 방식을 공개하다 AI 네이티브의 정의: ChatGPT, Copilot 등과 함께 성장한 세대로 AI를 도입된 도구가 아닌 당연한 환경으로 여기는 사람들 기존 코딩 테스트의 죽음: LeetCode 스타일 알고리즘 문제는 AI 에…
‘메인테이너(maintainer)’라는 단어를 처음 본 것은 9년 전 한겨레 지면에서였다. 그때 과학기술학자 전치형이 칼럼에서 이렇게 썼다. “미국 학자 앤드루 러셀과 리 빈셀은 작년에 발표한 ‘메인테이너에게 갈채를
코딩 에이전트가 코드 작성 전에 논문을 읽고 경쟁 프로젝트를 분석하면 더 나은 최적화를 찾을 수 있다는 연구 결과 문헌 조사 단계 추가로 성과 향상: 기존 autoresearch 루프에 논문 읽기와 포크 프로젝트 분석 단계 추가 llama.cpp CPU 최적화 결과: 3시간 내 5개 최적화 도출, Flash Attention 텍스트 생성 x86에서 +15%…
AI 시대에 학습을 체계적인 워크플로우로 전환하는 방법론을 소개하는 글로, 깊이 있는 학습을 위해서는 AI의 효율성과 개인의 판단력과 인내심이 함께 필요하다는 핵심 메시지를 담고 있다. 기존 학습방식 유지: 빠른 학습 콘텐츠보다 양질의 자료에 시간을 투자하는 전통적 방식 선호 인풋 중심에서 아웃풋 중심으로: 소비한 정보보다 설명하고 글로 쓰고 출판할 수 있…
Hermes Agent는 자가 호스팅형 AI 에이전트로, 기존 ChatGPT 같은 정적 챗봇의 한계를 극복하고 진정한 생산성 향상을 가능하게 하는 플랫폼이다. Hermes Agent의 핵심 특징 세션 간 모든 대화 기억 및 지속적인 학습 Telegram, Discord 등 여러 채널에서 접근 가능 터미널 명령어와 코드 실행 지원 (6개 백엔드) 계속 확장되…
에이전트를 개선하기 위한 핵심은 더 나은 하네스(harness)를 구축하는 것이며, 자동으로 하네스를 개선하려면 평가(evals)를 학습 신호로 활용해야 한다. 에벌(Evals)은 에이전트의 훈련 데이터 - 기계학습의 훈련 데이터처럼 에벌은 하네스 엔지니어링의 학습 신호 역할 하네스 개선 루프 - 에벌 + 하네스 엔지니어링으로 기울기 하강법처럼 지속적으로…
Anthropic 성장 리더의 역사적 성장 전략 본 대담은 Anthropic의 성장 담당 리더 Amole Evasari가 역사상 전례 없는 성장 속도로 확장되고 있는 회사에서의 경험과 전략을 공유하는 인터뷰입니다. 14개월 만에 ARR 10억 달러에서 190억 달러 이상으로 성장한 Anthropic의 성장 전략과 과제, 그리고 AI 제품의 활성화 문제에 대…
샌프란시스코의 스타트업 생태계를 지배하는 보이지 않는 집단적 판단 시스템인 '그룹 채트'에 대한 분석 그룹 채트는 SF의 투자자, 창업자, 운영자들이 스타트업에 대해 집단적으로 내리는 판단 X(트위터)의 바이럴과 입소문이 자금 조달 난이도를 크게 좌우함 개인적 신뢰 네트워크 기반의 비공식 파워 서클이 실제 의사결정에 영향력 발휘 집단 사고는 혁신을 가능하게…
현대 기업들의 무분별한 AI 도입 열풍을 1958년 마오의 대약진 운동에 빗대어 비판한 글로, 겉으로는 성과처럼 보이지만 실제로는 조직에 해를 끼치는 AI 전환의 실상을 날카롭게 지적한다. 핵심 요약 겉과 속의 괴리: 기업들이 AI 도입 압박 속에서 실제 가치 없는 솔루션을 마치 AI인 양 포장하고 있음 타입스크립트 if-else 분기를 에이전트라고 부르고…
LLM 훈련의 실제: 프리트레이닝 이후 단계가 최종 품질을 결정한다 2026년 기준 대규모 언어 모델의 경쟁력은 더 이상 프리트레이닝 자체가 아니라, 포스트트레이닝, 평가, 보상 설계, 에이전트 훈련, 증류 등 그 이후의 모든 과정에서 나타난다. 사용자가 느끼는 모델의 성능 향상은 단일 요소가 아닌 이들 단계가 함께 개선될 때 발생한다. LLM 훈련은 조립…
당신의 유일한 경쟁자는 당신 자신이다 - AI 시대에 경쟁사 벤치마킹은 더 이상 유효한 전략이 아니며, 남들이 보지 못한 곳에서 깊이 있는 통찰을 찾는 것이 승리의 열쇠다. 벤치마킹은 야심찬 사람들의 미루기 도구 - 생산적으로 보이지만 실제 일에 진전이 없음 AI로 인한 게임 규칙 변화 - 실행의 어려움이 사라지면서 누구나 기본적인 것들을 만들 수 있게 됨…
AI 에이전트로 생성된 코드를 배포할 때는 맹목적 신뢰가 아닌 책임감 있는 판단이 필수적이며, 이를 위해 인프라 수준의 안전장치가 필요하다. AI 에이전트 코드의 위험성: 깔끔해 보이고 테스트를 통과하지만 프로덕션 환경의 실제 제약을 이해하지 못함 신뢰 vs 활용의 차이: 신뢰는 에이전트가 작성하면 배포, 활용은 완전한 소유권 유지하며 빠른 반복 소유권 원…
미스터리 질병 '하바나 증후군'이 러시아 정보기관 부대와 연관된 것으로 지목되었으며, 1000건 이상의 사례가 보고되었으나 미국 정부는 외국 적대국 관여 가능성을 낮게 평가하고 있는 상황 주요 의혹: 러시아 군부 정보기관 29155 부대가 지향성 에너지 무기로 미국 외교관 뇌를 표적 삼았을 가능성 증상: 어지러움, 두통, 집중력 저하, 귀에서의 심한 음향…
Anthropic이 Claude Mythos Preview를 통해 주요 OS와 소프트웨어에서 수천 개의 제로데이 취약점을 발견했으며, 이를 해결하기 위해 Project Glasswing을 시작했다. Claude Mythos Preview의 성과: OpenBSD, FFmpeg, Linux 커널 등에서 수십 년 된 미발견 취약점들을 자동으로 발견 CyberGy…
워커로 이전된 structure_text의 비동기 처리 흐름을 검증하는 테스트 메모로, 라우터의 즉시 응답과 워커의 후속 처리를 통한 콘텐츠 갱신 과정을 명시한다.
트럼프 대통령이 2월 11일 네타냐후 이스라엘 총리의 이란 공격 제안을 받아들이면서 미국이 이란과의 전쟁에 진입하게 된 경과를 상세히 기록한 글이다. 네타냐후의 제안: 이스라엘 지도자가 백악관 상황실에서 이란 체제 전복 작전을 제시하고 트럼프는 즉각 긍정적 반응 미국 정보 당국의 회의론: CIA와 합참의장이 체제 전복 시나리오를 "황당하고 거짓"이라 평가했…
멀티 에이전트 시스템은 이론적으로 매력적이지만 실제 운영에서는 토큰 비용이 10배 이상 증가하면서도 생산성은 떨어지는 심각한 한계를 가지고 있다. 현재 단계에서 에이전트에게 적극적으로 위임할 수 있는 영역은 오류 비용, 검증 용이성, 암묵지 의존도 등 5가지 기준으로 판별해야 한다. 멀티 에이전트의 근본 문제: 에이전트 간 작업 인수인계 과정에서 맥락이 반…