Unbrowse: 100x Faster Than Browser Automation
브라우저 자동화 대신 웹사이트의 내부 API를 직접 호출하여 AI 에이전트의 웹 작업 속도를 100배 향상시키는 Unbrowse 도구 소개 브라우저 자동화의 문제점: 한 번의 웹 작업에 10-45초 소요, 15-30% 실패율, 500MB 이상의 RAM 소비 API 직접 호출의 장점: 동일한 작업을 200ms 내에 완료, 95% 이상의 신뢰도, 최소한의 자원…
최근에 읽었거나 읽으려고 하는 것들의 기록.
AI/ML 329건
브라우저 자동화 대신 웹사이트의 내부 API를 직접 호출하여 AI 에이전트의 웹 작업 속도를 100배 향상시키는 Unbrowse 도구 소개 브라우저 자동화의 문제점: 한 번의 웹 작업에 10-45초 소요, 15-30% 실패율, 500MB 이상의 RAM 소비 API 직접 호출의 장점: 동일한 작업을 200ms 내에 완료, 95% 이상의 신뢰도, 최소한의 자원…
Tree of Thoughts(ToT)는 복잡한 문제 해결을 위해 언어모델이 중간 단계의 생각들을 트리 구조로 탐색하고 평가하는 프롬프팅 프레임워크이다. ToT의 핵심 개념: 기존의 단순 프롬프팅을 넘어 트리 구조의 사고 탐색을 통해 복잡한 문제 해결 작동 방식: 언어모델이 생각을 생성하고 자체 평가한 후, 탐색 알고리즘(BFS/DFS/빔서치)으로 체계적…
오스트리아 개발자 피터 슈타인베르거는 10억 대 기기에서 사용되는 PDF 프레임워크 PSPDFKit을 만들었고, 현재 AI 에이전트 기반 코딩의 새로운 시대를 주도하고 있다. 그는 배포하는 코드의 대부분을 읽지 않고도 600개의 커밋을 병합할 수 있으며, 이것이 '루프 폐쇄'라는 AI 시스템 코딩 원칙을 따르기 때문이라고 주장한다. 피터의 개발 철학: 코드…
Claude Code의 스킬 시스템을 활용해 개인화된 AI 협업 도구로 만드는 방법 스킬 시스템의 핵심: .claude/skills/ 디렉토리에 마크다운 파일을 두면 Claude가 특정 작업 수행 시 참고하는 지침서로 인식 개인화의 필요성: 매번 같은 지시를 반복하는 대신 스킬로 정의해두면 Claude가 개발자의 워크플로우와 선호도를 학습 Agent Ski…
Clawdbot의 아키텍처와 작동 원리를 분석한 글로, AI 엔지니어들이 배울 수 있는 설계 패턴과 기술적 구현을 상세히 설명한다. TypeScript 기반 CLI 애플리케이션: Python이나 웹 앱이 아닌 로컬 머신에서 실행되는 프로세스로, 여러 메신저를 통해 접근 가능 Lane 기반 큐 아키텍처: 기본적으로 직렬 처리하되 안전한 작업만 병렬화하는 설계…
추론 속도로 배포하기: AI 에이전트 시대의 소프트웨어 개발 2025년 말, GPT-5와 Claude 같은 고급 AI 모델을 활용해 기존보다 훨씬 빠르게 소프트웨어를 개발하고 배포하는 새로운 워크플로우에 대한 실제 경험담. 모델 성능이 개발 속도의 핵심 제약: 과거 수작업이 필요했던 작업들이 이제 AI 프롬프트 한두 개로 자동 처리 가능 GPT-5.2와 C…
AI 연구 최전선에서 본 향후 10년, AGI와 초지능으로의 급격한 전환이 2025-2027년 사이에 임박했으며 이는 국가 안보와 지정학적 패권의 핵심이 될 것 AGI 도달 시기: 2025-2026년 대학 졸업생 수준의 지능 달성, 2030년경 인간을 초월한 초지능 도달 예상 핵심 성능 지표 OOMs: Order of Magnitudes(OOMs) 개념으로…
AI 코딩 보조 도구의 사용이 개발자의 코딩 스킬 형성에 부정적 영향을 미칠 수 있다는 연구 결과를 제시합니다. AI 사용 시 학습 효과 감소: AI 보조 그룹이 손코딩 그룹 대비 퀴즈에서 17% 낮은 점수 기록 (약 2개 학점 하락) 생산성 향상은 미미: 작업 완료 시간이 약간 단축되었으나 통계적으로 유의미하지 않음 AI 활용 방식이 결정적: AI를 단순…
Vercel의 연구에서 AI 코딩 에이전트에게 프레임워크 지식을 전달하는 데 있어 AGENTS.md 파일이 Skills 기반 접근보다 훨씬 효과적임을 입증했다. AGENTS.md 방식이 100% 성공률 달성 - 8KB 압축 문서 인덱스로 Skills의 79%를 능가 Skills의 근본적인 한계 - 에이전트가 필요한 순간에 스킬을 호출하지 않는 문제 (56%…
Kimi K2.5는 텍스트와 비전을 공동으로 최적화하는 오픈소스 멀티모달 에이전트 모델로, Agent Swarm을 통해 복잡한 작업을 병렬로 처리하여 4.5배의 지연시간 감소를 달성했다. 멀티모달 공동 최적화: 초기 단계부터 텍스트와 비전 토큰을 균형있게 혼합하는 방식으로 두 모달리티가 상호 강화 Zero-Vision SFT: 텍스트 전용 SFT만으로 시각…
Moltbook: AI 에이전트들의 소셜 네트워크가 인터넷에서 가장 흥미로운 곳으로 부상 OpenClaw(구 Clawdbot)라는 오픈소스 AI 어시스턴트를 기반으로 한 Moltbook이 AI 에이전트들의 소셜 네트워크로 급성장하고 있으며, 이는 혁신적이면서도 보안 위험을 안고 있는 현상을 보여준다. OpenClaw의 급성장: 2개월 만에 GitHub 스타…
AI 시대 소프트웨어 엔지니어링은 단순히 개발자를 대체하는 것이 아니라, 역량에 따라 심하게 양극화되는 'K자형 미래'로 나아가고 있다. AI는 대체가 아닌 '배치 전환' - 개발 역량보다 문제 해결 역량과 비즈니스 이해도가 중요해짐 AI는 레버리지 역할 - 우수한 팀은 더 빠르게 혁신하고, 평범한 팀은 더 많은 무의미한 코드를 생성할 뿐 소프트웨어 수요는…
직접 실행 가능한 멀티에이전트 시스템을 로컬에서 5분, 프로덕션에 20분 이내에 배포할 수 있는 완전한 예제를 제공하는 가이드 3가지 에이전트 패턴 제공: Pal(개인 AI 어시스턴트), Knowledge Agent(문서 기반 질답), MCP Agent(외부 서비스 연동) 프로덕션 레벨 기능: 학습 능력, PostgreSQL 기반 상태 저장, Agentic…
AI 주도 개발 생명주기(AI-DLC)는 기존 소프트웨어 개발 방법론을 근본적으로 재구상하여 AI를 중심 협력자로 삼는 새로운 방법론입니다. AI의 속도와 역량을 완전히 활용하기 위해 설계되었으며, 기존 애자일 방법론의 개조가 아닌 제1원칙에 기반한 전면적 재설계를 추구합니다. AI의 역할 전환: AI가 인간의 명령에 대응하는 것이 아니라 고수준 의도를 실…
AI 에이전트 기반 코딩의 극단적 활용 사례: 월 4,600달러를 투자해 22개의 Claude 구독으로 '디지털 노동력'을 구축한 개발자의 이야기 기술 업계의 아이러니: 전통 소프트웨어 엔지니어들은 에이전트 기반 코딩의 가능성을 간과하는 반면, 비엔지니어들이 AI 도구를 적극 활용해 서비스 구축에 성공 극단적 활용 사례 - Jeffrey Emanuel: 1…
AI 에이전트에게 작업을 지시할 때는 방대한 스펙을 한 번에 제시하기보다는, 명확하고 구조화된 지침을 단계적으로 나누어 제공하는 것이 핵심이다. 상위 수준의 비전부터 시작: 구체적인 세부사항은 AI가 초안을 작성하도록 하고, 인간은 목표와 방향만 제시 PRD 형식의 구조화된 스펙: 명령어, 테스트, 프로젝트 구조, 코드 스타일, Git 워크플로우, 작업 경…
Boris Cherny: Claude Code 창시자의 경력 성장과 Anthropic에서의 혁신 이 인터뷰는 Anthropic에서 Claude Code를 창시한 Boris Cherny와의 대담으로, 그의 경력을 형성한 핵심 원칙들과 Meta에서 Staff 엔지니어로 승진하기까지의 여정, 그리고 현재 Anthropic에서 이루어지고 있는 기술 혁신에 관해 다…
에이전트 코딩 도구가 개발자 개인에게는 10배 생산성 향상을 제공하지만, 조직 수준의 도입 시 혼란을 초래하는 근본적인 문제가 있다. 개인 역량과 조직 인프라의 불일치: 개발자 시연과 POC는 성공하지만, 실제 6개월 운영 후 조직은 증폭된 혼란을 경험 개인 생산성 향상 vs 조직 시스템 혼란이라는 이율배반적 결과 발생 보안 취약점: 마켓플레이스 31,13…
LLM 기반 에이전트가 학습 능력을 갖추도록 설계된 오픈소스 프레임워크 Agno를 통해 상태 비저장 에이전트의 한계를 극복하고 지속적인 학습이 가능한 인텔리전트 시스템 구축 방법을 제시한다. 기존 에이전트의 근본적 한계: LLM은 기본적으로 상태 비저장(stateless)이므로 대화 기록, 도구 호출, 이전 상호작용을 기억하지 못함 진정한 학습의 정의: 세…
Ramp가 자체 백그라운드 코딩 에이전트 'Inspect'를 개발한 이유와 그 구현 방식에 대한 상세 가이드 Inspect의 핵심 가치: 단순히 코드를 작성하는 것을 넘어 검증까지 완료하며, 엔지니어가 필요한 모든 컨텍스트와 도구를 통합 개발 환경의 완전성: 백엔드 테스트, 텔레메트리, 프론트엔드 시각적 검증 등 직접 작업 검증 가능 인프라 구성: Moda…