Claude Opus 4.6
Anthropic이 가장 강력한 AI 모델인 Claude Opus 4.6을 출시했으며, 코딩 능력, 장문맥 처리, 안전성 모두에서 업계 최고 수준의 성능을 달성했다. 코딩 및 에이전트 작업 대폭 개선 - 계획 수립 능력 강화, 대규모 코드베이스 처리 능력 향상, 코드 리뷰 및 디버깅 능력 우수 1M 토큰 컨텍스트 윈도우 베타 제공 - Opus 클래스 모델로…
최근에 읽었거나 읽으려고 하는 것들의 기록.
개발 280건
Anthropic이 가장 강력한 AI 모델인 Claude Opus 4.6을 출시했으며, 코딩 능력, 장문맥 처리, 안전성 모두에서 업계 최고 수준의 성능을 달성했다. 코딩 및 에이전트 작업 대폭 개선 - 계획 수립 능력 강화, 대규모 코드베이스 처리 능력 향상, 코드 리뷰 및 디버깅 능력 우수 1M 토큰 컨텍스트 윈도우 베타 제공 - Opus 클래스 모델로…
브라우저 자동화 대신 웹사이트의 내부 API를 직접 호출하여 AI 에이전트의 웹 작업 속도를 100배 향상시키는 Unbrowse 도구 소개 브라우저 자동화의 문제점: 한 번의 웹 작업에 10-45초 소요, 15-30% 실패율, 500MB 이상의 RAM 소비 API 직접 호출의 장점: 동일한 작업을 200ms 내에 완료, 95% 이상의 신뢰도, 최소한의 자원…
Tree of Thoughts(ToT)는 복잡한 문제 해결을 위해 언어모델이 중간 단계의 생각들을 트리 구조로 탐색하고 평가하는 프롬프팅 프레임워크이다. ToT의 핵심 개념: 기존의 단순 프롬프팅을 넘어 트리 구조의 사고 탐색을 통해 복잡한 문제 해결 작동 방식: 언어모델이 생각을 생성하고 자체 평가한 후, 탐색 알고리즘(BFS/DFS/빔서치)으로 체계적…
소프트웨어 아키텍처 결정을 체계적으로 관리하기 위한 세 가지 핵심 도구(기술 레이더, 기술 표준, 아키텍처 결정 기록)로 구성된 프레임워크를 제시한다. 기술 레이더(Technology Radar): 조직이 사용하거나 계획 중인 기술의 성숙도를 시각적으로 표현하고, 새로운 기술의 도입 여정(평가→시험→채택→중단)을 관리 기술 표준(Technology Stan…
오스트리아 개발자 피터 슈타인베르거는 10억 대 기기에서 사용되는 PDF 프레임워크 PSPDFKit을 만들었고, 현재 AI 에이전트 기반 코딩의 새로운 시대를 주도하고 있다. 그는 배포하는 코드의 대부분을 읽지 않고도 600개의 커밋을 병합할 수 있으며, 이것이 '루프 폐쇄'라는 AI 시스템 코딩 원칙을 따르기 때문이라고 주장한다. 피터의 개발 철학: 코드…
개인 홈랩 인프라를 Terraform과 Ansible을 이용한 IaC(Infrastructure as Code)로 관리하여 수동 설정을 없애고 재현 가능한 인프라를 구축한 경험담 Terraform + Ansible 조합: 인프라 프로비저닝과 설정 관리를 분리하여 효율적으로 운영 Proxmox VE 기반 구성: 게이트웨이, 모니터링, 레지스트리 LXC와 k3…
Claude Code의 스킬 시스템을 활용해 개인화된 AI 협업 도구로 만드는 방법 스킬 시스템의 핵심: .claude/skills/ 디렉토리에 마크다운 파일을 두면 Claude가 특정 작업 수행 시 참고하는 지침서로 인식 개인화의 필요성: 매번 같은 지시를 반복하는 대신 스킬로 정의해두면 Claude가 개발자의 워크플로우와 선호도를 학습 Agent Ski…
Clawdbot의 아키텍처와 작동 원리를 분석한 글로, AI 엔지니어들이 배울 수 있는 설계 패턴과 기술적 구현을 상세히 설명한다. TypeScript 기반 CLI 애플리케이션: Python이나 웹 앱이 아닌 로컬 머신에서 실행되는 프로세스로, 여러 메신저를 통해 접근 가능 Lane 기반 큐 아키텍처: 기본적으로 직렬 처리하되 안전한 작업만 병렬화하는 설계…
추론 속도로 배포하기: AI 에이전트 시대의 소프트웨어 개발 2025년 말, GPT-5와 Claude 같은 고급 AI 모델을 활용해 기존보다 훨씬 빠르게 소프트웨어를 개발하고 배포하는 새로운 워크플로우에 대한 실제 경험담. 모델 성능이 개발 속도의 핵심 제약: 과거 수작업이 필요했던 작업들이 이제 AI 프롬프트 한두 개로 자동 처리 가능 GPT-5.2와 C…
Vercel의 연구에서 AI 코딩 에이전트에게 프레임워크 지식을 전달하는 데 있어 AGENTS.md 파일이 Skills 기반 접근보다 훨씬 효과적임을 입증했다. AGENTS.md 방식이 100% 성공률 달성 - 8KB 압축 문서 인덱스로 Skills의 79%를 능가 Skills의 근본적인 한계 - 에이전트가 필요한 순간에 스킬을 호출하지 않는 문제 (56%…
Kimi K2.5는 텍스트와 비전을 공동으로 최적화하는 오픈소스 멀티모달 에이전트 모델로, Agent Swarm을 통해 복잡한 작업을 병렬로 처리하여 4.5배의 지연시간 감소를 달성했다. 멀티모달 공동 최적화: 초기 단계부터 텍스트와 비전 토큰을 균형있게 혼합하는 방식으로 두 모달리티가 상호 강화 Zero-Vision SFT: 텍스트 전용 SFT만으로 시각…
Moltbook: AI 에이전트들의 소셜 네트워크가 인터넷에서 가장 흥미로운 곳으로 부상 OpenClaw(구 Clawdbot)라는 오픈소스 AI 어시스턴트를 기반으로 한 Moltbook이 AI 에이전트들의 소셜 네트워크로 급성장하고 있으며, 이는 혁신적이면서도 보안 위험을 안고 있는 현상을 보여준다. OpenClaw의 급성장: 2개월 만에 GitHub 스타…
실리콘밸리 AI 유니콘 기업 Cohere의 채용 과제에 합격했지만 회사의 APAC 전략 변경으로 채용이 취소된 개발자의 회고기. 글로벌 Top-tier 기업의 기술적 기준과 개발자 역량 평가 기준을 공개하며, 제약된 환경에서도 성과를 낼 수 있는 개발자의 자질을 보여준다. Cohere 소개: Transformer 아키텍처 창시자 에이단 고메즈 설립, B2B…
직접 실행 가능한 멀티에이전트 시스템을 로컬에서 5분, 프로덕션에 20분 이내에 배포할 수 있는 완전한 예제를 제공하는 가이드 3가지 에이전트 패턴 제공: Pal(개인 AI 어시스턴트), Knowledge Agent(문서 기반 질답), MCP Agent(외부 서비스 연동) 프로덕션 레벨 기능: 학습 능력, PostgreSQL 기반 상태 저장, Agentic…
AI 주도 개발 생명주기(AI-DLC)는 기존 소프트웨어 개발 방법론을 근본적으로 재구상하여 AI를 중심 협력자로 삼는 새로운 방법론입니다. AI의 속도와 역량을 완전히 활용하기 위해 설계되었으며, 기존 애자일 방법론의 개조가 아닌 제1원칙에 기반한 전면적 재설계를 추구합니다. AI의 역할 전환: AI가 인간의 명령에 대응하는 것이 아니라 고수준 의도를 실…
AI 에이전트 기반 코딩의 극단적 활용 사례: 월 4,600달러를 투자해 22개의 Claude 구독으로 '디지털 노동력'을 구축한 개발자의 이야기 기술 업계의 아이러니: 전통 소프트웨어 엔지니어들은 에이전트 기반 코딩의 가능성을 간과하는 반면, 비엔지니어들이 AI 도구를 적극 활용해 서비스 구축에 성공 극단적 활용 사례 - Jeffrey Emanuel: 1…
하이퍼리즘의 전 CTO가 2년 7개월간의 경험을 바탕으로 CTO가 직면하는 테크 리딩, 매니징, 인사, 경영 전반의 챌린지와 인사이트를 솔직하게 공유하는 기술 블로그 기술적 의사결정은 스노우볼이 된다 - 잘못된 선택이 조직 전체에 영향을 미치며, 특히 인프라 결정은 회복하기 어려운 레거시가 됨 사례 기반 의사결정이 필수 - 과거 사례를 근거로 80% 이상의…
AI 에이전트에게 작업을 지시할 때는 방대한 스펙을 한 번에 제시하기보다는, 명확하고 구조화된 지침을 단계적으로 나누어 제공하는 것이 핵심이다. 상위 수준의 비전부터 시작: 구체적인 세부사항은 AI가 초안을 작성하도록 하고, 인간은 목표와 방향만 제시 PRD 형식의 구조화된 스펙: 명령어, 테스트, 프로젝트 구조, 코드 스타일, Git 워크플로우, 작업 경…
LLM 기반 에이전트가 학습 능력을 갖추도록 설계된 오픈소스 프레임워크 Agno를 통해 상태 비저장 에이전트의 한계를 극복하고 지속적인 학습이 가능한 인텔리전트 시스템 구축 방법을 제시한다. 기존 에이전트의 근본적 한계: LLM은 기본적으로 상태 비저장(stateless)이므로 대화 기록, 도구 호출, 이전 상호작용을 기억하지 못함 진정한 학습의 정의: 세…
Ramp가 자체 백그라운드 코딩 에이전트 'Inspect'를 개발한 이유와 그 구현 방식에 대한 상세 가이드 Inspect의 핵심 가치: 단순히 코드를 작성하는 것을 넘어 검증까지 완료하며, 엔지니어가 필요한 모든 컨텍스트와 도구를 통합 개발 환경의 완전성: 백엔드 테스트, 텔레메트리, 프론트엔드 시각적 검증 등 직접 작업 검증 가능 인프라 구성: Moda…