전체 글
-
Computer Use를 활용한 바이브 코딩 앱 사용성 테스트: 정적 린터를 넘어 에이전트 동적 QA와 자율 PR 완결까지AI 2026. 9. 28. 18:11
Computer Use를 활용한 바이브 코딩 앱 사용성 테스트: 정적 린터를 넘어 에이전트 동적 QA와 자율 PR 완결까지출처 및 참고: 디자이너이자 앱 빌더인 Eric Park의 실전 연구 및 커뮤니티 인사이트를 바탕으로, 자율 AI 에이전트(GPT-6 Astra High, Claude Fable 5.1 High 등)의 Computer Use(브라우저·데스크톱 제어) 프리미티브를 프로덕션 프론트엔드 사용성 테스트(UT) 및 자율 QA 파이프라인으로 체계화한 엔지니어링 포스트입니다.1. 바이브 코딩의 검증 공백: "코드를 보는 것"과 "화면을 만져보는 것"의 간극자연어 프롬프트와 LLM 코딩 에이전트의 결합인 바이브 코딩(Vibe Coding)은 소프트웨어 개발 속도를 유례없이 단축시켰습니다. 기획 아이..
-
AI에게 검증 가능한 목표 제시하기: SQuaRE 국제표준 기반 품질 목표와 아키텍처 드라이버AI 2026. 9. 27. 16:41
AI에게 검증 가능한 목표 제시하기: SQuaRE 국제표준 기반 품질 목표와 아키텍처 드라이버출처 및 참고: 유튜브 채널 [코딩하는기술사]의 "AI에게 검증가능한 목표 제시하기 — 국제표준 기반 품질목표 세우기" 강연을 바탕으로, 프로덕션 소프트웨어 아키텍처와 자율 코딩 에이전트(Claude Code, Cursor, Codex 등) 하네스 설계 실무 관점을 결합해 정리한 글입니다.1. "빠르게 만들어 주세요"라는 비극과 완료 판단(DoD)의 실종소프트웨어 개발 프로젝트에서 기획자나 고객, 혹은 동료 엔지니어로부터 가장 흔하게 듣는 요구사항 중 하나는 다음과 같은 문장들입니다."시스템이 버벅이지 않고 빠르게 동작해야 합니다.""장애가 최대한 안 나게 튼튼하게 만들어 주세요.""개인정보가 유출되지 않도록 보..
-
코딩 에이전트 하네스 설계 실증 연구: 176회 실험으로 밝혀진 컨텍스트·계획·도구의 진실AI 2026. 9. 26. 11:00
코딩 에이전트 하네스 설계 실증 연구: 176회 실험으로 밝혀진 컨텍스트·계획·도구의 진실출처: UMass Amherst · Emory University · UNC Charlotte · Zoom Video Communications — An Empirical Study of Harness Design for Coding Agents (arXiv:2609.20804) · GeekNews #33905 · Hacker News #497538781. 리더보드의 신기루: 모델이 뛰어난 것인가, 하네스가 영리한 것인가?코딩 에이전트 벤치마크(SWE-Bench, Terminal-Bench 등)의 리더보드를 살펴볼 때마다 모든 AI 엔지니어는 필연적으로 동일한 의문에 직면합니다."OpenHands가 SWE-Agent..
-
프롬프트는 실재하지 않는다: 프로덕션 AI 에이전트와 자기 교정 하네스 아키텍처AI 2026. 9. 26. 10:20
프롬프트는 실재하지 않는다: 프로덕션 AI 에이전트와 자기 교정 하네스 아키텍처출처: Dan McKinley (mcfunley.com, 전 Etsy 수석 엔지니어·Choose Boring Technology 저자) — Prompts aren’t Real: Dispatches from Agentic Product · GeekNews #34036 · Hacker News #497771111. 프롬프트라는 환상과 '의도적 관점'의 오류소프트웨어 엔지니어링 역사에서 명저로 꼽히는 Choose Boring Technology(지루한 기술을 골라라)의 저자이자 25년 경력의 베테랑 엔지니어 댄 맥킨리(Dan McKinley)가 최근 엔터프라이즈 AI 에이전트를 프로덕션에 구축하며 겪은 생생한 현장 경험을 공유했습니..
-
코드 에이전트 오케스트라 — 멀티 에이전트 코딩을 제대로 작동시키는 법AI 2026. 9. 25. 09:44
코드 에이전트 오케스트라 — 멀티 에이전트 코딩을 제대로 작동시키는 법이 글은 PyTorchKR Discourse에 공유된 GeekNews 기반 요약을 바탕으로 정리한 것입니다.AI 코딩 도구를 처음 써봤을 때의 그 신기함 — "와, 혼자 코드 짜네" — 은 시간이 지나면서 현실적인 질문으로 바뀐다. "에이전트 하나로는 한계가 있는데, 여러 개를 어떻게 굴려야 하지?"오케스트라에 비유하면 간단하다. 바이올린 한 명이 전곡을 연주하는 게 아니라, 각 파트가 자기 역할을 하면서도 지휘자의 박자에 맞춰 움직이는 것. 멀티 에이전트 코딩도 정확히 그렇게 작동해야 한다.Conductor에서 Orchestrator로지금까지 많은 팀이 쓰던 방식은 Conductor 모델이다. 에디터나 CLI 안에서 에이전트 하나와 ..
-
카프카(Kafka)를 메시지 큐로만 쓰면 안 되는 이유: 'The Log'와 분산 커밋 로그 아키텍처ARCHIVE 2026. 9. 21. 21:14
참고: 본 글은 링크드인(LinkedIn)의 분산 인프라를 설계하고 아파치 카프카(Apache Kafka)를 창시한 제이 크렙스(Jay Kreps)의 기념비적 논고, "The Log: What every software engineer should know about real-time data's unifying abstraction" (2013)의 핵심 통찰을 바탕으로 현대 분산 시스템과 데이터베이스 아키텍처의 기저 원리를 심층 분석합니다.📌 한 줄 요약카프카는 단순한 고성능 메시지 큐가 아니라, 물리적 시계의 불완전성을 논리적 순번(Offset)으로 극복하는 분산 커밋 로그(Distributed Commit Log)이며, $O(N^2)$ 거미줄 파이프라인을 $O(N)$으로 단순화하고 모든 분산 시스..
-
Jev와 디시전 트리: 초저지연 AI 의사결정 모델과 결정론적 제어 흐름의 융합AI 2026. 9. 21. 21:13
참고: 본 글은 최근 주목받고 있는 초저지연(30~100ms) 의사결정 전용 모델 Jev와 전통적 기계학습의 디시전 트리(Decision Tree) 간의 구조적·통계적 차이점을 비교 분석하고, 실제 프로덕션 소프트웨어 제어 흐름(Control Flow)에 융합하는 스마트 의사결정 노드(Smart Decision Node) 아키텍처를 다룹니다.📌 한 줄 요약전통적 디시전 트리가 "정형 테이블 피처를 사전에 고정된 축 정렬 규칙($x_i \le \theta$)으로 계단식 분할하는 닫힌 체계"라면, Jev는 "비구조화된 고차원 자연어/상태 문맥을 고차원 시맨틱 공간에서 즉석(In-context)으로 평가하여 통계적으로 보정된 확률로 분기하는 열린 체계"이며, 실무에서는 디시전 트리를 대체하는 것이 아니라 결..
-
에이전트의 기억과 비용을 지키는 법: 컨텍스트 예산(Budgeting)과 구조화 압축AI 2026. 9. 20. 08:32
참고: 본 글은 장기 실행(Long-running) 및 멀티턴 자율 에이전트 구축 시 직면하는 토큰 한계와 문맥 손실 문제를 해결하기 위한 결정론적 예산 할당(Context Budgeting) 및 구조화 압축(Structured Compression) 아키텍처 패턴을 다룹니다.📌 한 줄 요약멀티턴 에이전트의 컨텍스트 초과와 비용 폭증을 방어하기 위해, 매 턴마다 고정 예약(시스템 프롬프트·도구 스키마·출력 버퍼)을 먼저 차감하여 가용 입력 예산을 동적으로 산출하고, 최근 $N$턴은 원문을 보존하되 이전 대화는 fact / decision / todo 삼분법으로 구조화 요약하여 정보 왜곡 없는 결정론적 하네스(Harness)를 구축하는 패턴입니다.1. 배경: 멀티턴 에이전트가 겪는 3대 컨텍스트 위기LL..