Kubernetes GPU 스케줄링의 한계와 DRA의 등장 Kubernetes 위에서 GPU 자원을 운영해본 팀이라면 공통된 불편함을 경험했을 것이다. 기존 K8s의 리소스 모델은 nvidia.com/gpu: 1처럼 단순한 정수 카운팅 방식으로 GPU를 할당한다. B2...
아무도 원하지 않은 중복 인프라, 왜 쌓이는가 M&A(인수합병)와 반복되는 비즈니스·기술 이니셔티브는 조직 내에 예상치 못한 부산물을 남긴다. 바로 **중복 인프라(Duplicate Infrastructure)**다. 새로운 서비스를 도입할 때마다 기존 시스템을 완전히...
AI 코딩 도구, 이제는 '얼마나 잘 쓰느냐'의 시대 AI 코딩 도구 도입 초기에는 많은 조직이 "일단 써봐라"는 기조로 접근했다. Microsoft도 마찬가지였다. Copilot을 엔지니어들에게 적극 장려하며 사용량을 늘리는 데 집중했다. 하지만 이제 흐름이 바뀌고 ...
왜 지금 에이전트 오케스트레이션이 문제인가 멀티 에이전트 루프를 프로덕션에 배포하는 순간, 데모 환경에서는 드러나지 않던 구조적 문제들이 수면 위로 올라온다. 에이전트가 수렴에 실패하고 무한 루프에 빠지거나, 고위험 작업을 승인 없이 실행하거나, 비정상적인 상태 전이가...
코딩 에이전트와 편집기의 분리: AWS Kiro가 제시하는 방향 현재 대부분의 코딩 에이전트는 특정 IDE나 편집기에 강하게 결합되어 있다. GitHub Copilot은 VS Code나 JetBrains 계열에 플러그인 형태로 동작하고, Cursor는 자체 에디터를 통...
도구 호출이 유효해도 틀릴 수 있다 — AWS Dogwood의 정책 기반 거버넌스 백엔드 시스템에서 외부 API나 내부 서비스를 호출할 때, 우리는 보통 "이 요청이 문법적으로 올바른가?"를 먼저 따진다. 하지만 실무에서 진짜 문제는 그다음에 온다. 요청이 유효하더라도...