AI 게이트웨이는 왜 버퍼링을 꺼야 하는가: 스트리밍 응답의 내부
ThreadsChatGPT처럼 한 글자씩 도착하는 응답의 뒤에는 Streamable HTTP가 있다. HTTP/1.1 chunked와 HTTP/2 DATA frame의 차이, LLM 토큰 스트리밍에서 버퍼링을 꺼야 하는 이유와 그 메모리 대가, 그리고 Envoy Gateway와 APISIX 선택 기준까지.
ChatGPT처럼 한 글자씩 도착하는 응답의 뒤에는 Streamable HTTP가 있다. HTTP/1.1 chunked와 HTTP/2 DATA frame의 차이, LLM 토큰 스트리밍에서 버퍼링을 꺼야 하는 이유와 그 메모리 대가, 그리고 Envoy Gateway와 APISIX 선택 기준까지.
Namespace의 Hugo Santos와 Madison Faulkner가 AI Engineer 채널에서 발표한 'CI/CD Is Dead' 영상을 정리하고, 핵심 질문에 대한 답을 찾는 과정. 에이전트 Harness가 만드는 코드 변화량의 폭발, 이를 수용하기 위한 Continuous Compute 아키텍처, 그리고 '준비한다'는 것이 구체적으로 무엇을 의미하는지까지.
Harness 플러그인으로 Nx 모노레포에 5개 AI 에이전트를 구성하고 병렬 감사를 실행한 실전기. 보안 취약점, 의존성 경고, 인터페이스 불일치 등을 한 세션에서 식별하고 조치한 과정과 토큰 비용 분석.
Astro + GitHub Pages 정적 블로그에 SEO 메타 태그, OG 이미지 자동 생성, Giscus 댓글, Cloudflare Workers 좋아요, GoatCounter 분석을 서버 비용 0원으로 구현한 과정을 정리합니다.
Next.js + NestJS 모노레포에서 GitHub Actions, ArgoCD, AKS로 구축한 CI/CD 파이프라인. PR별 격리 Preview 환경, 변경 감지 기반 선택적 빌드, GitOps 배포, 자동 cleanup을 다룹니다.
100개 이상의 LLM을 단일 OpenAI 형식으로 통합하는 LiteLLM. SDK와 Proxy Server의 차이, 실제 운영 경험, 도입 판단 기준을 공유합니다.
NanoClaw의 Telegram 기능을 skills engine 기반으로 전환하고, upstream과 fork custom의 3계층 코드 구조를 확립한 과정을 정리합니다.