
Node.js HTTP 서버 요청 경로 - HTTP, TCP, 프로세스, 컨테이너
Node.js 서버의 성능, Event Loop, Worker Threads, Kubernetes CPU limit을 이해하려면 먼저 요청 하나가 어디에서 시작하고 어느 책임 경계를 지나 애플리케이션 코드에 도착하는지 알아야 합니다. GET /healthz 같은 HTTP 요청 하나를 기준으로 TCP 연결, HTTP 메시지, Node.js 프로세스, 컨...

Node.js 서버의 성능, Event Loop, Worker Threads, Kubernetes CPU limit을 이해하려면 먼저 요청 하나가 어디에서 시작하고 어느 책임 경계를 지나 애플리케이션 코드에 도착하는지 알아야 합니다. GET /healthz 같은 HTTP 요청 하나를 기준으로 TCP 연결, HTTP 메시지, Node.js 프로세스, 컨...

Node.js 서버에서 응답이 느려졌을 때 Express middleware부터 의심하기 쉽습니다. 하지만 route 코드가 정상이어도 Node.js process가 CPU를 오래 점유하거나, port를 열지 못했거나, container가 종료 신호를 받는 중일 수 있습니다. 원인을 나누려면 Node.js가 JavaScript 언어도, browser도...

GitHub Actions 같은 외부 CI에서 Google Cloud에 배포해야 할 때, Service Account key JSON을 secret에 넣는 방식은 시작은 쉽지만 끝이 어렵습니다. key가 오래 살아남고, 누가 어떤 실행에서 썼는지 분리하기 어렵고, 회전과 폐기까지 운영해야 합니다. 실행마다 외부 OIDC token을 받아 짧은 Goog...

로그인, 계정 생성, 쿠폰 발급처럼 자동화 요청이 실제 피해로 이어질 수 있는 browser flow에서는 정상 사용자를 매번 CAPTCHA에 통과시키지 않고도 의심스러운 client를 한 번 더 확인하고 싶을 때가 있습니다. AWS WAF Challenge는 이때 사용할 수 있는 WAF rule action입니다. browser가 background...

이전 글에서는 AWS WAF의 Web ACL, Managed Rule Group, 비용과 공통 rollout을 다뤘습니다. 조직이 직접 근거와 만료를 관리해야 하는 self-managed rule을 AsnMatchStatement, IP set match, rate-based rule 세 가지를 중심으로 다룹니다. 각 수단의 선택 기준, ASN Ma...

웹 애플리케이션은 Structured Query Language(SQL) injection, cross-site scripting(XSS), 취약점 스캔, credential stuffing, 악성 bot, Hypertext Transfer Protocol(HTTP) flood처럼 HTTP 요청의 내용을 이용하는 공격에 계속 노출됩니다. Securit...

LiteLLM에서 max_budget: 0으로 발급한 virtual key는 지출이 0.0인 상태에서도 HTTP 429로 거절됐습니다. 다른 키의 mock 호출은 당시 실행 요약에 HTTP 200으로 기록됐으며, 도구 출력에서 usage.total_tokens: 30과 /key/info의 spend: 0.0을 확인했습니다. 성공 응답의 토큰 수와 누적...

Claude Code, Codex, Hermes처럼 터미널에서 동작하는 Artificial Intelligence(AI) 코딩 에이전트를 동시에 사용하면 실행 능력은 빠르게 늘어납니다. 그러나 작업 수가 늘어날수록 더 큰 병목은 모델 성능이 아니라 사람이 현재 상황을 파악하고 안전하게 개입하는 과정에서 생깁니다. 어느 저장소에서 어떤 에이전트가 일하는...

tmux는 하나의 터미널에서 여러 터미널을 만들고, 실행 중인 프로그램을 화면에서 분리했다가 다시 연결할 수 있게 하는 터미널 멀티플렉서입니다. 이 글에서는 macOS와 Linux에서 장시간 실행되는 대화형 AI 코딩 에이전트를 안전하게 다루는 데 필요한 명령과 기본 단축키를 정리합니다. 1. 핵심 개념 tmux는 다음 계층으로 동작합니다. ...

출력 토큰을 포함한 최종 사용량은 응답 완료 시점에 확정됩니다. Envoy Gateway에서 HTTP 요청 수를 제한하던 설정에 토큰 예산을 넣으려면, provider 응답을 해석하고 사용량을 프록시의 정책 엔진에 전달하는 처리가 필요합니다. Envoy AI Gateway는 Envoy Gateway에 AI 전용 컨트롤러와 external process...