LLM·AI 에이전트
AI 에이전트·업무 자동화 실습
Codex·Claude Code 활용, 문서 자동화, AI 도구 설치와 웹 배포 과정에서 확인한 방법과 시행착오를 정리합니다.
최신 기술 글
AI 게이트웨이를 붙일 때 먼저 볼 것: OmniRoute의 라우팅·자격 증명·비용 경계
여러 AI 공급자를 하나의 로컬 게이트웨이에 연결할 때 자동 라우팅보다 먼저 정해야 할 데이터·자격 증명·비용·복구 기준을 OmniRoute 공식 문서로 정리합니다.
Microsoft Agent Framework에서 에이전트와 워크플로를 나누는 방법: 체크포인트·승인 기준
Microsoft Agent Framework 공식 문서와 Python 1.17.0 릴리스를 바탕으로 에이전트와 고정 워크플로를 나누고, 사람 승인·체크포인트·관측성을 설계하는 기준을 정리합니다.
ASCII smuggling에 대응하는 입력 보안: 유니코드 정규화만으로 부족한 이유
메일·문서·AI 에이전트가 읽는 문자열이 화면과 다를 때를 대비해, 유니코드 정규화·보이지 않는 문자 탐지·사람 검수 경계를 구현하는 방법을 정리합니다.
AI 코딩 에이전트의 변경 이유를 남기는 방법: Entire CLI로 세션과 Git 연결하기
Entire CLI는 AI 에이전트의 프롬프트·도구 호출·변경 파일과 Git 커밋을 연결합니다. 도입 전에 기록 위치, 복구 단위와 민감정보 경계를 확인하는 방법을 정리합니다.
Reverify가 보여주는 바이너리 AI 분석의 기준: 모델 제안과 바이트 검증 분리
Reverify는 AI의 바이너리 해석을 결정적 도구로 검증하고 VERIFIED·REFUTED·INCONCLUSIVE 결과와 증거를 남깁니다.
Open SWE를 코드 생성기가 아니라 격리된 소프트웨어 공장으로 읽는 법
LangChain의 Open SWE가 이슈·PR·일정에서 작업을 받아 격리된 샌드박스와 검증·리뷰 루프로 보내는 구조를 정리합니다.
GPT-6 Astra 출시에서 읽는 에이전트 안전성: 능력·모니터링·통제 분리
OpenAI의 GPT-6 Astra 안전 개요와 시스템 카드를 바탕으로 사이버 능력, 정렬, 모니터링, 도구 사용 통제를 분리해 읽습니다.
GitHub Copilot 코드 리뷰 승인 기능: 평가·승인·머지를 분리하는 방법
GitHub Copilot 코드 리뷰의 승인 평가와 실제 PR 승인을 구분하고, 기업·조직·저장소 정책에서 권한을 나누는 기준을 정리합니다.
GitHub Copilot 모델 지원 종료에 대비하는 방법: 이름보다 정책을 먼저 고정하기
GitHub Copilot에서 2026년 9월 1일 지원 종료된 모델과 대체 모델을 확인하고, 에이전트 업무의 모델 변경을 안전하게 관리하는 기준을 정리합니다.
Gemini API Managed Agents: 원격 Linux 샌드박스에 에이전트를 맡길 때 볼 것
Gemini API Managed Agents가 원격 Linux 샌드박스에서 코드·파일·웹 작업을 실행하는 구조와 네트워크·비용·수명 제한을 정리합니다.