2026.

AI ENGINEERING · AGENT SYSTEMS.

AI Engineering
Portfolio.

데이터와 업무 흐름을 구조화하고,
신뢰 가능한 AI 시스템을 설계하는 개발자 김재환입니다.

2026.#AI 도입 #검증 #운영

AI ADOPTION APPROACH.

현업의 문제 정의와 작은 PoC
검증·평가를 거쳐 운영·유지보수까지

01

업무 정의

현업의 반복·병목을 파악하고,
해결할 문제를 구체화.

02

작은 PoC

기획한 AI 기능을 제한된 데이터와
범위에서 시험하고, 활용 가능성을 확인.

03

검증·승인

출처·정확도·권한을 확인하고,
실제 운영 가능 여부를 검토.

04

운영·유지보수

운영 중 생긴 오류와 피드백을 반영하고,
규칙·도구·문서를 계속 보완.

생성형 AI를 단독 기능으로 두지 않고, 데이터·권한·검토 절차가 이어지는 업무 도구로 설계해 왔습니다.

2026.#AI 도입 #업무자동화 #데이터 검증

CONTENTS.

01

CONTEXT · VERIFICATION

자소전.

취업 공고 분석 및 인사이트 생성, AI 자기소개서 첨삭 서비스
02

WORKFLOW · OPERATIONS

DoitDo.

Grafana 경보 분석과 운영 요청을 지원하는 Discord AI 어시스턴트
03

AGENT · ORCHESTRATION

NanoClaw.

오픈소스 NanoClaw를 확장한 Claude·Codex 협업형 개인 AI 비서
04

LOCAL LLM · AGENT RUNTIME

Local LLM
Agent Runtime.

로컬 LLM 작업 위임과 공유 서버 수명주기를 설계한 실행 환경
05

RELIABILITY · CONTROL

HearBe.

시각장애인의 음성 쇼핑을 돕는 AI 쇼핑 어시스턴트
2026.#멀티에이전트 #컨텍스트 검증

01 · PROJECT INTRO.

01.

자소전.

공고·기업·개인 경험을
검증 가능한 작성 근거로 전환하는 멀티에이전트 워크플로우.

PERSONAL PROJECT2026. 04 · PRESENTTypeScript · Python · React · Fastify
2026.#기업 분석 #직무 분석 #출처 기반

01 · JASOJEON INSIGHT.

수집한 근거를
지원 전략으로 정리합니다.

INSIGHT ANALYSIS.

기업·직무·문항 분석

공고와 기업 정보를 문항별 지원 전략으로 정리하고, 초안에 반영할 근거와 확인이 필요한 내용을 구분합니다.

자소전 인사이트 분석 화면
2026.#멀티에이전트 #리뷰 워크플로우

01 · JASOJEON AGENT REVIEW.

생성과 검토 역할을 분리해,
초안과 근거를 교차 확인합니다.

AGENT REVIEW.

작성·적합성·근거 검토 분리

컨텍스트 리서처, 섹션 작성자, 적합성·근거 리뷰어 등 역할별 에이전트가 한 문항을 순차적으로 검토합니다.

자소전 멀티에이전트 첨삭 화면
2026.#컨텍스트 처리 #DART OpenAPI #Human-in-the-loop

CONTEXT · VERIFICATION.

AI가 답하기 전에,
검증 가능한 근거부터 구조화합니다.

INPUT.

형식별 파싱·전처리

PDF·DOCX·TXT·Markdown의 추출 경로를 나누고, 텍스트를 정규화·분할해 재사용 가능한 컨텍스트로 만듭니다.

RESEARCH.

핵심 근거 중심 압축

공고·기업·개인 경험을 출처·목적·중요도로 분류하고, 작성에 필요한 근거를 중심으로 요약합니다.

CHECK.

출처와 사람 검토

DART OpenAPI의 사업보고서 XML을 수집·파싱·청킹하고, 교차검증이 부족한 정보는 검토 대기로 남깁니다.

AI의 응답 품질은 프롬프트만이 아니라, 입력 데이터의 구조와 검증 가능한 출처에서 결정된다고 보았습니다.

2026.#Discord #관측성 #운영 자동화

02 · PROJECT INTRO.

02.

DoitDo.

팀 운영에 집중된 점검·분석·데이터 확인 업무를
Discord 기반 AI 운영 흐름으로 전환.

TEAM PROJECT2026. 04 · 2026. 05Customized NanoClaw · Discord · Grafana · Loki · Jira
2026.#DoitDo #운영 화면

02 · DOITDO AI INFRA ASSISTANT.

경보를 받으면,
원인과 대응을 정리합니다.

ALERT ANALYSIS.

Grafana 5xx 경보 분석

경보를 Discord 작업으로 연결한 뒤, 로그·메트릭·코드베이스를 함께 확인해 원인·영향 범위·권장 대응을 정리합니다.

경보의 단순 전달이 아니라, 담당자가 다음 조치를 판단할 수 있는 분석 흐름을 만들었습니다.

DoitDo Grafana 5xx 경보 분석과 대응 제안
2026.#DoitDo #자연어 조회

02 · DOITDO AI INFRA ASSISTANT.

질문을 업무 언어로 받고,
필요한 데이터를 조회합니다.

NATURAL LANGUAGE QUERY.

서비스 현황 데이터 응답

팀원이 Discord에서 사용자 수와 최근 가입자를 묻으면, 서비스 데이터를 조회해 읽기 쉬운 결과로 반환합니다.

운영 담당자에게 별도로 요청하지 않아도, 팀이 기존 협업 채널에서 필요한 현황을 확인할 수 있게 했습니다.

DoitDo 자연어 사용자 수 조회 응답
2026.#DoitDo #운영 요청

02 · DOITDO AI INFRA ASSISTANT.

운영 요청과 실행 결과를
기존 협업 채널에 남깁니다.

OPERATION REQUEST.

계정 상태·보상 데이터 처리

운영자가 요청한 독립 버튼 활성화, 도감 개방, 재화 지급 같은 계정 상태 변경을 봇이 결과와 함께 채널에 응답합니다.

실제 변경 기능은 데이터 접근권한과 실행 전 확인·승인 절차를 함께 설계해야 하는 영역입니다.

DoitDo 계정 상태 변경 요청 처리 화면
2026.#OSS Fork #Turn-taking #Additive Modules

03 · PROJECT INTRO.

03.

NanoClaw.

오픈소스 NanoClaw를 fork해 Claude와 Codex가
역할에 따라 작업을 이어가는 개인 AI 비서로 확장.

PERSONAL PROJECT · OSS FORK & EXTENSION2026. 02 · PRESENTTypeScript · SQLite · Docker · Discord.js
2026.#Discord #Claude #Codex

03 · NANOCLAW PERSONAL AGENT.

Claude와 Codex가 Discord에서
작업을 이어갑니다.

Claude와 Codex가 역할에 따라 응답하고, 작업 상태는 채널 메시지로 이어집니다.

나붕봇 Codex Discord 대화 화면 재붕봇 Claude Discord 대화 화면 재붕봇 개인 문서 저장과 성적증명서 조회 대화 화면
2026.#SQLite #Slash Commands #Background Agents

03 · NANOCLAW PERSONAL AGENT.

협업 상태를 기록해,
다음 실행 주체와 작업을 연결합니다.

Discord작업 요청 · 명령
NanoClaw · Claude세션 상태 · slash command
collab 모듈 · 배경 작업 spawn
OpenClaw · Codexhandoff 수신 · 작업 수행
COLLAB_STATUS 응답
/collab 턴 교대 작업 시작/collab-stop 실행 중인 협업 중단/responder 응답 담당 전환spawn_subagent 장시간 작업 분리

최대 라운드·DONE·CONTINUE·BLOCKED 상태를 제어하고, 종료된 배경 워커를 회수해 장시간 작업이 메인 대화를 막지 않도록 했습니다.

2026.#권한 경계 #관측성 #운영 자동화

SAFE OPERATIONS.

자연어 인터페이스와
실제 운영 권한은 분리합니다.

ACCESS.

채널·발신자 제한

허용된 채널과 요청자만 운영 흐름에 진입하도록 구성합니다.

DATA.

읽기·쓰기 경계

RO/RW 마운트를 분리하고, 시크릿이 응답에 노출되지 않도록 둡니다.

REVIEW.

담당자 검토

메트릭·로그·이슈를 함께 확인해 대응안은 사람이 판단하도록 연결합니다.

RECOVERY.

상태·실패 회수

세션 상태와 재시작 정책을 두어 장시간 작업의 실패를 회수합니다.

AI 도입에서 자동화 범위와 사람이 최종 판단해야 하는 경계를 함께 설계한 경험입니다.

2026.#로컬 LLM #서버 수명주기 #프로세스 소유권

04 · PROJECT INTRO.

04.

Local LLM Agent Runtime.

로컬 GPU의 sLLM을 Claude Code 플러그인과 CLI에서 공유하고,
작업 위임과 모델 서버 수명주기를 제어하는 실행 환경.

qwen-plugin-cc · OSS DERIVATIVE2026. 07 · PRESENTNode.js · PowerShell · llama.cpp · Qwen
2026.#로컬 LLM #llama.cpp #공유 서버

04 · LOCAL LLM EXECUTION.

플러그인과 CLI가 하나의
로컬 모델 서버를 공유합니다.

ARCHITECTURE.

Claude Code Plugin상위 OSS 파생 · /v1/responses
PowerShell CLI독립 진입점 · /v1/chat/completions
llama-serverQwen3.6-27B
로컬 GPU 1개
플러그인 경로는 openai/codex-plugin-cc v1.0.3을 기반으로 로컬 모델 백엔드·격리·수명주기 계층을 확장했습니다.
LIVE HANDOFF.
Claude Code가 qwen-worker 서브에이전트에 문서 요약 작업을 위임한 화면
ACTIVE WORKER.메인 에이전트가 qwen-worker에 작업을 전달 중인 하단 상태 표시

플러그인과 독립 CLI는 서로 다른 OpenAI 호환 엔드포인트를 사용하지만, 하나의 llama-server와 VRAM 할당을 공유합니다.

2026.#서브에이전트 #로컬 추론 #결과 반환

04 · LOCAL AGENT HANDOFF.

메인 에이전트가 작업을 위임하고,
로컬 LLM의 결과를 최종 응답으로 연결합니다.

01 · LOCAL LLM WORKER.파일을 읽고 근거 기반 보고서를 생성
로컬 Qwen 워커가 파일을 읽고 보고서를 생성하는 실행 과정
02 · MAIN RESPONSE.완료 신호를 받아 사용자 응답으로 정리
메인 에이전트가 Qwen 워커의 결과를 최종 응답으로 정리한 화면

메인 대화는 Claude Code가 유지하고, 파일 읽기·요약 작업은 로컬 GPU에서 실행되는 qwen-worker에 위임합니다.

2026.#도구 호출 #승인 게이트 #샌드박스

04 · TOOL CONTRACT & AGENT LOOP.

진입점마다 도구 계약을 분리하고,
필요한 실행 권한만 제공합니다.

PLUGIN WORKER.

Isolated Codex harness

filesystem파일 읽기·탐색
shell · edits명령 실행·파일 변경
workspace-write작업공간 쓰기 샌드박스
~/.codex-qwen별도 설정·인증 없는 격리 홈

STANDALONE CLIENT · 6 TOOLS.

read_file파일 내용 읽기NO CONFIRM
list_dir디렉터리 조회NO CONFIRM
web_search웹 검색 결과 조회NO CONFIRM
web_fetch웹 문서 가져오기NO CONFIRM
write_fileLCS diff 확인 후 쓰기CONFIRM
run_shell셸 명령 실행CONFIRM
MODEL다음 행동 판단TOOL CALL스키마에 맞춘 호출APPROVALwrite · shell만EXECUTE도구 실행OBSERVATION결과를 컨텍스트로 반환

write_file은 실제 LCS diff를 먼저 보여주고, run_shell과 함께 승인 후 실행합니다. 결과는 호출당 12,000자로 제한하고 한 턴은 최대 8회 반복합니다.

2026.#서버 소유권 #종료 경로 #자원 회수

04 · SERVER OWNERSHIP.

공유 서버는 재사용하고,
직접 실행한 프로세스만 종료합니다.

01 · EMPTY.

기동하고 소유

실행 전에 포트가 비어 있던 세션만 서버 소유권을 가집니다.

02 · READY.

재사용·비소유

정상 응답 중인 서버는 그대로 사용하되 종료 대상에 넣지 않습니다.

03 · LOADING.

종료하지 않고 대기

포트가 점유됐지만 미응답이면 다른 세션의 로딩으로 보고 기다립니다.

04 · EXIT.

소유 서버만 정리

Ctrl+C와 /exit가 같은 종료 경로에서 소유한 PID만 회수합니다.

DESIGN PRINCIPLE.

listeningready, 사용 중과 소유함을 분리해 다른 세션의 모델 서버와 VRAM을 임의로 종료하지 않도록 했습니다.

2026.#측정 기반 판단 #컨텍스트 비용 #로컬 추론

04 · MEASURED ENVIRONMENT.

컨텍스트·VRAM·속도를 측정해,
불필요한 복잡도를 배제했습니다.

CONTEXT.

32K

프리앰블·파일 읽기·답변이 하나의 컨텍스트를 공유합니다.

VRAM.

12,806 MiB

RTX 5070 Ti 16GB에서 측정한 모델 서버 점유량입니다.

GENERATION.

약 13 tok/s

Q3_K_M·51/64 blocks offload 조건의 생성 속도입니다.

TOOL SCHEMA.

720 tokens

도구 6개 기준, 32K 컨텍스트의 2.2%를 사용합니다.

측정 조건 · Qwen3.6-27B-Q3_K_M · llama.cpp b10173 · Vulkan · RTX 5070 Ti 16GB

DECISION.

현재 6개 도구에서는 지연 로딩이 줄이는 컨텍스트가 2.2%여서 도입하지 않고, 도구가 30개 규모가 되면 다시 검토하기로 했습니다.

2026.#AI 접근성 #신뢰도 #사용자 확인

05 · PROJECT INTRO.

05.

HearBe.

시각장애인이 음성만으로 쇼핑을 탐색하고 실행하도록 돕는
AI 음성 쇼핑 어시스턴트 서비스.

TEAM PROJECT2026. 01 · 2026. 02Python · KoELECTRA · Qwen VL · Spring Boot
2026.#보안 #검증 #변화관리

DESIGN PRINCIPLES.

01.

보안.

데이터 등급·접근권한·반출 기준을 먼저 정하고, 민감 정보는 모델 입력 이전에 통제합니다.

02.

검증.

정확도뿐 아니라 출처 일치·실패 사례·재작업을 확인하고, 고위험 업무에는 사람 승인을 둡니다.

03.

정착.

현업의 실제 업무 단위로 시작해 사용성·효과를 측정하고, 성공 기준을 충족한 흐름만 확산합니다.

프로젝트마다 자동화 범위와 사람의 판단 경계를 함께 두고, 실패를 확인하고 회수할 수 있는 흐름으로 설계했습니다.

2026.

AI ADOPTION · WORKFLOW AUTOMATION.

Make It
Work.

현업의 문제를 정의하고 안전하게 검증하며
신뢰하고 사용할 수 있는 AI 자동화 시스템을 설계하는 김재환입니다.