Engineering Decision Intelligence

검토한 결정을
에이전트에 재사용.

GitHub 변경에서 결정을 추출합니다. 사람이 승인한 결정만 Agent Context에 넣습니다. 실행별 토큰·시간·재작업을 비교합니다.

추출 · 검토 · 재사용 · 측정

codebuoy.ai
acme / payment-api
Agent Efficiency LIVEDecision Memory
MEMORY APPLIEDRUN #421 · payment-api

검증된 결정 3건으로 시작한 Agent Run

DECISION CB-0184

결제 API 재시도는 최대 3회 · Human verified

CONTEXT TOKENS

18.2K7.4K

−59%
TIME TO VALID CHANGE

46m17m

−29m
REWORK LOOPS

31

−2
ILLUSTRATIVE MEASUREMENT VIEW예시 수치 · Pilot에서 실제 기준선 대비 검증
EFFICIENCY FEEDBACK LOOP
MEMORYAGENTOUTPUTSAVINGS
LOCAL POC

저장소 1개 · commit 9개

1저장소
9commit
4/4상세 변경 후보 생성
0/5짧은 변경 후보 생성
01HOW IT WORKS

추출하고, 검토하고,
재사용합니다.

입력: GitHub 변경 · 출력: 승인된 결정과 Agent Context

01
TRACE

결정 후보 추출

PR·commit·diff·comment에서 결정과 근거를 추출합니다. 근거가 없으면 후보를 만들지 않습니다.

Input · GitHub change
02
VERIFY

사람 검토

병합된 변경의 후보를 승인·수정·거절합니다. 승인된 결정만 저장합니다.

Output · verified decision
03
REUSE

에이전트에 적용

현재 작업과 관련된 승인 결정만 Agent Context에 넣고 사용한 Decision ID를 기록합니다.

Output · context + usage log
02METRICS

측정 항목
3개.

Context Token, 첫 유효 결과까지의 시간, 재작업 횟수를 기준값과 비교합니다.

01
BASELINE

기준값 기록

저장소와 작업 유형별 토큰·시간·재작업 횟수를 기록합니다.

02
ASSISTED RUN

결정 재사용

승인된 결정을 넣은 Agent Run에서 같은 항목을 기록합니다.

03
DELTA

차이 계산

기준값과 Agent Run의 차이를 실행 단위로 표시합니다.

EFFICIENCY LEDGERRUN #421
EXAMPLE
MEMORY APPLIEDCB-0184 · CB-0211 · CB-0240
Context tokenBaseline → Memory-assisted

18.2K7.4K−59%

Time to valid changeAccepted output timestamp

46m17m−29m

Rework loopRejected or revised output

31−2

* 예시 수치입니다. Pilot에서 저장소·작업 유형별 기준값과 비교합니다.

03POC

내부 POC 결과.

저장소 1개의 최근 3개월 commit 9개를 읽기 전용으로 분석했습니다.

NO-EDIT APPROVAL2/8

후보 8개 중 2개만 수정 없이 승인할 수 있었습니다.

PRODUCT DECISION 01

자동 확정하지 않습니다.

AI가 후보를 만들고 사람이 승인·수정·거절합니다. 승인 또는 수정된 결정만 재사용합니다.

Candidate detection · GOAuto confirmation · NO-GO

* 작은 내부 표본입니다. GitHub PR E2E와 절감 효과는 Pilot에서 검증합니다.

04 · PRIVATE PILOT

4주 Pilot · 3팀.

저장소 1–3개에서 기준값을 만들고 결정 재사용 전후의 토큰·시간·재작업을 측정합니다.

Pilot 구성 보기
DEPLOYMENTSingle-tenant, self-hosted
SOURCEGitHub · 1–3 repositories
INFERENCELocal Qwen or managed model
SUCCESSVerified reuse · Token & time delta

기간 4주 · 대상 3팀 · 저장소 1–3개

05FAQ

질문.

01무엇을 저장하나요?

결정, 이유, 원문 Evidence, source SHA, 검토 상태를 저장합니다. 승인 또는 수정된 결정만 Agent Context에 사용합니다.

02외부 LLM이 필요한가요?

아닙니다. Self-hosted Pilot에서 local model을 선택할 수 있습니다. Managed model은 선택 사항입니다.

03효율은 어떻게 측정하나요?

같은 저장소와 작업 유형의 기준값과 비교합니다. Context Token, 첫 유효 결과까지의 시간, 재작업 횟수, 사용한 Decision ID를 기록합니다.