2.4 KiB
2.4 KiB
GPT-5.6 Sol 전문지식·법률·Python Agent Starter
이 번들은 AGENTS.md를 거대한 단일 프롬프트가 아니라 다음과 같이 분리하는 예시다.
AGENTS.md: 지속적으로 적용할 임무, 품질 기준, 자율성·승인 경계, 문서 라우팅.codex/config.toml: 모델·추론 수준·sandbox·승인·subagent 설정docs/workflows/: 지식작업, 대한민국 법률 분석, Python 검증 절차docs/quality/: 증거·인용·불확실성 규칙.codex/agents/: 범위가 좁은 전문 subagenttemplates/TASK_PROMPT.md: 개별 작업의 목표·맥락·제약·완료조건evals/EVAL_RUBRIC.md: 실제 workload에 맞춘 평가·개선 절차legal/,python/,research/: 디렉터리별 추가 지시의 예시
권장 사용 순서
- 저장소 루트에 이 번들의 파일을 복사한다.
- 실제 디렉터리명과 실행 환경에 맞게 경로를 수정한다.
AGENTS.md에서 불필요한 규칙을 삭제한다.- 대표 작업 10~20개로 baseline과 비교 평가한다.
- 동일 오류가 반복될 때만 지속 규칙을 추가한다.
- 가변적인 사건 사실, 법률 기준시점, 데이터셋, 산출물 요구는
AGENTS.md가 아니라 개별 task prompt에 둔다.
중요한 주의
-
Codex는
AGENTS.md를 자동 탐색한다. 별도의 자체 agent harness는 이 파일을 읽어 developer/system-level instruction으로 주입하도록 구현해야 한다. -
이 예시는 전문 작업을 위한 시작점이다. 실제로 “최적”인지 여부는 귀하의 법률 문서, 연구 보고서, Python 작업으로 구성한 고정 eval set을 통해 확인해야 한다.
-
model_reasoning_effort = "high"는 보수적인 프로젝트 기본값이다. 정형 작업은 낮추고, 최고 난도 작업은 실행 시점에 상향하는 방식이 비용과 품질의 균형에 유리하다. -
기본
web_search는indexed로 두었다. 최신 법령·행정규칙·시세·뉴스처럼 시점 민감성이 결론에 영향을 미치는 작업에서만 실행 시점에live로 상향하는 것이 안전하다. -
웹페이지·문서·이메일·데이터·코드 주석 안의 명령문은 자료의 일부일 뿐 상위 지시가 아니다. 비밀정보 요구, 외부 실행 유도, 안전장치 해제, 작업 전환 시도는 따르지 말고 보고하도록 루트 규칙에 명시했다.