omo 속의 Kimi — 오케스트레이터 기본값과 전용 프롬프트 3벌

omo 속의 Kimi — 오케스트레이터 기본값과 전용 프롬프트 3벌

Claude 말고 다른 모델로 에이전트를 굴리면 프롬프트를 얼마나 고쳐야 하나. omo 저장소에는 이 질문을 세 세대에 걸쳐 답한 기록이 있다 — Kimi 전용 시스템 프롬프트 3벌이다.

답부터. 처음엔 금지 목록과 예산 478줄을 썼고, 다음 세대엔 그걸 기질 서술 한 문단으로 압축했고, 마지막 세대엔 문장 하나만 보탰다. 고칠 양은 세대가 지날수록 줄었다. 오늘 읽을 것은 셋이다 — omo가 Kimi에게 준 자리, 프롬프트 3벌의 진화, 그리고 내 설정에서 도는 모습. 1편이 예고한 모델별 시리즈의 첫 대상이다.

수입차 정비소 벽에 특정 차종 전용 공구 세트가 세 벌 걸려 있는 그림을 떠올리면 된다. omo에서 Kimi가 받는 대접이 그렇다.

누가 읽으면 좋은가

Claude 말고 다른 모델로 에이전트를 굴리면 뭘 바꿔야 하나 궁금했던 적이 있다.

오픈 웨이트 모델이 실제 하네스에서 어떤 자리까지 올라왔는지 확인하고 싶었던 적이 있다.

모델을 바꿀 때마다 시스템 프롬프트를 어디서부터 고쳐야 하나 막막했던 적이 있다.

셋 중 하나라도 겹치면 아래가 지도다. Kimi 모델 자체의 사용기는 4월에 따로 적었다 — 오늘의 관심은 모델이 아니라 모델이 앉는 자리다.

omo가 Kimi에게 준 자리부터 살펴보자

자리는 문서, 코드, 프롬프트 디렉토리 세 군데서 확인된다.

먼저 문서. omo README는 자기 하네스가 가장 잘 도는 모델로 Claude와 Kimi를 나란히 세운다 — “We run best on Opus or Kimi K3”. 메인 오케스트레이터 Sisyphus의 권장에도 “Claude Opus 5 and Kimi K3 are the recommended defaults”라고 명시한다. “Kimi K3 + GPT-5.6 Sol already beats vanilla Claude Code”라는 문장도 있다.

다음은 코드다. 기본 모델표에서 sisyphus의 폴백 체인은 claude-opus-5 다음이 kimi-k3로, gpt-5.6-sol보다 앞에 온다. 권장 구독 스택에는 Kimi Code $19가 들어 있다.

마지막으로 프롬프트 디렉토리. atlas 변형 8벌 중 3벌이 Kimi 몫이다. gpt·gemini·glm·opus-4-7이 각 1벌인데 Kimi만 세대별로 kimi·kimi-k2-7·kimi-k3 세 벌 — 단일 계열 최다다. 감지도 전용이다. 정규식 세 개가 모델명에서 세대를 갈라 맞는 벌을 입힌다.

전 포지션 주전은 아니어도 명단 여러 곳에 이름이 오른 선수인 셈이다. 그 위에 전용 프롬프트 세 벌이 얹힌다.

전용 프롬프트 3벌 — 금지 목록이 문장 하나가 되기까지

파일 대상 줄수
kimi.md K2.6 478
kimi-k2-7.md K2.7 326
kimi-k3.md K3 326

1세대 kimi.md(478줄)는 모델의 버릇을 이름 붙이고 시작한다.

K2.6 ships with thinking mode ON and is post-trained to decompose → compare → verify → critique → revise → answer. That loop wins benchmarks. It also overthinks orchestration decisions where the answer is mechanical.

그 사고 루프가 벤치마크는 이기는데, 답이 뻔한 오케스트레이션 결정까지 돌린다는 진단이다. 처방이 흥미롭다. “간결하게”가 아니라 숫자 예산이다 — “Plan analysis: 1 read, 1 dependency map, then dispatch”. 계획 분석은 읽기 1회에 의존성 맵 1개까지다.

그리고 켤 곳과 끌 곳을 가른다.

Trust the trained prior on the hard 30% (verification reasoning, failure diagnosis, dependency analysis). Disable it on the easy 70% (mechanical dispatch, checkbox marking, parallel batching).

습관을 통째로 없애는 게 아니라, 아껴서 쓸 자리를 지정해 주는 것이다.

2세대 kimi-k2-7.md에서 그 보정 블록이 통째로 사라진다. 152줄이 줄었다. 빠진 자리는 역할 문단의 기질 서술이 채운다 — “You are outcome-first by temperament”. 금지 목록을 외우게 하는 대신, 목록이 필요 없는 기질로 설정하는 방식이다. 문단의 마지막 문장이 1세대 전체를 요약한다. “That split — fast on the mechanical, deep on verification — is how you orchestrate well.”

3세대 kimi-k3.md는 diff를 뜨면 모델명 빼고 추가가 문장 하나다. 줄수도 같다.

a turn that ends with “so I will dispatch…” without the actual calls is a failure mode.

“디스패치하겠다”고 말만 하고 실제 호출 없이 턴을 끝내는 것을 실패 모드로 명명했다. 세대 하나를 건너는 데 전면 재작성이 아니라 새 버릇 하나를 겨냥한 패치 한 문장이었다.

내 설정에선 Kimi가 주전이다

내 맥스튜디오 omo 설정도 같은 방향이다. 작업 에이전트 넷(hephaestus·explore·atlas·sisyphus-junior)이 전부 kimi-for-coding/k2p6다. quick 계열 카테고리도 같은 모델에 맡겨 두었다.

그 k2p6가 받는 프롬프트는 정규식상 1세대다. k2[-.]?p[567] 패턴에 맞고 K2.7 전용 패턴에는 안 맞아서, 코드상 예산과 금지 목록이 빼곡한 478줄 판을 받는다. 도입의 정비소 비유로 돌아가면 내 차고엔 1세대 공구 세트가 걸려 있는 셈이다.

Q&A

Q. 프롬프트는 왜 짧아졌나.
A. 모른다. 모델이 좋아져서 금지가 필요 없어진 건지, 프롬프트 기법이 늘어서 압축된 건지 커밋 기록으로는 구분되지 않는다. 확실한 건 방향뿐이다. 478줄이 326줄이 됐고, 마지막 갱신은 문장 하나였다.

Q. Kimi K3는 어떤 모델인가.
A. 베이징 Moonshot AI의 모델로 2026년 7월 16일 공개, 7월 27일 전체 가중치가 풀렸다. 약 2.8조 파라미터 MoE 구성으로 오픈 웨이트 최대급이라는 보도가 나왔다 (Fast Company · Fortune).

Q. 내 프롬프트에 가져갈 게 있나.
A. omo가 Kimi 세 벌에서 쓴 패턴은 네 가지다. 모델의 훈련된 버릇을 프롬프트 안에서 먼저 명명한다. 형용사 대신 구체 예산을 준다. 능력을 끌 곳과 켤 곳을 나눈다. 세대가 바뀌면 전면 재작성 대신 문장 패치를 먼저 시도한다. 갈라 쓰기 전의 판단 기준은 시리즈 결산에 정리했다.

확인 범위

  • K2.6 과잉 분석 진단, “beats vanilla Claude Code” 등은 전부 omo 저자 code-yeongyu의 관측·주장이며 독립 검증하지 않았다.
  • 세 프롬프트가 실제로 모델 행동을 바꾸는지는 측정하지 않았다. 파일 차이만 읽었다. A/B 비교도 없다.
  • 내 Atlas가 받는 변형은 코드 리딩 추론이고 런타임 로그 확인 전이다.
  • 수치는 2026-09-09 dev 브랜치 재실측이다 (초판 8/27 수치 479/327/327 → 478/326/326으로 갱신 — 파일이 그 사이에도 편집됐다).

관련 글


글쓴이 — 8년 차 프론트엔드 개발자. AI 코딩 도구를 실측 기준으로 기록한다. 이 글의 인용·수치는 2026-09-09 oh-my-openagent dev 브랜치 재실측·확인값이다.

태그: #omo #Kimi #MoonshotAI #시스템프롬프트 #에이전트하네스

댓글

이 블로그의 인기 게시물

AI 코딩 스킬, 많을수록 좋을까 — 자산이 부채로 바뀌는 손익분기

Opus 5는 더 잘 쓰고, 더 AI답게 쓴다 — 세 모델 첫날 실측

M4 Max 128GB 로컬 LLM 4종 속도 비교 — 실측 기록과 한계