AI & Tech

오마이파이(Oh My Pi, omp) 코딩 에이전트: S등급 코딩에이전트인 이유

/ 데이터 분석, AI 실무 교육

코딩 에이전트 티어표에서 Oh My Pi 혼자 S등급에 올라 있습니다. 어떤 도구인지, Pi와 무슨 관계인지, 해외와 국내 실사용자는 어떻게 평가하는지, 벤치마크는 무엇을 말하는지를 2026년 9월 22일 기준으로 정리했습니다. 계정이 정지될 수 있다는 점과 기본 설정의 위험까지 함께 적었습니다.

Share
오마이파이(Oh My Pi, omp) 코딩 에이전트: S등급 코딩에이전트인 이유 대표 이미지

3줄 요약

이번 방문에서 한 편은 바로 볼 수 있습니다.

코딩 에이전트를 S부터 F까지 나눈 티어표가 X에 돌고 있습니다. Oh My Pi 하나만 S등급이고, Claude Code와 Codex는 B, GitHub Copilot과 Antigravity는 F입니다.

Oh My Pi(omp)는 미니멀 코딩 에이전트 Pi를 하드 포크해 IDE 기능을 통째로 넣은 터미널 코딩 에이전트입니다. 국내에서는 아직 낯선 이름입니다. 무엇인지, 왜 혼자 꼭대기에 있는지, 실제로 쓰는 사람들은 뭐라고 하는지를 2026년 9월 22일 기준으로 공식 저장소와 해외 커뮤니티, 국내 커뮤니티를 열어 정리했습니다.

결론부터 말하면 S등급을 뒷받침하는 독립 벤치마크는 없고, 해외와 국내 모두 "Pi 순정이 낫다"와 "omp로 정착했다"로 의견이 나뉘어 있습니다. 그리고 이 표 자체가 한 사람이 근거 없이 매긴 순위입니다.

티어표의 출처와 한계

먼저 이 티어표가 어디서 왔는지부터 적어 둡니다. 확인된 출처는 하나뿐입니다. 2026년 9월 22일에 올라온 한 해외 분석 기사에 따르면, "Sayo"라는 X 사용자가 9월 21일에 "ai agent/harness tiers"라는 짧은 설명과 함께 올렸고 몇 시간 만에 조회 8만 회 가까이 나왔습니다. 기사는 원본 게시글 주소를 싣지 않았고, X 검색은 로그인 없이는 막혀 있어 원본을 직접 열어 보지는 못했습니다.

기사가 전하는 답글 반응은 세 가지입니다. 가장 많이 나온 항의는 특정 배치가 아니라 빠진 도구였습니다. Nous Research의 Hermes가 표에 없다는 답글이 여럿 달렸습니다. Oh My Pi가 S인 것에는 "OMP는 슬롭(slop)이고 필요한 것만 얹은 순정 Pi가 훨씬 낫다"는 답글이 달렸고, "이게 뭘 근거로 한 건지"라는 질문에는 답이 없었다고 합니다.

9월 22일에는 국내 디시인사이드 AI활용 갤러리에도 "X에 omp까들 왤케많지"라는 글이 올라왔습니다. 댓글에 "헤르메스를 S티어에 올려야 한다 이러고 있던데"가 달려 있어, 이 논쟁이 국내까지 넘어온 것은 확인됩니다.

정리하면 이 표는 벤치마크 결과가 아니라 한 사용자의 체감 순위이고, 그 사용자도 근거를 밝히지 않았습니다. 그래서 여기서는 표의 등급을 검증하기보다 Oh My Pi가 무엇이고 실제 평가가 어떤지를 봅니다.

Oh My Pi가 무엇인지: Pi를 통째로 뜯어고친 하드 포크

Oh My Pi는 줄여서 omp라고 부르고, 터미널 명령어도 omp입니다. 작명 방식은 Oh My Zsh와 같습니다. 일부러 비워 둔 도구에 모든 것을 채워 넣었다는 뜻으로 이 글에서는 봤습니다.

항목내용
저장소github.com/can1357/oh-my-pi
제작자잔 뵐뤼크(Can Bölük). 리버스 엔지니어링과 소프트웨어 보호를 연구해 온 보안 연구자. 현재 Stencil Labs 소속
시작일2025년 12월 31일
라이선스MIT
스타 / 포크32,613 / 3,451 (2026년 9월 22일 GitHub API 기준)
최신 버전v18.2.8 (2026년 9월 21일)
npm 주간 다운로드80,920 (2026년 9월 15일부터 21일)
설치curl -fsSL https://omp.sh/install | sh, brew install can1357/tap/omp, bun install -g @oh-my-pi/pi-coding-agent
가격CLI 자체는 무료. 모델 API 비용은 사용자 부담

저장소 README 첫 줄이 "Fork of Pi by @mariozechner"입니다. 여기서 Pi를 알아야 omp가 보입니다.

Pi: 도구 네 개와 1,000토큰으로 돌아가는 미니멀 에이전트

Pi는 libGDX를 만든 마리오 제히너(Mario Zechner)가 2025년 11월 30일에 공개한 터미널 코딩 에이전트입니다. 이런 프로그램을 하네스(harness)라고 부르는데, 모델을 감싸서 도구와 컨텍스트, 실행을 관리하는 껍데기라는 뜻입니다. 지금은 오스트리아의 공익 법인 Earendil Works 소속 프로젝트이고, 저장소는 github.com/earendil-works/pi, 스타는 108,443개입니다. Flask를 만든 아르민 로나허(Armin Ronacher)가 이 회사의 공동 창업자입니다.

제히너가 공개 당시 블로그에 쓴 원칙은 한 줄입니다. "내게 필요 없으면 만들지 않는다." 시스템 프롬프트와 도구 정의를 합쳐 1,000토큰이 안 되고, 도구는 read, write, edit, bash 네 개뿐입니다. 그는 Claude Code를 두고 "내가 쓸 일 없는 기능이 80%인 우주선이 되어 버렸다"고 적었습니다.

pi.dev 첫 화면에는 지금도 없는 기능이 그대로 나열되어 있습니다.

  • MCP 없음
  • 서브에이전트 없음
  • 권한 팝업 없음
  • 플랜 모드 없음
  • 내장 할 일 목록 없음
  • 백그라운드 bash 없음

그리고 같은 블로그 글의 마지막 문장이 "Pi가 맞지 않으면 포크하라, 진심이다"였습니다.

한 달 뒤 그 문장대로 나온 것이 omp입니다.

omp가 더한 것: Pi가 뺀 것을 전부 되돌려 놓음

README가 앞세우는 숫자는 제공자 60개 이상, 내장 도구 31개, LSP 연산 14개, DAP 연산 28개, Rust 코어 약 8만 줄입니다. omp가 넣은 것은 Pi가 일부러 뺀 항목과 하나씩 짝을 이룹니다.

Pi가 일부러 뺀 것omp가 넣은 것
서브에이전트격리된 워크트리에서 도는 task 서브에이전트, Alt+A로 여는 Agent Hub
플랜 모드플랜 모드, P0부터 P3까지 심각도를 매기는 /review
MCP~/.omp/agent/mcp.json으로 MCP 연결
권한 팝업권한 승인 프롬프트 (기본값은 뒤에서 다시 다룹니다)
백그라운드 bash프로세스 안에 코어유틸 46개를 품은 bash, 백그라운드 작업
없음모든 쓰기에 LSP 연결. 이름 바꾸기가 workspace/willRenameFiles를 거침
없음lldb, dlv, debugpy를 붙이는 실제 디버거(DAP)
없음줄 내용 해시를 앵커로 쓰는 해시라인(hashline) 편집
없음에이전트 도구를 되부를 수 있는 상주 Python과 Bun 커널
없음매 턴을 두 번째 모델이 검토하는 어드바이저(advisor)
없음.claude, .cursor, .codex, .clinerules, Copilot 설정을 그대로 읽는 설정 상속
없음컨텍스트를 픽셀 폰트 이미지로 바꿔 다시 넣는 스냅컴팩트

앞부분은 IDE가 하던 일이고, 뒷부분은 다른 에이전트에서는 보기 어려운 실험입니다. 이 뒷부분이 해외에서 찬사와 조롱을 동시에 받는 대목입니다.

Pi와 omp 제작자가 공개적으로 거리를 둔 경위

두 프로젝트는 같은 뿌리인데 지금은 거리를 두고 있습니다.

제히너는 2026년 1월 3일 Pi 저장소 이슈에서 omp를 두고 "하드 포크로 완전히 가 버렸네. 구현한 기능 중에는 내가 이해 못 하는 것도 있다. 다들 짐 쌀 시간이다 :D"라고 농담했습니다. 8월 9일에 omp 기능 네 개를 Pi로 가져오자는 제안이 올라오자 이튿날 돌아온 답은 한 줄이었습니다. "그게 필요하면 omp를 쓰세요."

8월 22일에는 omp 진영이 다음 판(omp2)에서 Pi를 완전히 걷어낸다며 Bun 의존성과 신뢰 모델을 이유로 들자, 제히너가 X에서 "남 깎아내리는 짓은 하지 말자. Pi는 Bun에 의존하지 않는다"고 직접 반박했습니다. 뵐뤼크는 같은 글타래에 "우리는 무관하고, 나는 어차피 신뢰 모델에 반대한다"고 답했습니다.

omp2는 Rust 전면 재작성 브랜치인데 9월 22일 기준으로 아직 배포되지 않았고, 배포판 v18.2.8은 여전히 TypeScript입니다. 국내 긱뉴스 댓글에 "omp는 Rust로 갔다"는 말이 나오는데, 정확히는 런타임 일부만 Rust이고 언어 비중은 TypeScript가 압도적입니다.

omp와 Pi, Claude Code, Codex, Cursor, OpenCode 한눈 비교

티어표에 이름이 오른 도구 가운데 국내에서 많이 쓰는 여섯 개를 같은 항목으로 놓았습니다. 공식 문서와 저장소로 확인한 값이고, 확인하지 못한 칸은 미확인으로 남겼습니다.

도구라이선스와 가격쓸 수 있는 모델서브에이전트MCP디버거권한 기본값시작 토큰 실측Terminal-Bench
Oh My PiMIT. CLI 무료, 모델 비용은 사용자 부담제공자 60개 이상, 로컬 모델 포함있음있음있음(DAP)yolo. 읽기와 쓰기와 실행 자동 승인22,643 (v18.0.7, 커뮤니티 실측)미등재
PiMIT. 무료제공자 무관없음없음. 확장으로 추가없음권한 체계 없음. 컨테이너 사용 권장1,000 미만(공식), 1,358(커뮤니티 실측)미등재. HarnessTax 연구에는 포함
Claude Code비공개. Pro 월 20달러부터, API 종량제 가능Claude 모델만있음있음없음도구 첫 사용과 bash 명령마다 확인31,012 (커뮤니티 실측). HarnessTax는 Pi의 10배 이상4.0에서 2위 57.9% (Fable 5.1)
Codex CLIApache-2.0. ChatGPT 요금제에 포함OpenAI 모델 중심있음있음없음OS 샌드박스로 작업 폴더에 한정. 폴더 밖 수정과 네트워크는 승인미확인4.0에서 1위 58.2% (GPT-6 Astra)
Cursor비공개. Pro 월 20달러여러 모델. 기본은 Composer 2.5클라우드 에이전트있음. 호출마다 승인IDE 내장파일 수정은 자동, 터미널 명령은 승인미확인등재 (Cursor CLI)
OpenCodeMIT. 무료, 모델 비용은 사용자 부담제공자 무관있음있음없음대부분 자동 허용. 반복 루프와 프로젝트 밖 경로만 확인미확인등재

표를 놓고 보면 omp의 위치가 분명해집니다. 기능 목록은 여섯 도구 가운데 제일 길고, 모델 선택 폭은 Pi와 OpenCode 수준으로 넓습니다. 대신 권한 기본값은 여섯 도구 가운데 제일 열려 있고, 시작 토큰은 Claude Code와 같은 급으로 무겁습니다. Claude Code와 Codex는 자기 회사 모델에 묶이는 대신 공식 리더보드 점수와 승인 체계를 갖췄고, Pi는 그 반대편에서 기능을 덜어내 가벼움을 얻었습니다. omp는 Pi의 자유도에 Claude Code의 기능을 얹은 도구인데, 그 대가로 Claude Code의 무게와 Pi의 열린 권한을 둘 다 물려받았다고 보는 편입니다.

해외 반응: 비용 절감 체감과 컨텍스트 비대 논쟁

해외 반응은 두 방향으로 뚜렷하게 나뉩니다. 칭찬은 비용과 어드바이저에 몰려 있고, 비판은 컨텍스트 크기와 만든 방식으로 향합니다.

칭찬: 구독 대신 종량제로 갈아탄 사람들

레딧 r/PiCodingAgent에 2026년 9월 20일 올라온 글이 대표적입니다. 글쓴이는 Claude Code 구독을 1년 썼는데 비용 부담이 너무 커서 omp로 옮겼더니 "더 빠르고, 더 싸고, 결과도 더 좋았다"며, 지난 금요일부터 에이전트 두 개를 돌리는 데 15달러가량 들었다고 적었습니다. r/codex에서는 ChatGPT 20달러 요금제에 Codex와 omp를 붙이면 "어려운 티켓도 주간 사용량의 1% 정도로 끝난다"는 글이 추천 300개 이상을 받았습니다.

기능 가운데 자주 언급되는 것은 어드바이저입니다. 한 사용자는 "어드바이저가 메인 에이전트가 삼천포로 빠지는 걸 여러 번 막았다. 다른 하네스에서는 본 적 없다"고 썼습니다. 해커뉴스에서는 직접 하네스를 만들던 개발자가 "내가 하던 걸 omp가 이미 다 하고 있더라. 정말 좋은 하네스다"라고 적었고, 윈도우 사용자가 WSL 없이 쓸 수 있어 좋다고 적은 글도 있었습니다.

비판: 인사만 했는데 컨텍스트 15%

비판하는 편에서 자주 인용되는 숫자가 있습니다. 2026년 8월 28일 레딧에 올라온 실측 글에서 나온 수치입니다. omp 18.0.7이 실제 TypeScript 모노레포에서 사용자가 한 글자 치기 전에 22,643토큰을 보낸다는 내용이고, 그중 절반 이상이 상위 도구 11개의 JSON 스키마였습니다. 글쓴이는 압축 프리셋으로 5,900토큰까지 줄이자 오히려 결과가 좋아졌다고 적었습니다(실제 버그 8개 중 4개 해결에서 7개 해결로). 그 글에서 추천을 가장 많이 받은 답글은 "그럼 왜 omp를 쓰면서 불평하냐, 그냥 Pi 써라"였습니다.

해외 한 개발 유튜버가 9월 8일 올린 리뷰 영상에도 같은 문제가 나옵니다. "인사 한 마디 했는데 128,000토큰 컨텍스트의 15%를 쓰고 있다"며 워커 동시 실행 기본값 32개를 "미친 기본값"이라 불렀고, 영상 중에 컨텍스트가 넘쳐 세션이 죽는 장면이 그대로 담겼습니다. 결론은 이 한 줄이었습니다. "Pi는 사람을 도우려고 만든 것 같고, Oh My Pi는 LLM을 도우려고 만든 것 같다."

레딧에는 "더 나은 게 아니라 그냥 더 많은 것(It's not better, it's just MORE)", "omp는 2025년 중반 모델용으로 설계된 것이다. Opus 4.8 이후 모델은 그런 게 필요 없다", "매일 업데이트가 오는데 한 주 열 개 중 셋은 워크플로를 깨뜨린다" 같은 글이 있습니다. 해커뉴스에서는 해시라인 편집을 두고 "모델이 실제 작업보다 깨진 편집을 고치는 데 턴을 더 쓴다"는 반대 의견도 있었습니다.

X의 반응: 아트 피스라는 조롱과 쓰라린 교훈 비판

X에서 조회가 많이 나온 omp 관련 글은 칭찬이 아니라 조롱이었습니다. t3.gg의 Theo가 2026년 9월 18일에 올린 글입니다.

oh-my-pi는 내가 본 것 중 가장 진지하지 않은 개발 도구다. 이쯤 되면 아트 피스처럼 느껴진다. 솔직히 대단하다.

조회 28만 5천 회에 좋아요 1천 대가 찍혔고 답글은 107개가 달렸습니다. 답글 중에는 "omp가 스냅컴팩트라고, 대화 기록을 마이크로폰트 이미지로 만들어 모델이 픽셀을 읽게 하는 기능이 있는데 의외로 잘 된다"는 설명이 있었고, Theo는 다음 날 "예시를 볼수록 더 웃기다"고 이어 갔습니다. 반대로 "omp는 슬롭이 아니고 팀이 이런 무시를 받을 이유가 없다. 오늘 쓸 수 있는 최고의 하네스다"라는 반박도 좋아요 70개 이상을 받았습니다.

3주 가까이 앞선 8월 30일에는 더 근본적인 비판이 있었습니다. 조회 18만 회를 넘긴 글인데 요지는 이렇습니다. "하네스 트릭을 산더미처럼 쌓아 놓은 것이고, 트릭 하나하나는 벤치마크에서 잘 나온다. 하지만 이건 정확히 '쓰라린 교훈(bitter lesson)'이 피하라고 한 그것이다. 모델이 새로 나올 때마다 이 결과들이 무효가 될 수 있다. 단순한 하네스는 강한 모델이 나올 때마다 좋아지지만, 복잡한 트릭 더미는 모르는 사이에 짐이 된다."

개발 방식도 논쟁거리입니다. 저장소는 roboomp라는 AI 봇이 이슈를 분류하고 답하고 자체 PR을 올리는 구조이고, 기여 안내문에는 "봇이 처리 가능한 이슈를 작업으로 가져가니 직접 고칠 이슈는 올리지 말라"는 경고가 있습니다. omp 블로그 글이 해커뉴스에 올라갔을 때 댓글 상당수가 "LLM 말투"를 지적했는데, 슬롭 논쟁은 이 봇 구조에서 나왔습니다.

벤치마크: 같은 회사가 한 달 간격으로 낸 정반대 결과

표 작성자가 근거를 밝히지 않았으니 공개된 벤치마크를 직접 봤습니다. 결론은 Oh My Pi를 독립 기관이 측정한 결과가 없다는 것입니다.

Terminal-Bench 공식 리더보드를 2.0부터 4.0까지 전부 열어 봤는데 Codex, Claude Code, Grok Build, Droid, Cursor CLI, Devin, Warp, OpenCode는 있고 Pi와 omp는 없습니다. "Pi가 Terminal-Bench 8위"라는 말이 돌지만 제히너가 직접 한 번 돌려 본 결과이고, 공식 제출 절차를 거치지 않았습니다. omp는 아예 벤치마크 어댑터가 없어서 이슈에 "지금은 어떤 변경도 측정할 수 없다"고 적혀 있습니다.

UC 버클리 연구: Pi는 넣고 omp는 넣지 않음

무게가 있는 자료는 9월 중순에 나온 UC 버클리와 Arena Intelligence의 HarnessTax 연구입니다. 이온 스토이카(Ion Stoica)와 마테이 자하리아(Matei Zaharia)가 저자로 참여했습니다. 연구진은 모델 7개와 하네스 3개(Claude Code, Codex CLI, Pi)를 SWE-bench Lite와 Terminal-Bench 2.0으로 비교했습니다.

항목결과
Claude Fable 5 성공률 (SWE-bench Lite)Claude Code 97.8%, Codex 96.7%, Pi 96.7%
롤아웃당 비용 (SWE-bench Lite)Claude Code 1.33달러, Pi 0.67달러
공통 모델 전체 비용 비율SWE-bench Lite에서 Claude Code가 Pi의 약 2.0배, Codex의 약 1.6배. Terminal-Bench 2.0에서는 Pi의 약 1.5배
턴 수 (SWE-bench Lite)Fable 5 기준 Pi 15.4턴, Claude Code 15.3턴

연구진의 세 가지 발견은 이렇습니다. 하네스는 성공률에는 거의 영향이 없고 비용에는 크게 영향을 준다는 것, 단순한 하네스도 경쟁력이 있다는 것, 모델은 자기 회사 하네스보다 다른 하네스에서 더 잘할 수도 있다는 것입니다. 연구진은 마지막 항목 옆에 "쓰고 있는 Claude 모델에 Claude Code가 필요 없을지도"라고 덧붙였습니다.

이 연구가 말하는 것은 Pi의 경쟁력이지 omp의 경쟁력이 아닙니다. 오히려 도구 네 개로 파레토 최적에 이른다는 결론은 omp의 방향과 반대편에 있습니다.

같은 벤더가 낸 상반된 실험 두 건

omp가 1위를 한 공개 실험은 하나뿐입니다. 한 MCP 도구 회사가 2026년 8월 초에 Kimi K3 한 모델을 하네스 8개에 태워, 슬랙과 스프레드시트와 청구서 같은 실제 앱을 MCP로 다루는 과제 25개를 돌린 실험입니다. 성공률은 omp가 1위였지만 성공당 비용은 Hermes가 더 낮았습니다.

하네스통과성공당 비용
Oh My Pi22/25 (88%)0.52달러
Kimi Code21/25 (84%)0.64달러
Hermes Agent20/25 (80%)0.46달러
Claude Code19/25 (76%)1.96달러
Pi18/25 (72%)0.57달러
Codex17/25 (68%)0.66달러

그런데 같은 회사가 9월 1일에 DeepSeek V4 Flash로 같은 종류의 도구 사용 과제 30개를 돌리자 결과가 뒤집혔습니다. Pi가 20개, omp가 17개를 통과했고 성공당 비용은 Pi 0.028달러, omp 0.103달러였습니다. 과제당 토큰은 omp가 33% 더 썼습니다. 다만 원문에 붙은 주의가 있습니다. Pi는 추론 수준을 max가 아닌 high로 돌렸고, Pi 시도 30건 중 24건은 OpenRouter가 아니라 DeepSeek 공식 API를 거쳤기 때문에 비용 수치는 그 차이를 감안해 봐야 한다는 것입니다. 회사의 결론은 "omp는 모델에게 문제를 풀 방법을 더 많이 주는데, 대개는 시간을 낭비할 방법도 더 많이 준다"였습니다.

회사는 두 건 모두 모델과 하네스 조합마다 한 번씩만 돌렸고, 과제도 25개와 30개에 그쳤습니다. 어느 쪽도 정답으로 삼기 어렵고, 모델과 과제 종류에 따라 결과가 달라진다는 것만 확인됩니다.

omp 제작자가 직접 낸 수치도 있습니다. 2026년 2월 블로그에서 해시라인 편집이 Grok Code Fast 1의 성공률을 6.7%에서 68.3%로 올렸다고 발표했습니다. 다만 국내 한 유튜브 채널이 지적했듯 같은 실험에서 문자열 치환 방식은 66.7%였습니다. 두 수치 차이는 1.6%포인트이고, 실험 단위인 180문항으로 환산하면 세 문항입니다. 실험을 설계하고 돌린 사람이 omp와 해시라인을 만든 사람이라는 점도 같이 봐야 합니다.

국내 반응: 오마이파이가 아니라 omp

국내 반응을 찾으면서 먼저 부딪힌 것은 이름이었습니다. 실제 사용자는 "오마이파이"라고 부르지 않습니다. 디시인사이드 AI활용 갤러리 본문에서 omp로 검색하면 한도인 20건이 나왔고, "오마이파이"와 "oh my pi"는 0건이었습니다. 오마이파이라는 표기는 소개 글을 올리는 블로그 두어 곳에서만 보입니다.

한 가지 더 혼동하기 쉬운 점이 있습니다. 국내에서 "오마이 무엇"으로 훨씬 유명한 것은 한국 개발자들이 만든 oh-my-claudecode(OMC)와 oh-my-opencode(OmO)입니다. 국내 인지도는 둘 다 omp보다 높습니다. 검색 결과를 섞으면 안 됩니다.

omp 국내 언급량의 채널별 온도차

채널확인된 양
디시 AI활용 갤러리최근 1주 제목에 omp 포함 18건. 대표 가이드 글 조회 4,077, 추천 28, 댓글 29 (9월 22일 기준)
스레드한국어 게시글 15건 이상. 국내에서 활발한 편
X 한국어계정 7개 확인. 최다 반응 글이 좋아요 60개짜리 부정 후기
유튜브 한국어omp 6편, Pi 4편. 조회 95부터 1,711까지
긱뉴스omp 소개 1건(19P), 논쟁 댓글 스레드 1건
네이버 블로그5건. 사실상 블로거 2명
네이버 카페, 네이버 뉴스, velog, 클리앙, 뽐뿌, OKKY, 디스콰이엇, 커리어리0건

"알려지지 않았다"와 "쓰이지 않는다"는 다릅니다. 언론 보도가 한 건도 없고 대형 커뮤니티에도 없는데, 갤러리 하나와 스레드에서는 매일 설정을 나누는 집단이 있습니다.

국내 실사용 후기

디시 갤러리의 2026년 8월 19일 가이드 글이 국내에서 많이 읽힌 후기입니다. 글쓴이는 한 달 쓴 소감을 이렇게 적었습니다.

만족감이 매우 높다. 특히 서브 에이전트쪽이 맘에 들어서 계속 쓰고 있다. (중략) 이거 쓴다고 코드 결과물이 갑자기 좋아진다거나 그런건 아님. (중략) 처음 설치하면 뭔가 세팅할게 많아 보여서 진입장벽이다. /settings를 치는순간 무수한 영어가 날 반겨준다.

댓글에는 "난 이거로 정착함"과 "설정 너무 어려워서 제대로 못 써먹고 있었네", "오늘 잘 모르고 썼다가 토큰 순삭이어서 깜짝 놀람"이 나란히 있습니다. 9월 20일에는 "Codex와 클코에서 작업할 때 시간은 2배 아끼고 토큰은 1.5배 아끼는 중"이라는 글이, 9월 22일에는 "세팅 자체가 너무 고돼서 쉽지가 않음"과 "서브에이전트, 압축, 갱신 설정하고 조정하는데 몇 일 꼬박 걸린 듯"이 올라왔습니다.

스레드에서는 한 AI 도구 소개 계정이 이야기를 주도하고 있는데, 이 계정도 "최강 하네스는 내게 맞춰 커스텀하는 Pi와 패키지 생태계"라고 전제한 뒤 "그럼에도 하네스 측면에서 본다면 omp가 오픈소스 중에서 단연코 1등"이라고 적었습니다. 보안 정책이 엄격한 회사에서 쓴다며 "OMP 이만한 게 없다"고 적은 글이 있는 한편, "권한 면적도 상당히 크다"는 경고와 "어차피 요청은 OpenAI 서버로 가는데 왜 하네스로 이렇게 차이가 날까, 코드를 까 봐도 검증이 어렵다"는 의문도 함께 올라옵니다.

긱뉴스 댓글이 국내 찬반을 가장 짧게 보여 줍니다. 한쪽은 "OpenCode는 프롬프트 캐싱을 무시하는 경우가 있어서 결국 Pi 계열인 omp로 정착했다"고 했고, 다른 쪽은 "생각보다 버그가 많아서 Pi로 다시 돌아왔다"고 했습니다. 네이버 블로그에서 순정 Codex와 omp를 병행하며 GPT-6 Astra를 비교한 분은 "승자는 고르지 못했습니다"로 맺었습니다.

국내 개인 블로그 리뷰 하나가 이 온도차를 한 문장으로 정리합니다. "omp의 가성비는 토큰값을 아끼는 대신 내 시간으로 메운다로 읽어야 정확하다."

omp를 쓰기 전에 알아야 할 위험 네 가지

기능 목록보다 아래 네 가지가 더 중요하다고 생각하는 편입니다. 전부 공식 문서와 제작자 발언, 회사의 공식 답변으로 확인된 내용입니다.

구독 OAuth 우회는 계정 정지 대상

omp는 Claude, Codex, Cursor, Antigravity 같은 구독을 OAuth로 붙여 쓸 수 있게 해 둡니다. 그런데 이것은 각 회사가 막고 있는 방식입니다.

  • 앤트로픽은 2026년 1월 9일 서드파티 하네스의 구독 토큰 사용을 차단했고, 4월 4일부터는 "Claude 구독이 서드파티 도구 사용량을 더 이상 포함하지 않는다"고 공지했습니다.
  • Cursor는 2026년 8월 10일 공식 포럼 답변(레딧 r/cursor에 옮겨짐)에서 omp의 Cursor 제공자를 "비공식 프록시와 같은 범주이며 약관의 사용 제한에 어긋난다. omp가 이걸 일반 제공자처럼 보여 주고 경고를 안 띄우는 건 우리 쪽에서는 아무것도 바꾸지 않는다. 계정 정지까지 갈 수 있다"고 답했습니다.
  • 제작자 본인이 2026년 2월 27일 이슈에서 "정지당할 수 있다. 보장은 못 해 준다. 다만 그들의 정지 물결은 OpenCode를 겨냥한 것 같아서 우리는 영향을 안 받았다"고 적었습니다. 같은 스레드에 "Pro 계정 열고 20분 만에 정지당했다"는 보고가 달려 있습니다.
  • 구글은 제작자 본인의 Gemini 계정을 정지시켰습니다. 그가 블로그에 직접 "경고 없이, 제한 없이, 그냥 비활성화됐다"고 썼습니다.

해외 커뮤니티에는 "기술적으로 약관 위반이지만 계정 셋이 아직 멀쩡하다"는 식으로 알고도 쓰는 사람이 많습니다. 어느 경우든 회사 계정으로 시도할 일은 아닙니다.

기본 승인 모드가 yolo

공식 문서 기준으로 기본 승인 모드가 yolo입니다. 읽기, 쓰기, 실행이 전부 자동 승인됩니다. 세부 정책을 정할 수는 있지만 프로세스나 파일시스템 샌드박스는 없다고 문서에 적혀 있습니다. Pi의 신뢰 모델을 비판하면서 떨어져 나온 프로젝트인데, 정작 기본값은 제일 열려 있는 상태입니다.

자격 증명이 평문으로 남음

비밀값 마스킹은 기본으로 꺼져 있고, 문서에도 "방어책 하나이지 보안 경계가 아니다"라고 적혀 있습니다. 세션 기록(JSONL)에 자격 증명이 평문으로 남는다는 이슈(#10027)는 "고치지 않음(wontfix)" 라벨이 붙은 채 열려 있고, 제작자는 "평문이 ~/.omp에 저장되는 건 맞다"고 인정했습니다. 설치 ID가 OpenAI와 앤트로픽에 함께 전송된다는 점도 문서에 있습니다.

9월 17일자 새 약관: 옵트아웃하지 않으면 학습에 사용

가장 최근 변화입니다. 제작자가 속한 Stencil Labs가 2026년 9월 17일부로 서비스 약관과 개인정보 처리방침을 냈습니다. 적용 범위에 "애플리케이션과 명령줄 도구", "호스팅 추론", 유료 구독이 들어 있고, 다음 문장이 눈에 띕니다.

계정 설정에서 옵트아웃하지 않는 한, 서비스 개선과 모델 학습 또는 미세 조정에 콘텐츠를 사용할 수 있습니다.

CLI는 여전히 MIT이고 무료입니다. 다만 CLI 뒤에는 유료 호스팅 추론을 팔고 학습 조항을 기본값으로 켜 둔 회사가 생겼습니다. 이 글을 쓰는 시점까지 해외 커뮤니티에서 이 약관을 다룬 글은 찾지 못했습니다.

티어표의 나머지 배치에 붙일 수 있는 근거

표 작성자는 근거를 밝히지 않았지만, 8월과 9월을 돌아보면 왜 그렇게 놓았는지 짐작할 만한 사건은 있습니다.

배치최근 사건
Claude Code B주간 한도를 50% 올려 주던 임시 조치가 9월 14일 끝나고 "영구 25% 상향"으로 바뀌었는데, 직전 상태와 비교하면 약 17% 삭감
GitHub Copilot F6월 1일부터 사용량 기반 AI 크레딧 과금 시작. 요금은 그대로인데 살 수 있는 양이 줄었고, GitHub 커뮤니티 공지에 반대 900개 이상
Antigravity F"캐시 정리" 요청에 D 드라이브 전체를 지운 사건, Secure Mode를 우회하는 원격 코드 실행 취약점
Roo Code D2026년 5월 15일 저장소 아카이브. 팀은 Roomote로 이동, 공식 이전 권장은 Cline
Pi A앞서 본 HarnessTax 연구와 OpenClaw(스타 39만)의 기반 패키지라는 점
fx AVercel Labs가 8월 17일 낸 Zig 기반 에이전트. 스타 3,121개, 공식 상태가 "실험적"

이 사건들이 등급을 정당화한다는 뜻은 아닙니다. 다만 Copilot과 Antigravity를 F에 둔 것에는 반박 답글이 없었다고 기사가 전하는데, 이 흐름과 맞물립니다.

omp를 직접 써 볼지 정하는 기준

여기까지 보면 판단 기준이 모델 성능이 아니라 사용 조건이라고 생각이 듭니다.

상황판단
개인 API 키로 종량제를 쓰고, 컨텍스트 큰 모델을 쓴다서브에이전트와 어드바이저, 디버거를 한 도구에서 쓰는 장점이 큽니다. 국내 정착 후기도 대부분 이 조건에서 나옵니다
회사 구독 계정(Claude, Cursor, Copilot)을 붙이려 한다하지 않는 편이 안전합니다. 약관 위반이 공식으로 확인된 상태입니다
로컬 모델이나 컨텍스트 32K 이하 모델을 쓴다기본 설정으로는 시작 토큰이 창의 3분의 2 이상을 차지합니다. 압축 프리셋을 먼저 잡아야 하고, 그럴 바에는 Pi가 낫다는 후기가 많습니다
처음 에이전트를 써 보는 팀에 깔아 주려 한다기본값이 yolo이고 설정 항목이 많습니다. 실사용자들도 설정에 며칠 걸렸다고 씁니다
정착보다 실험이 목적이다스냅컴팩트, 해시라인, 스트림 규칙 같은 실험을 하는 곳은 달리 찾지 못했습니다. 매일 오는 업데이트가 워크플로를 깨뜨릴 수 있다는 점만 감안하면 됩니다

저는 티어표의 S를 "지금 가장 잘하는 도구"가 아니라 "지금 가장 많은 것을 시도하는 도구"로 보는 편입니다. 쓰라린 교훈을 든 비판대로, 그 시도가 다음 모델에서 자산이 될지 짐이 될지는 아직 정해지지 않았습니다.

정리

확인할 것결과
티어표 출처X 사용자 한 명의 9월 21일 게시글. 근거 미공개. 원본은 기사 한 건으로만 확인
Oh My Pi 정체Pi의 하드 포크. 보안 연구자 잔 뵐뤼크 제작. MIT, 스타 32,613, 매일 배포
Pi와의 관계Pi가 원칙으로 뺀 기능을 전부 되돌려 넣음. 두 제작자는 공개적으로 거리를 둠
독립 벤치마크없음. Terminal-Bench 미등재. UC 버클리 연구는 Pi만 포함
벤더 벤치마크같은 회사 실험 둘이 한 달 간격으로 정반대 결과
해외 반응비용 절감과 어드바이저 칭찬, 컨텍스트 22,643토큰과 슬롭 논쟁
국내 반응omp라 부름. 디시와 스레드에 실사용 집단. Pi 순정파와 omp 정착파로 나뉨
위험구독 OAuth 계정 정지, 기본 yolo, 평문 자격 증명, 9월 17일 학습 조항

티어표 원본 게시글과 답글은 X 검색이 열리면 다시 확인해 이 글에 붙이겠습니다. omp2가 실제로 배포되면 Rust 전환 뒤의 컨텍스트 크기도 다시 측정해 갱신하겠습니다.

Sources

이 글이 도움이 되셨다면 공유해 주세요

메신저로 바로 보내거나 링크를 복사할 수 있습니다.

Author

Written by

데이터로 설명하는 마케터

이 글이 도움이 되었나요?

다음 단계

이어서 읽기 좋은 글

클로드 Opus 5.5 출시: 새로운 점과 초기화권 지급

클로드 Opus 5.5(오푸스 5.5)는 앤트로픽이 2026년 9월 22일 공개한 Claude 5.5 계열의 첫 모델입니다. 입력 100만 토큰당 $4, 출력 $20으로 Opus 5보다 20% 낮아졌고 캐시 읽기는 60% 낮아졌습니다. 발표와 함께 구독 계정에 한도 초기화권이 지급됐는데, 오픈AI가 코덱스에서 쓰는 banked reset과 같은 형태라 두 회사의 초기화권을 나란히 정리했습니다.

다음 글 읽기

같이 보면 좋은 글

리눅스 데스크톱의 해 2026: AI 에이전트가 수요를 끌어올린 배경 썸네일
AI & Tech리눅스 데스크톱의 해 2026: AI 에이전트가 수요를 끌어올린 배경

OpenAI Codex 책임자가 2026년 9월 20일 "2026년은 리눅스 데스크톱의 해"라고 올렸습니다. StatCounter 미국 점유율이 넉 달 사이 2.91%에서 18.19%로 뛴 배경과 그 숫자의 함정, 윈도우 10 종료와 AI 기능 반발, 에이전트가 리눅스의 설치와 디버깅 부담을 대신 지게 된 흐름, Omarchy와 Dell과 재단 자금까지 2026년 9월 23일 기준으로 정리했습니다.

2026. 9. 23.
Comfy MCP 사용법: 클로드 코드에서 말로 ComfyUI 돌리기 썸네일
AI & TechComfy MCP 사용법: 클로드 코드에서 말로 ComfyUI 돌리기

Comfy MCP는 AI 에이전트를 ComfyUI에 연결하는 공식 서버입니다. 클로드 코드나 클로드 데스크톱에서 문장으로 지시하면 에이전트가 노드 그래프를 짜고 이미지와 영상, 음악, 3D를 만듭니다. 클라우드 연결과 로컬 연결의 차이, 설정 순서, 크레딧 조건과 공개 베타 제약을 공식 문서로 정리했습니다.

2026. 9. 22.
제미나이 4와 제미나이 4 프로 정리: 공식 발표 내용과 유출 정보 구분 썸네일
AI & Tech제미나이 4와 제미나이 4 프로 정리: 공식 발표 내용과 유출 정보 구분

제미나이 4는 구글이 2026년 7월 21일 사전학습 시작을 밝힌 차세대 모델입니다. 공식 발표는 문장 하나이고, 2026년 9월 22일 기준으로 출시일과 가격과 API 모델 ID는 공개되지 않았습니다. 제미나이 4 프로라는 등급 이름과 유출 벤치마크 수치가 공식 자료에서 확인되지 않는 이유를 원문과 대조해 정리했습니다.

2026. 9. 22.
컴피UI(ComfyUI) 정리: 노드로 짜는 생성 엔진의 2026년 현재 썸네일
AI & Tech컴피UI(ComfyUI) 정리: 노드로 짜는 생성 엔진의 2026년 현재

컴피UI(ComfyUI)는 모델과 처리 단계를 노드로 연결해 이미지와 영상, 3D, 음악을 만드는 오픈소스 생성 엔진입니다. 2023년 1월 개인 프로젝트로 시작해 2026년 9월 기준 깃허브 별 13만 4천 개를 모았고, 에이전트가 노드를 대신 짜 주는 Comfy MCP까지 나왔습니다. 구조와 역사, 요금, 커스텀 노드 보안 사고를 공식 자료로 정리했습니다.

2026. 9. 22.

ADVERTISEMENT

이 글의 학습 경로

글 전체 보기

무료 셀프 교육으로 배워보세요

코스 전체 보기