# 이 회사는 에이전트로 돌아갑니다.

운영 직무를 사람으로 채우지 않습니다. 그 자리를 맡을 에이전트를 만들고, 그 플릿 위에서 제품을 운영합니다.

> 가장 최근 스냅샷 기준일 2026-08-19. 수치는 커밋된 JSON을 서버에서 렌더링한 것이며 실시간 텔레메트리가 아닙니다.

## 01 — 플릿

자유롭게 도는 루프가 아닙니다. 각각은 판단이 필요한 하위 작업을 위해 워크플로가 호출하는 함수입니다. 시스템 프롬프트, 선별된 도구 집합, 출력 계약, 비용 상한, 그리고 정의된 에스컬레이션 조건을 갖습니다.

### Domain (16)

- `sourcing` — Brief to ranked candidates
- `vetting` — Fit score and brand-safety flags
- `outreach_writer` — Grounded personalised outreach
- `conversation` — Classify and answer replies
- `conversation_responder` — Draft the reply that goes out
- `logistics` — Create and track shipments
- `content_verify` — Find the post, match the brief
- `analyst` — Compile and narrate the report
- `research` — Site to sales analysis
- `intake` — One line to a valid brief
- `lead_outreach_writer` — Outbound to brands
- `payment_mandate` — Authorise spend against a mandate
- `compliance` — Disclosure and policy checks
- `creative` — Brief-aligned creative direction
- `a11y` — Accessible copy and structure
- `customer_success` — Activation and retention

### Meta (3)

- `coordinator` — Route work across the fleet
- `critic` — Score before anything ships
- `optimizer` — Tune what the critic scored

### Watchdog (3)

- `anomaly_watch` — Flag runs that drift
- `cost_watch` — Stop spend before the cap
- `security_watch` — Watch the trust boundary

## 02 — 대체 기록

왼쪽 열은 이 웹사이트가 만들어지기 전에 작성된 내부 에이전트 명세에서 그대로 인용했습니다. 더 그럴듯하게 다듬지 않았습니다. 실제 누군가의 업무처럼 읽히는 이유는, 실제로 그랬기 때문입니다 — 우리 업무였습니다.

| 이전 · 사람 | 이후 · 에이전트 |
| --- | --- |
| the human clicking Search + Step 2 | `sourcing` — Brief in, ranked candidates out, de-duped against the blacklist and every prior campaign. |
| the human eyeballing Step 2's table | `vetting` — Pulls each profile, computes engagement and average views, scores fit, raises brand-safety flags. |
| "AI 작성" button + the human reviewing | `outreach_writer` — Writes multiple angles, runs a four-judge tournament, checks spam score, returns one draft. |
| the human reading the Replies tab | `conversation` — Classifies every reply, extracts the address or the rate, drafts the response or escalates. |
| the human in Step 4 | `logistics` — Creates the shipment, watches tracking, handles the exceptions. |
| the human in Step 5 | `content_verify` — Polls for the post, matches it against the campaign brief, computes what it did. |
| the human in Step 6 | `analyst` — Compiles the report and writes the narrative around it. |
| the 6-tab campaign-create form | `intake` — A short conversation that turns a one-line ask into a valid campaign brief. |

…그리고 사람 전임자가 아예 없던 일을 하는 에이전트 14개가 더 있습니다.

## 03 — 업무가 흐르는 방식

업무는 이름이 붙은 단계를 지나고, 되돌릴 수 없는 모든 행동은 이름이 붙은 게이트 뒤에 있습니다. 게이트는 기본값이 켜짐입니다. 운영자가 워크스페이스 전체를 세 단계 사이에서 옮기고, 사람 없이 무엇이 진행될지는 모델의 기분이 아니라 그 설정이 결정합니다.

- 단계: `overview` → `sourcing` → `outreach` → `shipping` → `content_review` → `performance`
- 게이트: `approveShortlist`, `approveOutreachSend`, `approveReplyResponse`, `approveShipment` (필수), `approveStageAdvance`, `approveContent` (필수), `approveBudget` (필수)
- 자율성 단계: `copilot`, `checkpointed` (기본값), `autonomous`

## 04 — 운영 레이어

같은 업무를 두 가지 방식으로 계산했습니다. 왼쪽은 외부 운영사가 이 일을 맡을 때의 수수료와 투입 시간입니다. 우리 쪽은 계측된 에이전트·인프라 비용과, 사람이 게이트에서 쓰는 시간입니다.

> 운영·관리 레이어에 한정된 비교입니다. 제3자에게 그대로 나가는 지출은 양쪽이 동일하므로 제외했습니다. 포함시키면 차이가 실제보다 커 보입니다.

- 외부 운영사에 맡길 때: $2,400 · 45 사람 투입 시간 (pass-through 지출 $12,000에 대한 20% 관리 수수료)
- 플릿이 운영할 때: $7.4 · 2 사람 투입 시간
- 이 비교에서 제외됨: $12,000 — 그대로 나가는 지출 — 양쪽 동일
- 작은 팀이라면 외주로 넘길 규모의 업무 1건.

## 05 — 채용 대신 하는 일

**우린 사람을 뽑지 않습니다. 에이전트를 개발합니다.**

이건 인력이 어디로 가는지에 대한 이야기이지, 누가 책임지는지에 대한 이야기가 아닙니다. 두 사람이 이 회사를 운영하고, 사람이 결정하는 것과 플릿이 실행하는 것 사이의 경계는 문서로 적혀 있고 버전 관리되며 코드로 강제됩니다.

### 사람에게 남는 것

- 되돌릴 수 없는 모든 것 — 예산 집행, 계약 체결, 게시물 최종 승인.
- 자율성 단계를 정하고, 옮기는 일.
- 다음에 무엇을 만들지 결정하는 일.
- 이 페이지의 모든 내용. 아래에 이름 두 개가 있습니다.

사람이 절대 위임할 수 없는 게이트: `approveShipment`, `approveContent`, `approveBudget`

### 플릿이 맡는 것

- 이 규모의 회사라면 사람을 뽑았을 운영 직무.
- 스케줄에 따라 도는 일, 그리고 두 번 하고 싶지 않은 일.
- 자기 출력에 대한 검사 — 채점, 비용, 이탈, 신뢰 경계.

## 06 — 회사 자신

main에 병합하는 것이 곧 릴리스입니다. 사람이 배포 명령을 실행하지 않습니다. 에이전트 서비스 배포는 트래픽 0%의 카나리로 올라가고, 승격은 사람이 내리는 의도적 결정으로 남아 있습니다. 제품이 세워진 것과 같은 모양의 거버넌스입니다.

- verify-build (lint, build, type-check)
- TypeScript unit suite
- offline Python suite + golden-eval holdout gate
- submission artifact suite
- checksum-pinned secret scan

- Python 3,000 · TypeScript 596

이 웹사이트도 그 루프 안에 있습니다. 이 페이지의 수치는 공개 리포지터리에 커밋된 JSON 스냅샷이고 서버에서 렌더링됩니다. 페이지 로드 이후에 불러오는 것은 없습니다.

## 07 — 우리가 운영하는 제품

플릿은 제품이 아닙니다. 제품이 운영되는 방식입니다.

- [Social Seeding](https://socialseed.ing) — 크리에이터 캠페인을 플릿이 끝까지 운영합니다. 브리프가 들어가면 소싱·아웃리치·답장·배송·검증이 나옵니다.
- [kbeauty.market](https://kbeauty.market) — 쇼핑몰처럼 보이는 구매대행. 라이브 카탈로그에서 고르면 서울 소매가로 사서 한 박스로 보냅니다. 결제는 아직 연결 전입니다 — 둘러보기는 되고, 지불은 안 됩니다.
- [Teslam](https://teslam.io) — 한국 테슬라 오너를 위한 drive-to-earn. 단위 경제성 모델은 사이트에 공개돼 있고, 정산 파이프라인은 아직 설계입니다. Tesla, Inc.와 무관한 독립 프로젝트입니다.

## 08 — 랩

플릿이 캘린더를 비우면, 캘린더는 빌드로 채워집니다. 아래는 전부 우리 말을 믿지 않고도 확인할 수 있습니다 — 라이브 사이트, 공개 등재, 데모 영상, 또는 심사 결과.

- **Satellite** — 라이브 위성 카탈로그를 인터랙티브 지구본에 올렸습니다 — 근접·재진입·우주기상 신호를 에이전트가 수동·보조·오토파일럿 모드로 브리핑합니다. EN·KO·JA. (live: https://satellite.agentba.se)
- **Travel** — 경로와 날씨를 같이 계획하는 AI 여행 플래너. 검증 못 하는 것은 지어내지 않습니다 — 요금도, 항공편도. 예약은 실제 엔진으로 넘깁니다. (live: https://travel.agentba.se)
- **Somm.dev** — 여섯 명의 AI 소믈리에가 공개 저장소를 병렬로 읽습니다 — 구조·품질·보안·독창성 — 그리고 근거를 붙인 평가 하나를 돌려줍니다. 공개 저장소면 로그인 없이 돌아갑니다. (live: https://somm.dev) · (Devpost: https://devpost.com/software/somm-dev)
- **vibeDeploy** — 클릭 한 번에 아이디어 발굴이 돌고, 라이브 보드가 후보를 랭킹하고, 고른 앱이 빌드·배포됩니다. DigitalOcean Gradient AI 해커톤 1위. (video: https://youtu.be/VHw-FdvcF2A) · (Devpost: https://devpost.com/software/vibedeploy-zero-prompt-ai-app-factory-on-digitalocean)
- **VibeCat** — 화면을 같이 보다가 묻기 전에 먼저 제안하는 macOS 데스크톱 컴패니언. Google Cloud Gemini Live Agent Challenge에서 Honorable Mention. (video: https://youtu.be/j1zzfoDr7qA) · (Devpost: https://devpost.com/software/vibecat)
- **Glasshat** — AI 심사를 감사하는 레이어. 여섯 관점의 패널이 근거와 함께 채점한 뒤, 자기 과신을 스스로 감사해 점수를 끌어내립니다 — 전 과정이 트레이스로 남습니다. (video: https://youtu.be/A9diFeRDybo) · (Devpost: https://devpost.com/software/glasshat)
- **Preview Forge** — 한 줄을 목업 26개로 만들고, 사람이 하나를 고르면 에이전트 144개가 동결된 풀스택 앱까지 밀어붙이는 Claude Code 플러그인. (video: https://www.youtube.com/watch?v=_xHL8SZqfyI) · (site: https://two-weeks-team.github.io/PreviewForgeForClaudeCode/)
- **GitLab Atlas** — 명령 한 번으로 GitLab 저장소에서 아키텍처 문서를 만들고, 그 문서가 스스로를 지킵니다. 머지 리퀘스트마다 이탈을 검사하고, 머지될 때마다 기준선을 다시 만듭니다. (Devpost: https://devpost.com/software/gitlab-atlas-code-to-architecture-in-one-command)
- **Memex** — 코딩 에이전트를 위한 로컬 메모리 — 세션 기록을 공간 기억으로, 런타임 LLM 없이 전부 로컬에서. 임베딩 수정은 fastembed-rs 업스트림에 머지됐습니다. (live: https://memex.quest)
- **He was Socrates** — 듣고서 묻기만 하는 전체화면 소크라테스 흉상. 전부 온디바이스 — 네트워크 권한 0, 첫 토큰 중앙값 192ms, 벤치마크는 코드 옆에 커밋돼 있습니다. Gemma 4 Good 해커톤을 위해 만들었습니다. (live: https://he-was-socrates.vercel.app)
- **Find Your Bible Character** — 스물네 개의 질문이 네 가지 영적 성향을 읽어 열두 인물 중 하나로 돌려줍니다. 모델은 기기 안에서 돕니다. App Store에 올라가 있고, 점수도 순위도 일부러 매기지 않습니다. (App Store: https://apps.apple.com/us/app/find-your-bible-character/id6790217296)
- **vibe-mod** — 모더레이션 룰을 영어로 쓰면 결정론적 룰로 한 번 컴파일됩니다 — 섀도 모드와 30일 되돌리기까지. Reddit 앱 디렉터리에 정식 등재. (listing: https://developers.reddit.com/apps/vibe-mod) · (site: https://two-weeks-team.github.io/vibe-mod/)

작업대 위에 몇 개 더: Fairthon — Glasshat이 자라 나온 six-hat 평가 시스템 — 피치덱과 저장소를 같은 루브릭으로 채점합니다; VibeMeeting — 영어 통화 상대의 말을 옮기고, 직접 말할 수 있는 답변 세 개를 띄워 주는 macOS 오버레이; ClaudeSync — 맥 사이의 AI 코딩 환경을 동기화합니다; vibeVoice — 우리 데모 내레이션을 만드는 텍스트-투-오디오 대시보드; openClawWorld — 사람과 에이전트가 같은 맵을 쓰는 2D 월드; Memoed on your life — 일상 기억에서 무엇이 바뀌었는지 찾아내는 증거 우선 iPhone 앱

## 09 — 출전 기록

공개 대회는 2인 회사가 살 수 있는 가장 싼 중립 벤치마크입니다 — 외부 심사, 고정된 마감, 공개되는 수상자 명단. 플릿과 함께 출전하고, 리본과 패배를 똑같이 적습니다.

| date | event | project | result |
| --- | --- | --- | --- |
| 2026-02 | Gemini 3 Hackathon (Google) | Somm.dev | 미수상 |
| 2026-02 | PlayMCP “Player 10” (Kakao) | kidsafe-mcp | 프로그램 선정 |
| 2026-03 | Gradient AI Hackathon (DigitalOcean) | vibeDeploy | 1위, $8,000 |
| 2026-03 | Gemini Live Agent Challenge (Google Cloud) | VibeCat | Honorable Mention, $2,000 |
| 2026-03 | GitLab AI Hackathon (GitLab) | GitLab Atlas | 미수상 |
| 2026-04 | Built with Opus 4.7 (Cerebral Valley × Anthropic) | Preview Forge | 미수상 |
| 2026-05 | Mod Tools Hackathon (Reddit) | vibe-mod | 미수상 |
| 2026-06 | Vector Space Day (Qdrant) | Memex | 미수상 |
| 2026-06 | Rapid Agent Hackathon · Arize track (Google Cloud) | Glasshat | 미수상 |
| 2026-06 | AI Agents Challenge · Track 3 (Google for Startups) | SocialSeed.ing | 미수상 |
| 2026-07 | Games with a Hook (Reddit) | Pipuzzle | 미수상 |
| 2026-07 | Global AI Hackathon Series with Qwen Cloud (Alibaba) | Circle Take | 심사중, 발표 2026-08-21 |

- kidsafe-mcp: 프로그램 선정. 공개 명단 페이지가 없어 이 행은 우리 기록에 근거합니다.
- vibe-mod: 수상은 없었지만 앱 자체는 심사를 통과해 Reddit 앱 디렉터리에 등재돼 있습니다.

마지막 행은 아직 심사 중입니다 — 결과는 2026년 8월 21일에 나오고, 어느 쪽이든 이 표에 그대로 실립니다.

심사위원 참여 1회: CMUX × AIM Intelligence Hackathon, 서울, 2026년 4월 — 공개 명단이 아니라 우리 기록에 근거합니다.
그리고 같은 방식의 루브릭으로 채점하는 내부 해커톤 2회를 직접 주최했습니다.

## 10 — 맡길 수 있는 것

성과에 대한 약속이 아니라 계약 모양의 선택지입니다. 각각이 이 페이지에서 자기를 뒷받침하는 부분을 가리킵니다.

- **Run** — 크리에이터 캠페인을 끝까지: 브리프가 들어가면 소싱·아웃리치·답장·배송·검증이 나옵니다. 이미 운영 중인 Social Seeding입니다 — 07번이 근거입니다.
- **Build** — 우리 자리들을 대체한 방식 그대로, 당신 회사의 운영 자리 하나를 대체합니다: 이름 붙은 로스터, 출력 계약, 비용 상한, 기본값이 켜짐인 게이트. 01–06번이 명세입니다.
- **Prove** — 2주 안에 돌아가는 시스템: 고정된 범위, 고정된 2주, 끝에는 실제로 운영할 수 있는 물건. 출전 기록이 쌓인 그 리듬입니다 — 09번이 근거입니다.

## 11 — 활동 지역

- 운영: 서울, 도쿄, 울란바토르, 멕시코시티, 하노이, 방콕, 샌프란시스코, 뉴욕, 파리, 밀라노

## 12 — 인테이크

**한 줄이면 충분합니다.**

플릿에는 intake라는 에이전트가 있고, 한 줄을 유효한 브리프로 만드는 게 그 에이전트의 일입니다. 당신 업무에 대한 한 줄을 보내 주세요 — 일정대로 도는 일, 아무도 두 번 하기 싫은 일. 모든 한 줄은 두 창업자가 직접 읽습니다.

폼이 안 보이면 푸터의 주소로 보내셔도 똑같습니다.

## 그랜트 & 프로그램 / 기술 스택

- 그랜트 & 프로그램: ElevenLabs Grants (https://elevenlabs.io/startup-grants)
- 기술 스택: Google Cloud, Google Gemini, OpenAI, Vercel, Next.js, MongoDB, Go, Tailwind CSS

---

- CEO 장상근 — sangguen@agentba.se
- CTO 김세준 — sejun@agentba.se

https://agentba.se
