요약 / 핵심 포인트
- "AI 이메일 도구"는 지원 에이전트, 이메일 클라이언트, AI 보조 기능이 포함된 공유 받은 편지함, 에이전트 이메일 인프라라는 네 가지 서로 다른 제품 카테고리를 의미하며, 이들은 서로 대체될 수 없습니다.
- Intercom Fin의 $0.99 '성과'에는 고객이 침묵하는 경우도 포함되지만, Zendesk는 72시간의 침묵과 LLM 검증 이후에만 해결로 간주합니다. 가격보다 정의가 더 중요합니다.
- Gorgias는 '사람의 개입 없는' 자동화를 약속하고, Front는 '사람이 통제하는 AI'를 판매합니다. 모든 공급업체의 자체 문서에서는 '초안 우선' 방식으로 시작할 것을 권장합니다.
- 문서화된 재난 사례(Air Canada, Cursor의 'Sam')는 루프가 아니라 자신 있게 제시된 가상의 정책이었습니다. 에이전트의 발언은 법적으로 귀하의 발언입니다.
- Zendesk만이 메일 루프 방지를 깊이 있게 문서화합니다. RFC 3834 아웃바운드 스탬핑은 아무도 마케팅하지 않는 가장 저렴한 안전 메커니즘입니다.
- Sierra, Decagon, Zowie는 가격을 공개하지 않습니다. 이들에 대해 읽게 되는 모든 금액은 추측일 뿐입니다.
Stork은 다른 곳과 마찬가지로 도구 제출, 목록 관련 질문, 가끔 발생하는 화난 크롤러의 불만 등 지원 이메일을 받습니다. 우리는 시장에 제품이 없어서가 아니라, "카탈로그를 알고 실제 퍼널로 고객을 안내하는 창업자 브랜드의 지원 에이전트"와 같은 형태의 제품이 없었기 때문에 직접 에이전트를 구축했습니다. 우리의 에이전트는 인간의 검토를 위해 답장을 초안으로 작성하고, 응답하기 전에 자체 카탈로그와 블로그에서 정보를 검색하며, 이메일을 통한 계정 관련 질문에는 답변을 거부하고, 자동 응답기와 논쟁에 휘말리지 않도록 강력한 회로 차단기를 갖추고 있습니다.
이러한 안전장치를 구축하는 과정에서 상용 에이전트들이 동일한 문제를 어떻게 처리하는지 조사했습니다. 그 조사가 이 감사 보고서로 이어졌습니다. 아래의 모든 내용은 리뷰 사이트의 소문이 아닌, 2026년 7월 23일 기준으로 확인된 각 업체의 가격 페이지, 문서 및 엔지니어링 블로그에서 가져온 것입니다. 업체가 아무것도 공개하지 않은 경우, 추측하는 대신 공개된 정보가 없음을 명시했습니다.
첫째: 실제로 구매하려는 네 가지 제품 중 무엇인지 파악하십시오.
"AI 이메일 도구"는 하나의 라벨을 공유하지만 실제로는 네 가지 다른 제품 카테고리이며, 서로 대체할 수 없습니다. 이 경계를 넘나들며 구매하는 것이 우리가 가장 흔하게 보는 실수이며, 솔직히 말해 우리 디렉토리의 자동 생성된 경쟁사 목록도 이 카테고리를 직접 큐레이션하기 전에는 범했던 실수입니다.
| Category shape | Who it's for | Representative tools |
|---|---|---|
| AI support agent — answers your customers | Support teams; the agent replies on behalf of the business | Intercom Fin, Zendesk AI, Gorgias, Sierra, Decagon, Zowie, Forethought, Chatbase, Tidio Lyro, Freddy AI |
| AI email client — manages your inbox | Individuals and teams drowning in their own mail | Shortwave, Superhuman, TabMail, SaneBox, Mailbutler |
| Shared inbox with AI assist — humans reply, AI helps | Teams that want drafting and triage, not autonomy | Front, Hiver, Pylon, DelightChat |
| Email infrastructure for agents / deliverability / outreach | Developers giving agents inboxes; senders protecting reputation | AgentMail, MailReach, Instantly |
가격 책정의 세부 약관에 인센티브가 숨어 있습니다.
Intercom Fin은 독립형으로 실행될 때 월 최소 약정 금액과 함께 "결과(outcome)"당 $0.99를 청구합니다. 그들의 정의를 읽어보십시오: 고객이 해결을 확인하거나, Fin이 워크플로우를 완료하거나, 또는 Fin이 응답한 후 고객이 더 이상 도움을 요청하지 않을 때 결과로 간주됩니다. 침묵도 과금 대상입니다. 포기한 고객도 답변을 얻은 고객과 동일하게 계산됩니다.
Zendesk는 동일한 단위를 정직하게 가격 책정합니다. 자동 해결은 요청자가 72시간 동안 조용히 유지하고, 인간이 티켓에 관여하지 않았으며, 언어 모델이 답변이 실제로 관련성이 있었음을 검증한 후에만 계산됩니다. 같은 지표이지만 더 엄격한 심판을 거칩니다. 해결 건당 가격을 평가할 때, "해결"의 정의가 가격보다 더 중요합니다.
| Tool | Pricing model | Published figures (Jul 2026) |
|---|---|---|
| Intercom Fin | Per outcome | $0.99/outcome, min. commitment (e.g. 50/mo) standalone; $9.99 per sales-qualification outcome |
| Zendesk AI agents | Seats + automated resolutions | Suite from $55/agent/mo annual; per-resolution rate not public |
| Gorgias | Ticket-volume tiers + AI usage | Starter $40/mo (helpdesk $10 + AI agent $30); $1.50 per automated interaction over plan |
| Front | Per seat + per conversation for AI | $25–$105/seat/mo annual; Autopilot from $0.05/conversation |
| Pylon | Per seat + flat AI add-ons | $59–$139/seat/mo annual; AI agents from $100/mo |
| Hiver | Per seat | Free; $25/$55/$85 per user/mo annual |
| Tidio Lyro | Conversation-metered tiers | Starter $24.17/mo; pay-per-resolution only on Premium |
| Chatbase | Flat tiers + message credits | Free; $32–$400/mo |
| Freshdesk Freddy | Per seat + sessions | $19–$89/agent/mo; 500 AI sessions included, then $49/100 |
| Sierra | Outcome-based | No public pricing — sales-led |
| Decagon | Per conversation or resolution | No public pricing — sales-led |
| Forethought | Platform fee + outcomes | Quote-only |
이 글이 마음에 드셨나요? 매일 아침 이런 글을 메일로 받아보세요.
하루 한 통 · 두 번의 클릭으로 구독 취소 · 제3자 추적 없음
자율성 스펙트럼: 벤더가 약속하는 것 vs 실제로 제한하는 것
마케팅은 양극단을 오갑니다. Gorgias는 "사람의 개입 없이" 자동 반품 및 주문 추적을 약속합니다. Freshworks는 Freddy가 "고객 문의의 최대 80%를 사람의 개입 없이 해결"한다고 홍보합니다. 반대편 극단에서는 Front가 가격 페이지 전면에 "사람이 제어하는 AI"를 내세우며, 구매자들이 첫 번째 그룹이 판매하는 바로 그 방식에 두려움을 느끼고 있다는 점을 공략합니다.
솔직한 버전은 보통 한 번 더 클릭해야 나오는 문서 속에 있습니다. Gorgias의 자체 플레이북은 AI가 답장을 보내기 전에 사람이 검토할 수 있도록 내부 메모로 먼저 시작할 것을 권장합니다. Zendesk는 숫자 기반 신뢰도 임계값(기본값 100점 만점에 60점)을 통해 자동 응답을 제한하며, 이보다 낮으면 에이전트가 사람에게 상담을 이관합니다. Fin은 자해, 미성년자, 탈옥 시도, 고위험 의료, 법률 또는 금융 주제에 대해 별도의 설정 없이도 자동으로 상담을 이관합니다. 대량 발송에 모든 유인이 있는 콜드 아웃리치 도구인 Instantly조차도 응답 에이전트를 출시하면서 "Human-In-The-Loop 모드 사용... 그 후 오토파일럿으로 전환"할 것을 명시적으로 권장합니다.
다시 말해, 자율성을 판매하는 모든 업체는 내부적으로는 초안 작성 방식을 우선시합니다. 랜딩 페이지와 설정 패널 사이의 간극은 이 문서들을 읽으며 배운 가장 유용한 사실입니다.
업계가 내부적으로 초안 작성 방식을 고수하는 이유
두 가지 공개된 사건이 이러한 신중함을 설명합니다. 2024년 2월, 캐나다 재판소는 Air Canada가 자사 챗봇이 지어낸 유족 할인 정책을 이행하도록 판결했으며, 챗봇이 "자신의 행동에 책임이 있는 별도의 법적 주체"라는 항공사의 주장을 기각했습니다. 2025년 4월, Cursor의 AI 지원 에이전트는 로그인 버그를 설명하기 위해 "구독당 기기 1대" 정책을 지어냈고, 사용자마다 서로 다른 허위 답변을 받아 실제 존재하지 않는 정책 때문에 유료 고객들이 구독을 취소하는 사태가 발생했습니다.
두 사례에서 무엇이 실패했는지 주목하십시오. 루프나 전달 가능성의 문제가 아니라, 모델이 지식의 공백을 메우기 위해 지원 에이전트의 자신감 있는 어조로 정책을 지어낸(confabulated) 것입니다. 에이전트의 발언은 법적으로 귀하의 발언입니다. 이것이 바로 이 시장의 모든 신뢰도 임계값, 제외 카테고리, 검증 단계가 실제로 가격에 반영하고 있는 위험 요소입니다.
우리가 구축한 것, 그리고 마케팅에서 전혀 언급하지 않는 것
저희 에이전트는 의도적으로 지루하게 설계되었습니다. 초안을 작성하면 사람이 직접 전송합니다. 답변하기 전에 자체 카탈로그와 게시된 포스트에서 정보를 검색하며, 검색 결과가 없으면 더 많이 말하는 대신 말을 아낍니다. 계정 관련 질문은 채널 내에서 답변하지 않으며, 인증된 대시보드로 연결되는 링크를 제공합니다. From: 헤더는 신원을 보장하지 않기 때문입니다. 또한 결정론적 서킷 브레이커를 탑재하여 수신 메시지에 대한 자동 응답 감지 및 스레드당 엄격한 제한을 두어, 부재중 자동 응답과 같은 무한 루프에 빠지지 않도록 합니다.
가장 중요한 메커니즘은 어떤 공급업체도 마케팅하지 않는 것들입니다. 2004년 자동 이메일 응답기 사양인 RFC 3834에 따르면, 자동 응답은 Auto-Submitted: auto-replied 헤더를 포함해야 하며, 해당 헤더가 있는 메시지에는 절대 답변하지 않아야 하고, null return-path에는 응답하지 않아야 합니다. 저희가 감사한 모든 공급업체 중 Zendesk만이 메일 루프 처리에 대해 깊이 있게 문서화하고 있습니다. 여기에는 1시간 내 20통 이상의 이메일을 보낸 발신자를 차단하는 속도 제한 기능과 모든 루프를 차단할 수 있는 시스템은 없다는 솔직한 인정이 포함되어 있습니다. 다른 모든 업체의 문서는 자동 이메일의 가장 오래된 실패 모드에 대해 침묵하고 있습니다.
- 구매자라면: 먼저 카테고리 형태를 맞춘 다음, 영업 자료에서는 답해주지 않는 네 가지 질문을 던지십시오. 과금 가능한 해결의 기준은 무엇인가? 자동 응답이 절대 불가능한 카테고리는 무엇인가? 계정 데이터를 공개하기 전에 에이전트가 상대방을 어떻게 검증하는가? 그리고 자체 발신 메일에 RFC 3834 헤더를 포함하는가?
- 구축자라면: '초안 우선(draft-first)' 방식은 초보 단계가 아니라 업계의 실제 운영 표준입니다. 자동 전송 전 의도 허용 목록(intent allowlist)을 추가하고, 금전 및 법적 주제에 대해서는 엄격한 보류를 설정하며, 검색 레이어에서 실제로 보여줄 수 없는 가격이나 정책을 언급하는 답변은 차단하는 검증 단계를 거치십시오.
- 어느 쪽이든: 해결 건수를 엄격하게 측정하십시오. 사람이 개입하지 않았고, 요청자가 72시간 동안 조용했으며, 샘플링 검사 결과 답변이 정확했는지 확인하십시오. 관대한 정의는 대시보드를 화려하게 만들 뿐 실패를 숨길 뿐입니다.
이 카테고리의 목록은 1차 소스를 기준으로 사실 확인을 거칠 것입니다. 이는 저희 에이전트의 답변을 근거 있게 만드는 것과 동일한 파이프라인입니다. AI 이메일 도구를 운영 중인데 가격이나 문서가 변경되었다면, 목록을 신청하여 알려주십시오. 추측보다 수정이 더 가치 있습니다.

