VS Tip AppAI 비교 · 지도 앱 비교 · 은행 앱 비교 · 스마트 가이드

AI 앱 호스팅 5곳, 기다리는 시간이 공짜인 곳은 한 곳

글쓴이발행일

벽에 나란히 걸린 다섯 개의 주차 미터기 중 네 개는 시계 바늘이 돌고 있고 가장 왼쪽 하나만 바늘이 멈춰 있는 모습을 표현한 일러스트

AI 챗봇을 만들어 인터넷에 올려 본 분이라면 이런 장면을 아실 겁니다. 사용자가 질문을 보내면 서버는 AI 모델에게 “이거 답해 줘”라고 전달하고, 답이 글자 단위로 흘러나오는 20초 동안 아무 계산도 하지 않고 그냥 기다립니다. 그런데 호스팅 요금은 이 기다리는 시간을 어떻게 계산할까요. 이 질문에 다섯 곳이 서로 다른 답을 냅니다.

오늘(2026년 10월 1일) 개발자 커뮤니티에서는 넷리파이가 엣지 함수 인프라를 통째로 바꿨다는 글이 화제입니다. 공식 블로그에 따르면 함수 한 번 도는 시간(중앙값)이 2540ms에서 56ms로 줄었고, 가격은 그대로라고 합니다. 반가운 소식이지만, AI 앱 호스팅을 고르는 분에게는 속도보다 먼저 확인할 게 있습니다. **“기다리는 동안에도 돈이 나가는가”**입니다.

이 글은 이런 분을 위해 썼습니다. AI 챗봇이나 에이전트를 처음 인터넷에 올리려는 개발자, 무료로 시작했다가 청구서가 예상과 다르게 나올까 걱정되는 분, 그리고 “서버리스”라는 말은 들었지만 요금이 어떻게 계산되는지는 모르는 분입니다. 용어는 처음 나올 때 풀어서 씁니다.

비교 대상은 다섯 곳입니다. 모두 2026년 10월 1일 기준 각 사 공식 가격 페이지와 공식 문서로 직접 확인했습니다.

CDN 요금이 궁금하시면 CDN 5곳 비교 글을, 코드를 격리해서 돌리는 곳이 궁금하시면 AI 샌드박스 비교 글을 같이 보시면 좋습니다. 이 글은 그 앞 단계, **“내가 만든 AI 앱을 어디에 올릴까”**를 다룹니다. 확인하지 못한 숫자는 마지막에 따로 모아 두었습니다.

먼저 알아야 할 것: 기다리는 시간을 누가 얼마나 세는가

AI 앱의 서버 일은 대부분 “기다림”입니다. 사용자 요청을 받아 AI 모델 API에 전달하고, 답이 스트리밍으로(조금씩 이어서) 돌아오는 동안 그 연결을 열어 둡니다. 실제로 서버가 계산하는 시간은 20초 중 0.02초(20ms) 남짓일 수 있습니다. 이런 앱에서 AI 앱 호스팅 요금의 차이는 기다림을 세느냐 안 세느냐에서 크게 벌어집니다.

다섯 곳이 이 기다림을 세는 방식은 이렇게 나뉩니다.

버셀넷리파이클라우드플레어렌더레일웨이
무료로 시작Hobby 0달러Free 0달러Free 0달러Hobby 0달러30일 체험
첫 유료Pro 월 20달러Personal 월 9달러Paid 월 5달러인스턴스 월 7달러Hobby 월 5달러
계산 단위활성 CPU + 메모리 + 호출 수함수 실행 시간 × 메모리CPU 시간 + 요청 수인스턴스 월정액메모리·CPU 초 단위
기다리는 시간CPU는 정지, 메모리는 계속전부 계산계산 안 함켜 둔 시간켜 둔 시간

표 아랫줄이 이 글의 핵심입니다. 이제 한 곳씩 보겠습니다.

버셀 — CPU 시계는 멈추고, 메모리 시계는 돕니다

버셀은 함수 요금을 세 가지로 나눠 셉니다. 활성 CPU(Active CPU), 프로비전 메모리(Provisioned Memory), 호출 수(Invocations)입니다.

활성 CPU는 코드가 실제로 계산하는 시간만 셉니다. 공식 문서에는 “데이터베이스 조회나 AI 모델 호출 같은 입출력(I/O)을 기다리는 동안에는 과금이 멈춘다”고 적혀 있습니다. 100ms를 계산하고 400ms를 DB 응답을 기다렸다면 100ms만 청구된다는 예시도 있습니다. AI 앱에 유리한 설계입니다.

다만 메모리는 다릅니다. 같은 문서에 “I/O를 기다리는 동안에도 메모리 과금은 계속된다. 마지막 요청이 끝날 때까지 계속된다”고 적혀 있습니다. 함수 하나당 기본 메모리는 2GB(1 vCPU)입니다. 그나마 한 인스턴스가 여러 요청을 동시에 처리할 수 있어서(최적화된 동시성) 메모리 비용을 나눠 씁니다.

가격은 이렇습니다. 가장 싼 지역(워싱턴 D.C. 등) 기준으로 활성 CPU는 시간당 0.128달러, 프로비전 메모리는 GB-시간당 0.0106달러, 호출은 100만 건당 0.60달러입니다. 서울(icn1) 리전은 CPU 0.169달러, 메모리 0.0140달러로 더 비쌉니다. 지역마다 단가가 다르니 리전을 바꾸면 청구서가 달라집니다.

넷리파이 — 요금제가 크레딧으로 바뀌었고, 기다림도 계산됩니다

넷리파이 가격 페이지는 이제 크레딧 방식입니다. Free는 월 300크레딧 한도, Personal은 월 9달러에 1,000크레딧, Pro는 월 20달러(구성원 무제한)에 3,000크레딧부터 시작해 5,000·10,000·15,000·20,000 단계로 올릴 수 있습니다. 크레딧을 다 쓰면 추가 크레딧을 살 수 있습니다. 가격표에는 500크레딧에 5달러, 1,500크레딧에 10달러 두 가지가 적혀 있고 각각 Personal·Pro 칸으로 읽힙니다. 자동 충전은 기본으로 꺼져 있습니다.

크레딧이 무엇으로 소모되는지는 가격 페이지에 적혀 있습니다.

이 중 AI 앱에 중요한 건 컴퓨트입니다. 함수 문서를 보면 컴퓨트는 함수가 실행된 총 시간 × 메모리로 셉니다. 기본 메모리가 1GB인데, 함수가 2시간 돌았다면 2GB-시간입니다. 함수가 AI 응답을 기다리는 시간도 “실행 시간”이라 그대로 들어갑니다. 버셀의 활성 CPU 같은 “기다리는 동안 정지” 옵션은 문서에서 확인되지 않았습니다.

이해를 돕는 환산이 있습니다. Pro 3,000크레딧은 대역폭만 쓴다면 150GB(3,000÷20), 함수 컴퓨트만 쓴다면 300GB-시간(3,000÷10)입니다. Free의 300크레딧은 각각 15GB, 30GB-시간입니다.

응답 시간 제한은 문서에 구체적으로 나옵니다. 동기 함수는 60초이고 변경할 수 없습니다. 예약 실행은 30초, 백그라운드 함수는 15분입니다. 스트리밍 응답은 20MB까지 허용합니다. 사용자가 기다리는 챗봇이라면 60초가 천장이라는 뜻입니다.

클라우드플레어 워커스 — “기다림 무과금”, 대신 CPU 10ms의 벽

클라우드플레어 공식 가격 문서에는 이런 표가 있습니다. 무료 플랜은 하루 요청 10만 건, 기간(duration)에는 요금이 없고, 호출당 CPU 시간 10밀리초가 한도입니다. 유료(Standard)는 월 5달러가 최소이고, 요금제에 포함된 양은 요청 월 1,000만 건, CPU 시간 월 3,000만 밀리초입니다. 초과분은 요청 100만 건당 0.30달러, CPU 100만 밀리초당 0.02달러입니다. 기간에 대한 요금도, 제한도 없다고 문서에 적혀 있습니다.

한도 문서는 더 직접적입니다. “CPU 시간은 코드가 CPU를 쓰는 시간을 잰다. fetch 호출이나 데이터베이스 조회 같은 네트워크 응답을 기다리는 시간은 CPU 시간에 포함되지 않는다.” HTTP 요청에는 기간 제한이 없고, 클라이언트가 연결돼 있는 한 스트리밍을 계속할 수 있습니다. 평균적인 워커의 CPU 사용량은 요청당 약 2.2ms라고 합니다.

그래서 AI 응답을 20초 기다려도 CPU는 20ms만 쓴다면 요금은 CPU 20ms 기준입니다. 데이터 전송료(이그레스)도 따로 없다고 합니다.

대신 걸리는 지점이 있습니다.

렌더 — 서버를 빌립니다, 요금제는 그 위에 얹힙니다

렌더는 구조부터 다릅니다. 워크스페이스 요금제(월정액) + 서버(인스턴스) 요금을 따로 냅니다. Hobby는 월 0달러, Pro는 월 25달러, Scale은 월 499달러이고, 여기에 인스턴스 비용이 붙습니다. 포함 대역폭은 Hobby 5GB, Pro 25GB, Scale 1TB이고 초과분은 GB당 0.15달러입니다.

인스턴스는 무료(512MB, CPU 1개 미만)부터 시작하고, 첫 유료는 월 7달러(CPU 0.5개, 512MB)입니다. 2GB 메모리는 월 25달러, 4GB는 월 85달러입니다. 청구는 초 단위로 비례 계산합니다. 하루만 켜 두면 하루치만 냅니다.

무료 인스턴스의 함정이 공식 문서에 있습니다. 15분 동안 들어오는 요청이 없으면 잠들고, 다음 요청 때 다시 깨어나는 데 약 1분이 걸립니다. 챗봇 첫 질문에 1분을 기다려야 한다는 뜻입니다. 월 750시간의 무료 인스턴스 시간이 주어지고, 다 쓰면 그달 끝까지 무료 서비스가 정지됩니다. 문서가 “프로덕션에 쓰지 말라”고 직접 적었습니다.

반대로 유료 인스턴스는 항상 켜져 있으니 응답을 오래 기다려도 월정액 안에서 해결됩니다. 동시에 여러 연결을 처리할 수 있는 일반 서버라서, 한 인스턴스가 스트리밍 연결 여러 개를 맡는 구조입니다. 다만 이 글에서 렌더의 HTTP 요청 최대 시간은 공식 문서에서 확인하지 못했습니다.

레일웨이 — 쓴 만큼, 초 단위로

레일웨이 가격 페이지의 첫 문장이 “앱이 쓴 만큼만, 초 단위로 계산한다”입니다. 단가는 메모리 GB·초당 0.00000386달러, CPU vCPU·초당 0.00000772달러, 이그레스 GB당 0.05달러입니다. 한 달을 30일(2,592,000초)로 환산하면 메모리는 GB당 약 10달러, CPU는 vCPU당 약 20달러입니다.

요금제는 이렇습니다.

공용 네트워크 문서에는 응답 시간 제한이 있습니다. HTTP 요청은 데이터가 계속 오가면 최대 15분, 데이터가 오가지 않으면 5분 뒤 닫힙니다. 웹소켓은 이 제한에서 제외되어 계속 열어 둘 수 있습니다. 스트리밍 응답은 데이터가 흐르니 15분까지 갑니다.

버셀·넷리파이와 다른 점은 서비스가 켜져 있는 동안 메모리를 점유하는 만큼 청구된다는 것입니다. 요청이 없어도 켜 둔 서비스는 계속 계산됩니다.

20초짜리 챗봇 10만 건, 다섯 곳 청구서를 직접 뽑아 보면

계산해 보겠습니다. 다음 세 가지를 가정합니다.

  1. 한 달에 요청 10만 건
  2. 요청마다 AI 응답을 20초 동안 스트리밍
  3. 그 20초 중 실제 CPU 계산은 20ms

이 가정은 제가 정한 예시입니다. 컴퓨트 비용만 계산했고 AI 모델 API 요금, 대역폭, 데이터베이스는 뺐습니다.

버셀 Pro (워싱턴 D.C. 리전, 기본 메모리 2GB)

넷리파이 Pro (Credit 기반, 3,000크레딧 단계)

클라우드플레어 워커스 Paid

렌더 (Hobby 워크스페이스 + 7달러 인스턴스)

레일웨이 Hobby

월 컴퓨트 비용(예시)
클라우드플레어 워커스5달러
레일웨이 Hobby약 6달러
렌더7달러
버셀 Pro20달러(사용분 약 11.9달러, 크레딧으로 상쇄)
넷리파이 Pro약 37달러

여기서 눈여겨볼 점은 두 가지입니다. 첫째, 같은 앱인데 7배 넘게 갈립니다. 둘째, 서버가 항상 켜져 있는 렌더·레일웨이는 요청 수가 아니라 동시 연결 수가 비용을 정합니다. 요청이 10배로 늘어도 동시 연결이 한두 개를 넘지 않으면 비용은 거의 그대로입니다. 반대로 같은 시각에 사용자가 몰리면 인스턴스를 키우거나 늘려야 합니다.

무료 한도로 위 챗봇은 며칠이나 버틸까

같은 가정(요청당 20초 대기, CPU 20ms)으로 무료 플랜의 천장을 계산해 보면 이렇습니다.

같은 “무료”인데 5,400건에서 멈추는 곳, 하루 10만 건까지 되지만 계산이 10ms를 넘으면 안 되는 곳, 한 달 내내 켜지지만 첫 응답이 1분 걸리는 곳으로 갈립니다. 무료 플랜을 고를 때는 **“어느 숫자에서 막히는가”**부터 보는 게 맞습니다.

청구서 폭탄을 막는 장치는 있나

AI 앱은 사용량이 갑자기 튈 수 있습니다. 누군가 요청을 쏟아붓거나, 코드 버그로 같은 호출이 반복되는 경우입니다. 이때 비용을 묶어 주는 장치가 곳마다 다릅니다.

AI 모델 API 요금까지 합치면 호스팅 요금보다 모델 호출 요금이 훨씬 클 가능성이 높습니다. 호스팅의 한도와 별개로, 모델 API 쪽에도 반드시 월 한도를 걸어 두세요. 여러 모델을 한 곳으로 묶어 비용을 보는 방법은 AI 게이트웨이 5곳 비교 글에서 다뤘습니다.

응답 최대 시간, 스트리밍이 어디까지 버티나

AI 에이전트는 한 번의 요청이 몇 분씩 걸릴 때가 있습니다. 응답 시간 천장은 이렇게 다릅니다.

곳HTTP 응답 최대 시간비고
버셀Hobby 300초, Pro 800초(베타 1,800초)그 이상은 별도 워크플로 제품
넷리파이동기 함수 60초(변경 불가)백그라운드 함수 15분
클라우드플레어제한 없음클라이언트가 연결돼 있는 동안
렌더확인하지 못함문서에서 못 찾음
레일웨이데이터가 흐르면 15분5분간 데이터 없으면 종료

넷리파이의 60초가 가장 짧습니다. 사용자가 기다리는 요청은 60초 안에 끝내거나, 백그라운드 함수로 넘기고 결과를 따로 받아 오는 구조로 바꿔야 합니다. 클라우드플레어는 천장이 없지만 사용자가 창을 닫아 연결이 끊기면 작업이 취소될 수 있습니다. 문서가 ctx.waitUntil()로 응답 뒤에도 일을 이어가라고 안내합니다.

이 글에 나온 낯선 말, 여섯 개만 풀면

서버리스(serverless) — 내가 서버를 직접 켜 두지 않고, 요청이 올 때만 코드가 돌아가는 방식입니다. 서버가 없는 게 아니라 내가 관리하지 않는다는 뜻입니다.

스트리밍 응답 — AI의 답을 다 만든 뒤 한 번에 보내지 않고, 만들어지는 대로 조금씩 흘려 보내는 방식입니다. 챗GPT에서 글자가 하나씩 나타나는 그 방식입니다.

콜드 스타트 — 한동안 쓰지 않은 서비스가 잠들어 있다가 처음 요청이 올 때 깨어나는 데 걸리는 시간입니다. 렌더 무료 인스턴스가 약 1분입니다.

I/O 대기 — 코드가 계산을 멈추고 다른 곳(데이터베이스, AI 모델)의 응답을 기다리는 시간입니다. AI 앱은 이 시간이 대부분입니다.

GB-시간 — 메모리 1GB를 1시간 쓰는 양입니다. 메모리 2GB를 30분 쓰면 1GB-시간입니다.

크레딧 — 넷리파이가 쓰는 자체 단위입니다. 배포·컴퓨트·대역폭·요청이 각각 다른 크레딧 값으로 소모됩니다.

AI 앱 호스팅, 내 앱이 이런 모양이라면 여기로

Next.js로 만든 AI 앱을 가장 빨리 올리고 싶다면 → 버셀. 프레임워크 지원이 가장 매끄럽고, AI 모델 호출 대기 시간에 CPU 과금이 멈춥니다. 다만 메모리 과금이 따로 붙고, 개발자 자리당 월 20달러가 든다는 점은 기억해 두세요.

요청이 많고 계산은 적은 API(AI 프록시, 간단한 챗봇)라면 → 클라우드플레어 워커스. 기다림에 요금이 없고 데이터 전송료도 없습니다. 대신 워커 방식으로 코드를 짜야 하고 메모리가 128MB로 작습니다.

기존 Node·Python 서버를 그대로 올리고 싶다면 → 렌더나 레일웨이. 일반 서버처럼 켜 두는 방식이라 오래 걸리는 에이전트 작업이 편합니다. 렌더는 월정액이라 예측이 쉽고, 레일웨이는 초 단위라 놀리는 시간이 적으면 저렴합니다.

정적 사이트에 가벼운 함수 몇 개만 붙이는 정도라면 → 넷리파이. 이 용도라면 Free의 300크레딧으로도 시작해 볼 수 있습니다. 다만 AI 응답을 오래 기다리는 함수가 많으면 크레딧이 빨리 닳고, 동기 함수는 60초에서 끊깁니다.

무료로 먼저 만져 보고 싶다면 레일웨이 체험(카드 없이 시작), 클라우드플레어 무료(CPU 10ms에 맞는 가벼운 작업), 버셀 Hobby 순으로 시작해 보세요. 렌더 무료 인스턴스는 15분 뒤 잠드니 데모용으로만 쓰세요.

이전에 다룬 서버리스 데이터베이스 5곳 비교 글에서 본 것처럼, 같은 서비스도 회사마다 요금을 세는 단위가 전부 다릅니다. AI 앱 호스팅도 마찬가지입니다. 가격표의 숫자보다 **“무엇을 세는가”**를 먼저 확인하세요.

빠진 숫자와 계산의 전제