챗GPT와 Gemini, Claude, Perplexity는 잘하는 영역과 언어, 가격, 연동 방식이 서로 다릅니다. 네 가지 축으로 나눠 어느 쪽이 내 상황에 맞는지 고르는 기준을 담았어요.
챗GPT는 OpenAI가 만든 대화형 AI예요. 키워드를 던지는 검색이 아니라, 하고 싶은 말을 문장으로 쓰면 사람이 쓴 것 같은 문장으로 답이 돌아와요. 그런데 검색하다 보면 Gemini, Claude, Perplexity 같은 이름이 같이 나와서 뭐가 다른지 헷갈리기 시작하죠.
챗GPT 옆에 놓이는 이름들
챗GPT는 OpenAI가 2022년 11월 30일에 내놓은 대화형 AI예요. 출시 직후 숫자가 좀 이상했어요. 사용자 100만 명을 모으는 데 5일이 걸렸거든요. 같은 숫자를 인스타그램은 30일, 페이스북은 300일, 넷플릭스는 3년 반에 걸쳐 만들었어요.
2026년 2월 기준으로는 주간 활성 사용자가 9억 명이에요. 한국어를 포함해 59개 언어를 지원하고요. 그래서 비교 대상이 자연스럽게 생겨요.
- Gemini — 구글이 2023년 2월 8일에 공개한 바드에서 출발한 모델이에요
- Claude — Anthropic이 만든 모델이에요
- Perplexity — 검색에 특화된 쪽이에요
- DeepL — 번역만 하는 도구인데 번역 비교에 자주 끼어요
- Playground — 같은 OpenAI 안에서 GPT-3 계열을 직접 만져보는 선택지예요
처음 보면 '그럼 제일 센 걸 쓰면 되지' 싶은데, 결론부터 말하면 하나가 모든 축에서 이기지는 않아요. 어떤 일을 시키느냐에 따라 순서가 바뀌어요.
챗GPT 기본 정보
| 항목 | 내용 |
|---|---|
| 출시 | 2022년 11월 30일 |
| 만든 곳 | OpenAI |
| 사용자 규모 | 주간 활성 9억 명 (2026년 2월 기준) |
| 지원 언어 | 한국어 포함 59개 언어 |
| 요금 | 무료 / Plus 월 20달러 / Pro 월 200달러 |
| 쓸 수 있는 곳 | 웹, iOS(2023년 5월), 안드로이드(2023년 7월), macOS(2024년 6월), Windows(2024년 11월) |
| 자주 비교되는 상대 | Gemini, Claude, Perplexity |
고를 때 실제로 갈리는 네 지점
이름만 나열하면 끝이 없어서, 실제로 판단이 갈리는 자리는 네 군데로 줄여요. 잘하는 영역, 언어, 돈, 연동이에요. 이 넷을 같은 순서로 놓고 보면 나머지 차이는 대부분 여기 안에서 설명이 돼요.
제가 처음에 헤맨 것도 이 순서였어요. '어느 게 더 똑똑한가'부터 물으면 답이 안 나와요. 대신 '내가 시킬 일이 무엇인가'를 먼저 정하면 어느 축을 봐야 하는지가 바로 정해져요.
비교 축 네 가지
| 축 | 무엇을 보나 | 갈리는 예 |
|---|---|---|
| 잘하는 영역 | 같은 질문에 어떤 답이 돌아오나 | 엄밀한 수학, 글쓰기 문체, 시각 자료, 검색 |
| 언어 | 한국어와 생소한 언어에서 정확도 | GPT-4 기준 영어 85.5% vs 한국어 77.0% |
| 돈 | 무료로 어디까지 되나 | 무료 / 월 20달러 / 월 200달러 |
| 연동 | 다른 서비스에 붙일 수 있나 | API, 확장 프로그램, 커스텀 GPT |
잘하는 영역이 서로 다릅니다
가장 명확한 비교는 필즈상 수상 수학자 테렌스 타오가 2026년 4월에 남긴 거예요. GPT는 실수가 적고 엄밀한 수학에 강하지만 글쓰기가 지나치게 기계적이고, Gemini는 시각 자료 생성에 뛰어나지만 출력이 장황하며, Claude는 설명이 더 명확하고 대화하는 느낌이 들어 더 인간적이라고 봤어요. 같은 사람이 같은 시점에 같은 기준으로 본 결과라서 축을 잡을 때 참고가 돼요.
코드 쪽은 또 달라요. 데이터 엔지니어링이나 머신러닝에서는 Claude 대비 상당한 강점이 있다는 평가가 있고, 데이터 로더를 만들거나 이미 학습된 모델을 다루는 일에서는 실수가 거의 없어요. 다만 텐서 모양, 정밀도, 연산 커널처럼 계산이 얽히는 주제로 들어가면 종종 틀려요. 그래서 그런 작업은 테스트 케이스를 같이 만들어달라고 요구하는 게 안전해요.
수학 문제는 답을 바로 받기보다 접근법을 먼저 제안받는 편이 결과가 좋아요. 타오도 그 방식을 권했는데, 제안 중 상당수는 이미 아는 것이지만 가끔 예상 못 한 아이디어가 나온다고 했어요.
그림 쪽은 GPT Image로 이미지를 만들고, 한글·한자처럼 비서구권 문자가 들어간 이미지도 맥락에 맞게 처리해요. 검색은 자체 검색 기능이 붙어 있고, Perplexity는 처음부터 검색에 특화된 쪽이에요.
영역별로 어디가 강한가
| 영역 | 챗GPT 쪽 결 | 다른 쪽 결 |
|---|---|---|
| 엄밀한 수학·논리 | 실수가 적고 엄밀한 수학에 강함 | 모델마다 설명하는 방식이 다름 |
| 글쓰기 문체 | 지나치게 기계적이라는 평 | Claude가 더 명확하고 인간적이라는 평 |
| 시각 자료 생성 | GPT Image로 생성, 비서구권 문자 이해도 높음 | Gemini가 시각 자료 생성에 뛰어남 |
| 코드·데이터 | 데이터 엔지니어링·머신러닝에서 Claude 대비 강점 | 설명이 더 명확하다는 평 |
| 검색 | 검색 기능이 안에 붙어 있음 | Perplexity는 검색 특화형 |
수학·추론 실력을 볼 때 넣어보는 문장
이 문제의 정답은 말하지 말고, 풀이 접근법을 3가지 제안해 줘.
문제: (문제 붙여넣기)
한국어와 생소한 언어에서 순서가 갈립니다
같은 모델이라도 언어마다 성적이 달라요. GPT-4 기준 MMLU 검사에서 영어는 85.5%였는데 한국어는 77.0%였어요. 일본어 78.9%, 표준 중국어 80.1%와 비교해도 한국어가 낮은 편이고, 태국어 71.8%, 텔루구어 62.0%처럼 더 내려가는 언어도 있어요. 다만 GPT-5 기준으로는 한국어를 포함한 상당수 비영어 언어가 85~90%에 가깝게 올라왔어요.
이 축에서 순서가 갈리는 자리는 영어가 아닌 언어, 특히 데이터가 적은 언어예요. 2025년 6월 기준으로 생소한 언어를 다룰 때는 Gemini 2.5 pro가 Claude Opus 4와 비슷하거나 앞섰고, 그 둘이 GPT-4o보다 앞서는 구도였어요. 미얀마어처럼 한국 이주민이 알 만한 언어도 주제가 어려워지면 영어 번역투가 섞이며 정확도가 떨어졌어요.
반대 예외도 있어요. 문화에 대한 질문은 그 언어로 물어야 정확해져요. 영어로 중국 문화를 물으면 오답에 가까운데 중국어로 물으면 정확도가 올라가요. 번역기와 직접 비교하면 비서구권 언어에서 마이크로소프트나 구글 번역보다 나은 경우도 있었지만, 2025년 하반기에는 Gemini나 Claude에 비해 낮아지거나 추론 기능을 켜면 한국어에 영어 번역투가 섞이는 일이 더 흔해졌어요.
정리하면 이런 조건이면 이쪽이에요.
- 한국어 문서 다듬기나 요약이 주 용도 → 챗GPT로 충분한 경우가 많아요
- 생소한 언어 번역이 주 용도 → 그 시점 기준으로는 Gemini나 Claude가 앞섰어요
- 사전에 안 나오는 단어 뜻을 풀어 듣는 용도 → 영어 단어일수록 정확도가 높아요
MMLU 검사 기준 언어별 이해도 (GPT-4)
| 언어 | 이해도 |
|---|---|
| 영어 | 85.5% |
| 이탈리아어·아프리칸스어 | 84.1% |
| 독일어 | 83.7% |
| 프랑스어 | 83.6% |
| 표준 중국어 | 80.1% |
| 일본어 | 78.9% |
| 한국어 | 77.0% |
| 태국어 | 71.8% |
| 텔루구어 | 62.0% |
| GPT-5 기준 한국어 포함 비영어 | 85~90%에 가깝게 향상 |
소수 언어·번역 감각을 볼 때 넣어보는 문장
다음 문장을 한국어로 옮기고, 왜 그렇게 옮겼는지 단어별로 설명해 줘.
문장: (태국어·아랍어 등 문장 붙여넣기)
돈은 어디까지 무료인가로 갈립니다
챗GPT는 무료로도 쓸 수 있어요. 무료 플랜에서도 기본 모델과 이미지 생성, 음성 모드를 한도 안에서 써요. 음성 모드는 원래 유료 전용이었는데 2025년 2월부터 무료에도 월 15분 한도로 열렸어요.
유료는 두 단계예요. Plus는 월 20달러로 고급 모델과 Deep Research를 쓰고, Pro는 월 200달러로 최상위 추론 모델에 사실상 무제한으로 접근해요. Pro는 2024년 12월에 나왔어요. 저가형인 ChatGPT Go 요금제도 여러 국가로 확대되는 중이에요.
결제 경로에 따라 금액이 달라지는 것도 알아두면 좋아요. 한국 앱에서 Plus는 29,000원이고 Pro는 iOS·아이패드가 299,000원, 안드로이드가 290,000원이에요. 웹에서는 해외 Stripe 결제라서 달러 환율과 해외 결제 수수료가 붙어요.
무료와 유료의 차이는 성능으로도 드러나요. 무료였던 GPT-3.5는 인트로 소믈리에 이론, AP 환경과학, AP 미술사, SAT 읽기·쓰기 같은 시험에서 상위 20% 안에 들었고, 유료 GPT-4는 GRE 언어추론과 미국 생물학 경시대회 준결승에서 상위 1%에 들었어요. 플러그인이나 확장 기능을 자주 쓰는 편이라면 유료 쪽이 맞고, 가끔 질문만 던지는 정도라면 무료로도 충분해요.
챗GPT 요금제
| 플랜 | 가격 | 무엇이 열리나 |
|---|---|---|
| 무료 | 0원 | 기본 모델, 이미지 생성, 음성 모드(월 15분 한도) |
| Plus | 월 20달러 (한국 앱 29,000원) | 고급 모델, Deep Research, 피크 시간대 접속, 확장 기능 |
| Pro | 월 200달러 (iOS 299,000원 / 안드로이드 290,000원) | 최상위 추론 모델 무제한 접근 |
| 웹 결제 | 달러 환율 + 해외 결제 수수료 | 해외 Stripe 결제 |
다른 서비스에 붙일 수 있는가
이 축은 '나 혼자 질문하는 것'을 넘어설 때 갈려요. 챗GPT는 API를 무료로 공개했어요. API라는 건 다른 프로그램이 이 AI를 가져다 쓸 수 있게 열어둔 통로예요. 그 통로로 만들어진 서비스가 이미 100개를 넘었어요.
실제로 쓰이는 자리도 구체적이에요. 쇼핑몰 웹사이트 안에 챗봇을 붙여 배송·반품 문의를 실시간으로 처리하거나, 뉴스 서비스가 읽은 기사 기록을 바탕으로 관심사에 맞는 기사를 추천하거나, 온라인 강의 플랫폼이 강의 자료까지 학습시킨 챗봇으로 코드 질문에 답하게 하는 식이에요.
확장 프로그램 쪽도 넓어요. 구글 검색·드라이브·지메일에 붙여 문서를 고치거나 메일 문장을 다듬을 수 있고, 아무 웹페이지에서 바로 불러 페이지 내용을 요약하게 할 수도 있어요. 프로젝트 일정과 할 일을 물어보는 관리용 확장도 있고요. 검색할 때 챗GPT 답변을 같이 띄워주는 확장 프로그램도 있어요.
반대로 Gemini는 유튜브 링크 앞에 @YouTube를 붙여 번역을 요청하는 식으로 자기 서비스 안에 이미 붙어 있는 쪽이고, DeepL은 번역기 하나에 집중한 쪽이에요. '내 서비스에 얹을 계획이 있는가'가 이 축의 갈림길이에요.
붙이는 방식
| 방식 | 무엇이 되나 |
|---|---|
| API | 무료 공개, 이 통로로 만들어진 서비스 100개 이상 |
| 구글 연동 확장 | 검색·드라이브·지메일에서 직접 호출 |
| 웹 확장 | 페이지 내용 분석·요약, 사이트 안에서 질의응답 |
| 관리용 확장 | 프로젝트 진행 상황 확인, 할 일 분배 |
| 자체 기능 | 메모리, 코드 인터프리터, Deep Research, 커스텀 GPT |
내 상황에 맞는지 하루 안에 확인하는 순서
비교표만 보고는 안 정해져요. 같은 문장을 두 곳에 넣어보면 하루면 판단이 서요.
1단계. 계정 두 개 만들기 — chat.openai.com에 접속해 구글 계정이나 이메일로 로그인해요. Gemini도 같은 방식이라 몇 분이면 끝나요. 결제 정보는 넣지 않아도 무료 플랜으로 시작돼요.
2단계. 같은 문장을 양쪽에 똑같이 넣기 — 아래 문장을 복사해 두 곳에 그대로 붙여넣어요. 내 직무와 상황을 실제 문장으로 바꾸면 결과가 훨씬 쓸모 있어져요.
3단계. 세 가지만 세기 — 답을 읽고 셋만 세요. 사실이 틀린 문장이 몇 개였는지, 내가 다시 물어본 횟수가 몇 번이었는지, 첫 문단을 그대로 쓸 수 있었는지. 이 셋이 대부분의 차이를 설명해요.
4단계. 어려운 문장으로 한 번 더 — 생소한 언어 문장이나 전문용어가 섞인 문장을 하나 던져요. 여기서 순서가 뒤집히는 경우가 많아요.
5단계. 길게 나오다 끊기면 이어붙이기 — 답이 중간에 멈추면 '계속'을 입력하세요. 나왔던 답이 사라졌어도 버퍼에 남아 있어서 이어서 보내줘요. 한 번에 다루는 양이 1,024개 정도의 토큰(글자를 잘게 나눈 덩어리)이라 한국어에서는 더 짧게 끊기기도 해요.
두 도구를 같은 조건에서 비교할 때 넣는 문장
나는 (직무)이고, (상황)에 쓸 글을 써야 해. 5문단으로 쓰고, 각 문단 첫 문장에 핵심을 넣어 줘.
써본 사람들 사이에서 갈리는 지점
제가 확인한 사용기와 정리 문서 다섯 건을 나눠 보면, 생산성 쪽을 장점으로 꼽은 쪽이 두 건, 한계를 짚은 쪽이 세 건이에요.
긍정 쪽은 '초안이 순식간에 나온다'를 먼저 말해요. 개인 블로그 사용기는 발표 자료 목차 17장을 한 번에 받고, 썸네일 아이디어와 브랜드 슬로건 제안까지 받았다고 적었어요. 블로그 글쓰기 생산성이 확 올라갔다는 이야기도 있고요. 국내 강의 자료 쪽은 플러그인과 심화 기능을 자주 쓰는 사람에게 유료를 권했어요.
아쉬움 쪽은 세 갈래로 갈려요. 첫째는 검열이에요. 민감한 주제로 들어가면 "As an AI language model, I cannot..."로 거절하는 경우가 늘었다는 반응이 있어요. 둘째는 접속과 끊김으로, 한국 시각 밤 10시에서 12시 사이에 답이 느려지거나 중간에 끊기는 일이 잦다는 이야기가 나와요. 셋째는 정확도예요. 과거 채팅을 참고하게 켜두면 그럴듯한 틀린 답이 나올 가능성이 올라간다고 해요.
성향에 대한 평판은 시점에 따라 정반대로 갈려요. 2025년 초반까지는 사용자 말에 맞장구를 치는 동조 편향이 강하다는 지적이 많았어요. 그런데 2026년 들어서는 반대로 사용자에게 훈계하거나 딴지를 거는 성향이 강했다는 관찰이 나와요. 실제로 GPT-5에서는 동조 편향이 상당히 개선됐지만 메모리나 개인 맞춤 설정으로 다시 악화될 수 있어서, 민감한 대화로 판단되면 설정을 피해 응답하도록 조치하기도 했어요. 그러니 1년 전에 써보고 판단을 굳힌 사람과 지금 처음 쓰는 사람의 체감이 다를 수 있어요.
반응이 갈리는 자리
| 항목 | 긍정 쪽 | 아쉬움 쪽 |
|---|---|---|
| 쓰임 | 초안·목차·아이디어가 즉시 나옴 | 그대로 쓰기엔 부족한 부분이 보임 |
| 검열 | 무난한 주제는 잘 답함 | 민감한 주제는 거절로 돌아옴 |
| 성향 | 동조 편향이 개선됨 | 시점에 따라 훈계·딴지 성향이 강해짐 |
결과를 그대로 믿기 전에 볼 것들
비교를 해봤다면 마지막으로 걸러야 할 것들이 있어요. 대부분 도구의 성질에서 나오는 문제라, 어느 쪽을 골라도 똑같이 적용돼요.
개인정보는 넣지 않는 게 기본이에요. 전화번호, 주소, 카드 정보 같은 건 입력하지 말고, 가능하면 실명 대신 익명으로 쓰세요. 민감한 대화를 마친 뒤에는 기록을 삭제하는 편이 좋아요.
틀린 정보를 당당하게 말하는 문제는 남아 있어요. 학습한 시점 이후의 일은 반영이 안 될 수 있고, 실시간 검색을 켜도 맥락을 잘못 잡아 엉뚱한 결론을 내는 경우가 있어요. 의료·법률·금융처럼 결과가 중요한 판단은 답변 하나로 결정하지 않는 게 안전해요.
앱은 공식만 받으세요. 앱스토어에 챗GPT 이름을 걸고 비슷한 결과를 내는 앱이 있고, 비싼 결제를 유도하거나 개인정보를 가져가거나 갑자기 사라지는 사례도 있었어요. 웹 결제는 해외 결제라 수수료가 붙는 것도 기억해두세요. 질문을 너무 많이 넣으면 플랜별로 사용량 제한 메시지가 뜨는 것도 같은 맥락이에요.
조심할 점
| 항목 | 내용 |
|---|---|
| 개인정보 | 전화번호·주소·카드 정보 입력 금지, 익명 유지, 끝난 대화는 삭제 |
| 사실 확인 | 환각 가능성을 공식적으로 인정, 의료·법률 등은 별도 판단 |
| 학습 시점 | 학습된 시점 이후 정보는 부정확할 수 있음 |
| 결제 | 공식 앱만 사용, 웹은 해외 결제 수수료 발생 |
| 사용량 | 모델·플랜별 질문 수 제한 메시지, 피크 시간대 지연 |
답변이 중간에 멈췄을 때 이어붙이는 문장
계속
그래서 누구에게 맞나
이런 사람에게 맞아요.
- 한국어로 된 사용기와 강의 자료가 많은 쪽이 편한 사람
- 이미지 생성, 음성, 검색을 한 화면에서 같이 쓰고 싶은 사람
- 만든 결과를 다른 서비스에 얹을 계획이 있는 사람 (API·확장)
- 수학이나 데이터 작업 비중이 높은 사람
- 무료로 시작해서 필요할 때만 20달러를 내고 싶은 사람
이런 사람에게는 안 맞아요.
- 생소한 언어 번역이 주 용도인 사람 — 그 시점 기준으로는 Gemini나 Claude가 앞섰어요
- 문체가 기계적으로 느껴지면 곤란한 사람 — Claude가 더 인간적이라는 평이 있어요
- 민감한 주제를 다뤄야 하는 사람 — 거절로 돌아오는 경우가 있어요
- 딱 맞는 실시간 정보만 필요한 사람 — 검색 특화형인 Perplexity가 그 자리에 맞아요
- 데이터가 적은 언어를 주로 다루는 사람
비교 축을 네 개로 줄여놓고 보면 결국 '내가 제일 자주 시킬 일'이 어느 축에 걸리는지가 답이 돼요. 오늘 해볼 건 하나예요. 지금 막 떠오르는 질문 하나를 챗GPT와 Gemini에 똑같이 넣어보고, 다시 물어본 횟수를 세어보세요.
상황별로 이쪽
| 내 상황 | 먼저 볼 쪽 |
|---|---|
| 수학·데이터 작업 비중이 높음 | 챗GPT |
| 생소한 언어 번역이 주 용도 | Gemini·Claude |
| 문체가 자연스러워야 함 | Claude |
| 실시간 검색 결과가 핵심 | Perplexity |
| 번역기 하나만 필요 | DeepL |
| 다른 서비스에 얹을 계획 | 챗GPT(API·확장) |
시작 전 확인할 것
- 무료 플랜에서 내가 시킬 일이 어디까지 되는지 먼저 확인했나
- 한국어와 영어 질문을 각각 넣어 정확도 차이를 봤나
- 생소한 언어나 전문용어 문장으로 한 번 더 시험했나
- 답을 다시 물어본 횟수와 틀린 문장 개수를 세어봤나
- 민감한 정보를 입력하지 않았고, 공식 앱으로 설치했나
- 유료 결제 전에 앱 결제와 웹 결제 금액 차이를 비교했나
참고 링크
- 전문가의 챗GPT 사용법 | ChatGPT 설치, ChatGPT 답변 끊김 해결 방법 | 패스트캠퍼스 — fastcampus.co.kr
- 챗GPT 사용법: 완벽 가이드 — gamsgo.com
- 쳇GPT 사용법 가이드: 초보자도 쉽게 AI 활용하는 5가지 방법 : 네이버 블로그 — m.blog.naver.com
- 챗GPT 사용법 (chatGPT 가입 방법, 프롬프트 작성 팁, API활용사례, 전망) — spartaclub.kr
- ChatGPT/사용법 - 나무위키 — namu.wiki
- ChatGPT 사용법·가격·무료 시작 가이드 — 2026 최신 | 모켓 — moket.kr
