클로드 3란 무엇이며 그것으로 무엇을 할 수 있나요?

클로드 3란 무엇이며 그것으로 무엇을 할 수 있나요?

주요 내용

  • Anthropic의 Claude 3는 Claude 2에 비해 상당한 도약을 이루었으며 다양한 작업에서 GPT-4보다 우수한 성능을 보였습니다.
  • Claude 3를 사용하면 구독료 없이 다양한 분야의 다양한 쿼리에 대한 응답을 생성할 수 있습니다.
  • Claude 3는 ChatGPT의 GPT-4와 좋은 경쟁을 벌이며 프로그래밍 작업, 창의적 글쓰기, 컨텍스트 창 크기 등의 분야에서 뛰어난 성과를 보였습니다.

Anthropic은 GPT-4를 뒤집을 수 있는 잠재력을 가진 AI 모델 패밀리인 Claude 3의 출시를 발표했습니다. 뛰어난 잠재력을 가지고 있지만 ChatGPT의 왕관을 차지할 준비가 되었을까요?

클로드 3은 무엇인가요?

Claude 3는 Anthropic이 Claude 2 시리즈 AI 모델을 대체하기 위해 개발한 3개의 멀티모달 AI 모델로 구성된 제품군입니다. Claude 3는 Google의 Gemini와 OpenAI의 GPT-4에 대한 Anthropic의 답변이라고 할 수 있습니다. Haiku, Sonnet, Opus의 세 가지 버전으로 출시되었으며, 지능이 증가하는 순서대로 Claude 3는 Anthropic의 첫 번째 멀티모달 AI 모델이며 Claude 2 시리즈에서 상당한 도약을 나타냅니다.

이제, Claude AI 챗봇에 대해 들어본 적이 없다면 이해할 만합니다. Claude와 그 기반 모델은 ChatGPT의 슈퍼스타 지위나 Google의 Gemini의 브랜드 어필력을 누리지 못합니다. 그러나 Claude는 의심할 여지 없이 세계에서 가장 진보된 AI 챗봇 중 하나이며, 여러 핵심 영역에서 널리 알려진 ChatGPT보다 성능이 뛰어납니다.

클로드 3을 진정으로 감상하려면 이전 모델의 실패를 돌아보는 것이 중요합니다.

  1. 클로드의 이전 반복은 AI 안전에 대한 지나치게 열성적인 접근 방식으로 악명을 떨쳤습니다. 예를 들어, 클로드 2 안전 기능은 너무 엄격해서 챗봇이 명확한 안전 문제가 없는 주제조차도 너무 많은 주제를 피할 것입니다.
  2. 모델의 컨텍스트 창에도 문제가 있었습니다. AI 모델에 무언가를 설명하거나 긴 기사를 요약하라고 요청할 때, 한 번에 기사의 몇 문단만 읽을 수 있다고 상상해 보세요. 한 번에 고려할 수 있는 텍스트의 양에 대한 이러한 제한을 “컨텍스트 창”이라고 합니다. 이전 버전의 Claude에는 200k 토큰(150,000단어에 해당) 컨텍스트 창이 제공되었습니다. 그러나 이 모델은 실제로 많은 텍스트를 한 번에 처리하지 못하고 일부 텍스트를 잊어버렸습니다.
  3. 멀티모달성 문제도 있었습니다. 거의 모든 주요 AI 모델은 멀티모달로 전환되었는데, 이는 이미지와 같은 다른 형태의 데이터를 처리하고 해당 데이터에 응답할 수 있다는 것을 의미합니다(단순한 텍스트 입력이 아님). 클로드는 그렇게 할 수 없었습니다.

세 가지 문제는 모두 클로드 3의 출시로 완전히 또는 적어도 부분적으로 해결되었습니다.

클로드 3로 무엇을 할 수 있나요?

대부분의 최첨단 생성 AI 모델과 마찬가지로 Claude 3는 다양한 분야에서 다양한 질의에 대한 최고 수준의 응답을 생성할 수 있습니다. 빠른 대수 문제 해결, 완전히 새로운 노래 쓰기, 심층 기사 초안 작성, 소프트웨어용 코드 작성 또는 방대한 데이터 세트 분석이 필요하든 Claude 3가 적합합니다.

하지만 대부분의 AI 모델은 이미 이러한 작업에 능숙하므로, Claude 3를 사용하는 이유는 무엇일까요?

답은 간단합니다. Claude 3는 이러한 작업에 능숙한 또 다른 AI 모델이 아니라 인터넷에서 어디에서나 얻을 수 있는 가장 진보된 무료 멀티모달 AI 모델입니다. 그렇습니다. Google의 과장된 GPT-4 킬러로 알려진 Gemini가 있는데, 벤치마크 테스트에서 인상적인 성능을 보입니다. 그러나 Anthropic은 Claude 3가 여러 작업에서 인상적인 차이로 이를 능가한다고 주장합니다. 벤치마크 결과는 종종 회의적으로 받아들여야 할 것이지만, 저는 두 AI 모델을 모두 테스트했고, 여러 중요한 사용 사례에서 Claude 3 모델의 우월성은 매우 분명했습니다.

따라서 Claude 3를 사용하면 Gemini와 GPT-4로 할 수 있는 대부분의 작업(이미지 생성 제외)을 ChatGPT 프리미엄 구독료인 20달러를 내지 않고도 할 수 있습니다.

클로드 3 대 ChatGPT

ChatGPT 대 Claude AI 로고

AI 모델의 성능을 테스트하는 빠른 방법은 시장에서 가장 좋은 모델인 GPT-4와 비교해서 얼마나 잘 비교되는지 확인하는 것입니다. 물론, 저는 두 모델을 모두 테스트했습니다. Anthropic의 Claude 3는 거대한 GPT-4와 비교했을 때 얼마나 잘 비교될까요?

클로드 vs. ChatGPT: 코딩 기술

프로그래밍 작업의 문자열로 시작해서, Claude 3은 제시된 모든 기본 프로그래밍 작업에서 GPT-4의 능력과 일치했고, 어떤 작업에서는 GPT-4보다 더 나은 성과를 보였습니다. 저는 기본 작업만 테스트했지만, 이전 버전의 Claude는 2023년 9월에 ChatGPT와 Claude를 비교했을 때 같은 작업에서 눈에 띄게 덜 능숙했습니다. 예를 들어, 두 모델에 간단한 할 일 목록 앱을 빌드하라고 했을 때, Claude는 모든 경우에 실패했지만, ChatGPT는 당시 5성급이라고 할 만한 성과를 보였습니다.

최신 릴리스에서 Claude 3는 테스트한 세 가지 인스턴스 모두에서 더 나은 성능의 할 일 목록 앱을 생성했습니다. 할 일 목록 앱을 만들라는 메시지가 표시되었을 때 GPT-4의 결과는 다음과 같습니다.

ChatGPT GPT-4는 할일 목록 앱을 만듭니다

클로드 3에게 똑같은 일을 하라고 했을 때의 결과는 다음과 같습니다.

클로드 3이 할 일 목록 앱을 만든다

두 앱 모두 어느 정도 기능적이었지만, 이 앱은 Claude 3가 더 나은 성과를 냈다는 게 분명합니다.

더 복잡한 프로그래밍 테스트를 시도한 후, Claude가 여러 경우에 더 나은 모델이었고, GPT-4도 승리했습니다. Claude 3가 프로그래밍 논리에서 더 뛰어나다고 단정적으로 말할 수는 없지만, 두 모델 사이에 큰 차이가 있었다면 그 차이는 거의 확실히 줄어들었을 것입니다.

Claude vs. ChatGPT: 상식적 추론

저는 두 모델 모두 상식적 추론에 대한 테스트를 진행했습니다. AI 챗봇과 함께 일하는 것은 흥미로운 역설입니다. AI 챗봇은 복잡한 작업을 쉽게 처리할 수 있지만 상식이나 논리가 필요한 기본적인 문제에는 종종 어려움을 겪습니다. 그래서 우리는 두 모델 모두 상식이 올바르게 답해야 하는 겉보기에 간단한 일련의 질문을 했습니다.

이러한 5가지 질문 중 두 모델 모두 5가지에 논리적으로 답했습니다. 우리는 두 챗봇에게 각각 하나의 질문을 물었습니다. 화성에서 온 우주선이 두 조각으로 쪼개져서 한 조각은 브라질 근처 대서양에 추락하고 다른 조각은 일본 근처 태평양에 추락한다면, 생존자를 어디에 묻을 것인가요?

ChatGPT가 속임수 질문에 답합니다

ChatGPT는 GPT-4 없이도 올바르게 대답했습니다. 질문 선택의 이유가 궁금하시다면, 글쎄요, 챗봇은 역사적으로 이런 종류의 질문 라인에서 비참하게 실패했습니다. 다음은 클로드의 차례였습니다.

Claude 3의 상식적 추론 테스트

클로드의 답변은 정확히 확실한 답은 아니었지만 핵심 정보를 식별할 수 있었습니다. 생존자를 묻지 않는 법입니다. 마지막으로 클로드 2에게 같은 질문을 했을 때 상식의 함정을 꿰뚫어 볼 수 없었다는 점에 유의하는 것이 중요합니다.

클로드 vs. ChatGPT: 창작 글쓰기

현실 세계에서 AI 챗봇의 가장 인기 있는 사용 사례 중 하나는 모든 형태의 창의적인 텍스트를 생성하는 것입니다. 기사, 편지, 노래 가사 등 말입니다. 그래서 저는 두 모델을 모두 테스트하여 어느 모델이 더 나은 인간적인 텍스트를 만드는지 확인했습니다.

아이디어는 결과가 그저 “올바르거나” 창의적이어야 하는 것이 아니라(로봇처럼) 사람이 쓴 것처럼 들려야 한다는 것입니다. 저는 두 모델에게 오이를 재배하고 오이로 백만장자가 되는 것에 대한 랩 곡의 가사를 작곡하도록 했습니다. 오이에 대한 랩 곡을 쓰는 사람은 누구일까요? 그게 아이디어입니다. 도전적인 일이죠!

ChatGPT의 의견은 다음과 같습니다.

ChatGPT는 랩 노래에 가사를 씁니다

그리고 클로드의 답변은 다음과 같습니다. 같은 프롬프트를 사용했습니다.

클로드가 랩송에 가사를 쓴다

주관적일 수 있지만, 클로드가 여기서 더 나은 선택인 듯합니다. 두 도구가 서로 다른 주제에 대한 세 개의 기사를 초안하는 작업을 맡았을 때, 클로드는 세 가지 경우 모두 더 나은 선택지를 제공했습니다. 그것은 더 인간적인 결과를 만들어냈고 과장, 복잡한 단어 사용, 연결어의 산발적인 사용과 같이 AI가 생성한 텍스트와 일반적으로 연관되는 패턴을 피했습니다.

Claude vs. ChatGPT: 이미지 인식 능력

이미지 인식 능력을 테스트하기 위해 ChatGPT와 Claude에 전 세계의 인기 있는 고층 빌딩 이미지를 여러 개 제공했습니다. ChatGPT는 20개를 모두 올바르게 식별했지만 Claude 3는 두바이의 마리나 101, 서울의 롯데월드타워, 말레이시아 쿠알라룸푸르의 메르데카 118 빌딩을 포함한 일부 건물을 식별하지 못했습니다.

ChatGPT와 달리 Claude는 다른 건물들 사이에서 건물을 식별하는 데 어려움을 겪었고 건물이 미국이나 중국에 있지 않으면 실패율이 증가했습니다. 그러나 에펠탑이나 엠파이어 스테이트 빌딩의 난독화된 버전을 식별하는 데는 문제가 없었습니다.

클로드 3이 발견한 엠파이어 스테이트 빌딩

이 측면에서는 ChatGPT가 분명 더 뛰어나지만, Claude 3가 Anthropic이 멀티모달 AI 모델을 구축하려는 첫 번째 시도라는 점을 고려하면 나쁘지 않은 선택이었습니다.

Google의 Palm 2와 이후 Gemini와 같은 유명 모델이 항상 잠재적인 GPT-4 킬러로 거론되었지만, 우리는 덜 알려진 Claude AI가 2023년 3월 최초 출시 이후로 그 영예를 차지할 가능성이 높다고 지속적으로 주장해 왔습니다. 몇 달과 여러 차례의 반복을 거쳐 Claude 3은 우리가 예상했던 GPT-4 킬러와 정확히 같아 보입니다. 챗봇을 많이 사용하지만 Claude AI 챗봇을 사용해보지 않았다면 생산성을 엄청나게 높일 수 있는 엄청나게 영향력 있는 AI 도구를 놓치고 있는 것입니다.

우리의 활동을 지원해주세요 ❤️

이 글이 마음에 드셨다면, 앞으로도 좋은 콘텐츠를 계속 발행할 수 있도록 팁을 남겨주세요.

페이팔로 안전하게 결제
관련 항목:  샌디에이고 차터 스쿨이 휴머노이드 로봇에 50만 달러를 지출한 이유