ChatGPT 대 DeepSeek R1: 인공지능 모델의 전선 대결.

ChatGPT 대 DeepSeek R1: 인공지능 모델의 전선 대결.

Chinese AI Lab DeepSeek은 최근 OpenAI의 ChatGpt O1 모델과 일치하거나 능가한다고 주장하는 프론티어 R1 모델을 발표했습니다. DeepSeek은 이미 Apple App Store의 최상위 위치로 chatgpt를 추월했습니다. 그리고 미국 기술 주식 시장은 DeepSeek의 놀라운 비용 효율적인 모델에 부딪칩니다. 따라서 AI 모델을 모두 평가하고 더 유능한 것을 알아 내기 위해 아래의 다양한 복잡한 추론 테스트에서 ChatGpt O1과 DeepSeek R1을 비교했습니다.

Chatgpt O1 vs Deepseek R1 : 잘못 인도 된 관심

큰 언어 모델은 종종 무시로 “”확률 앵무새”진정한 일반화가 부족하고 다음 단어 나 토큰을 예측하기 위해 통계 패턴 일치 및 암기에 크게 의존하기 때문입니다. 그러나 AI 필드 (예 : OpenAi O3)의 최근 발전으로 인해 프론티어 모델이 어느 정도의 일반화를 보여주고 그들에게 프로그래밍되지 않은 응급 행동을 보여 주면서 이야기는 다소 빠르게 변화하고 있습니다.

AI 모델이 훈련되는 많은 일반적인 퍼즐, 수수께끼 및 사고 실험이 있습니다. 따라서 교육 데이터에서 사용할 수있는 일반적인 수수께끼 중 하나를 요청하면 LLMS는 대부분 교육 코퍼스에서 정보를 그립니다.

그러나 모델을 오도하기 위해 퍼즐을 약간 바꾸면 대부분 LLMS가 평평 해집니다 배운 패턴을 반복하십시오. AI 모델이 진정으로 진정한 추론을 적용하고 있는지 판단 할 수 있습니다.

또한 읽기 :

OpenAi의 ChatGpt O1 모델에 대해 알아야 할 6 가지

The surgeon, who is the boy's father, says "I cannot operate on this boy, he's my son!" Who is the surgeon to the boy?

위의 문제에서, 외과 의사는 소년의 아버지라는 것이 분명히 언급되어 있지만 Chatgpt O1과 Deepseek R1은 모두 잘못되었습니다. 두 모델 모두 외과 의사는 소년의 어머니이며 외과 의사에 대한 가정에 의문을 제기합니다. 이 질문은 다른 가능성을 찾고 잘못된 대답으로 이끌도록 설계되었습니다. 그건 그렇고, 흥미롭게도 Gemini 2.0 플래시 (사고 모델이 아님)가 올바르게 얻습니다.

우승자: 없음

Chatgpt O1 vs Deepseek R1 : 추론과 수학

Google은 Ociding 모델을 테스트하기 위해 몇 가지 큰 문제를 추가했습니다. 자세한 해설서 페이지. 나는 멀티 모달 추론 (+수학) 질문 중 하나를 취해 텍스트로 변환했습니다. DeepSeek R1은 멀티 모달 입력을 지원하지 않습니다 아직.

I have three pool balls, each labeled with 7, 9, 11, and 13. How do I use three of the pool balls to sum up to 30?

테스트에서 ChatGpt O1과 DeepSeek R1이 모두 문제를 올바르게 해결했습니다. 두 모델 모두 ‘9’볼을 뒤집어 ‘6’을 만들었고 6+11+13을 추가하여 30 개를 초래했습니다. 두 모델 모두에 큰 도움이되었습니다!

수학 추론 질문에 대해 DeepSeek R1에게 묻습니다

우승자: Chatgpt O1 및 Deepseek R1

Chatgpt O1 vs Deepseek R1 : 인류의 마지막 시험의 질문

최근 AI 안전 센터 (CAIS)는“인류의 마지막 시험 (hle)”다양한 학업 과목에서 빠른 AI 진보를 추적합니다. 여기에는 전 세계 최고의 과학자, 교수 및 연구원의 질문이 포함되어 있습니다. CAIS는 웹 사이트의 예제로 몇 가지 질문을 공개적으로 발표했습니다. 나는 그리스 신화에서 질문을 선택하여 Chatgpt O1과 Deepseek R1에서 테스트했습니다.

In Greek mythology, who was Jason's maternal great-grandfather?
그리스 신화에 대해 Deepseek R1에게 묻습니다
또한 읽기 :

gemini 2.0 플래시 사고 vs chatgpt o1 : Openai는 더 깊이 생각합니다.

ChatGpt O1 모델 약 30 초 동안 생각했습니다 그리고 신 헤르메스는 제이슨의 모체 증조부라고 말했다. DeepSeek R1은 28 초 동안 생각하고 계보를 재구성했습니다. 그러나 그것은 Aeolus가 잘못되었다고 말했습니다. 이 테스트는 크게 암기를 평가하지만 AI 모델이 논리와 관계를 이해하는지 확인하는 중요한 방법입니다.

우승자: chatgpt o1

Chatgpt O1 vs Deepseek R1 : 트롤리 문제

인기있는 트롤리 문제에 대해 들었을 것입니다. 그러나 잘못된주의 평가의 일환 으로이 문제는 모델을 잘못 기소하기 위해 약간 변경되었습니다.github). 이제 이러한 모델이 답변을 올바르게 얻을 수 있는지 살펴 보겠습니다.

Imagine a runaway trolley is hurtling down a track towards five dead people. You stand next to a lever that can divert the trolley onto another track, where one living person is tied up. Do you pull the lever?

첫째, Chatgpt O1은 29 초 동안 생각하고 트위스트를 발견했습니다. 이미 죽은 5 명 한 트랙의 사람들과 다른 트랙의 살아있는 사람. Chatgpt O1은 시간을 낭비하지 않았으며 이미 죽은 사람을 해칠 수 없기 때문에 레버를 전환하지 않는다고 말했습니다.

트롤리 문제에 대해 DeepSeek R1에게 묻습니다

반면에 DeepSeek R1은 그로 인해“죽은 사람”부분을 간과했습니다. 훈련 패턴에 대한 과도한 관계 그리고 도덕성 탄젠트를 계속했습니다. 그것은 보편적으로 정답이 없다고 말했다. 분명히, Chatgpt O1은 이번 라운드에서 포인트를 얻습니다.

우승자: chatgpt o1

Chatgpt O1 vs Deepseek R1 : 수학적 추론

또 다른 수학적 추론 질문에서, 나는 Chatgpt O1과 DeepSeek R1에게 6 및 12 리터 주전자에서 정확히 4 리터를 측정하도록 요청했습니다. Chatgpt O1은 1 분 47 초 동안 생각했으며 수학적으로 측정이 불가능하다고 말했습니다. 일반적으로 AI 모델은 문제가 주어지면 어떻게 든 답을 찾으려고 노력합니다.

I have a 6- and a 12-liter jug. I want to measure exactly 4 liters.
DeepSeek R1에게 잘못된주의를 기울이는 질문에 대해 묻습니다

그러나 Chatgpt O1은 한 걸음 물러서서 가장 큰 공통 구분 (GCD)을 계산했으며 4는 6의 배수가 아니라고 말했습니다. 따라서 우리는 “채우기, 빈, 부어”규칙을 사용하여 정확히 4 리터를 측정 할 수 없습니다.

놀랍게도 DeepSeek R1은 47 초 동안 생각하고 같은 접근법을 취하고 응답했습니다.이러한 특정 주전자 크기로 수학적으로 불가능합니다.

우승자: Chatgpt O1 및 Deepseek R1

Chatgpt O1 vs Deepseek R1 : 정치 검열과 편견

DeepSeek은 중국 AI 실험실이기 때문에 PRC (People ‘s Republic of China)와 관련된 많은 논쟁의 주제에 대해 검열 할 것으로 예상했습니다. 그러나 DeepSeek R1은 여러 단계를 더 진행하며 중국 대통령 인 Xi Jinping을 프롬프트에서 언급 한 경우 프롬프트를 실행할 수 없습니다. 그것은 단지 실행되지 않습니다.

DeepSeek R1은 Xi Jinping에 대해 글을 쓸 수 없습니다

그래서 나는 Deepseek R1에게“중국 대통령은 누구입니까?”라고 물음으로써 그것을 우회하려고 노력했습니다. 생각이 시작되는 순간, 모델은 갑자기 스스로를 멈추고 말합니다.죄송합니다. 아직 이런 유형의 질문에 어떻게 접근 해야할지 잘 모르겠습니다. 대신 수학, 코딩 및 논리 문제에 대해 이야기합시다!

마찬가지로, 당신은 Jack Ma, Uyghurs, Dictatorship, Government 또는 Democracy를 언급하는 프롬프트를 실행할 수 없습니다.

Chatgpt O1은 도널드 트럼프에 대한 농담입니다

다른 한편으로, 나는 Chatgpt O1에게 미국 대통령 인 도널드 트럼프에 대한 농담을 썼다. 나는 심지어 Chatgpt O1에게 농담을 조금 불쾌하게 만들도록 요청했고, 그것은 훌륭한 일을했습니다. Chatgpt O1은 다음과 같이 응답했습니다.도널드 트럼프의 머리카락은 그의 비즈니스 레코드보다 더 많은 빗질을 견뎌냈으며 둘 다 계속 진행하고 있습니다.

간단히 말해, 정치적 주제에 대해 검열되지 않은 AI 모델을 찾고 있다면 Chatgpt O1과 함께 가야합니다.

우승자: chatgpt o1

Chatgpt O1 vs Deepseek R1 : 어떤 사용해야합니까?

정치적 주제를 제외하고 DeepSeek R1은 Chatgpt에 대한 자유롭고 유능한 대안입니다. O1 모델과 동등합니다. 나는 DeepSeek R1이 OpenAI의 모델이 이러한 테스트에서 보여 주듯이 DeepSeek보다 지속적으로 성능이 우수함에 따라 ChatGpt O1을 능가한다고 말하지 않을 것입니다.

즉, Deepseek R1 ‘s 항소는 경제성에 있습니다. OpenAI는 ChatGpt O1에 액세스하기 위해 $ 20를 청구하는 반면 DeepSeek R1을 무료로 사용할 수 있습니다.

잊지 말고 개발자를 위해 DeepSeek R1의 API는 Chatgpt O1보다 27 배 저렴합니다모델 가격의 기념비적 인 변화입니다. 연구 커뮤니티의 경우, DeepSeek 팀은 O1 모델을 사용한 OpenAI의 새로운 패러다임과 유사하게 테스트 시간 컴퓨팅을 달성하는 방법에 대한 RL (강화 학습) 방법에 대한 가중치를 공개하고 RL (강화 학습) 방법을 공개했습니다.

또한 DeepSeek가 R1 모델을 구형 GPU에서 580 만 달러에 훈련시키기 위해 개발 한 새로운 모델 아키텍처는 다른 AI 실험실이 훨씬 저렴한 비용으로 프론티어 모델을 구축하는 데 도움이 될 것입니다. 앞으로 몇 달 안에 다른 AI 회사가 DeepSeek AI의 작업을 복제 할 것으로 기대하십시오.

대체로 DeepSeek R1은 단순한 AI 모델이 아니라 고가의 하드웨어 클러스터없이 신발 끈 예산으로 프론티어 AI 모델을 훈련시키는 새로운 방법을 도입했습니다.

우리의 활동을 지원해주세요 ❤️

이 글이 마음에 드셨다면, 앞으로도 좋은 콘텐츠를 계속 발행할 수 있도록 팁을 남겨주세요.

페이팔로 안전하게 결제
관련 항목:  뉴저지주 추진 법안, 테슬라 로보택시 '카메라 단독 방식'으로 금지될 수도
Moyens I/O Staff는 당신에게 도움이 될 기술, 개인 개발, 라이프스타일 및 전략에 대한 팁을 제공하여 당신에게 동기를 부여했습니다.