Alibaba는 최신 추론 모델을 방금 공개했으며, Deepseek과 Openai는 적어도 Alibaba의 모든 약속이 진실로 밝혀지면 걱정할 것이있을 것 같습니다. 오픈 소스이므로 확인했습니다. 의심 할 여지없이, 당신과 이야기하지 않을 것들이 있다는 것을 알 수는 있지만, 당신은 그것을 무료로 시도 할 수 있습니다.
QWQ-32B (Quan-With-Questions)라고 불리는 새로운 모델은 훨씬 적은 매개 변수로 실행되므로 리소스가 적 으면서 알리바바는 DeepSeek 또는 OpenAI의 O1-MINI와 동일한 수준에서 수행한다고 주장합니다.
추천 동영상
DeepSeek의 R1 Large Language Model (LLM)은 2 월 초에 나왔을 때 모든 분노였으며, 갑자기 Chatgpt 및 기타 대안이 설정 한 Golden Standard와 경쟁 할 수 있지만 훨씬 저렴한 비용으로. 알리바바가 봉투를 더욱 밀어 넣을 것 같습니다.
설명했듯이 벤처 비트DeepSeek-R1은 6,710 억 개의 매개 변수를 실행해야하며 그 중 370 억이 활성화됩니다. 한편, Alibaba의 새로운 QWQ-32B는 320 억 개의 매개 변수로 얻을 수 있습니다. 그 숫자는 많은 사람들에게 완전히 추상적이지만 컴퓨팅 전력에는 큰 차이가 있습니다. DeepSeek R1은 1600GB의 VRAM을 요구하지만 QWQ-32B는 24GB의 VRAM으로 얻을 수 있습니다. 대부분의 경우 이것은 NVIDIA의 H100 또는 이와 동등한 것을 의미하지만 게임 중심의 RTX 4090 Sports 24GB조차도 의미합니다. 최신 RTX 5090은 32GB입니다.
Alibaba의 QWQ-32B는 Apache 2.0 라이센스로 제공되므로 회사와 연구원이 사용할 수 있습니다. 더 중요한 것은 우리 알리바바를 시험해 보면 사용할 수 있습니다 Qwen 채팅. Deepseek와 마찬가지로 몇 가지 제한 사항이 있지만 매우 빨리 눈에 띄는 몇 가지 즉각적인 특전도 있습니다.
빠르고 간단한 질문에도 매우 심도있는 답변을 제공하는 것 같습니다. 이것은 좋을 수 있지만, 어떤면에서, 그것은 당신이 요구하지 않은 불필요한 맥락을 많이주기 때문에 대부분 성가신 일이었습니다. 그래도 Chatgpt의 깊은 사고 기능과 비슷하지만 깊이가 훨씬 적은 전체 추론 과정을 보여줍니다.
정치적 문제에 대해 물었을 때 Qwen 채팅은 부적절한 것으로 표시합니다. 결국 Deepseek과 함께 가능했을 수있는 방법이있을 수 있습니다. 그러나 나는 아직 관리하지 못했습니다.
알리바바의 주장이 사실 인 것으로 밝혀 졌는지 여부는 여전히 남아 있지만, Chatgpt와 Deepseek은 이제 새로운 라이벌을 가지고있는 것처럼 보입니다.
우리의 활동을 지원해주세요 ❤️
이 글이 마음에 드셨다면, 앞으로도 좋은 콘텐츠를 계속 발행할 수 있도록 팁을 남겨주세요.






















