Sau thời điểm ChatGPT năm 2022, đỉnh cao tiếp theo đến vào đầu năm 2025 với DeepSeek. Công ty tương đối xa lạ đến từ Trung Quốc này đã tham gia vào cuộc đua AI và thách thức nhiều đối thủ đã thành danh. Nếu bạn vẫn đang thắc mắc DeepSeek AI là gì và nó làm gì, thì chúng tôi đã tổng hợp tất cả thông tin ở một nơi. Với lưu ý đó, chúng ta hãy tiếp tục tìm hiểu chi tiết về DeepSeek AI.
DeepSeek AI là gì?
DeepSeek AI là một chatbot AI tương tự như ChatGPT và được phát triển bởi một công ty Trung Quốc có trụ sở chính tại Hàng Châu. Nó được đăng ký chính thức với tên gọi Công ty TNHH Nghiên cứu Công nghệ Cơ bản Trí tuệ Nhân tạo DeepSeek Hàng Châu và thuộc sở hữu của quỹ phòng hộ High-Flyer của Trung Quốc. DeepSeek được thành lập vào tháng 7 năm 2023 bởi Liang Wenfeng, CEO và đồng sáng lập của cả High-Flyer và DeepSeek.
Hãy coi DeepSeek AI như một đối thủ đang lên của các phòng thí nghiệm AI phương Tây như OpenAI và Anthropic. Là một startup trẻ nhưng chỉ trong vòng 2 năm, nó đã khiến cả thế giới phải ngạc nhiên với những mô hình AI mạnh mẽ. DeepSeek AI trở nên nổi tiếng khi ra mắt mô hình lý luận R1 vào tháng 1 năm 2025, gần bằng hiệu suất o1 của OpenAI và vượt qua ChatGPT để chiếm vị trí đầu bảng trên App Store Hoa Kỳ.

Điều khiến DeepSeek trở nên hấp dẫn hơn nữa là nó được cho là đã đào tạo mô hình R1 với chi phí chỉ 6 triệu USD, thấp hơn đáng kể so với mức ước tính 100 triệu USD cần thiết để đào tạo các mô hình AI phương Tây có quy mô tương tự. Điều này khiến giá cổ phiếu của Nvidia giảm 18%. Không chỉ vậy, DeepSeek còn cung cấp công khai trọng số mô hình nhằm thúc đẩy phát triển AI nguồn mở.
Ngoài ra, DeepSeek đã phát hành một tài liệu kỹ thuật chi tiết và chia sẻ công khai phương pháp đào tạo sau dựa trên RL để đào tạo các mô hình suy luận. Trong khi OpenAI và các phòng thí nghiệm AI phương Tây khác bảo vệ chặt chẽ các phương pháp dựa trên RL của họ để đào tạo các mô hình lý luận, DeepSeek, một công ty khởi nghiệp AI trẻ đến từ Trung Quốc đã tham gia cuộc đua AI khá muộn và đã chứng minh cho thế giới rằng các mô hình lý luận mạnh mẽ có thể được đào tạo với chi phí thấp hơn nhiều.
Vào thời điểm phát hành, OpenAI yêu cầu người dùng trả 20 USD để truy cập mô hình lý luận o1 của nó. Tuy nhiên, DeepSeek R1 được phát hành miễn phí và điều đó gây áp lực cho những người chơi AI bao gồm OpenAI phải cung cấp miễn phí các mô hình AI tiên tiến của họ cho người dùng. Theo một cách nào đó, DeepSeek của Trung Quốc đã phá vỡ sự độc quyền của phương Tây về AI và giúp người dùng trên toàn thế giới dễ tiếp cận nó hơn.
Các mô hình AI do DeepSeek phát hành
Vào năm 2023, DeepSeek phát hành mô hình AI đầu tiên có tên DeepSeek Coder cho các tác vụ mã hóa. Ngoài ra, nó cũng phát hành các mô hình DeepSeek LLM và DeepSeek-Math. Chỉ sau sáu tháng, công ty đã công bố các mẫu AI DeepSeek-V2 và DeepSeek-Coder V2 lớn hơn nhiều.
Sau đó, DeepSeek-V2.5 được phát hành vào tháng 9. Mô hình AI lý luận đầu tiên, DeepSeek-R1-Lite được phát hành vào tháng 11 và vào tháng 12, chúng tôi có mô hình cơ sở DeepSeek-V3. Giờ đây, vào tháng 1 năm 2025, mô hình lý luận DeepSeek-R1 có khả năng đã được phát hành cùng với ứng dụng DeepSeek cho cả Android và iOS.
Vào năm 2025, công ty tiếp tục cập nhật các mẫu DeepSeek-V3 và DeepSeek-R1. Hiện tại, DeepSeek-R1-0528 và DeepSeek-V3.2 là phiên bản mới nhất được phát hành vào tháng 9. Dự kiến DeepSeek có thể phát hành một mô hình AI lớn trong những tháng tới.
Làm cách nào để sử dụng DeepSeek AI?
Bạn có thể sử dụng DeepSeek AI miễn phí qua chat.deepseek.com hoặc bạn có thể cài đặt ứng dụng di động DeepSeek (Android / iOS). Ngoài ra, bạn có thể chạy DeepSeek R1 cục bộ trên PC hoặc thiết bị di động của mình. Điều đó có nghĩa là bạn chỉ có thể tải xuống và chạy các phiên bản chắt lọc của mẫu lớn hơn trên thiết bị cục bộ của mình.

Điều gì đang xảy ra với DeepSeek bây giờ?
Trong khi DeepSeek nhanh chóng tung ra các mô hình AI có tính cạnh tranh thì trong những tháng gần đây, công ty vẫn chưa thực hiện bất kỳ đợt ra mắt lớn nào. Nguyên nhân là do chính phủ Trung Quốc kêu gọi DeepSeek sử dụng chip AI nội địa như Huawei Ascend cho mẫu AI tiếp theo của mình.
các Thời báo tài chính báo cáo rằng chính quyền Trung Quốc đã yêu cầu DeepSeek sử dụng chip Ascend của Huawei để đào tạo mẫu R2. Kết quả là mẫu xe mới đã bị trì hoãn. Các báo cáo mới cho thấy nhóm DeepSeek đã cố gắng sử dụng chip Ascend nhưng đã chuyển trở lại GPU Nvidia để đào tạo do hạn chế về mặt kỹ thuật.
Được biết, DeepSeek chỉ sử dụng chip Ascend để suy luận. Như đã nói, DeepSeek là một công ty AI lớn đến từ Trung Quốc, cùng với Alibaba, và chúng ta nên theo dõi tiến trình của nó.