Cập nhật: Của chúng tôi Blog trực tiếp sự kiện OpenAI đang hoạt động. Hãy theo dõi tất cả các tin tức và thông báo mới nhất khi chúng diễn ra.
OpenAI đang cùng với Google, Apple và Microsoft tổ chức một sự kiện để quảng cáo một sản phẩm mới và nó được quảng cáo rầm rộ tương tự như bất kỳ sự kiện nào mà nhà sản xuất iPhone tổ chức.
Vậy chúng ta có thể mong đợi điều gì từ sự kiện công bố chính thức đầu tiên của OpenAI? Có lẽ đó không phải là điều bạn mong đợi khi công ty bắt đầu tập trung vào sản phẩm hơn là mẫu mã.
Có tin đồn rằng chúng ta sẽ thấy một số dạng công cụ tìm kiếm mới và có thể là GPT-5, nhưng điều đó sẽ không xảy ra theo Giám đốc điều hành Sam Altman.
Anh ấy nói trên X rằng thông báo này “không phải gpt-5, không phải công cụ tìm kiếm, nhưng chúng tôi đã làm việc chăm chỉ để tạo ra một số nội dung mới mà chúng tôi nghĩ mọi người sẽ yêu thích! đối với tôi nó giống như một phép thuật vậy.”
Tin đồn chủ yếu dựa vào thực tế là chúng ta sẽ có một trợ lý giọng nói và đây không phải là trợ lý giọng nói như Siri hay Alexa, nó sẽ gần giống với Samantha trong bộ phim “Her” hơn – một kết thúc thực sự -kết thúc cuộc trò chuyện AI.
Chúng ta có thể mong đợi gì từ sự kiện OpenAI?

Tôi đồng ý với tin đồn rằng trợ lý giọng nói theo một số mô tả có thể sẽ là thông báo quan trọng nhất tại sự kiện OpenAI.
Tuy nhiên, việc tạo ra một trợ lý giọng nói thực sự sẽ liên quan đến một số mô hình được nâng cấp đáng kể, bao gồm cải thiện khả năng nhận dạng giọng nói và phân tích giọng nói. Điều này có thể có nghĩa là một phiên bản mới của mô hình sao chép Whispering vốn đã mạnh mẽ của OpenAI.
Chúng tôi cũng có thể có được hành vi giống như đặc vụ đối với trợ lý mới. Đây là nơi AI có thể tự mình thực hiện các hành động thay mặt bạn trên mạng mở rộng hơn.
Những mô hình thay thế và đại lý tiềm năng này có thể tìm đường vào ChatGPT Plus, gói cao cấp dành cho sản phẩm chủ lực của OpenAI.
Nếu chúng tôi nhận được một bản nâng cấp lớn cho ChatGPT Plus, điều đó có thể có nghĩa là một bản nâng cấp cho phiên bản miễn phí, cuối cùng sẽ mang đến GPT-4 và DALL-E.
Một thỏa thuận với Apple?

Một trong những thông báo đáng chú ý nhất từ sự kiện hôm nay là thỏa thuận với Apple trao cho nhà sản xuất iPhone quyền sử dụng công nghệ của OpenAI trong các sản phẩm của chính họ. Một thỏa thuận như vậy đã được gợi ý bởi Mark Gurman của Bloomberg và có lẽ sẽ là nền tảng cho Siri 2.0. Trên thực tế, trợ lý giọng nói của Apple có thể là ChatGPT được đổi tên thương hiệu – giống như Microsoft đã làm với Windows Copilot.
Vì WWDC của Apple chỉ còn một tháng nữa là diễn ra nên có thể mọi thỏa thuận như vậy sẽ được giữ nguyên cho đến lúc đó. Nhưng nếu một thỏa thuận như vậy đang được thực hiện, có lẽ sự kiện ngày hôm nay sẽ cho chúng ta một đoạn giới thiệu rất nhỏ.
Trợ lý giọng nói kỳ diệu này sẽ có hình dạng gì?

Trong bộ phim “Her”, nhân vật AI Samantha được thiết kế để thích nghi và phát triển thông qua tương tác với con người. Theo thời gian, Samantha phát triển khả năng tự nhận thức, chiều sâu cảm xúc và khả năng hình thành những kết nối có ý nghĩa.
Chúng tôi đã thấy những dấu hiệu cho thấy OpenAI đang nghiêng về hướng đó. ChatGPT giờ đây có thể ghi nhớ nội dung bạn đã nhập và sử dụng nội dung đó trong các cuộc trò chuyện trong tương lai. Đồng thời, nếu bạn đã từng tương tác với tác nhân giọng nói trong ứng dụng ChatGPT thì ứng dụng này sẽ bao gồm các khoảng dừng và chuyển giọng giống con người, khiến cho âm thanh trở nên giàu cảm xúc hơn.
Tôi không nghĩ một phút nào, chúng ta sẽ thấy bất cứ thứ gì có quy mô như Samantha. Tuy nhiên, nếu OpenAI đã tạo ra một AI giọng nói toàn diện được cải tiến, có thể thay mặt bạn hành động và được tích hợp vào thiết bị khác – thì đó sẽ là một khoảnh khắc “kỳ diệu”.
Thay đổi lớn nhất sẽ là chuyển sang tính năng chuyển lời nói thành giọng nói. Hiện tại ChatGPT Voice chuyển đổi lời nói của bạn thành văn bản, sau đó lấy văn bản đó, gửi đến mô hình AI, lấy lại văn bản và chuyển văn bản đó thành lời nói. Điều này tạo ra độ trễ không tốt cho cuộc trò chuyện.
Không giống như Siri hay thậm chí là Gemini nơi bạn tương tác bằng cách đặt câu hỏi và chờ đợi, hy vọng câu hỏi đó đã được đào tạo hoặc lập trình để có câu trả lời, với trợ lý giọng nói thực sự mới, bạn sẽ có một cuộc trò chuyện tự nhiên, giống con người.
Còn các đại lý thì sao?

Đại lý là xu hướng lớn tiếp theo của trí tuệ nhân tạo. Chúng là những mô hình AI mini được điều khiển bởi mô hình chính như GPT-4 nhưng có khả năng tự xử lý các tác vụ.
Ví dụ: bạn có thể nói với ChatGPT “hôm nay là sinh nhật của vợ tôi và tôi đã quên” và nó có thể tắt, hãy tìm một món quà từ những gì bạn đã nói về cô ấy trước đây, đặt quà và sắp xếp giao hàng cùng với việc nhắn tin cho vợ bạn.
Bạn có thể thấy một ví dụ về “nhóm” tác nhân này trong nền tảng nhà phát triển AI Devin, nơi bạn yêu cầu nó phải làm gì và nó sẽ tắt và thực hiện tất cả các hành động cần thiết để đạt được mục tiêu từ duyệt web đến tải xuống hình ảnh.
Chúng ta có thể thấy gì nữa?

Chúng tôi có thể nhận được nhiều video Sora hơn và thông tin về thời điểm nó sẽ ra mắt công chúng. Chúng ta cũng có thể có ý tưởng đầu tiên về việc giải pháp thay thế Voice Engine ElevenLabs thực sự hoạt động tốt như thế nào.
Trọng tâm sẽ là các sản phẩm hơn là các mô hình cơ bản. Chúng ta đang bước vào kỷ nguyên thương mại của AI, nơi những mô hình ấn tượng đó phải kiếm tiền để tồn tại.
Điều đó không có nghĩa là chúng ta sẽ không thấy các mô hình mới. Altman đã nói rằng GPT-5 sẽ là một cải tiến đáng kể so với GPT-4 và anh ấy sẽ bỏ ra số tiền lớn để phát triển một AI siêu thông minh.
Sự kiện này giống như Phòng thí nghiệm AI bước vào lĩnh vực thương mại và nói với thế giới – chúng tôi coi trọng bộ phận sản phẩm của mình cũng như nghiên cứu của mình.
- OpenAI phát hành sách quy tắc ChatGPT – điều này có ý nghĩa gì đối với người dùng
- Google I/O 2024: Pixel 8a đã được công bố, trọng tâm chuyển sang AI
- AI có thể giúp chúng ta sống lâu hơn và khỏe mạnh hơn – và tất cả đều phụ thuộc vào dữ liệu