Bạn có thể muốn ngồi xuống trước khi đọc phần này, có thể bạn cũng có thể yêu cầu ChatGPT đưa cho bạn một cốc nước khi bạn đang đọc.
Một công ty khởi nghiệp AI tương đối mới vừa đưa trí tuệ nhân tạo của OpenAI vào cơ thể của một con robot và kết quả gần giống như những gì bạn mong đợi (trừ sự hỗn loạn và hủy diệt nếu bạn giống như một cốc nước vơi một nửa). của người).
Công nghệ mới này đang được phát triển bởi Nhân vật, một công ty chế tạo robot AI trị giá 2,6 tỷ USD hợp tác với OpenAI. Cải tiến mới nhất của nó là Hình 01, một robot mà công ty đã giới thiệu trong một video ấn tượng.
Hình ảnh và lời nói được ngữ cảnh hóa
Chỉ đánh giá bằng kỹ năng diễn xuất thì thật khó để biết ai là con người thật, nhưng chúng tôi cho rằng Hình 01 là nhân vật có vẻ ngoài sáng bóng đang thực hiện tất cả công việc.
Lời nhắc bằng văn bản đã trở thành quá khứ vì Hình 01 có khả năng trò chuyện bằng giọng nói theo thời gian thực với bạn – và nó nghe giống hệt như các cuộc trò chuyện với tùy chọn OpenAI ChatGPT Voice trong ứng dụng.
Hình ảnh được chụp từ camera trên tàu để cung cấp cho robot bối cảnh trực quan để khi người đối diện đề cập rằng anh ta đang đói, Hình 01 sẽ xác định một quả táo trong tầm tay và đưa nó cho robot. Chúng ta bắt đầu từ “Tôi có thể ăn gì không?” đến Apple được chuyển giao thành công đến tay con người trong khoảng 10 giây.
Tổ chức một cuộc trò chuyện phức tạp
Giống như các cuộc thảo luận của chúng tôi với ChatGPT, Hình 01 có thể xử lý các cuộc hội thoại phức tạp không kém. Nó có thể mô tả những gì nó nhìn thấy, lên kế hoạch cho các hành động trong tương lai, suy ngẫm về trí nhớ và giải thích lý do bằng lời nói.
Vì Hình 01 có thể đưa mọi thứ vào bối cảnh nên có lẽ chúng ta nên hỏi nó nên chuẩn bị cho loại tình huống nào. Nếu chúng ta đang sử dụng trái cấm hoặc nếu chúng ta đang ở trên đỉnh của một kỷ nguyên khoa học và công nghệ mới.
Ở hậu trường, camera của robot đang ghi lại những hình ảnh sau đó được bối cảnh hóa. Micrô đang thu giọng nói, sau đó được chuyển thành văn bản và đưa vào một mô hình đa phương thức lớn được OpenAI huấn luyện có khả năng hiểu cả hình ảnh và văn bản.
Vì vậy, khi Hình 01 được hỏi tại sao lại đưa quả táo, nó nhanh chóng trả lời: “Tôi đưa cho bạn quả táo vì đó là món ăn được duy nhất mà tôi có thể cung cấp cho bạn trên bàn ăn.”
Con người đã có một lịch sử thú vị với táo. Họ đã gây ra khá nhiều rắc rối trong Vườn Địa Đàng nhưng sau đó họ đã truyền cảm hứng cho Isaac Newton phát triển lý thuyết hấp dẫn của mình.
Vì Hình 01 có thể đưa mọi thứ vào bối cảnh nên có lẽ chúng ta nên hỏi nó nên chuẩn bị cho loại tình huống nào. Nếu chúng ta đang sử dụng trái cấm hoặc nếu chúng ta đang ở trên đỉnh của một kỷ nguyên khoa học và công nghệ mới.
- OpenAI sắp cung cấp cho robot bộ não để nâng cao ‘nhận thức, lý luận và tương tác của robot’
- LG công bố robot AI mới cho CES 2024 có thể giám sát ngôi nhà thông minh của bạn, theo dõi thú cưng của bạn và thậm chí cải thiện tâm trạng của bạn
- DeepMind của Google đang sử dụng AI để dạy robot làm việc nhà – đây là kết quả