Gemini và Bard: một sự kết hợp đã thành công

Bard hiện là Gemini, nhưng mạnh mẽ hơn, có nhiều tính năng và chức năng mới nhằm mục đích tạo điều kiện thuận lợi và tối ưu hóa nhiều tác vụ khác nhau.

Quảng cáo


Mỗi ngày, chúng ta lại bắt gặp ngày càng nhiều công cụ AI có khả năng cách mạng hóa thị trường và cuộc sống của chúng ta.

Thật đáng sợ khi nghĩ đến những gì chúng có thể làm.

Ví dụ, Trò chuyệnGPT, được phát triển bởi Open AI và phát hành ra công chúng vào tháng 11 năm 2022, là một ví dụ về trí tuệ nhân tạo có khả năng tạo ra nhiều dạng nội dung khác nhau chỉ trong vài giây và cung cấp thông tin về mọi chủ đề.

Công cụ này nhanh chóng trở nên phổ biến, buộc các công ty công nghệ lớn khác phải tạo ra các AI cạnh tranh. 

quảng cáo

Và tất nhiên, Google hùng mạnh không thể bị bỏ lại phía sau. Vào tháng 12 năm 2023, công ty công nghệ lớn đã ra mắt Song Tử, một công cụ đa phương thức hoạt động với văn bản, mã, hình ảnh và video cùng lúc.

Nhưng xét cho cùng, Song Tử là gì và nó hoạt động như thế nào?

Tính năng chính của nó là có thể làm việc với nhiều loại nội dung khác nhau, ngoài ra còn có thể diễn giải các ngôn ngữ lập trình chính được sử dụng trên thế giới và hiểu các ngôn ngữ khác nhau. 

Bạn đã bao giờ nghĩ đến việc tích hợp văn bản, video và hình ảnh chỉ bằng một lệnh chưa? Thật tuyệt vời phải không?

Ngay từ đầu, nó đã được thiết kế để có thể kết hợp các định dạng thông tin khác nhau này và có thể xử lý các phản hồi rộng hơn và đầy đủ hơn.

Cho đến nay, các AI hiện có đều thực hiện tất cả các nhiệm vụ này một cách riêng biệt. Cần một công cụ cho văn bản, một công cụ khác cho tạo hình ảnh, một công cụ khác cho video, v.v.

Nhưng Gemini đã xuất hiện và kết hợp tất cả lại thành một. Sức mạnh kết hợp tất cả dữ liệu này và tạo ra những kết quả đáng kinh ngạc chính là điểm khác biệt lớn nhất của nó. 

Trong phiên bản đầu tiên, Gemini 1.0, nó có ba chế độ. Đó là:

  • Gemini Ultra;
  • Gemini Pro;
  • Nano Song Tử.

Sự khác biệt giữa chúng thay đổi tùy theo mức độ khó của các hoạt động mà mỗi người có thể thực hiện.

Ví dụ, phiên bản Ultra được khuyến nghị cho các chuyên gia làm việc trong lĩnh vực phát triển phần mềm và những người thực hiện công việc phức tạp hơn.

Nhưng dù sao đi nữa, đây là công cụ có thể hoạt động trong mọi thứ, từ trung tâm dữ liệu đến điện thoại di động.

+ Khám phá cách cải thiện ảnh của bạn bằng trí tuệ nhân tạo

Và Bard đóng vai trò gì trong câu chuyện này?

Thi nhân là một chatbot cũng được Google tạo ra để trở thành đối thủ cạnh tranh trực tiếp của Trò chuyệnGPT. Đây là một robot có thể giao tiếp thông qua trí tuệ nhân tạo.

Nói cách khác, nó tạo ra và phát triển nội dung mới bằng cách vận dụng các kỹ thuật học máy và mạng nơ-ron. Nói cách khác, nó là bộ não con người được vận hành bởi hệ thống máy tính. 

Tuy có chức năng tương tự nhau nhưng chúng không giống nhau. ChatGPT chỉ giới hạn cung cấp thông tin và sự kiện đến năm 2021, trong khi Thi nhân Mọi thứ đều diễn ra theo thời gian thực (truy cập trực tiếp vào Google).

Điểm cho Thi nhân!

Trò chuyệnGPT Bard cung cấp kết quả chính xác như được viết trong lệnh. Bard thực tế trò chuyện với bạn như thể nó là một con người và hiểu được nhiều chủ đề phức tạp hơn.

Thêm một điểm nữa cho anh ấy!

Ngôn ngữ hoạt động cũng khác nhau. Thi nhân sử dụng mô hình ngôn ngữ gọi là LLM, trong tiếng Anh là từ viết tắt của “large language models”.

Và theo Google, đây là phiên bản nhẹ và được tối ưu hóa của LaMDA, Mô hình ngôn ngữ cho ứng dụng và hộp thoại (LaMDA).

Đã là Trò chuyệnGPT dựa trên việc lập trình 175 tỷ tham số để giao tiếp.

Bard cũng có nút tìm kiếm và bạn thậm chí có thể biến kết quả nội dung thành liên kết để chia sẻ với bất kỳ ai bạn muốn.

Và anh ấy còn thông thạo nhiều ngôn ngữ nữa. Anh ấy có thể dịch được 40 ngôn ngữ!  

Cả hai đều có thanh bên để lưu và đặt tên cho cuộc trò chuyện.

Nhưng Thi nhân vẫn còn một con át chủ bài: câu trả lời của bạn có một nút truy cập trực tiếp vào tìm kiếm của Google về chủ đề bạn đang tìm kiếm và thậm chí có thể đọc to. 

 Thay đổi tầm nhìn: BARD hiện là Song Tử

Cho đến cuối năm ngoái, chatbot của Google có thể được truy cập thông qua trang web bard.google.com, thông qua trình duyệt máy tính hoặc điện thoại di động.

Nhưng giống như trong thế giới công nghệ, các bước đi được thực hiện và những thay đổi diễn ra chỉ sau một đêm, Google đã thông báo vào ngày 8 tháng 2 rằng Thi nhân bây giờ nó được gọi là Song Tử, kết hợp giao diện và mô hình AI trong một địa chỉ duy nhất, giúp công cụ được cải tiến hơn nữa.

Vậy nên giờ đây, cả hai công nghệ đều giống nhau. Theo chính Google, việc sáp nhập này nhằm mục đích cho người dùng biết họ đang sử dụng mô hình ngôn ngữ tiên tiến nhất của gã khổng lồ công nghệ này.

Sissie Hsiao, phó chủ tịch của Google, coi sự hợp nhất này là một trong những điều quan trọng nhất trong lịch sử công ty.

Ngoài tin tuyệt vời này, còn có thông báo rằng phiên bản mới này đã được cập nhật đầy đủ và có nhiều cải tiến, nhưng hiện tại phiên bản này chỉ có tại Hoa Kỳ. 

Kiểm tra những thay đổi chính

Địa chỉ mới của Bard:

Như chúng tôi đã nói trước đó, giao diện trợ lý ảo và mô hình AI là giống nhau và có thể được truy cập trong gemini.google.com

Phiên bản Android và iPhone:

Ngoài phiên bản web, Gemini cũng có thể được truy cập trên các thiết bị Android và iPhone, nhưng hiện tại chỉ có ở Hoa Kỳ và sẽ sớm có mặt ở các quốc gia khác.

Bất kỳ ai sở hữu điện thoại di động chạy hệ điều hành Android cũng có thể tin tưởng vào RAM 4GB và hệ điều hành Android 12. 

Gemini nâng cao:

Với R$96,99 mỗi tháng, bạn có thể truy cập phiên bản trả phí của AI thông qua Google Open AI Premium.

Không giống như phiên bản đơn giản hơn của gói miễn phí, gói Nâng cao thực hiện các tác vụ khó hơn nhiều, chẳng hạn như các cuộc trò chuyện dài và chi tiết, và hỗ trợ các tác vụ phức tạp, chẳng hạn như lập trình, suy luận logic và các dự án sáng tạo.

Hiện tại, ứng dụng chỉ có phiên bản tiếng Anh, nhưng có thể truy cập được ở 150 quốc gia, bao gồm cả Brazil. Ứng dụng cung cấp bản dùng thử miễn phí hai tháng và dung lượng lưu trữ lên đến 2 TB. 

Google Assistant và Gemini kết hợp:

Google Assistant đã tham gia xu hướng này và cũng sẽ tích hợp với Gemini.

Ý tưởng là công cụ này sẽ được hỗ trợ bởi Gemini, giúp nó hiệu quả hơn, đảm bảo kết quả đầy đủ và rõ ràng hơn. 

Các thiết bị Android có thể có Gemini là trợ lý ảo mặc định.

Người dùng có thể kích hoạt bằng cách nói "Ok, Google" hoặc nhấn và giữ phím "Home". Trên iPhone (iOS), mô hình này sẽ được tích hợp vào ứng dụng Google, có nút để bắt đầu trò chuyện với trí tuệ nhân tạo.

Ngay cả bạn, Duet:

Trợ lý ảo Duet AI, được tích hợp với các công cụ Google Cloud và Google Workspace, cũng Song Tửvà sẽ mang lại tất cả lợi ích của AI cho Gmail và Google Docs.

Với sự tích hợp này, Google muốn cạnh tranh trực tiếp với Microsoft Copilot.

Gã khổng lồ công nghệ này đặt mục tiêu tăng năng suất của các công ty và cung cấp khả năng bảo vệ chống lại các cuộc tấn công mạng.

Song Tử, một kỷ nguyên mới bắt đầu

Theo CEO Google Sundar Pichai, “Vào tháng 12, chúng tôi đã có bước tiến đáng kể trong hành trình giúp AI trở nên hữu ích hơn cho mọi người với sự khởi đầu của kỷ nguyên Gemini, thiết lập một chuẩn mực mới cho nhiều tiêu chuẩn về văn bản, hình ảnh, âm thanh và video.

Tuy nhiên, Gemini đang phát triển để trở thành một hệ sinh thái toàn diện hơn, không chỉ là một tập hợp các mô hình. Nó hỗ trợ toàn bộ hệ sinh thái - từ các sản phẩm mà hàng tỷ người sử dụng hàng ngày đến các API và nền tảng giúp các nhà phát triển và tổ chức đổi mới.

Với tất cả những sự kết hợp này, hầu như mọi thứ giờ đây đều mang tên Gemini, khiến tất cả những "lễ rửa tội" mới này trở thành một canh bạc lớn cho Google. Một canh bạc mà Google đã thắng.  

Nguồn: Google Blog. Bài viết của Mauro Ruffulo. Biên tập bởi Nara Sampaio.

Xu hướng