Trang chủ Kinh tế Công nghệ
11:01 | 28/12/2023 GMT+7

“ChatGPT phiên bản Việt” và câu chuyện của người tiên phong

aa
Chỉ 9 tháng sau khi ChatGPT ra mắt, đội ngũ kỹ sư VinBigdata (Tập đoàn Vingroup) đã làm chủ hoàn toàn mô hình ngôn ngữ lớn tiếng Việt và chính thức giới thiệu ViGPT - ChatGPT phiên bản Việt đầu tiên dành cho người dùng cuối vào tháng 12/2023. Sản phẩm nhanh chóng gây được tiếng vang trong cộng đồng khoa học công nghệ Việt Nam.
VinBigdata phát triển thành công công nghệ AI tạo sinh
VinBigdata ra mắt “ChatGPT" phiên bản Việt đầu tiên dành cho người dùng cuối

Chọn con đường khó để giải bài toán Việt

Vào cuối năm 2022, ChatGPT tạo nên một “cú nổ lớn”, mở ra cuộc đua chinh phục AI tạo sinh giữa các các quốc gia và ông lớn trong lĩnh vực công nghệ. Giới công nghệ Việt khi ấy cũng sục sôi mong muốn phát triển những sản phẩm của riêng người Việt để tự chủ về công nghệ, giảm thiểu sự phụ thuộc vào các sản phẩm quốc tế. Tuy nhiên, không phải đơn vị nào cũng đủ khả năng và quyết tâm hiện thực hóa mong muốn ấy như VinBigdata.

“AI tạo sinh là một bài toán khó. Các ông lớn như OpenAI hay Google cũng phải đổ rất nhiều nguồn lực và thời gian vào nghiên cứu mới có thể tạo ra những sản phẩm như chúng ta thấy. Các sản phẩm này đã rất tốt, nhưng thật ra các nhà khoa học cũng vẫn chưa hoàn toàn hiểu cơ cấu hoạt động của nó. Khi nào nó có lỗi, và lỗi sẽ như thế nào ít ai đoán trước được. Để phát triển một sản phẩm tương tự ChatGPT dành cho người Việt, trong thời gian ngắn chưa tới một năm, thì rất nhiều thử thách. Nhưng chúng tôi đã lựa chọn "liều" vì một phiên bản ChatGPT tiếng Việt nếu không phải người Việt làm thì ai làm- GS. Vũ Hà Văn, Giám đốc khoa học VinBigdata chia sẻ.

“ChatGPT phiên bản Việt” và câu chuyện của người tiên phong
GS. Vũ Hà Văn, Giám đốc khoa học VinBigdata.

Thực tế, rất ít công ty lựa chọn xây dựng Mô hình ngôn ngữ lớn của riêng mình từ đầu. Như GPT 3 của OpenAI có 175 tỷ tham số và được đào tạo trên bộ dữ liệu 45 terabyte và tiêu tốn 4,6 triệu USD. Thậm chí, theo tính toán, số tiền để phát triển GPT 4 có thể lên tới 100 triệu USD. “Với những con số khổng lồ như thế, rất khó để tìm được một công ty nào đủ sức đầu tư cho công nghệ này”, TS. Nguyễn Kim Anh, Giám đốc Sản phẩm VinBigdata nói.

Để các doanh nghiệp Việt Nam có thể tiếp cận với công nghệ AI thế hệ mới, với chi phí và hạ tầng tối ưu, VinBigdata lựa chọn một hướng đi hoàn toàn khác biệt, đó là tạo ra một mô hình ngôn ngữ chỉ với 1,6 tỷ tham số, nhưng có khả năng tương đương với những mô hình ngôn ngữ lớn có nhiều tỷ tham số.“Kết quả cho thấy, với kiến trúc do chính VinBigdata tự phát triển hoàn toàn có thể tối ưu và đẩy nhanh quá trình huấn luyện mô hình ngôn ngữ, giảm chi phí hạ tầng (bao gồm chi phí huấn luyện và chi phí sử dụng), nhưng vẫn đảm bảo chất lượng của mô hình”, TS. Nguyễn Kim Anh cho biết thêm.

“ChatGPT phiên bản Việt” và câu chuyện của người tiên phong
“ChatGPT phiên bản Việt” và câu chuyện của người tiên phong

Sau khi giải quyết bài toán về kích thước mô hình ngôn ngữ lớn, trong quá trình “thai nghén” ViGPT, sau khi nghiên cứu các mô hình của nước ngoài, đội ngũ VinBigdata còn nhận ra một thử thách khác là “tính ảo giác”, đến từ bản chất cố hữu của mô hình xác suất thống kê.

Theo đó, các mô hình ngôn ngữ lớn trên thế giới thường được huấn luyện bằng các nguồn dữ liệu tiếng Anh. Do đó, mô hình này chưa thực sự hiểu và phản ứng đúng với ngữ cảnh và văn hóa của người Việt. Điều này dẫn đến tình trạng ảo giác (hallucination) khiến mô hình ngôn ngữ lớn “bịa đặt” ra câu trả lời không chính xác.

Để tìm ra lời giải tối ưu trong thời gian ngắn nhất, đội ngũ Xử lý ngôn ngữ tự nhiên (NLP) của VinBigdata được chia thành các nhóm nhỏ, cùng phân tích, bàn bạc các ý tưởng khác nhau để tìm hướng đi cuối cùng phù hợp nhất.

Sau cùng, chúng tôi quyết định phát triển kiến trúc khác so với phần lớn mô hình ngôn ngữ lớn hiện tại, đồng thời tiến hành đào tạo trên bộ 600GB dữ liệu tiếng Việt tinh chỉnh, nhằm tạo ra một “trợ lý ảo thông minh” có khả năng hiểu và đưa ra câu trả lời theo ngữ cảnh của người Việt”, TS. Nguyễn Kim Anh nói thêm.

Khát vọng một hệ sinh thái công nghệ Việt

Theo kết quả đánh giá từ Bộ Tiêu chuẩn đánh giá năng lực tiếng Việt (VMLU) ViGPT đạt điểm trung bình là 42.24%, đứng thứ hai chỉ sau ChatGPT (48.54%). Kết quả này cho phép ViGPT tìm kiếm thông tin, giải đáp câu hỏi về các chủ đề đặc trưng, đặc thù của Việt Nam một cách nhanh chóng.

“ChatGPT phiên bản Việt” và câu chuyện của người tiên phong
“ChatGPT phiên bản Việt” và câu chuyện của người tiên phong

Bên cạnh năng lực của trợ lý ảo, điều đội ngũ phát triển mong muốn là tích hợp ViGPT vào các sản phẩm gần gũi, sử dụng hàng ngày, nhằm tạo ra sự thay đổi trong cuộc sống của người Việt. Đó chính là động lực thôi thúc đội ngũ VinBigdata xây dựng một hệ sinh thái các sản phẩm ngôn ngữ và tiếng nói ứng dụng ViGPT - Hệ sinh thái “Vi” bao gồm: ViChat, ViVoice, Trợ lý ảo ViVi. Các sản phẩm này có thể sử dụng cho đa ngành nghề, từ công nghiệp ô tô, ngân hàng - tài chính, bảo hiểm đến giao thông vận tải và nhiều lĩnh vực khác.

“Khi làm công nghệ, nhất là AI, chúng tôi không chỉ muốn chinh phục những hệ thống hay, phức tạp mà khó nhìn thấy. Chúng tôi muốn tạo ra những sản phẩm hữu hình, có tính ứng dụng cao, mà ở đó, AI là tác nhân trực tiếp tạo ra những thay đổi trong cuộc sống”, Giám đốc Sản phẩm VinBigdata khẳng định.

Do đó, phát triển thành công ViGPT mới chỉ là bước đầu tiên trong hành trình đưa công nghệ và dữ liệu “thuần Việt” phục vụ cuộc sống của hàng triệu người dân Việt Nam. Đại diện VinBigdata cho biết, đơn vị này đặt mục tiêu tích hợp ViGPT vào nền tảng trí tuệ nhân tạo đa nhận thức VinBase 2.0, nhằm cung cấp các giải pháp vượt trội cho hệ thống tổ chức, doanh nghiệp ở đa dạng quy mô, ngành nghề.

Trước ViGPT, đội ngũ chuyên gia, kỹ sư trong lĩnh vực công nghệ xử lý ngôn ngữ và tiếng nói VinBigdata đã ghi dấu ấn với việc cho ra mắt ViVi - trợ lý ảo tiếng Việt toàn diện đầu tiên (được ứng dụng và triển khai trên các dòng ô tô điện VinFast, ứng dụng cư dân Vinhomes Resident và sàn thương mại điện tử Vinhomes Online), đồng thời, làm chủ hoàn toàn những công nghệ tiên tiến nhất trên thế giới như Sinh trắc học giọng nói (Voice Biometrics) hay Nhân bản giọng nói (Voice Cloning).

Tất cả những công nghệ này đều được phát triển dựa trên cơ sở dữ liệu 3.500 terabyte, tập trung chủ yếu vào dữ liệu đặc thù của người Việt, do VinBigdata thu thập, phân tích và tinh chỉnh. Mục tiêu sau cùng là làm sao mang công nghệ thế giới, chạm tới cuộc sống Việt, bằng chính dữ liệu và hệ tri thức của người Việt.

ViGPT là “ChatGPT phiên bản Việt" đầu tiên dành cho người dùng cuối được xây dựng dựa trên mô hình ngôn ngữ lớn tiếng Việt (LLM) do VinBigdata phát triển. ViGPT sở hữu những tính năng vượt trội và thiết kế phù hợp nhất với nhu cầu sử dụng của người Việt như sáng tạo nội dung, tìm kiếm thông tin, giải đáp các câu hỏi thường thức mang đặc trưng của Việt Nam. Đăng ký và trải nghiệm ViGPT tại: vigpt.vinbigdata.com
Vinbigdata công bố kết quả cuộc thi toàn cầu về ứng dụng ai trong phân tích hình ảnh y tế trị giá 50.000 usd Vinbigdata công bố kết quả cuộc thi toàn cầu về ứng dụng ai trong phân tích hình ảnh y tế trị giá 50.000 usd
Ngày 7/4/2021, Viện Nghiên cứu Dữ liệu lớn VinBigdata (Tập đoàn Vingroup) công bố kết quả của Cuộc thi Ứng dụng AI phát hiện điểm bất thường trên ảnh X-quang lồng ngực với tổng giải thưởng trị giá 50.000 USD. Đây là cuộc thi có quy mô dữ liệu đặc trưng người Việt lớn nhất thế giới, thu hút 1.277 đội thi đến từ hơn 60 quốc gia và vùng lãnh thổ.
Trợ lý ảo ViVi được vinh danh Sản phẩm công nghệ tiềm năng 2022 Trợ lý ảo ViVi được vinh danh Sản phẩm công nghệ tiềm năng 2022
Ngày 7/1/2022, Sản phẩm Trợ lý ảo ViVi của Công ty cổ phần VinBigData (Tập đoàn Vingroup) vừa được vinh danh là Sản phẩm công nghệ tiềm năng 2022 tại Lễ trao giải Tech Awards 2021. ViVi cũng là thương hiệu phần mềm duy nhất được vinh danh tại Hạng mục Sản phẩm công nghệ tiềm năng.
PV
Nguồn:

Tin bài liên quan

Công nghệ xác thực khuôn mặt - “Tấm khiên” chống giả mạo danh tính

Công nghệ xác thực khuôn mặt - “Tấm khiên” chống giả mạo danh tính

Kết hợp phương pháp xác thực dữ liệu sinh trắc khuôn mặt với giải pháp Vizone Access tích hợp công nghệ xác minh thực thể sống (do Công ty VinBigdata phát triển) khi giao dịch trực tuyến, khách hàng sẽ được bảo vệ tối đa trước những phương thức giả mạo danh tính tinh vi và tiết kiệm thời gian thực hiện thao tác.
VinBigdata khẳng định chỗ đứng của AI Việt trên thế giới

VinBigdata khẳng định chỗ đứng của AI Việt trên thế giới

Liên tiếp những thành tựu được đánh giá cao của VinBigdata tại Việt Nam và quốc tế đã cho thấy năng lực của đội ngũ nghiên cứu khoa học cũng như chất lượng công nghệ ở sản phẩm “made in Vietnam”.
Trí tuệ nhân tạo không thể thay thế vai trò nhà báo

Trí tuệ nhân tạo không thể thay thế vai trò nhà báo

Trí tuệ nhân tạo (AI) có thể phân tích, tổng hợp dữ liệu, đưa ra các nhận định, nhưng không thể thay thế vai trò của nhà báo. Giáo sư, Tiến sỹ khoa học Nguyễn Ngọc Thành - Trưởng Bộ môn Tin học Ứng dụng, Đại học Khoa học và Công nghệ Wroclaw (Ba Lan) cho biết như vậy khi trao đổi với phóng viên tạp chí Thời Đại nhân kỷ niệm ngày báo chí cách mạng Việt Nam (21/6).

Các tin bài khác

Lần đầu tiên cuộc thi “Thiết kế cầu thép châu Á 2024” diễn ra tại Việt Nam

Lần đầu tiên cuộc thi “Thiết kế cầu thép châu Á 2024” diễn ra tại Việt Nam

Ngày 27/8, tại thành phố Cần Thơ diễn ra Cuộc thi thiết kế cầu thép châu Á 2024 (Asia Bridge Competition 2024 2024), do Trường Đại học Cần Thơ đăng cai tổ chức. Đây cũng là lần đầu tiên cuộc thi “Thiết kế cầu thép châu Á 2024” diễn ra tại Việt Nam.
Chuyên gia quốc tế cảnh báo về mối đe dọa từ ô nhiễm hữu cơ tại Việt Nam

Chuyên gia quốc tế cảnh báo về mối đe dọa từ ô nhiễm hữu cơ tại Việt Nam

Tình trạng ô nhiễm chất hữu cơ khó phân hủy (POPs) và các chất gây rối loạn nội tiết (EDCs) tại Việt Nam là vấn đề được các chuyên gia hàng đầu về môi trường cảnh báo trong Toạ đàm "Tác động của các chất ô nhiễm hữu cơ đến môi trường và sức khỏe con người: Thách thức và giải pháp".
Sôi động Ngày hội công nghệ thực phẩm nước Ý tại Cần Thơ

Sôi động Ngày hội công nghệ thực phẩm nước Ý tại Cần Thơ

Sáng ngày 23/3, tại Viện Công nghệ Sinh học và Thực phẩm - Trường Đại học Cần Thơ diễn ra “Ngày hội công nghệ thực phẩm nước Ý”, do Tổng lãnh sự quán Ý tại thành phố Hồ Chí Minh phối hợp cùng Công ty TNHH Tim Corp và Trường Đại học Cần Thơ tổ chức, thu hút hàng ngàn sinh viên hứng khởi tham gia.
“Công nghệ thế kỷ” đã làm thay đổi ngành sản xuất thức uống giải khát tại Việt Nam thế nào?

“Công nghệ thế kỷ” đã làm thay đổi ngành sản xuất thức uống giải khát tại Việt Nam thế nào?

GEA Procomac (Đức) là doanh nghiệp đã phát triển ra công nghệ chiết lạnh vô trùng Aseptic, một hệ thống công nghệ được coi là “phát minh của thế kỷ 21”, tạo nền tảng thúc đẩy chuyển đổi từ sản xuất truyền thống sang mô hình sản xuất theo kinh tế tuần hoàn. Tại Việt Nam, đối tác điển hình sử dụng công nghệ này là Tân Hiệp Phát.

Đọc nhiều

Đề xuất đặt tấm bia ghi dấu ấn lịch sử về chuyến thăm của Chủ tịch Hồ Chí Minh tại Cộng hòa Séc

Đề xuất đặt tấm bia ghi dấu ấn lịch sử về chuyến thăm của Chủ tịch Hồ Chí Minh tại Cộng hòa Séc

Hướng tới kỷ niệm 75 năm thiết lập quan hệ ngoại giao Việt Nam - Cộng hòa Séc (1950 - 2025), Đại sứ Dương Hoài Nam đề xuất đặt tấm bia ghi lại dấu ấn lịch sử về chuyến thăm Chrastava của Chủ tịch Hồ Chí Minh và thời gian học tập của các thiếu sinh quân Việt Nam tại thành phố này.
Vùng 3 Hải quân: tạo diễn đàn để cán bộ, chiến sĩ chia sẻ, đóng góp ý kiến xây dựng đơn vị

Vùng 3 Hải quân: tạo diễn đàn để cán bộ, chiến sĩ chia sẻ, đóng góp ý kiến xây dựng đơn vị

Ngày 26/9, tại thành phố Đà Nẵng, Bộ Tư lệnh Vùng 3 Hải quân tổ chức sinh hoạt đối thoại dân chủ quý III năm 2024 cho cán bộ, quân nhân chuyên nghiệp, chiến sĩ trong toàn Lữ đoàn 172. Đại tá Nguyễn Thiên Quân, Ủy viên Đảng ủy Quân chủng Hải quân, Tư lệnh Vùng 3 dự và chủ trì hội nghị.
Trung Quốc quyết định tăng tuổi nghỉ hưu

Trung Quốc quyết định tăng tuổi nghỉ hưu

Tình trạng già hóa dân số tăng nhanh trong khi số lao động trẻ giảm sút khiến Trung Quốc quyết định tăng tuổi nghỉ hưu kể từ đầu năm 2025 sau 75 năm áp dụng hệ thống hưu trí được thiết lập từ những năm 1950.
3 trường Đại học, Cao đẳng của Đà Nẵng hợp tác trao đổi nguồn nhân lực với thành phố Kisarazu (Nhật Bản)

3 trường Đại học, Cao đẳng của Đà Nẵng hợp tác trao đổi nguồn nhân lực với thành phố Kisarazu (Nhật Bản)

Lễ ký kết Bản ghi nhớ (MOU) về trao đổi nguồn nhân lực giữa Phòng Thương mại và Công nghiệp thành phố Kisarazu (Nhật Bản) và trường Đại học Duy Tân, Cao đẳng Phương Đông và Cao đẳng Lương thực - Thực phẩm do Sở Ngoại vụ Đà Nẵng tổ chức vào ngày 26/9.
Xét, tặng giải thưởng sáng tác văn học nghệ thuật về đề tài hải quân nhân dân Việt Nam

Xét, tặng giải thưởng sáng tác văn học nghệ thuật về đề tài hải quân nhân dân Việt Nam

Cục Chính trị Hải quân đã có văn bản đề nghị ban tuyên giáo các tỉnh uỷ, thành uỷ; Hội Văn học Nghệ thuật tỉnh, các cơ quan báo chí tuyên truyền, phổ biến rộng rãi đến văn nghệ sĩ, hội viên, phóng viên, cộng tác viên, tác giả có tác phẩm tham gia xét giải thưởng sáng tác văn học, nghệ thuật về đề tài hải quân nhân dân Việt Nam giai đoạn 2021-2025.
Vùng 4 Hải quân: ngư dân gặp nạn được điều trị kịp thời

Vùng 4 Hải quân: ngư dân gặp nạn được điều trị kịp thời

Ngày 27/9, Bệnh xá đảo Sinh Tồn Đông (Lữ đoàn 146, Vùng 4 Hải quân) đã tiếp nhận và điều trị cho 3 ngư dân tỉnh Bình Thuận.
Hải quân Việt Nam – Campuchia tuần tra chung lần thứ 76

Hải quân Việt Nam – Campuchia tuần tra chung lần thứ 76

Sáng 27/9, Tàu 265, Lữ đoàn 175, (Vùng 5 Hải quân nhân dân Việt Nam) đã cập quân cảng Vùng 5 (Kiên Giang), kết thúc tốt đẹp chuyến tuần tra chung lần thứ 76 với Tàu 1144, Căn cứ biển Ream, Hải quân Hoàng gia Campuchia.
inforgraphics phong chong dich benh mua mua bao
thong diep chuyen du dai hoi dong lhq cua tong bi thu chu tich nuoc to lam
inforgraphics bao ve tre em trong truong hop xay ra thien tai
inforgraphics 11 dai hoc viet nam dat tieu chuan nuoc ngoai
video su doan ket cua nguoi viet trong con bao yagi gay an tuong voi ban be quoc te
video ca nuoc huong ve dong bao vung bao lu
su doan ket cua nguoi viet trong con bao yagi gay an tuong voi ban be quoc te
Xin chờ trong giây lát...
Liên hoan Giai điệu hữu nghị tỉnh Đồng Nai năm 2024
Cận cảnh Kia Seltos 2024 tại đại lý
Khởi động Giải báo chí toàn quốc về văn hóa, thể thao và du lịch lần 2
Lộ diện kỳ thủ Việt Nam tranh chức vô địch Cờ Shogi Quốc tế 2024 tại Nhật Bản
UNICEF hỗ trợ người dân Sóc Trăng có nước sạch bằng năng lượng mặt trời
Ông Vi Tiêu Nghị, con trai Tướng Vi Quốc Thanh - trưởng Đoàn cố vấn quân sự Trung Quốc: Để những kỷ niệm xưa tạo sinh trong hiện tại và tương lai
Vietnam Cultural Show London 2024
Lão nông nhiều năm sưu tập những bức ảnh quý giá về Bác Hồ
Bác Hồ và bộ phim Những ngày tháng bên nhau
Hồ Chí Minh là biểu tượng của hòa bình, độc lập và tiến bộ xã hội
Bộ đội hải quân giúp dân chống hạn
Du học sinh Trung Quốc trải nghiệm đặc sản Hà Nội - 'cà phê trứng'
Du học sinh Trung Quốc trải nghiệm đặc sản Hà Nội - cà phê trứng
Top 3 điểm đến thu hút du khách quốc tế tại Hà Nội
Sản phẩm Làng nghề Dệt Thổ cẩm Xí Thoại, xã Xuân Lãnh, huyện Đồng Xuân, tỉnh Phú Yên.
Phiên bản di động