Xã hội số

Viettel Cyberspace đưa sản phẩm Make in VietNam vươn tầm thế giới

PV 26/09/2023 15:16

Vừa qua tại sự kiện IDCAR lần thứ 17, hội nghị hàng đầu thế giới về phân tích và nhận dạng tài liệu tại Mỹ. Trung tâm Không gian mạng Viettel (Viettel Cyberspace), đã công bố kết quả nghiên cứu khoa học.

Hội nghị ICDAR lần thứ 17 được tổ chức tại California, Mỹ, Viettel là đơn vị duy nhất đại diện doanh nghiệp Việt Nam tham dự sự kiện này cùng nhiều chuyên gia cấp cao đến từ các tổ chức hàng đầu về nghiên cứu AI trong lĩnh vực xử lý ảnh tài liệu như Google Research, Microsoft Research, Adobe, Naver, CASIA, Wacom, Goodnote…

Theo nội dung Trung tâm Không gian mạng Viettel (Viettel Cyberspace) công bố tại sự kiện, Viettel Cyberspace mang đến sự kiện các sản phẩm công nghệ được tập trung cải thiện hiệu suất nhận diện cấu trúc bảng trong ảnh tài liệu, đặc biệt là với những bảng có cấu trúc phức tạp.

Cũng theo Viettel Cyberspace cho biết trích xuất thông tin trong bảng biểu thuộc ảnh tài liệu đang là bài toán rất thách thức do cấu trúc đọc khác biệt với dữ liệu đoạn văn thông thường, trong khi thông tin của bảng lại mang nhiều ý nghĩa quan trọng, nhất là trong các lĩnh vực tài chính, ngân hàng, bảo hiểm.

fgrghfgh.jpg
Nhóm nghiên cứu công nghệ OCR, Viettel Cyberspace tham gia hội nghị

Công nghệ này đang được ứng dụng trong Viettel Intelligent Document Processing (Viettel IDP), thuộc hệ sinh thái sản phẩm Viettel AI, cho phép chuyển đổi không chỉ chữ mà cả bảng biểu từ dạng hình ảnh sang định dạng có thể chỉnh sửa được như Excel, Word với độ chính xác cao.

Điểm khác biệt của Viettel IDP là xem bảng biểu là một thực thể quan trọng trong ảnh tài liệu để trích xuất toàn bộ thông tin, thay vì chỉ coi là một đối tượng ảnh thông thường. Công nghệ này được coi là một trong những thành phần cốt lõi trong xây dựng công cụ chuyển đổi số và tìm kiếm thông tin thông minh.

Phương pháp này đặc biệt hiệu quả với các ô trong bảng, không chỉ áp dụng với ô tiêu đề. Thử nghiệm trên các bộ dữ liệu chuẩn, phương pháp này cho kết quả cao hơn hẳn về độ chính xác so với các phương pháp đã được công bố trước đó. Cụ thể, cao hơn 0,3% F1-score trên tập dữ liệu SciTSR-COMP và cao hơn 1,2% WAvgF1 trên tập ICDAR19-cTDaR so với kết quả đứng thứ hai.

Ông Nguyễn Mạnh Quý, Giám đốc Viettel Cyberspace chia sẻ: "Viettel Cyberspace luôn đề cao nghiên cứu công nghệ gắn liền với ứng dụng thực tiễn. Với các công nghệ lõi trong lĩnh vực trí tuệ nhân tạo (AI), chúng tôi xác định mục tiêu không ngừng nghiên cứu, tìm tòi và phát triển các phương pháp, thuật toán mới. Từ đó, đơn vị liên tục ứng dụng nâng cấp chất lượng của các sản phẩm, dịch vụ trong hệ sinh thái Viettel AI, hỗ trợ hiệu quả cho quá trình chuyển đổi số của các tổ chức, doanh nghiệp và chính phủ".

Thông thường, việc nhận diện các ô gộp trong bảng (Spanning cells) dễ bị bỏ sót nội dung, sai định dạng khiến thông tin không còn chính xác. Thay vì chỉ lấy thông tin từ một số ô lân cận ô gộp để xử lý như các phương pháp cũ, Viettel Cyberspace đề xuất sử dụng mạng nơ-ron dựa trên cấu trúc Transformer, nhận diện đặc trưng từ tất cả các ô trong bảng, giúp nhận diện đúng và không bỏ sót nội dung.

Phương pháp này đặc biệt hiệu quả với các ô trong bảng, không chỉ áp dụng với ô tiêu đề. Thử nghiệm trên các bộ dữ liệu chuẩn, phương pháp này cho kết quả cao hơn hẳn về độ chính xác so với các phương pháp đã được công bố trước đó. Cụ thể, cao hơn 0,3% F1-score trên tập dữ liệu SciTSR-COMP và cao hơn 1,2% WAvgF1 trên tập ICDAR19-cTDaR so với kết quả đứng thứ hai.

Viettel Cyberspace hiện cung cấp hệ sinh thái sản phẩm trí tuệ nhân tạo Viettel AI gồm 5 dòng sản phẩm: Nền tảng trí tuệ nhân tạo, nền tảng quản trị và phân tích dữ liệu, nền tảng trợ lý ảo, nền tảng robot thông minh và nền tảng bản sao số.

International Conference on Document Analysis and Recognition (ICDAR) thuộc top 14,55% hội nghị uy tín nhất thế giới về AI trong số các hội nghị được xếp hạng. Đây là sự kiện quốc tế hàng đầu dành cho các nhà khoa học, kỹ sư về phân tích và nhận dạng tài liệu, một lĩnh vực ngày càng quan trọng trong thời đại chuyển đổi số hiện nay. Các nghiên cứu khoa học sẽ phải vượt qua nhiều vòng thẩm định vô danh khắt khe từ hội đồng chuyên gia đến từ nhiều quốc gia trên thế giới. Hội nghị được tổ chức 2 năm một lần, trung bình có khoảng 30% nghiên cứu được chấp nhận mỗi năm.

Nổi bật Tạp chí Thông tin & Truyền thông
Đừng bỏ lỡ
  • Công đoàn TT&TT tổ chức nhiều hoạt động thiết thực nhân tháng công nhân, NLĐ 2024
    Với chủ đề “Tăng cường đảm bảo an toàn, vệ sinh lao động tại nơi làm việc và trong chuỗi cung ứng”, tháng công nhân, tháng hành động về An toàn vệ sinh lao động (ATVSLĐ) năm 2024 đã được Công đoàn Thông tin và Truyền thông Việt Nam (TT&TT VN) phát động sáng ngày 3/5/2024, tại Hà Nội.
  • Bộ TT&TT đẩy mạnh ứng dụng AI hẹp
    Bộ trưởng Bộ TT&TT Nguyễn Mạnh Hùng nhấn mạnh trí tuệ nhân tạo (AI) đã vào giai đoạn ứng dụng rộng rãi. Trong quý 2 này, Bộ TT&TT sẽ đưa ra một số ứng dụng mẫu để các cơ quan nhà nước có thể áp dụng rộng rãi.
  • Phát triển nông nghiệp bền vững, cần chuyển đổi số trong mọi quy trình
    Cách đây không lâu, tại diễn đàn Hợp tác xã quốc gia năm 2024 hướng đến mục tiêu xây dựng, phát triển chuỗi giá trị sản phẩm nông nghiệp bền vững, nhiều quan điểm, góc nhìn, giải pháp đã được đưa ra.
  • Giải pháp nào cho tổ chức, DN trước tấn công ransomware gia tăng?
    Ngoài việc lên kế hoạch cho các giải pháp phát hiện và phòng chống, các tổ chức và doanh nghiệp (DN) cần lên kế hoạch và giải pháp khôi phục lại dữ liệu trong tình huống tội phạm mạng tấn công và vượt qua tất cả các hàng rào bảo mật và phá hủy hoàn toàn hệ thống.
  • CMC hợp tác cùng NVIDIA đưa TP. HCM trở thành trung tâm AI của cả nước
    Mới đây, tại Tổ hợp không gian sáng tạo CMC TP.HCM CCS, Chủ tịch Tập đoàn CMC Nguyễn Trung Chính đã có cuộc gặp với lãnh đạo của Tập đoàn NVIDIA nhằm tăng cường hợp tác chiến lược toàn diện của hai doanh nghiệp (DN).
  • Bia Trúc Bạch kiệt tác chinh phục đỉnh cao
    Khám phá một kiệt tác, một di sản dẫn lối tinh hoa. Hoa Bia Saaz quý tộc vùng Zatec một kinh nghiệm bậc thầy tạo ra hương vị tinh túy bậc nhất đẳng cấp vượt thời gian, trải nghiệm đỉnh cao hoàn mỹ. Bia Trúc Bạch kiệt tác chinh phục đỉnh cao
  • Alibaba sẽ xây dựng trung tâm dữ liệu tại Việt Nam
    Trong thời gian chờ xây dựng, tập đoàn công nghệ Trung Quốc thuê không gian máy chủ từ các công ty viễn thông của Việt Nam.
  • Lan tỏa kinh nghiệm, mô hình CĐS cho các cơ quan báo chí
    Trong quý I-2024, Bộ Thông tin và Truyền thông (TT&TT) tiếp tục tăng cường thực hiện công tác đấu tranh, ngăn chặn thông tin xấu độc trên mạng xã hội (MXH) xuyên biên giới.
  • Tam Đảo - điểm đến cho một không gian âm nhạc riêng
    Từng được mệnh danh là “Hòn Ngọc Đông Dương” - Tam Đảo luôn khiến những kẻ lãng du nao lòng bởi không gian bảng lảng sương mù lẩn khuất giữa những kiến trúc biệt thự tráng lệ. Và còn gì quyến rũ hơn, khi giữa không gian ấy lại được đắm mình trong những giai điệu trữ tình, ngọt ngào sâu lắng.
  • Hiệu quả thiết thực từ mô hình tiếp công dân trực tuyến
    Với sự phát triển của công nghệ truyền thông, họp trực tuyến, xét xử trực tuyến, tiếp công dân trực tuyến cũng đã được một số địa phương áp dụng. Việc tiếp công dân trực tuyến phần nào mang lại hiệu quả thiết thực so với tiếp công dân trực tiếp.
Viettel Cyberspace đưa sản phẩm Make in VietNam vươn tầm thế giới
POWERED BY ONECMS - A PRODUCT OF NEKO