Dữ liệu giải mã 1.000 gene người Việt lần đầu được công bố
Thành công bước đầu này đặt nền móng rất lớn cho các công tác y sinh và hóa dược, giúp cá thể hóa tối đa trong điều trị bệnh, đồng thời giúp ích rất nhiều trong việc xác định ADN.
Công trình này giới thiệu nguồn dữ liệu hệ gen, đa omics và kiểu hình toàn diện đầu tiên ở quy mô lớn của người Việt, đồng thời xây dựng thành công Vietnamese PanGenome Reference (VPR) - hệ gen tham chiếu quần thể đầu tiên dành riêng cho người Việt. Đây được xem là nền tảng khoa học quan trọng cho các nghiên cứu di truyền học và nhiều ứng dụng trong y học chính xác, y học dự phòng cũng như các giải mã gen phục vụ người Việt.

Nhóm các nhà khoa học chính tham gia nghiên cứu.
Công trình do nhóm nghiên cứu gồm hơn 40 nhà khoa học Việt Nam thực hiện, dưới sự dẫn dắt của TS Võ Sỹ Nam - Giám đốc điều hành Viện nghiên cứu dữ liệu lớn, Trường Đại học VinUni và GS Vũ Hà Văn - Giám đốc khoa học của Viện.
Các nhà khoa học tham gia gồm: PGS Lê Đức Hậu (Đại học Bách Khoa Hà Nội), PGS Nguyễn Thùy Dương (Viện Hàn lâm Khoa học và Công nghệ Việt Nam), PGS Lê Thị Lý (Đại học Quốc gia TP Hồ Chí Minh), GS Lê Sỹ Vinh (Đại học Quốc gia Hà Nội), GS Nguyễn Thanh Liêm (Đại học VinUni), GS Trần Huy Thịnh (Trường Đại học Y Hà Nội), PGS Nguyễn Hoàng Quân (Đại học Queensland, Úc), PGS Lưu Nguyên Hưng (Viện Nghiên cứu Houston Methodist và Đại học Cornell, Mỹ) và nhiều nhà khoa học trẻ tài năng khác.

Hình ảnh minh họa kết quả chính của bài báo. (Ảnh Vinuni)
Dự án được khởi xướng từ năm 2018 tại Viện Nghiên cứu Dữ liệu lớn (nay thuộc Trường Đại học VinUni), với mục tiêu xây dựng nguồn dữ liệu hệ gen quy mô lớn dành riêng cho người Việt và thúc đẩy các ứng dụng của di truyền học trong chăm sóc sức khỏe cũng như các lĩnh vực phục vụ cộng đồng.
GS Vũ Hà Văn, người khởi xướng dự án cho biết, đây là công trình hoàn toàn do các nhà khoa học Việt Nam thực hiện tại Việt Nam, cho người Việt, có tính chất tiên phong và làm nền móng cho các nghiên cứu toàn diện về hệ gen người Việt.
"Hy vọng đây sẽ là bước đầu trong một loạt công trình kế tiếp có giá trị hàn lâm đáng kể”, GS Vũ Hà Văn bày tỏ kỳ vọng.
TS Võ Sỹ Nam - người lãnh đạo chuyên môn và là tác giả liên hệ chính của công bố chia sẻ, ngay từ đầu, mục tiêu của nhóm không chỉ là xây dựng một cơ sở dữ liệu lớn và các công cụ thống kê, AI hiệu quả cho dữ liệu gen của người Việt, mà còn tạo ra nền tảng để các kết quả nghiên cứu có thể được chuyển hóa thành những ứng dụng phục vụ cộng đồng.
"Chúng tôi kỳ vọng VN1K sẽ góp phần thúc đẩy các ứng dụng học y dự phòng và y học chính xác mạnh mẽ hơn tại Việt Nam và mang lại lợi ích thiết thực cho người Việt”, TS Võ Sỹ Nam cho hay.

GS. Vũ Hà Văn (bên trái) và TS. Võ Sỹ Nam (bên phải) là hai tác giả chính của bài báo. (Ảnh VinUni)
Theo nhóm nghiên cứu, VN1K được xây dựng trên cơ sở phân tích dữ liệu của 1.011 người Việt có nguồn gốc từ 53/63 tỉnh, thành phố (theo địa giới hành chính tại thời điểm lấy mẫu), ghi nhận hơn 42 triệu biến thể di truyền. Trong đó, khoảng 8,5 triệu biến thể chưa từng được ghi nhận trong các cơ sở dữ liệu quốc tế phổ biến.
Từ nguồn dữ liệu này, nhóm nghiên cứu đã phát triển Vietnamese PanGenome Reference (VPR) - hệ gen tham chiếu quần thể quy mô lớn đầu tiên của Việt Nam, giúp nâng cao độ chính xác trong phân tích và diễn giải các biến thể di truyền so với việc sử dụng các hệ gen tham chiếu được xây dựng chủ yếu từ quần thể người châu Âu.
Trước đây, dữ liệu di truyền của người Việt trong các nghiên cứu quốc tế còn rất hạn chế. Khoảng trống này khiến nhiều nghiên cứu về bệnh học, đáp ứng thuốc và các ứng dụng y học chính xác chưa phản ánh đầy đủ đặc điểm di truyền của người Việt.
Việc xây dựng thành công VN1K không chỉ bổ sung dữ liệu còn thiếu của Việt Nam trên bản đồ gen thế giới mà còn đóng góp thêm một nguồn dữ liệu quy mô lớn cho khu vực Đông Nam Á - một trong những khu vực còn thiếu dữ liệu di truyền nhất hiện nay.
Bên cạnh đó, một thành quả ứng dụng nổi bật của VN1K là VinGenChip - con chip sinh học đầu tiên được thiết kế dựa trên dữ liệu hệ gen người Việt. Sản phẩm do GeneStory phát triển trên nền tảng các kết quả nghiên cứu từ VN1K, đánh dấu bước tiến quan trọng trong việc làm chủ công nghệ lõi về phân tích dữ liệu di truyền và thiết kế chip sinh học tại Việt Nam.
VinGenChip có khả năng phân tích đồng thời hàng chục nghìn biến thể di truyền đặc trưng của người Việt, phục vụ nhiều mục đích như định danh cá thể, dự đoán đáp ứng thuốc, sàng lọc nguy cơ bệnh và các nghiên cứu di truyền quần thể. Việc tối ưu hóa trên dữ liệu hệ gen người Việt giúp nâng cao độ chính xác khi ứng dụng trong thực tiễn, đồng thời tạo tiền đề để các công nghệ giải mã gen trở nên dễ tiếp cận hơn đối với người dân.
Hiện nay, VinGenChip là một trong những công nghệ đang được sử dụng trong Dự án Ngân hàng gen liệt sĩ và thân nhân cũng như chiến dịch 500 ngày đêm tìm mộ liệt sĩ do Nhà nước triển khai với quy mô lên tới hàng triệu mẫu ADN.
Với khả năng đọc đồng thời số lượng lớn biến thể di truyền có giá trị định danh, công nghệ này góp phần nâng cao độ chính xác trong đối sánh dữ liệu giữa mẫu ADN thân nhân và hài cốt, đồng thời giảm đáng kể chi phí so với nhiều giải pháp nhập khẩu.
Việc ứng dụng VinGenChip trên nền tảng dữ liệu hệ gen người Việt được kỳ vọng sẽ góp phần nâng cao hiệu quả xác định danh tính hài cốt liệt sĩ còn thiếu thông tin, phục vụ một nhiệm vụ có ý nghĩa đặc biệt về lịch sử, chính trị và nhân văn. Đây cũng là minh chứng cho khả năng chuyển hóa kết quả nghiên cứu khoa học thành các công nghệ phục vụ những nhu cầu thực tiễn của đất nước.
Phạm Huyền
1 ngày trước
20 phút trước
2 phút trước
1 giờ trước
9 phút trước
18 phút trước
40 phút trước