Nghiên cứu toàn diện nhất về hệ gen người Việt được công bố quốc tế

(Dân trí) – Sau gần 7 năm theo đuổi mục tiêu xây dựng bản đồ gen của người Việt, nhóm khoa học do TS Võ Sỹ Nam và GS Vũ Hà Văn dẫn dắt vừa công bố những kết quả đầu tiên trên Nature Communications. Bài báo mang tên “VN1K is a pangenome-informed multi-omics and phenomics resource for the Vietnamese population“, giới thiệu nguồn dữ liệu gen kèm theo các thông tin nhân khẩu học và sức khỏe đặc trưng với quy mô lớn và toàn diện cho người Việt. Bài được đăng trên Nature Communications – một trong những tạp chí khoa học uy tín hàng đầu thế giới – vào ngày 22/7. Trên cơ sở phân tích mẫu gen của 1.011 người Việt Nam có gốc gác từ 53/63 tỉnh, thành phố (theo địa giới hành chính cũ tại thời điểm lấy mẫu), VN1K ghi nhận hơn 42 triệu biến thể gen, trong đó khoảng 8,5 triệu biến thể chưa từng xuất hiện trong các cơ sở dữ liệu quốc tế phổ biến. Từ nguồn dữ liệu này, nhóm nghiên cứu đã xây dựng thành công VPR (Vietnamese PanGenome Reference) – bộ hệ gen tham chiếu quần thể quy mô lớn đầu tiên của Việt Nam, giúp nâng cao độ chính xác trong phân tích và giải mã các biến thể di truyền. Đây là dấu mốc đáng chú ý khi công trình được phát triển từ dữ liệu trong nước, do các nhà khoa học Việt Nam chủ trì và hướng tới giải quyết bài toán đặc thù của quần thể Việt. Trước đây, dữ liệu về người Việt trong các nghiên cứu di truyền quốc tế rất hạn chế. Phần lớn nghiên cứu trên người Việt thường phải tham chiếu cơ sở dữ liệu được xây dựng chủ yếu từ người gốc Âu. VN1K đã góp phần lấp đầy khoảng trống dữ liệu này, đóng góp quan trọng vào kho tri thức di truyền toàn cầu. Công trình cũng là một trong những bộ dữ liệu gen quy mô lớn hàng đầu ở Đông Nam Á. Khu vực có đến 700 triệu dân này lâu nay thuộc nhóm thiếu dữ liệu gen nhất thế giới. VN1K sẽ bổ sung một mắt xích quan trọng cho nghiên cứu di truyền của khu vực, giúp các nghiên cứu về bệnh tật, đáp ứng thuốc và đặc điểm sinh học của quần thể người Đông Nam Á trở nên chính xác hơn. Không chỉ mang ý nghĩa học thuật, VN1K còn được xem là hạ tầng dữ liệu nền tảng cho nhiều ứng dụng y sinh học, từ di truyền dược lý đến y học dự phòng và cá thể hóa. Những kết quả từ VN1K cũng đã đặt nền móng cho VinGenChip – công nghệ đang được sử dụng trong các thử nghiệm kỹ thuật phục vụ chiến dịch 500 ngày đêm tìm kiếm, quy tập và xác định danh tính hài cốt liệt sỹ còn thiếu thông tin bằng phương pháp giám định ADN. Công trình vì thế vừa khẳng định năng lực làm chủ công nghệ của các nhà khoa học Việt Nam, vừa tạo nền tảng khoa học phục vụ những nhiệm vụ có ý nghĩa đặc biệt về chính trị, lịch sử và nhân văn của đất nước. Hai thành viên chính trong nhóm tác giả liên hệ của công bố là TS Võ Sỹ Nam và GS Vũ Hà Văn, hiện cùng công tác tại Viện Nghiên cứu Dữ liệu lớn, Trường Đại học VinUni, trong đó GS Vũ Hà Văn đồng thời là giáo sư của Đại học Hong Kong. Từ khoảng trống của người Việt trên bản đồ gen thế giới… VN1K bắt nguồn từ dự án “Giải mã 1.000 hệ gen người Việt” do GS Vũ Hà Văn khởi xướng cuối năm 2018 tại Viện Nghiên cứu Dữ liệu lớn Vingroup (nay thuộc trường Đại học VinUni). Thời điểm ấy, mục tiêu này được xem là khá tham vọng khi dấu ấn của người Việt trên bản đồ gen thế giới còn rất mờ nhạt. Cũng trong giai đoạn đó, TS Võ Sỹ Nam đang là nhà nghiên cứu tin sinh học tại ĐH Chicago (Hoa Kỳ) và tập trung vào phân tích dữ liệu hệ gen người. Nhiều năm làm việc với các cơ sở dữ liệu gen quốc tế giúp ông nhận ra sự thiếu vắng của dữ liệu người Việt trong các nghiên cứu quy mô lớn và những hệ lụy mà điều này có thể gây ra đối với việc chăm sóc sức khỏe cộng đồng. TS Nam ví điều đó như việc may đo áo quần. Một hãng thời trang toàn cầu có số đo của nhiều dân tộc để thiết kế trang phục nhưng lại thiếu thông tin về vóc dáng người Việt. Khi ấy, những bộ quần áo của họ khó có thể phù hợp với chúng ta. Trong các ứng dụng y tế, sự không vừa vặn này không chỉ dừng lại ở cảm giác thiếu thoải mái. Chẳng hạn, một số loại thuốc với liều lượng hoặc hoạt chất được xây dựng dựa trên thể trạng người Âu – Mỹ có thể kém hiệu quả, thậm chí gây phản ứng bất lợi đối với người Việt. Thực tế này đã đặt ra nhiều câu hỏi về đặc điểm gen của người Việt mà TS Võ Sỹ Nam muốn tìm lời giải. Năm 2019, ông Nam được GS Vũ Hà Văn – khi đó là Giám đốc Khoa học của Viện Nghiên cứu Dữ liệu lớn – mời tham gia dự án giải mã 1.000 hệ gen người Việt. Bị thuyết phục bởi tầm nhìn của GS Văn, ông quyết định trở về nước. “Anh Văn đã từng nói rằng: Có những bài toán nếu không phải người Việt làm thì ai sẽ làm? Quả vậy, các nhà nghiên cứu ở Mỹ hay châu Âu sẽ không có động lực rõ