Chỉ số g-index là gì? So sánh g-index với H-index trong đánh giá năng lực nhà khoa học
g-index là chỉ số định lượng đo ảnh hưởng khoa học của một tác giả, được xác định là số nguyên lớn nhất g sao cho g bài báo được trích dẫn nhiều nhất của tác giả đó có tổng số trích dẫn cộng dồn đạt tối thiểu g². Chỉ số này do nhà khoa học thông tin Leo Egghe đề xuất năm 2006, nhằm khắc phục một nhược điểm cụ thể của H-index: H-index "bỏ qua" hoàn toàn phần trích dẫn vượt trội của các bài rất nổi bật, còn g-index tính đến toàn bộ khối lượng trích dẫn đó.
Cập nhật: tháng 9/2026 — Biên soạn bởi đội ngũ Scibase, Metis JSC
g-index là gì?
g-index là số nguyên lớn nhất g sao cho g bài báo được trích dẫn nhiều nhất của một tác giả, xếp theo thứ tự giảm dần, có tổng trích dẫn cộng dồn ≥ g².
Định nghĩa này do Leo Egghe công bố năm 2006 trên tạp chí Scientometrics trong bài báo "Theory and practise of the g-index", với mục tiêu công khai là sửa lỗi mà chính Egghe chỉ ra ở H-index: một khi một bài báo đã đạt ngưỡng h trích dẫn, số trích dẫn vượt ngưỡng đó của bài báo không còn ảnh hưởng gì đến giá trị H-index nữa. Một nhà khoa học có 1 bài "hit" được trích dẫn 5.000 lần và một người có bài được trích dẫn đúng 5 lần đều có thể cho ra cùng H-index nếu các bài còn lại giống nhau — g-index cho phép bài trích dẫn cực cao "kéo" chỉ số lên cao hơn.
g-index luôn ≥ H-index về mặt toán học, vì g-index cho phép các bài phía sau trong danh sách "vay mượn" phần trích dẫn dư thừa của các bài đứng đầu để đạt ngưỡng bình phương. Đây là điểm khác biệt cốt lõi so với H-index — chỉ số vốn chỉ đếm số bài đạt ngưỡng tuyến tính, không quan tâm phần trích dẫn dư.
Công thức tính g-index từng bước
Không giống công thức đại số một dòng, g-index được xác định qua một quy trình sắp xếp và cộng dồn:
- Liệt kê toàn bộ công bố của tác giả.
- Sắp xếp các công bố theo số lượt trích dẫn giảm dần.
- Tính tổng trích dẫn cộng dồn (running total) từ bài đầu tiên đến từng vị trí.
- Tìm vị trí g lớn nhất mà tổng cộng dồn tại vị trí đó vẫn ≥ g².
- Giá trị vị trí đó chính là g-index.
text
g-index = max(g) sao cho: tổng trích dẫn của g bài đứng đầu ≥ g²Khác với H-index, g-index có thể vượt quá tổng số công bố của tác giả trong một số cách tính mở rộng (Egghe cho phép "bài giả" với 0 trích dẫn để lấp đầy công thức), nhưng cách áp dụng phổ biến nhất — và cũng là cách các công cụ như Publish or Perish sử dụng — giới hạn g-index không vượt quá tổng số bài thực tế có trích dẫn.
Ví dụ minh hoạ cách tính g-index
Giả sử một nhà khoa học có 8 công bố với số lượt trích dẫn sau, đã sắp xếp giảm dần — dùng cùng dạng dữ liệu như ví dụ H-index để dễ đối chiếu song song:
| Thứ tự bài | Số trích dẫn | Tổng cộng dồn | g² cần đạt | Đạt? |
|---|---|---|---|---|
| 1 | 80 | 80 | 1 | Đạt |
| 2 | 45 | 125 | 4 | Đạt |
| 3 | 20 | 145 | 9 | Đạt |
| 4 | 10 | 155 | 16 | Đạt |
| 5 | 5 | 160 | 25 | Đạt |
| 6 | 4 | 164 | 36 | Đạt |
| 7 | 2 | 166 | 49 | Đạt |
| 8 | 1 | 167 | 64 | Đạt |
Ở vị trí 8, tổng cộng dồn (167) vẫn ≥ 64 (8²). Vì chỉ có 8 bài, g-index dừng lại ở g = 8 — bằng đúng tổng số công bố, vì bài đầu tiên có lượng trích dẫn rất lớn (80 lần) đã "gánh" đủ cho toàn bộ 8 bài đạt ngưỡng bình phương.
Đối chiếu bằng H-index trên cùng bộ dữ liệu này: sắp xếp lại theo quy tắc H-index (bài thứ h có trích dẫn ≥ h), chỉ 5 bài đầu đạt ngưỡng (bài 5 có 5 trích dẫn ≥ 5, bài 6 có 4 trích dẫn < 6) — H-index chỉ bằng 5. Cùng một bộ dữ liệu, g-index (8) cao hơn hẳn H-index (5) vì một bài "hit" duy nhất (80 trích dẫn) không làm tăng H-index quá ngưỡng 5, nhưng lại đủ sức kéo g-index lên tối đa.
g-index khác H-index ở điểm nào? Khi nào hai chỉ số cho kết quả khác biệt lớn
Hai chỉ số dùng chung logic sắp xếp theo trích dẫn giảm dần nhưng khác nhau ở ngưỡng so sánh: H-index so bài thứ h với chính số thứ tự h (tuyến tính), còn g-index so tổng cộng dồn với g² (bậc hai) — nên phần trích dẫn dư của các bài đầu bảng luôn được g-index "giữ lại và tái sử dụng" cho các bài phía sau.
| Tiêu chí | g-index | H-index |
|---|---|---|
| Ngưỡng so sánh | Tổng trích dẫn cộng dồn ≥ g² | Trích dẫn từng bài ≥ thứ tự h |
| Có tính phần trích dẫn dư của bài "hit"? | Có | Không |
| Quan hệ giá trị | g-index ≥ H-index luôn đúng | Là chỉ số gốc, thấp hơn hoặc bằng g-index |
| Nhạy với 1 bài trích dẫn cực cao | Rất nhạy | Gần như không đổi |
| Công cụ tính tự động phổ biến | Publish or Perish (Harzing) | Scopus, Web of Science, Google Scholar |
| Công nhận chính thức tại Việt Nam | Chưa | H-index Scopus/WoS được dùng tham khảo ở một số quy trình xét đề tài |
Khoảng cách giữa g-index và H-index lớn nhất xảy ra ở nhóm nhà khoa học có một hoặc vài bài "hit" — thường là bài tổng quan (review) được trích dẫn hàng nghìn lần, hoặc bài mở đầu một hướng nghiên cứu mới được cả cộng đồng trích dẫn lại. Ngược lại, với nhà khoa học có phân bố trích dẫn đều giữa các bài (không có bài nào vượt trội hẳn), g-index và H-index thường sát nhau, đôi khi bằng nhau.
Muốn hiểu đầy đủ công thức gốc, cách tra cứu H-index trên ba nguồn phổ biến và ví dụ tính tay chi tiết, xem lại bài H-index tính như thế nào? Công thức, ví dụ minh hoạ và cách tra cứu nhanh.
Vì sao Scopus, Web of Science, Google Scholar không hiển thị g-index?
Đây là khác biệt quan trọng nhất về mặt thực hành: cả ba cơ sở dữ liệu trích dẫn lớn nhất — Scopus, Web of Science và Google Scholar Profile — đều không tính sẵn g-index trên trang hồ sơ tác giả, dù cả ba đều hiển thị H-index tự động. g-index vẫn chủ yếu là một chỉ số học thuật được thảo luận trong nghiên cứu về đo lường khoa học (scientometrics), chưa được các nhà cung cấp dữ liệu thương mại tích hợp làm chỉ số mặc định.
Muốn có g-index, nhà khoa học cần dùng công cụ bên thứ ba. Phổ biến nhất là Publish or Perish — phần mềm miễn phí do Anne-Wil Harzing phát triển từ năm 2006, lấy dữ liệu trích dẫn từ Google Scholar, Scopus, Crossref hoặc Web of Science rồi tự tính ra một loạt chỉ số gồm H-index, g-index, hI-index và e-index cùng lúc.
Cách tra g-index bằng Publish or Perish
- Tải và cài Publish or Perish (miễn phí) từ trang chính thức của Harzing.
- Chọn nguồn dữ liệu — thường dùng Google Scholar vì không cần tài khoản trả phí.
- Nhập tên tác giả, có thể thêm từ khoá lĩnh vực để lọc bớt kết quả trùng tên.
- Chạy tìm kiếm, phần mềm tự động liệt kê toàn bộ công bố kèm số trích dẫn.
- Đọc bảng kết quả tổng hợp — g-index hiển thị cùng H-index, hI-index, tổng trích dẫn và số năm hoạt động.
- Rà lại danh sách bài trả về để loại các bài không phải của mình (rủi ro trùng tên tương tự khi tra H-index trên Google Scholar).
Vì Publish or Perish lấy dữ liệu thô từ Google Scholar theo mặc định, g-index tính ra thường cao hơn g-index nếu tính từ dữ liệu Scopus hoặc Web of Science — cùng nguyên nhân khiến H-index Google Scholar cao hơn H-index Scopus mà bài viết về H-index đã phân tích.
g-index có được công nhận trong xét GS/PGS, đề tài tại Việt Nam không?
g-index chưa xuất hiện trong bất kỳ văn bản quy định chính thức nào của Hội đồng Giáo sư Nhà nước (HĐGSNN) hay các tiêu chí xét duyệt đề tài cấp Bộ, cấp Nhà nước tại Việt Nam — tương tự tình trạng của i10-index và h5-index (vốn là chỉ số cấp tạp chí). Ba lý do chính giải thích vì sao:
- Không có nguồn tra cứu chính thức thống nhất: Scopus và Web of Science — hai cơ sở dữ liệu được HĐGSNN công nhận — không tính g-index, nên không thể đưa vào quy định mà thiếu một nguồn tra cứu kiểm chứng được.
- Phụ thuộc công cụ bên thứ ba: g-index chỉ tính được qua phần mềm như Publish or Perish, kết quả có thể khác nhau tuỳ nguồn dữ liệu đầu vào (Google Scholar, Scopus, Crossref), thiếu tính nhất quán cần thiết cho một tiêu chí xét duyệt.
- Chưa phổ biến trong cộng đồng học thuật quốc tế ở mức đủ để trở thành chuẩn so sánh — g-index chủ yếu được nhắc đến trong các nghiên cứu về scientometrics, ít xuất hiện trên hồ sơ cá nhân nhà khoa học so với H-index.
Vì vậy, khi chuẩn bị hồ sơ học thuật hoặc hồ sơ xét đề tài, chủ nhiệm đề tài, nhà khoa học Việt Nam nên tiếp tục dùng H-index từ Scopus hoặc Web of Science làm căn cứ chính thức, chỉ dùng g-index như thông tin tham khảo bổ sung — tương tự cách nên đối xử với i10-index trên Google Scholar.
g-index và các chỉ số biến thể khác: hg-index, e-index
Sau khi Egghe công bố g-index, một số nhà nghiên cứu tiếp tục đề xuất các biến thể để bù đắp hạn chế còn lại của cả H-index lẫn g-index — hai chỉ số đáng chú ý nhất:
- hg-index: là trung bình nhân của H-index và g-index (căn bậc hai của tích H×g), do Alonso và cộng sự đề xuất năm 2010, nhằm tạo một con số duy nhất cân bằng giữa hai chỉ số thay vì phải đọc song song cả hai.
- e-index: đo phần "trích dẫn dư" bị H-index bỏ qua — cụ thể là căn bậc hai của tổng trích dẫn vượt ngưỡng h của chính h bài cấu thành H-index, do Zhang đề xuất năm 2009, dùng để bổ sung cho H-index chứ không thay thế.
Cả hai chỉ số này đều ít phổ biến hơn g-index và hầu như chỉ xuất hiện trong nghiên cứu chuyên sâu về đo lường khoa học, không có mặt trên hồ sơ tác giả của bất kỳ cơ sở dữ liệu thương mại nào. Nhà khoa học không cần theo dõi các chỉ số này trong công việc thường ngày, chỉ cần biết đến sự tồn tại của chúng khi đọc tài liệu về scientometrics.
Sai lầm thường gặp khi dùng g-index tại đơn vị nghiên cứu Việt Nam
Dùng g-index thay cho H-index trong hồ sơ chính thức. Một số nhà khoa học tính g-index bằng Publish or Perish rồi điền vào hồ sơ xét đề tài, xét thi đua vì con số này thường "đẹp" hơn H-index. Hội đồng đối chiếu lại trên Scopus không tìm thấy chỉ số này, dẫn đến yêu cầu giải trình hoặc phải bổ sung lại đúng H-index Scopus.
Hiểu nhầm g-index luôn phản ánh chất lượng tốt hơn H-index. g-index cao chủ yếu do có một vài bài "hit" gánh điểm — điều này không đồng nghĩa toàn bộ sự nghiệp công bố đều có chất lượng cao và đều đặn. Một nhà khoa học có g-index cao nhưng H-index thấp có thể chỉ có 1–2 bài nổi bật, phần còn lại ít được trích dẫn.
So sánh g-index tính từ hai nguồn dữ liệu khác nhau. Vì không có chuẩn tính g-index thống nhất, so sánh g-index của người A (tính từ Google Scholar) với người B (tính từ Scopus) là so sánh khập khiễng — cần ghi rõ nguồn dữ liệu mỗi khi trích dẫn con số này.
Checklist áp dụng khi tham khảo g-index
- [ ] Xác định rõ mục đích: tham khảo cá nhân (dùng được g-index) hay hồ sơ chính thức (chỉ dùng H-index Scopus/WoS)
- [ ] Ghi rõ nguồn dữ liệu (Google Scholar/Scopus/Crossref) và công cụ tính (thường là Publish or Perish) khi báo cáo g-index
- [ ] Không dùng g-index thay thế H-index trong hồ sơ gửi HĐGSNN, Nafosted hoặc báo cáo Bộ KH&CN
- [ ] Khi g-index và H-index chênh lệch lớn, kiểm tra xem có phải do 1–2 bài "hit" đơn lẻ gánh điểm hay không
- [ ] Rà soát danh sách bài trả về từ Publish or Perish để loại trừ bài của người trùng tên trước khi chốt số liệu
- [ ] Với so sánh nội bộ đơn vị, quy định thống nhất một nguồn dữ liệu duy nhất cho toàn bộ nhà khoa học
g-index có ý nghĩa gì với đơn vị quản lý dữ liệu khoa học?
Với các trường, viện đang xây dựng hệ thống CSDL khoa học và công nghệ nội bộ, g-index gần như không xuất hiện trong yêu cầu báo cáo Bộ hay tiêu chí tính khối lượng nghiên cứu khoa học, nên các đơn vị không cần cấu hình hệ thống để tính g-index tự động. Ưu tiên đúng nên dành cho H-index Scopus/WoS, CiteScore, SJR và các chỉ số đã được Hội đồng Giáo sư Nhà nước công nhận.
Tuy vậy, với đơn vị có nhóm nghiên cứu mạnh sở hữu các công trình đột phá được trích dẫn rất cao, g-index vẫn là một góc nhìn bổ sung hữu ích khi lãnh đạo muốn nhận diện chính xác ai đang tạo ra "cú hit" lớn cho đơn vị, khác với việc chỉ nhìn H-index vốn phản ánh sự đều đặn hơn là đỉnh cao. Trên Scibase, phần phân tích trích dẫn tập trung vào các chỉ số đã được công nhận chính thức (H-index, CiteScore, SJR, FWCI) để phục vụ báo cáo và xét duyệt — nhà khoa học muốn tham khảo thêm g-index cá nhân vẫn có thể dùng song song công cụ Publish or Perish mà không cần tích hợp vào hệ thống quản lý chính thức của đơn vị.
Câu hỏi thường gặp về g-index
g-index có phải là phiên bản nâng cấp thay thế H-index không?
Không. g-index là chỉ số bổ sung, không thay thế H-index. Cả hai đo hai khía cạnh khác nhau: H-index đo tính đều đặn và ổn định của trích dẫn, g-index đo thêm tác động của các bài "hit" nổi bật. Cộng đồng khoa học vẫn dùng H-index làm chỉ số chính, g-index làm tham khảo.
Vì sao g-index luôn lớn hơn hoặc bằng H-index?
Vì cách tính g-index cho phép các bài phía sau "vay" phần trích dẫn dư thừa của các bài đứng đầu để đạt ngưỡng bình phương g², trong khi H-index yêu cầu chính bài đó phải tự đạt ngưỡng tuyến tính h. Về mặt toán học, điều kiện của g-index luôn dễ đạt hơn hoặc bằng điều kiện của H-index.
Làm sao tính g-index nếu không có Publish or Perish?
Có thể tính tay theo 5 bước đã nêu ở trên: sắp xếp trích dẫn giảm dần, cộng dồn từng bước, tìm vị trí lớn nhất có tổng cộng dồn ≥ vị trí bình phương. Với tác giả có nhiều bài, tính tay mất thời gian hơn nhiều so với dùng phần mềm chuyên dụng.
g-index bao nhiêu là cao?
Không có ngưỡng chuẩn chung cho mọi ngành, tương tự H-index. Vì g-index luôn ≥ H-index, nên khi so sánh cần đối chiếu cả hai cùng lúc và cùng nguồn dữ liệu — một g-index cao hơn H-index từ 2–3 điểm là phổ biến, chênh lệch lớn hơn thường cho thấy có bài "hit" nổi bật.
Nộp hồ sơ đề tài cấp Nhà nước có cần khai báo g-index không?
Không. Các quy trình xét duyệt đề tài cấp Nhà nước tại Việt Nam hiện chỉ tham chiếu H-index từ Scopus hoặc Web of Science, chưa yêu cầu g-index. Xem chi tiết các tiêu chí đầy đủ tại bài tiêu chí đánh giá đề tài nghiên cứu khoa học — Hội đồng xem xét điều gì?.
g-index có bị ảnh hưởng bởi tự trích dẫn không?
Có, và mức độ ảnh hưởng có thể lớn hơn H-index vì g-index nhạy với tổng khối lượng trích dẫn cộng dồn — một vài bài được tự trích dẫn nhiều có thể đẩy g-index tăng đáng kể. Cần thận trọng tương tự như khi đọc chỉ số tự trích dẫn (self-citation).
Tóm tắt
- g-index là số g lớn nhất sao cho g bài trích dẫn nhiều nhất có tổng trích dẫn cộng dồn ≥ g², do Leo Egghe đề xuất năm 2006.
- g-index luôn ≥ H-index, và chênh lệch lớn nhất xảy ra khi tác giả có bài "hit" được trích dẫn vượt trội.
- Scopus, Web of Science và Google Scholar không tự tính g-index — cần dùng công cụ như Publish or Perish (Harzing).
- HĐGSNN và các quy trình xét đề tài tại Việt Nam chưa công nhận g-index, chỉ H-index từ Scopus/WoS được dùng chính thức.
- Sai lầm phổ biến: dùng g-index thay H-index trong hồ sơ chính thức, hoặc so sánh g-index tính từ hai nguồn dữ liệu khác nhau.
Nguồn tham khảo: Egghe, L. (2006), "Theory and practise of the g-index", Scientometrics, 69(1); Hirsch, J.E. (2005), "An index to quantify an individual's scientific research output", PNAS; Harzing, A.W., Publish or Perish software documentation; Alonso, S. et al. (2010), "hg-index: A new index to characterize the scientific productivity"; Zhang, C.T. (2009), "The e-index, complementing the h-index for excess citations", PLoS ONE. Biên soạn bởi đội ngũ Scibase — Metis JSC.
Bài viết liên quan
- H-index tính như thế nào? Công thức, ví dụ minh hoạ và cách tra cứu nhanh
- Chỉ số i10-index là gì và khác H-index như thế nào — Hướng dẫn đọc hồ sơ Google Scholar
- Chỉ số trích dẫn khoa học là gì? Phân biệt số trích dẫn, H-index và Impact Factor
- Tính khối lượng nghiên cứu khoa học
- Hồ sơ học thuật cho nhà khoa học
- Tính năng chính của Scibase
