Ngày 21/8/2026, Viện Công nghệ Thông tin – Đại học Quốc gia Hà Nội (VNU-ITI) đã tổ chức ITI Technology Seminar với chủ đề “Speculative Decoding: Hướng tới suy luận hiệu quả cho Mô hình ngôn ngữ lớn”, trong khuôn khổ phối hợp cùng AI Lunch & Seminar Series.

Seminar có sự tham gia của GS. Nguyễn Lê Minh, JAIST (Nhật Bản), với vai trò diễn giả; TS. Nguyễn Việt Cường, Nexus Lab, VNU-ITI & INT2, chủ trì chương trình và toàn thể các cán bộ khoa học, nhà nghiên cứu tham dự.

TS. Nguyễn Việt Cường giới thiệu chung về Seminar

 Giải pháp nâng cao hiệu quả suy luận mô hình ngôn ngữ lớn

Tại seminar, GS. Nguyễn Lê Minh đã trình bày về Speculative Decoding – một hướng tiếp cận nhằm nâng cao tốc độ suy luận của các mô hình ngôn ngữ lớn (LLM), qua đó góp phần giải quyết bài toán chi phí tính toán ngày càng cao trong quá trình triển khai các hệ thống AI.

Nội dung trình bày tập trung vào cơ chế “phác thảo và xác minh” (draft-and-verify). Thay vì thực hiện suy luận tuần tự, phương pháp sử dụng một mô hình phác thảo để nhanh chóng dự đoán các token tiếp theo, sau đó mô hình ngôn ngữ lớn thực hiện xác minh song song. Cách tiếp cận này cho phép tăng tốc quá trình suy luận mà vẫn đảm bảo chất lượng đầu ra của mô hình.

Một nội dung đáng chú ý tại seminar là UNISPEC – khung speculative decoding có khả năng vận hành mà không yêu cầu huấn luyện lại mô hình và không cần thay đổi phần phối đầu ra. UNISPEC sử dụng cơ chế tự động điều chỉnh kích thước bản phác thảo theo thiết bị, đồng thời áp dụng thuật toán ước lượng độ tin cậy để lựa chọn kích thước bản phác thảo phù hợp.

Thông qua đó, phương pháp hướng tới khả năng thích ứng với các điều kiện phần cứng khác nhau, góp phần tối ưu hiệu quả suy luận của LLM trên nhiều nền tảng.

Kết nối nghiên cứu và mở rộng hợp tác quốc tế

Bên cạnh những nội dung chuyên môn về Speculative Decoding và UNISPEC, seminar cũng mở ra cơ hội trao đổi về các hướng nghiên cứu mới trong suy luận thích ứng, nhận biết phần cứng và tối ưu hóa đa ngôn ngữ.

GS. Nguyễn Lê Minh hiện là Giáo sư tại JAIST (Japan Advanced Institute of Science and Technology) và Trưởng nhóm Nguyen Lab, với các hướng nghiên cứu tập trung vào học máy, xử lý ngôn ngữ tự nhiên, mô hình ngôn ngữ lớn (LLM), AI có khả năng giải thích (XAI), Legal AI và tối ưu hiệu năng suy luận LLM.

Nhóm nghiên cứu của GS. Nguyễn Lê Minh đã đạt được nhiều thành tựu quốc tế đáng chú ý, trong đó có SAC Highlights Award tại ACL 2025 và giải thưởng tại ACL 2026 cho các công trình liên quan đến tối ưu hóa suy luận mô hình ngôn ngữ lớn.

Seminar là hoạt động học thuật thiết thực, tạo diễn đàn để cán bộ, nhà nghiên cứu, giảng viên, học viên và sinh viên trao đổi về những vấn đề mới trong lĩnh vực trí tuệ nhân tạo, đồng thời góp phần tăng cường kết nối nghiên cứu và hợp tác quốc tế giữa VNU-ITI và các đối tác trong lĩnh vực AI.

Một số hình ảnh trong Seminar: