Bạn có bao giờ nhận được một tin nhắn bí ẩn và tự hỏi: liệu đây có phải mật thư không? Hoặc ngồi xem phim điệp viên và thắc mắc những cái máy mã hóa phức tạp đó hoạt động ra sao? Mật mã học — nghệ thuật bảo vệ thông tin qua mã hóa — có lịch sử dài hơn 3.000 năm, và hành trình của nó từ những trò chơi chữ cái đơn giản thời cổ đại đến các mô hình AI hiện đại phục hồi văn bản cổ đại là một câu chuyện kỳ diệu về trí tuệ con người. Hãy cùng khám phá!

Mã Caesar — mật mã đơn giản nhất mọi thời đại

Julius Caesar — vị tướng kiêm nhà độc tài La Mã huyền thoại — không chỉ giỏi đánh trận mà còn là một tay mật mã nghiệp dư cừ khôi. Ông dùng một kỹ thuật cực kỳ đơn giản: dịch chuyển mỗi chữ cái trong bảng chữ cái đi 3 vị trí. Vậy là chữ A thành D, B thành E, và HELLO thành KHOOR. Cách giải mã? Dịch ngược lại 3 vị trí là xong. Nghe có vẻ ngây thơ phải không? Nhưng trong thế giới của thế kỷ thứ nhất trước Công nguyên — khi phần lớn dân số không biết chữ — đây là một lớp bảo vệ đủ tốt để Caesar giao tiếp bí mật với các tướng lĩnh của mình.

Thử ngay: Hãy mã hóa tên của bạn bằng mã Caesar dịch +3. Nếu tên bạn là TUAN, nó sẽ thành WXDQ. Bạn có thể giải mã không? Đây chính là "trò chơi" mà hàng thế kỷ trước, các tướng quân La Mã đã dùng để bảo vệ bí mật chiến trường!

Mật mã Vigenère — "Mật mã không thể phá vỡ" trong 300 năm

Mã Caesar có một điểm yếu chết người: chỉ có 25 cách dịch chuyển khác nhau. Một kẻ tấn công kiên nhẫn chỉ cần thử 25 khả năng là xong — điều mà người ta gọi là brute force attack. Vào thế kỷ 16, nhà ngoại giao người Pháp Blaise de Vigenère đã giải quyết vấn đề này bằng một ý tưởng thiên tài: dùng một từ khóa nhiều chữ cái, mỗi chữ cái trong từ khóa mã hóa một ký tự tương ứng trong bản rõ với lượng dịch chuyển khác nhau. Nếu từ khóa là KEY, thì ký tự thứ nhất dịch +K, thứ hai dịch +E, thứ ba dịch +Y, rồi lặp lại. Kết quả là cùng một chữ cái trong bản rõ sẽ được mã hóa thành nhiều ký tự khác nhau trong bản mã — phá vỡ hoàn toàn phân tích tần suất ký tự, vũ khí chủ lực của giải mã thời đó. Mật mã Vigenère được mệnh danh là "le chiffre indéchiffrable" (mật mã không thể phá) và giữ danh hiệu này suốt gần 300 năm — cho đến khi Charles Babbage và Friedrich Kasiski độc lập tìm ra cách phân tích độ dài từ khóa vào thế kỷ 19.

Enigma và cuộc chiến trí tuệ Thế chiến II

Nhảy vọt đến thế kỷ 20: Thế chiến II đã đẩy mật mã học lên tầm cao chưa từng có. Máy Enigma của Đức Quốc xã là một cỗ máy cơ điện kỳ diệu với hàng tỷ cấu hình có thể — lý thuyết là không thể phá vỡ. Nhưng năm 1941, nhà toán học thiên tài Alan Turing cùng đội ngũ tại Bletchley Park đã xây dựng máy "Bombe" — tiền thân của máy tính hiện đại — để phá mã Enigma. Ước tính rằng thành tựu này đã rút ngắn Thế chiến II từ 2 đến 4 năm và cứu hàng triệu sinh mạng. Điều thú vị là Turing không phá Enigma bằng toán học thuần túy mà khai thác lỗi con người: các nhân viên điện báo Đức thường dùng các cụm từ có thể đoán được (như "Heil Hitler" ở cuối tin) để tìm điểm tựa giải mã.

Ithaca — khi AI đọc được văn bản cổ đại bị xóa mờ

Và đây là nơi câu chuyện trở nên thực sự kỳ diệu. Năm 2022, nhóm nghiên cứu DeepMind phối hợp với các nhà ngôn ngữ học tại Oxford và Athens đã công bố Ithaca — mô hình deep learning đầu tiên có thể phục hồi văn bản trên các tấm bia đá Hy Lạp cổ đại bị hỏng, xác định địa điểm và niên đại tạo ra chúng. Ithaca được huấn luyện trên hơn 78.000 văn bản bia ký Hy Lạp từ cơ sở dữ liệu Packard Humanities Institute. Khi nhập một đoạn văn bản có những ký tự bị mất, Ithaca đề xuất các từ điền vào chỗ trống với xác suất tương ứng — và khi kết hợp với chuyên gia người, độ chính xác đạt tới 72%, so với 43% của chuyên gia làm việc đơn độc. Đây là minh chứng đẹp nhất cho AI-human collaboration: không phải AI thay thế nhà nghiên cứu, mà AI và nhà nghiên cứu cùng nhau làm được điều mà không ai làm được một mình.

Từ những xáo trộn chữ cái thô sơ của Caesar đến mạng nơ-ron đọc vết mực nhòa trên đá cẩm thạch 2.500 năm tuổi — hành trình của mật mã học và giải mã chứng minh một điều: con người luôn bị cuốn hút bởi bí ẩn, và không bí ẩn nào là vĩnh viễn không thể giải được, chỉ là chưa đến lúc thôi.