Quay lại trang tin tức

Toàn cảnh công nghệ AI tại World Cup 2026

Xuất bản vào 16 tháng 06, 2026
Toàn cảnh công nghệ AI tại World Cup 2026

Tóm tắt nhanh

World Cup 2026 là cuộc triển khai AI quy mô lớn nhất lịch sử thể thao, với bóng thông minh Adidas Trionda thu 500 dữ liệu mỗi giây, công nghệ việt vị bán tự động sử dụng avatar 3D từng cầu thủ, camera trọng tài được AI ổn định hình ảnh theo thời gian thực, nền tảng Football AI Pro do FIFA và Lenovo xây dựng cho cả 48 đội, Google Gemini hỗ trợ chiến thuật ngay bên đường biên cùng đội Argentina, và robot chó Boston Dynamics tuần tra an ninh. Từ quả bóng đến sân vận động, AI không còn là thử nghiệm mà đã trở thành hạ tầng vận hành cốt lõi.

Quả bóng Adidas Trionda, mô hình 3D cầu thủ chính xác đến từng milimet, robot chó tuần tra sân vận động và Google Gemini ngồi ngay bên đường biên cùng đội tuyển Argentina. World Cup 2026 không chỉ là giải đấu lớn nhất lịch sử với 104 trận đấu tại 16 thành phố ở Mỹ, Canada và Mexico mà còn là cuộc triển khai AI quy mô nhất từng có trong thể thao.

Quả bóng thông minh Adidas Trionda hoạt động như thế nào

Quả bóng chính thức của giải đấu mang tên Adidas Trionda được trang bị cảm biến IMU (Inertial Measurement Unit) hoạt động ở tần số 500Hz, tức là mỗi giây nó thu thập 500 điểm dữ liệu về chuyển động, độ xoáy và thời điểm chính xác bóng chạm chân cầu thủ. Điều này đặc biệt quan trọng cho các tình huống việt vị, bởi cảm biến sẽ xác định chính xác đến từng mili giây thời điểm bóng rời chân người chuyền.

Quả bóng Adidas Trionda với cảm biến bên trong (nguồn FIFA)
Quả bóng Adidas Trionda với cảm biến bên trong (nguồn FIFA)

Dấu thời gian (timestamp) từ cảm biến được đồng bộ ngay lập tức với hệ thống theo dõi cầu thủ, giúp khóa chặt vị trí của mọi cái bóng trên sân tại đúng khoảnh khắc ấy thay vì phụ thuộc vào mắt thường vốn có thể lệch đến nửa giây. Kết quả là những quyết định việt vị được đưa ra nhanh chóng và chính xác hơn bao giờ hết. Công nghệ tối tân này đã lập tức cứu nguy cho đội tuyển Thụy Điển khi xác định chính xác thời điểm chạm bóng của tiền đạo Alexander Isak . Trước đó, niềm vui của người ghi bàn Svanberg phải tạm chùng xuống khi tổ VAR vào cuộc kiểm tra. Trong pha bóng diễn ra với tốc độ chóng mặt, anh dường như đã đứng dưới hàng thủ Tunisia khi bóng được đưa vào vòng cấm, khiến nhiều người tin rằng bàn thắng sẽ bị hủy bỏ. Thế nhưng, chính dữ liệu từ cảm biến chuyển động gắn bên trong quả bóng Trionda của Adidas đã chứng minh Svanberg kịp di chuyển trở lại vị trí hợp lệ, mang về bàn thắng hợp pháp cho Thụy Điển trong sự vỡ òa của người hâm mộ. .

Thụy điển được hưởng lợi với công nghệ trong bóng Adidas Trionda (nguồn FIFA)
Thụy điển được hưởng lợi với công nghệ trong bóng Adidas Trionda (nguồn FIFA)

Công nghệ việt vị bán tự động với mô hình 3D cầu thủ

Công nghệ bắt việt vị bán tự động (SAOT) đã được nâng cấp đáng kể cho World Cup 2026 với điểm nhấn là avatar 3D của từng cầu thủ. Mỗi cầu thủ tham dự giải đấu được quét kỹ thuật số toàn thân chỉ trong khoảng một giây, tạo ra mô hình 3D với kích thước cơ thể chi tiết đến từng bộ phận.

Khi có tình huống cần VAR xem xét, hệ thống sẽ phủ các mô hình 3D này lên dữ liệu theo dõi thời gian thực từ hơn 12 camera chuyên dụng tại mỗi sân vận động. Cách tiếp cận này giải quyết triệt để vấn đề tồn tại lâu nay của đường kẻ việt vị 2D, khi cánh tay, vai hoặc bàn chân cầu thủ có thể bị che khuất từ một góc camera nhất định. Mô hình 3D lấp đầy những khoảng trống đó bằng dữ liệu giải phẫu thực tế, và kết quả hiện lên dưới dạng hoạt hình 3D hoàn chỉnh trên sân cũng như trên sóng truyền hình, thay thế hoàn toàn những đường kẻ phẳng xanh đỏ từng gây bối rối cho khán giả.

Football AI Pro: nền tảng phân tích AI cho cả 48 đội

FIFA đã hợp tác cùng Lenovo để xây dựng Football AI Pro, một nền tảng phân tích được xây dựng trên mô hình nền tảng Football Language của FIFA, vốn được huấn luyện từ hàng trăm triệu điểm dữ liệu bóng đá qua nhiều thập kỷ thi đấu. Đây là lần đầu tiên trong lịch sử World Cup mà tất cả 48 đội tham dự đều có quyền truy cập vào cùng một nền tảng phân tích, thay vì các liên đoàn giàu có hơn nắm lợi thế nhờ công cụ dữ liệu tốt hơn.

Nền tảng này xuất kết quả dưới nhiều định dạng: tóm tắt văn bản, clip video, biểu đồ tương tác và trực quan hóa chiến thuật 3D. Các đội có thể sử dụng nó trước và sau trận đấu để phân tích chiến thuật đối thủ, phát hiện mẫu hình đá phạt, theo dõi cường độ vận động cầu thủ và phân tích lịch sử đối đầu. Tuy nhiên, FIFA cấm sử dụng trong thời gian thi đấu, ban huấn luyện chỉ được dùng vào giờ nghỉ giữa hiệp và sau trận.

Camera trên ngực trọng tài với AI ổn định hình ảnh

Lần đầu tiên trong lịch sử, trọng tài ở cả 104 trận World Cup đều đeo camera trên ngực. Hình ảnh thô từ camera khi trọng tài chạy ở tốc độ cao vốn rung lắc và không thể dùng cho phát sóng, nhưng FIFA chạy mô hình AI ổn định hình ảnh theo thời gian thực trên từng khung hình, tạo ra chất lượng đủ chuẩn phát sóng.

Kết quả là góc nhìn "Referee View" mang đến trải nghiệm chủ quan từ mặt sân, nhanh chóng trở thành một trong những đổi mới phát sóng được yêu thích nhất. Góc nhìn này không chỉ phục vụ giải trí mà còn cung cấp cho các nhà phân tích một nguồn dữ liệu mới: chính xác tầm nhìn mà trọng tài có khi đưa ra quyết định.

Hình ảnh camera gắn trên người trọng tài (nguồn FIFA)
Hình ảnh camera gắn trên người trọng tài (nguồn FIFA)

Google Gemini trên đường biên và trải nghiệm người hâm mộ

Tháng 3 năm 2026, Liên đoàn bóng đá Argentina công bố Google là nhà tài trợ toàn cầu chính thức, với logo Gemini xuất hiện trên áo tập của cả đội nam, nữ và trẻ. Nhưng sự hợp tác này vượt xa quảng cáo thương hiệu, vì ban kỹ thuật Argentina sử dụng Gemini trực tiếp cho phân tích chiến thuật từ video trận đấu, theo dõi dữ liệu tải trọng và phục hồi chấn thương, truy vấn dữ liệu lịch sử về các kịch bản đối đầu cụ thể, cũng như tạo bản tóm tắt đối thủ riêng cho từng cầu thủ.

Đáng chú ý, cầu thủ và huấn luyện viên Argentina sử dụng Gemini qua ứng dụng tiêu chuẩn chứ không qua giao diện tùy chỉnh nào, phản ánh mức độ trưởng thành của các công cụ AI đa năng trong ứng dụng thể thao chuyên nghiệp. Bên cạnh đó, Google cũng triển khai hàng loạt tính năng cho người hâm mộ: tỷ số trực tiếp ghim trên màn hình khóa Android, tóm tắt trận đấu AI trên ứng dụng Gemini, sơ đồ chiến thuật theo yêu cầu, mẫu áo đấu trên Google Photos, điều hướng sân vận động qua Google Maps và thống kê trận đấu trên Google Search.

Robot chó, nhận diện khuôn mặt và an ninh AI

Tại các địa điểm tổ chức, FIFA triển khai robot chó Boston Dynamics Spot cho tuần tra an ninh vòng ngoài và kiểm tra cơ sở vật chất. Những robot này thực hiện tuần tra tự động ở các khu vực hạn chế, với camera trên thân kết nối vào hệ thống AI an ninh của sân vận động, đặc biệt hiệu quả ở những không gian khó giám sát liên tục như khu vực đường hầm, hành lang kỹ thuật ngầm và vòng ngoài sân vào ban đêm.

Chó robot tại World Cup 2026 (nguồn FIFA)
Chó robot tại World Cup 2026 (nguồn FIFA)

Tầng sinh trắc học cũng đáng chú ý không kém: một số sân vận động sử dụng nhận diện khuôn mặt cho việc vào cổng, khuôn mặt bạn chính là vé vào, được xử lý đối chiếu với cơ sở dữ liệu trong chưa đầy một giây. Tuy nhiên, sự hiện diện rộng rãi của giám sát AI cũng đặt ra câu hỏi về quyền riêng tư trong các sự kiện thể thao quy mô lớn.

AI dự đoán nhà vô địch: mỗi mô hình một đáp án

Trước khi giải đấu khởi tranh, nhiều hệ thống AI đã mô phỏng toàn bộ 104 trận đấu để dự đoán nhà vô địch, và kết quả hoàn toàn không thống nhất. ChatGPT dự đoán Tây Ban Nha, mô hình nghiên cứu của FanDuel chọn Pháp (thắng Argentina 3 trên 2 trong trận chung kết), còn Yahoo Sports cùng DataCamp đều đặt cược vào Brazil.

Sự bất đồng này rất đáng suy ngẫm, bởi mọi mô hình đều được cung cấp cùng một nguồn dữ liệu công khai gồm bảng xếp hạng FIFA, điểm ELO, phong độ vòng loại và báo cáo chấn thương, nhưng cách đánh trọng số khác nhau lại tạo ra những kết quả hoàn toàn khác biệt. Và tất nhiên, không mô hình nào có thể tính toán được cú sút chân trái của Messi ở phút 89 trong trận knock-out. Đó vẫn là bóng đá.

AI không còn là thử nghiệm mà là hạ tầng

Điều tạo nên sự khác biệt của World Cup 2026 so với các giải đấu trước không nằm ở bất kỳ công nghệ đơn lẻ nào, mà ở việc AI đã chuyển từ giai đoạn thử nghiệm sang hạ tầng vận hành. Quả bóng thông minh, hệ thống việt vị 3D, camera trọng tài, nền tảng phân tích: không thứ nào trong số này là dự án thí điểm. Chúng là nền tảng hoạt động cơ bản cho mọi trận đấu.

Cảm biến 500Hz trong quả bóng không hiểu gì về bóng đá, nó chỉ đo độ xoáy. Nhưng quyết định mà nó tạo ra, chính xác đến milimet, hiển thị dưới dạng 3D và trả kết quả trong vài giây tình huống của tuyển Thụy Điển là điển hình và từ đó nó sẽ thay đổi cách môn bóng đá được vận hành. Đó mới là hình dạng thực sự của AI khi vận hành ở quy mô lớn.

Thảo luận (0)

Đăng nhập để tham gia thảo luận.

Chưa có bình luận nào. Hãy là người đầu tiên!

Các bài viết liên quan

Gemini đồng hành cùng Argentina và Messi tại World Cup 2026

Gemini đã thắng lớn theo đúng nghĩa đen ngay khi Messi lập cú hat-trick đầu tiên tại World Cup 2026, giúp Argentina đè bẹp Algeria với tỷ số 3-0 và cân bằng kỷ lục 16 bàn thắng của Miroslav Klose. Khoảnh khắc lịch sử này chính là bệ phóng hoàn hảo cho Gemini. Trước đó vào tháng 3/2026, Google và Liên đoàn bóng đá Argentina (AFA) đã đưa ra một quyết định táo bạo: thay vì chỉ in logo trên áo tập, họ ký hợp đồng để AI này tham gia hỗ trợ chiến thuật và đưa ra các quyết định chuyên môn. Đến nay, thương vụ đặt cược này đã chứng minh đó là một chiến lược hoàn toàn đúng đắn. Từ áo tập đến phòng họp chiến thuật Thỏa thuận giữa AFA và Google được công bố tại Times Square, New York, một địa điểm được chọn có chủ ý để gây chú ý với truyền thông toàn cầu. Logo Gemini xuất hiện trên toàn bộ trang phục tập luyện của đội tuyển nam, nữ lẫn các lứa trẻ Argentina, đứng ngang hàng với Adidas và American Express trong tầng tài trợ cao nhất của AFA. Nhưng phần thú vị không nằm ở chiếc áo. Theo thông tin từ Inside World Football, ban huấn luyện Argentina sẽ dùng Gemini cho ba việc cụ thể: phân tích chiến thuật, phòng ngừa chấn thương và hỗ trợ ra quyết định. Nói cách khác, Gemini có mặt trong những cuộc họp mà trước đây chỉ có Scaloni và các trợ lý của ông được ngồi. Google không tiết lộ cụ thể những công cụ Gemini nào được tích hợp vào quy trình làm việc của AFA. Điều duy nhất rõ ràng là họ đang dùng World Cup để đưa Gemini vào thực tế bóng đá chuyên nghiệp, và kết quả sẽ được chấm điểm công khai. Gemini làm gì trong phòng thay đồ? Argentina đến World Cup 2026 với tư cách nhà đương kim vô địch. Mọi quyết định của Scaloni, từ danh sách triệu tập đến lựa chọn đội hình, đều bị soi kỹ hơn bất kỳ đội nào khác, và đây cũng chính là lý do Argentina trở thành phòng thí nghiệm lý tưởng nhất mà Google từng có cho Gemini trong môi trường bóng đá chuyên nghiệp và đặc biệt là ở giải đấu lớn. Phân tích chiến thuật Gemini được dùng để xử lý dữ liệu trận đấu của cả Argentina lẫn đối thủ, bao gồm thống kê di chuyển, mẫu hình tấn công và điểm yếu phòng thủ. Thay vì ban huấn luyện phải ngồi xem lại hàng giờ video, AI tổng hợp và đưa ra các sơ đồ chiến thuật được tạo tự động điều này sẽ tiết kiệm đáng kể thời gian chuẩn bị trước mỗi trận. Phòng ngừa chấn thương Đây là bài toán mà mọi đội bóng lớn đều muốn giải, đặc biệt khi Messi và nhiều trụ cột đã ở độ tuổi cần quản lý tải lượng tập luyện cẩn thận. Gemini phân tích dữ liệu sinh học và lịch sử chấn thương để đưa ra cảnh báo sớm, giúp ban huấn luyện điều chỉnh cường độ tập trước khi vấn đề thực sự xảy ra. Đó là lý do vì sao vừa ghi hat-trick Scaloni đã quyết định thay Messi ra để đảm bảo thể lực và an toàn cho các trận đấu sau. AI trong phòng ngừa chấn thương tất nhiên không phải diều mới mẻ gì khi mà tại Premier League đã có Microsoft làm đối tác cho mục đích tương tự. Điểm khác biệt lần này là Gemini được tích hợp trực tiếp vào quy trình của một đội tuyển dự giải lớn, không chỉ ở cấp câu lạc bộ. Phía người hâm mộ: tạo ảnh Messi, theo dõi tỉ số không cần mở khóa màn hình Song song với việc hỗ trợ ban huấn luyện, Gemini cũng triển khai một loạt tính năng hướng đến người hâm mộ, và đây mới là phần mà hàng trăm triệu người thực sự chạm vào. Gemini cho phép tạo nội dung về cầu thủ luôn Người dùng có thể tạo ảnh, bài nhạc và nội dung kỹ thuật số gắn với các cầu thủ Argentina như Messi ngay trong ứng dụng Gemini. Tính năng này được thiết kế để đưa trải nghiệm World Cup đến gần hơn với những người không thể đến sân trực tiếp. Tỉ số thời gian thực và bản tin tự động Trên Google Search, tỉ số trận đấu được ghim lên màn hình khóa và cập nhật theo thời gian thực, có animation riêng cho bàn thắng và thẻ đỏ mà không cần mở khóa điện thoại. Với người dùng Gemini trả phí, tính năng Scheduled Actions cho phép thiết lập bản tin bóng đá tự động mỗi ngày, bao gồm tỉ số, tin tức và lịch thi đấu, được giao đúng giờ đã chọn mà không cần nhắc lại mỗi ngày. Hạ tầng phục vụ ngày thi đấu Google cập nhật Street View tại 16 sân vận động chủ nhà và tối ưu hóa lộ trình trên Waze cho ngày thi đấu. Waze còn hiển thị tỉ số trực tiếp khi xe dừng đèn đỏ, để người lái không cần cầm điện thoại trong lúc di chuyển. World Cup 2026 là phép thử thật sự cho AI trong thể thao Google không chỉ tài trợ cho Argentina. Gemini còn có mặt trên áo của Pháp, Morocco, Iraq, Thổ Nhĩ Kỳ và Mỹ, trong khi Pixel là điện thoại chính thức của đội Pháp với Gemini được dùng cho liên lạc nội bộ. Đây rõ ràng là chiến lược tổng thể của Google và không phải một hợp đồng đơn lẻ. Điều khiến World Cup 2026 trở nên đặc biệt là nó sẽ trả lời một câu hỏi mà không phòng lab nào làm được: người dùng thực sự dùng AI để làm gì khi có một giải đấu World Cup 2026 kéo dài 6 tuần với 104 trận? Các tính năng chạy trên sức hút ban đầu sẽ tắt dần sau vòng bảng. Những gì người dùng còn tiếp tục dùng đến tận trận chung kết mới là câu trả lời thật cho câu hỏi AI phù hợp ở đâu trong cuộc sống hàng ngày, và Google biết rõ điều đó. Giám đốc truyền thông Google khu vực Mỹ Latinh, Flor Sabatini, phát biểu rằng World Cup 2026 sẽ đánh dấu một trước và sau trong lịch sử bóng đá nhờ AI. Câu nói nghe có vẻ marketing, nhưng thực tế là lần đầu tiên một mô hình AI lớn được tích hợp vào chuẩn bị của đội đương kim vô địch, ngay giữa một giải đấu được xem nhiều nhất hành tinh. World Cup 2026 là bài kiểm tra thật của Gemini Điểm đáng chú ý nhất của toàn bộ câu chuyện này không phải logo Gemini trên áo Messi. Đó là việc Argentina tất nhiên vẫn là đội được kỳ vọng nhất và bị soi kỹ nhất, với áp lực bảo vệ chức vô địch vẫn đặt một phần quy trình chuẩn bị của mình vào AI. Nếu Argentina thành công, Gemini có một case study không thể mua bằng tiền quảng cáo. Nếu Argentina thất bại mà ban huấn luyện quy trách nhiệm một phần cho AI, câu chuyện sẽ đi theo chiều ngược lại hoàn toàn. Dù kết quả thế nào, đây là lần đầu tiên AI phải chịu trách nhiệm ở một sân khấu thực sự có giá trị, không phải benchmark, không phải demo, mà là World Cup. Với người dùng AI, điều đáng theo dõi không chỉ là Argentina có vô địch hay không, mà là xem liệu Gemini có thực sự thay đổi cách một đội bóng vận hành, hay chỉ là logo trên áo tập đẹp hơn mọi năm.

Nam
17 thg 6, 2026
Spotify ra mắt trợ lý AI trò chuyện

Spotify biến tìm nhạc thành một cuộc trò chuyện liên tục: người dùng có thể yêu cầu phát nghệ sĩ mới, đổi không khí, lưu bài hát và hỏi về lịch sử nghe mà không rời ứng dụng. Trợ lý mới đưa AI từ gợi ý thụ động thành công cụ hiểu yêu cầu và thực hiện hành động. Spotify biến tìm kiếm thành cuộc trò chuyện như thế nào? Theo thông báo chính thức của Spotify, người dùng đủ điều kiện sẽ thấy cách trò chuyện mới tại màn hình Home và Now Playing trên ứng dụng di động. Họ có thể gõ câu hỏi hoặc nhấn nút micro để nói, sau đó tiếp tục trao đổi qua nhiều lượt thay vì nhập lại một truy vấn hoàn toàn mới. Điểm đáng chú ý là trợ lý không chỉ trả về một danh sách bài hát. Nó có thể điều khiển nội dung đang phát, giải thích thông tin liên quan và thực hiện hành động như lưu bài, thêm bài vào hàng đợi hoặc theo dõi nghệ sĩ. Ví dụ, người nghe có thể yêu cầu một số nghệ sĩ mà mình chưa từng nghe, rồi bổ sung rằng họ muốn nhạc mới phát hành hoặc không khí sôi động hơn. Trợ lý AI mới làm được những gì? Spotify chia trải nghiệm thành ba nhóm chính gồm chọn nội dung, tìm hiểu nội dung đang phát và khám phá thói quen nghe. Trong âm nhạc, người dùng có thể yêu cầu một phong cách, một nghệ sĩ hoặc một tâm trạng, sau đó thay đổi lựa chọn bằng câu hỏi tiếp theo. Trong podcast và sách nói, họ có thể hỏi thêm về khách mời, tác giả hoặc những chương trình liên quan. Trợ lý cũng có quyền truy cập vào ngữ cảnh cá nhân mà một chatbot thông thường không tự có. Nó hiểu playlist, nghệ sĩ yêu thích, bài nghe lặp lại và lịch sử phát của tài khoản, vì vậy người dùng có thể hỏi lần đầu mình nghe một bài là khi nào hoặc gần đây đang nghe nhiều thể loại nào. Đây là lợi thế lớn vì câu trả lời gắn với dữ liệu sử dụng thực tế thay vì chỉ dựa trên kiến thức chung. Một yêu cầu có thể được chỉnh qua nhiều lượt Hãy hình dung bạn đang chuẩn bị một buổi chạy bộ nhưng không biết nên mở playlist nào. Bạn có thể yêu cầu nhạc có nhịp nhanh từ các nghệ sĩ chưa từng nghe, tiếp tục thêm một ca sĩ yêu thích, rồi giới hạn kết quả ở các bản phát hành gần đây. Khi gặp bài phù hợp, bạn có thể yêu cầu lưu bài ngay mà không chuyển qua nhiều màn hình. Tính năng này khác AI DJ và ChatGPT ra sao? AI DJ chủ yếu đóng vai trò người dẫn chương trình, chọn nhạc và giới thiệu bằng giọng nói, trong khi trợ lý mới mở rộng hội thoại sang Home và Now Playing. Người dùng không chỉ nghe lựa chọn do hệ thống đưa ra mà còn có thể đặt câu hỏi, thay đổi hướng đề xuất và yêu cầu ứng dụng thực hiện tác vụ cụ thể. Spotify cũng từng kết nối dịch vụ với ChatGPT, nhưng trải nghiệm mới diễn ra trực tiếp bên trong ứng dụng nghe nhạc. Điều này có nghĩa là người dùng không cần rời Spotify, liên kết một dịch vụ khác rồi quay lại để phát nội dung. Theo TechCrunch, Spotify kết hợp công nghệ AI do hãng phát triển với model từ nhiều nhà cung cấp và chọn công nghệ phù hợp cho từng tác vụ. Spotify chưa công bố tên model cụ thể hoặc cách định tuyến yêu cầu. Vì vậy, chưa thể kết luận trợ lý mạnh đến đâu ở các câu hỏi kiến thức, nhưng chiến lược nhiều model cho thấy hãng không muốn phụ thuộc vào một nhà cung cấp duy nhất. Người dùng cần lưu ý gì trước khi thử? Tính năng đang được triển khai dần dưới dạng beta cho người dùng Premium từ 18 tuổi tại Mỹ, Ireland và Thụy Điển. Trợ lý hiện hỗ trợ tiếng Anh trên iOS và Android, vì vậy người dùng tại Việt Nam chưa nằm trong phạm vi được công bố. Spotify thừa nhận phản hồi có thể chưa luôn chính xác trong giai đoạn thử nghiệm và ý kiến của người dùng sẽ được dùng để cải thiện sản phẩm. Trước khi tin vào thông tin về ngày phát hành, nguồn cảm hứng của bài hát hoặc tiểu sử nghệ sĩ, người nghe vẫn nên kiểm tra nguồn chính thức nếu dữ kiện đó quan trọng. Kiểm tra tài khoản có thuộc khu vực và độ tuổi được hỗ trợ hay không. Thử cả nhập chữ và giọng nói để xem cách nào hiểu ý định tốt hơn. Bắt đầu bằng yêu cầu rõ ràng, sau đó dùng câu hỏi nối tiếp để tinh chỉnh. Không xem câu trả lời beta là nguồn duy nhất cho thông tin cần độ chính xác cao. Spotify đang thay đổi cách khám phá âm thanh Điểm quan trọng nhất không phải là Spotify có thêm một chatbot, mà là hội thoại đang trở thành lớp điều khiển cho cả nội dung và hành động trong ứng dụng. Khi AI hiểu được thư viện, lịch sử nghe và nội dung đang phát, một câu nói có thể thay thế nhiều lần tìm kiếm, mở menu và chỉnh hàng đợi. Nếu được quyền thử beta, người dùng nên kiểm tra ba tình huống gồm khám phá nghệ sĩ mới, hỏi về lịch sử nghe và tinh chỉnh playlist qua nhiều lượt. Ba phép thử này sẽ cho thấy trợ lý thực sự hiểu sở thích cá nhân hay chỉ biến câu lệnh thành một cách tìm kiếm dài hơn.

Nam
19 thg 7, 2026
Microsoft tung 7 mô hình AI mới thách thức OpenAI

Microsoft vừa tung cùng lúc 7 mô hình AI mới tại Build 2026, trong đó MAI-Thinking-1 sở hữu 35 tỉ tham số và được huấn luyện hoàn toàn từ dữ liệu sạch. Đây là lần đầu tiên gã khổng lồ phần mềm công khai thách thức vị thế của chính đối tác chiến lược OpenAI trên sân chơi mô hình AI. MAI-Thinking-1 và tham vọng suy luận AI của riêng Microsoft Tâm điểm của sự kiện Build 2026 chính là MAI-Thinking-1, mô hình AI suy luận đầu tiên do Microsoft tự phát triển từ đầu. Với khoảng 35 tỉ tham số hoạt động, mô hình này được thiết kế để xử lý các tác vụ đòi hỏi suy luận nhiều bước, làm việc với ngữ cảnh dài và hỗ trợ lập trình phức tạp, tất cả với chi phí thấp hơn so với nhiều mô hình AI quy mô lớn hiện nay. Điểm đáng chú ý nhất là Microsoft khẳng định MAI-Thinking-1 được huấn luyện từ dữ liệu sạch, không sử dụng phương pháp chắt lọc (distillation) từ các mô hình AI của bên thứ ba. Nói cách khác, đây là lời tuyên bố rõ ràng rằng Microsoft đủ năng lực nghiên cứu AI độc lập mà không cần "mượn" tri thức từ GPT hay bất kỳ mô hình nào khác. Theo kết quả đánh giá mà Microsoft công bố, MAI-Thinking-1 đạt hiệu suất cạnh tranh trong các bài kiểm tra lập trình và được đánh giá tương đương nhiều mô hình AI hàng đầu hiện nay trong các thử nghiệm đánh giá mù. Con số 35 tỉ tham số cũng cho thấy Microsoft đang hướng tới hiệu quả thay vì chạy đua kích thước, vì nhiều mô hình đối thủ có số tham số lớn hơn gấp nhiều lần nhưng chưa chắc đã vượt trội về chất lượng đầu ra. Từ lập trình đến giọng nói: hệ sinh thái AI khép kín Không chỉ dừng ở mô hình suy luận, Microsoft còn giới thiệu thêm 6 mô hình AI mới nhằm xây dựng một hệ sinh thái AI hoàn chỉnh phục vụ cả người dùng cá nhân lẫn doanh nghiệp. Từ lập trình, tạo ảnh cho đến giọng nói, mỗi mảnh ghép đều có mô hình chuyên biệt. Lập trình thông minh hơn với MAI-Code-1-Flash Đối với các lập trình viên, MAI-Code-1-Flash là tin vui lớn. Mô hình này chuyên về sinh mã nguồn và hỗ trợ phát triển phần mềm, được tối ưu hóa cho các tác vụ lập trình thực tế. Điều quan trọng hơn là nó sẽ được tích hợp trực tiếp vào GitHub Copilot và Visual Studio Code, hai công cụ mà hàng triệu lập trình viên sử dụng hằng ngày. Điều này có nghĩa là trải nghiệm gợi ý mã nguồn và viết code tự động sẽ được nâng cấp đáng kể ngay trên môi trường làm việc quen thuộc. Hình ảnh và giọng nói: hai mảnh ghép còn thiếu Ở mảng sáng tạo nội dung, Microsoft công bố MAI-Image-2.5 cùng phiên bản MAI-Image-2.5-Flash. Đây là các mô hình tạo sinh và chỉnh sửa hình ảnh thế hệ mới, trong đó phiên bản Flash được tối ưu cho khả năng phản hồi nhanh, phù hợp với các ứng dụng cần xử lý thời gian thực như chỉnh sửa ảnh trực tiếp hay tạo hình minh họa theo yêu cầu. Về lĩnh vực âm thanh, Microsoft giới thiệu hai mô hình quan trọng: MAI-Voice-2 với khả năng tổng hợp giọng nói tự nhiên hơn và hỗ trợ thêm nhiều ngôn ngữ mới MAI-Transcribe-1.5 chuyển đổi giọng nói thành văn bản với tốc độ xử lý nhanh hơn đáng kể so với thế hệ trước Ngoài ra, Microsoft cũng phát triển thêm những biến thể được tối ưu riêng cho nền tảng Microsoft Foundry, giúp doanh nghiệp dễ dàng xây dựng và triển khai ứng dụng AI của riêng mình. Chiến lược giảm phụ thuộc OpenAI Nếu như trước đây Microsoft chủ yếu được nhìn nhận là đối tác cung cấp hạ tầng và nền tảng triển khai cho OpenAI, thì Build 2026 cho thấy hãng đang từng bước sở hữu đầy đủ các mảnh ghép quan trọng trong hệ sinh thái AI. Microsoft hiện đã có mô hình suy luận, mô hình lập trình, mô hình tạo ảnh, mô hình tổng hợp giọng nói và mô hình nhận dạng giọng nói, tất cả được kết nối trực tiếp với hệ sinh thái Azure, Copilot và Microsoft Foundry. Chiến lược này giúp Microsoft chủ động hơn trong việc phát triển công nghệ cốt lõi, đồng thời giảm rủi ro khi phụ thuộc vào các đối tác bên ngoài. Cụ thể hơn, việc sở hữu mô hình AI riêng cho phép Microsoft kiểm soát lộ trình sản phẩm, tối ưu chi phí vận hành và tùy chỉnh mô hình theo nhu cầu cụ thể của từng dịch vụ mà không phải chờ đợi hay đàm phán với bên thứ ba. Cuộc đua mô hình AI sẽ đi về đâu? Việc ra mắt đồng thời 7 mô hình AI mới cho thấy Microsoft đang đầu tư mạnh vào các công nghệ nền tảng nhằm cạnh tranh trực tiếp với những tên tuổi lớn như OpenAI, Google hay Anthropic. Khi đối tác lớn nhất của OpenAI quyết định tự xây mô hình AI riêng, đó là tín hiệu rõ ràng nhất rằng cuộc đua AI đã bước sang giai đoạn mới, nơi không ai muốn đặt tương lai công nghệ của mình vào tay kẻ khác. Với các nhà phát triển và doanh nghiệp, đây là lúc để theo dõi sát nền tảng Microsoft Foundry và hệ sinh thái Azure AI, vì những công cụ mà trước đây chỉ có OpenAI mới cung cấp sắp xuất hiện ngay trong hệ sinh thái Microsoft quen thuộc. Build 2026 có thể sẽ được nhớ đến như thời điểm Microsoft chính thức phát đi tuyên ngôn về một hệ sinh thái AI độc lập, toàn diện và mang đậm dấu ấn riêng.

Nam
4 thg 6, 2026
NotebookLM đổi tên thành Gemini Notebook và có gì mới?

NotebookLM đã chính thức mang tên Gemini Notebook từ ngày 16/7/2026. Tên mới đánh dấu bước chuyển từ công cụ hỏi đáp tài liệu sang không gian nghiên cứu AI có thể chạy code, phân tích dữ liệu, tạo báo cáo đa định dạng và theo người dùng sang Gemini cũng như Google Search. Bài viết này giải thích điều gì thực sự thay đổi, tính năng nào được giữ lại và ai có thể sử dụng các nâng cấp mới. Gemini Notebook vẫn là NotebookLM quen thuộc Google khẳng định Gemini Notebook vẫn là một sản phẩm độc lập, tập trung vào nghiên cứu và học tập. Người dùng hiện tại không phải chuyển dữ liệu sang dịch vụ khác. Notebook, nguồn, ghi chú và nội dung đã tạo vẫn nằm trong cùng trải nghiệm, trong khi tên mới cho thấy sản phẩm đang trở thành một phần rõ ràng hơn của hệ sinh thái Gemini. Cốt lõi của công cụ cũng không đổi. Người dùng tập hợp PDF, website, video YouTube, tệp âm thanh, Google Docs hoặc Google Slides vào từng notebook. Khi đặt câu hỏi, Gemini Notebook trả lời dựa trên những nguồn đã chọn và đưa ra trích dẫn để người đọc mở đúng đoạn tài liệu liên quan. Cách làm này đặc biệt hữu ích khi cần kiểm chứng một nhận định thay vì chỉ nhận câu trả lời trôi nổi từ chatbot. Việc đổi tên đến sau hành trình bắt đầu với Project Tailwind tại Google I/O 2023. Theo Google, sản phẩm đã có hơn 30 triệu người dùng và hơn 600.000 tổ chức sử dụng. Tên Gemini Notebook vì thế phản ánh giai đoạn trưởng thành mới, khi một notebook không còn chỉ là nơi đọc tài liệu mà trở thành không gian để nghiên cứu, phân tích và tạo đầu ra hoàn chỉnh. Gemini Notebook chạy code như thế nào? Thay đổi kỹ thuật đáng chú ý nhất là mỗi notebook có thể được trang bị một máy tính đám mây bảo mật. Hiểu đơn giản, Gemini Notebook có một môi trường riêng để viết và chạy code phục vụ nhiệm vụ nghiên cứu. Công cụ có thể làm sạch dữ liệu, tính toán, so sánh nhiều bảng số liệu, dựng biểu đồ hoặc kiểm tra một giả thuyết thay vì chỉ tóm tắt văn bản. Từ hỏi đáp tài liệu đến phân tích có hành động Trước đây, giá trị nổi bật của NotebookLM nằm ở khả năng đọc nhiều nguồn và trả lời có trích dẫn. Với môi trường chạy code, Gemini Notebook tiến thêm một bước: nó có thể thao tác trên dữ liệu để tạo ra kết quả mới. Một nhà phân tích có thể nhập dữ liệu từ nhiều quốc gia với định dạng khác nhau, yêu cầu công cụ chuẩn hóa chúng, chạy phép tính rồi tạo biểu đồ và báo cáo. Google cho biết hệ thống còn có hơn 100 kỹ năng phần mềm được tuyển chọn. Tuy vậy, đây vẫn là AI có thể mắc lỗi. Người dùng nên kiểm tra code, phép tính, dữ liệu đầu vào và kết luận, nhất là khi kết quả được dùng cho tài chính, pháp lý, y tế hoặc quyết định kinh doanh. Lưu ý: Khả năng agent và chạy code chưa mở đồng loạt cho mọi tài khoản. Google AI Ultra cùng một số gói Workspace được hỗ trợ trước; Google cho biết tính năng sẽ tiếp tục được triển khai cho người dùng Pro trên web. Gemini Notebook tạo được những định dạng đầu ra nào? Gemini Notebook không còn giới hạn ở báo cáo dạng chữ. Từ dữ liệu và tài liệu trong notebook, người dùng có thể yêu cầu tạo biểu đồ PNG hoặc SVG, báo cáo PDF, tệp Word, Markdown, văn bản, CSV, JSON, Excel và PowerPoint. Hệ thống cũng hỗ trợ hình ảnh, bảng dữ liệu, infographic và slide, đồng thời cho phép chỉnh sửa phiên bản sau khi tạo. Một nguồn, nhiều cách trình bày Cùng một bộ tài liệu đào tạo có thể được chuyển thành báo cáo cho quản lý, slide cho buổi thuyết trình, bảng tính cho nhóm vận hành và Audio Overview cho người muốn nghe. Học sinh có thể tạo thẻ ghi nhớ, câu đố, sơ đồ tư duy hoặc Video Overview. Nhóm nội dung có thể dựng bảng so sánh và infographic mà không phải sao chép dữ liệu qua quá nhiều công cụ. Nghiên cứu: tìm nguồn, đọc chéo tài liệu, trích dẫn và tạo báo cáo có biểu đồ. Phân tích dữ liệu: chuẩn hóa bảng, chạy code, xuất CSV hoặc XLSX và trực quan hóa kết quả. Học tập: tạo hướng dẫn ôn tập, flashcard, quiz, audio, video và sơ đồ tư duy. Làm việc nhóm: xây kho kiến thức, chia sẻ quyền xem hoặc chỉnh sửa và theo dõi mức sử dụng. Điểm đáng giá không nằm ở số lượng định dạng, mà ở việc chúng được tạo từ cùng một tập nguồn. Khi muốn thay đổi góc nhìn hoặc đối tượng người đọc, người dùng có thể điều chỉnh yêu cầu mà không phải dựng lại toàn bộ ngữ cảnh. Gemini Notebook xuất hiện ở đâu trong hệ sinh thái Google? Gemini Notebook đã bắt đầu xuất hiện trong ứng dụng Gemini. Notebook tạo ở sản phẩm độc lập có thể hiển thị trong phần điều hướng của Gemini; việc đổi tên notebook, thêm nguồn hoặc cập nhật hướng dẫn tùy chỉnh được đồng bộ giữa các ứng dụng. Người dùng vì thế có thể tiếp tục trò chuyện với kho kiến thức mà không phải luôn quay về một tab riêng. Google cũng dự kiến đưa notebook vào AI Mode trong Search. Khi hoàn thiện, hướng đi này có thể biến notebook thành lớp ngữ cảnh cá nhân đi cùng người dùng từ nghiên cứu trên web đến trò chuyện với Gemini. Dù vậy, notebook được chia sẻ và hội thoại trong Gemini có quy tắc hiển thị, chia sẻ và lưu giữ dữ liệu riêng; người dùng tổ chức nên đọc chính sách của gói Workspace đang sử dụng. Cách bắt đầu với tên gọi mới Mở Gemini Notebook bằng tài khoản Google và tạo một notebook cho một mục tiêu cụ thể. Thêm các nguồn đáng tin cậy, sau đó kiểm tra cách công cụ phân loại và trích dẫn chúng. Đặt câu hỏi hẹp trước, rồi mới yêu cầu nghiên cứu sâu, phân tích dữ liệu hoặc tạo tệp đầu ra. Kiểm tra trích dẫn, phép tính và phiên bản cuối trước khi chia sẻ. Người dùng cũ có thể tiếp tục truy cập địa chỉ NotebookLM quen thuộc trong giai đoạn chuyển đổi. Slug công cụ trên 4AIVN cũng được giữ nguyên để các liên kết cũ không bị đứt, trong khi tên và nội dung đã được cập nhật thành Gemini Notebook. Đổi tên có làm Gemini Notebook hữu ích hơn không? Bản thân cái tên không thay đổi chất lượng nghiên cứu. Điều làm lần đổi tên này đáng chú ý là Google đang ghép ba lớp năng lực vào một sản phẩm: nguồn có trích dẫn, môi trường chạy code và khả năng đưa notebook sang Gemini cũng như Search. Nếu được triển khai ổn định, Gemini Notebook có thể rút ngắn quãng đường từ đọc tài liệu đến phân tích và giao sản phẩm hoàn chỉnh. Tuy nhiên, không phải tính năng nào cũng có sẵn cho mọi người ngay lập tức, và đầu ra do AI tạo vẫn cần kiểm tra. Cách dùng hiệu quả nhất vẫn là chọn nguồn tốt, chia notebook theo mục tiêu rõ ràng, yêu cầu đầu ra cụ thể và giữ con người ở bước phê duyệt cuối.

Liên
17 thg 7, 2026