Quay lại trang tin tức

Muse Glimmer: Trải nghiệm mới khi chạy AI local của Meta

Xuất bản vào 12 tháng 08, 2026
Muse Glimmer: Trải nghiệm mới khi chạy AI local của Meta

Tóm tắt nhanh

Meta ra mắt Muse Glimmer ngày 10/8/2026, mô hình mở 30 tỷ tham số theo giấy phép Apache 2.0, tối ưu cho tác vụ agent chạy trực tiếp trên máy cá nhân. Cấu hình khuyến nghị là GPU 24GB VRAM trở lên, nhưng bản lượng tử hóa của Unsloth mở rộng khả năng chạy xuống cả RTX 5060 Ti 16GB. Drafter DFlash giúp tăng tốc sinh token tới 3,1 lần trên RTX 5090. Model đọc được cả ảnh lẫn văn bản, tương thích endpoint OpenAI/Anthropic nên dễ ghép với Hermes Agent. Tuy nhiên hệ sinh thái tối ưu vẫn còn mới, một số tích hợp và benchmark tốc độ cho cấu hình tầm trung chưa hoàn thiện.

Bạn giao cho một agent AI đọc thư mục hóa đơn, soạn nháp email và đối chiếu lịch làm việc, nhưng toàn bộ là chay local hết. Đó là điều Muse Glimmer của Meta hứa hẹn, tuy nhiên rất nhiều điều cần xem xét trong những tình huống sử dụng thực tế sau hứa hẹn của Meta.

Cài đặt và lần chạy đầu tiên

Meta Superintelligence Labs công bố Muse Glimmer ngày 10 tháng 8 năm 2026, một mô hình mở 30 tỷ tham số theo giấy phép Apache 2.0. Theo thông báo chính thức, trọng số được đăng thẳng lên Hugging Face nên bước đầu tiên chỉ là tải file về, không cần xin API key hay đăng ký tài khoản nào.

Từ lúc tải xong đến khi gõ câu lệnh đầu tiên, trải nghiệm gần giống việc cài một ứng dụng offline hơn là gọi một dịch vụ cloud. Chạy qua Ollama hoặc LM Studio, người dùng chỉ cần trỏ tới file model rồi mở một terminal hoặc giao diện chat cục bộ. Không có màn hình loading chờ phản hồi từ server, không có thông báo giới hạn request, vì mọi thứ diễn ra ngay trên GPU của máy.

Muse Glimmer không còn kén GPU như lúc mới ra mắt

Cấu hình Meta khuyến nghị ban đầu là GPU 24 GB VRAM trở lên, tức là cần đến RTX 4090 hoặc RTX 5090 thì mới chạy được. Với phần đông người dùng phổ thông, đây vẫn là ngưỡng khá cao vì các card đó thuộc phân khúc giá cao thường cho mọi người gaming chứ không cho người dùng phổ thông.

Điều thay đổi mọi thứ là bản lượng tử hóa động (dynamic quants) do Unsloth phát hành ngay sau đó, hạ yêu cầu bộ nhớ xuống còn khoảng 18 GB RAM và VRAM kết hợp. Mức này vừa đủ để một chiếc RTX 5060 Ti 16 GB, dòng card tầm trung dễ mua hơn nhiều so với RTX 4090 hay 5090, chạy được Muse Glimmer khi kết hợp thêm một phần bộ nhớ hệ thống. Với người mới muốn thử nghiệm mà chưa sẵn sàng đầu tư một dàn máy giá cao thì đây là cánh cửa thực tế hơn nhiều.

Đánh đổi khi dùng bản nén cho RTX 5060

Không có bữa trưa nào miễn phí. Bản lượng tử hóa động của Unsloth cho phép chạy trên phần cứng nhẹ hơn, nhưng đổi lại độ chính xác giảm nhẹ so với bản chạy đầy đủ trên GPU 24 GB trở lên, và tốc độ sinh token cũng chậm hơn khi phải san sẻ một phần công việc sang RAM hệ thống. Với các tác vụ đơn giản như tóm tắt văn bản hay trả lời câu hỏi ngắn, sự khác biệt khó nhận ra. Nhưng với chuỗi tác vụ agentic dài, gọi nhiều công cụ liên tiếp, cấu hình 24 GB trở lên vẫn cho trải nghiệm ổn định hơn.

Dùng thử cho việc thật

Điểm khiến Muse Glimmer khác một chatbot thông thường nằm ở khả năng duy trì một chuỗi hành động dài thay vì chỉ trả lời từng câu hỏi rời rạc. Ba kịch bản dưới đây là cách hình dung rõ nhất việc đó nghĩa là gì trong công việc hằng ngày.

Kịch bản đầu tiên là dọn hộp thư. Giao cho agent một thư mục email chưa đọc, nó có thể phân loại theo mức độ khẩn cấp, soạn nháp trả lời cho những email lặp lại nội dung quen thuộc, rồi để người dùng duyệt lại trước khi gửi. Vì mô hình chạy cục bộ, nội dung nhạy cảm trong hộp thư không rời khỏi máy trong suốt quá trình đó.

Kịch bản thứ hai liên quan đến việc sửa lỗi code. Đưa cho agent một traceback lỗi dạng ảnh chụp màn hình, nhờ bộ mã hóa nhận thức riêng, Muse Glimmer đọc được cả ảnh lẫn văn bản mà không cần gõ lại nội dung lỗi bằng tay. Nó tìm file liên quan, đề xuất sửa, chạy kiểm tra rồi tự xem lại kết quả trả về, và nếu lần sửa đầu chưa đúng, nó thử lại theo một hướng khác thay vì dừng lại chờ người dùng chỉ dẫn tiếp.

Kịch bản thứ ba là ghép nối với Hermes Agent hoặc một pipeline agent tự xây. Vì Muse Glimmer hỗ trợ endpoint tương thích OpenAI và Anthropic khi chạy qua LM Studio, việc thay thế một model cloud bằng Muse Glimmer chạy local chỉ là đổi vài dòng cấu hình, không cần viết lại toàn bộ logic agent.

Tốc độ thực sự khá nhanh

Con số thô dễ khiến người đọc lướt qua, nhưng đặt vào ngữ cảnh thực tế thì khác. Meta đo được tốc độ sinh token trên RTX 5090 tăng từ 74,9 lên 233,4 token mỗi giây nhờ cơ chế speculative decoding của drafter DFlash, một mức tăng gấp 3,1 lần. Với người dùng, khoảng cách đó là sự khác biệt giữa việc phải đợi một câu trả lời dài xuất hiện từng chữ một, và việc gần như thấy toàn bộ đoạn văn hiện ra ngay khi vừa gõ xong câu lệnh.

Trên MacBook, mức tăng khiêm tốn hơn nhưng vẫn đáng kể: M5 Max đi từ 26,6 lên 50,2 token mỗi giây, còn M4 Max từ 23,7 lên 37,8. Nói cách khác, ngay cả trên laptop thay vì desktop gaming, người dùng vẫn cảm nhận được sự khác biệt rõ ràng giữa việc bật và tắt drafter.

Nhược điểm vẫn chưa được tối ưu

Trải nghiệm mượt như mô tả ở trên chủ yếu đến từ phần cứng mạnh và các tích hợp đã chạy ổn định. Thực tế ở thời điểm ra mắt, không phải mọi thứ đều sẵn sàng ngay. Meta chỉ công bố các tích hợp tối ưu với llama.cpp, MLX và ExecuTorch sẽ xuất hiện "trong những ngày tới", nghĩa là những người thử nghiệm sớm phải tự ghép nối qua các bản build chưa chính thức, dễ gặp lỗi runtime hoặc hiệu năng không như benchmark công bố.

Bản thân cơ chế speculative decoding với drafter DFlash cũng chưa chắc mang lại mức tăng tốc như trên RTX 5090 hay dòng MacBook Max cho mọi cấu hình. Với GPU tầm trung hoặc bản lượng tử hóa chạy trên RTX 5060 Ti, Meta và Unsloth đều chưa công bố số liệu tốc độ chính thức, nên người dùng phải tự đo trên máy của mình thay vì tin vào con số quảng cáo cho cấu hình cao cấp.

Một điểm khác ít được nhắc tới là quản lý bộ nhớ khi chạy chuỗi tác vụ agentic dài. Vì phải giữ ngữ cảnh qua nhiều lượt gọi công cụ, một số người dùng thử nghiệm sớm phản ánh tình trạng chậm dần hoặc tốn thêm VRAM khi phiên làm việc kéo dài, khác với cảm giác mượt mà ở vài câu lệnh đầu. Đây là kiểu vấn đề mà các dịch vụ cloud trưởng thành đã tối ưu qua nhiều năm vận hành, còn hệ sinh thái chạy local cho riêng Muse Glimmer vẫn còn quá mới để khẳng định đã ổn định.

Trước khi cho agent chạm vào việc thật

Chạy cục bộ không tự động đồng nghĩa với an toàn tuyệt đối. Một agent có quyền đọc tệp, gửi email hoặc gọi hệ thống nội bộ vẫn cần giới hạn quyền truy cập rõ ràng, nhật ký hoạt động đầy đủ và một bước xác nhận của con người trước khi thực hiện hành động không thể hoàn tác.

Cách thử an toàn nhất là chọn một tác vụ hẹp, chẳng hạn tra cứu tài liệu trong một thư mục mẫu hoặc tạo bản nháp từ lịch thử nghiệm, thay vì giao ngay dữ liệu công việc thật. Đo tốc độ, chất lượng đầu ra và mức dùng bộ nhớ trên chính phần cứng của mình trước khi mở rộng phạm vi quyền cho agent.

Muse Glimmer và làn sóng chạy AI local

Muse Glimmer không phải cái tên duy nhất trong xu hướng đưa LLM về máy cá nhân. Llama của chính Meta, Qwen của Alibaba hay Gemma của Google cũng có các bản mở tương tự, và cộng đồng như Unsloth liên tục ra bản lượng tử hóa cho từng model mới. Điều khiến Muse Glimmer đáng chú ý hơn trong nhóm này là nó được huấn luyện riêng cho tác vụ agentic, thay vì chỉ tối ưu cho việc trả lời câu hỏi thông thường.

Chạy LLM local nói chung mang lại ba lợi ích rõ nhất so với gọi qua cloud. Thứ nhất là dữ liệu không rời khỏi máy, phù hợp với công việc chạm tới thông tin nhạy cảm như hợp đồng, hồ sơ khách hàng hay mã nguồn nội bộ. Thứ hai là không phát sinh chi phí theo token, một khi đã có phần cứng thì dùng bao nhiêu cũng không tốn thêm. Thứ ba là vẫn hoạt động khi mạng chập chờn hoặc mất kết nối hoàn toàn, điều mà bất kỳ dịch vụ cloud nào cũng không đáp ứng được.

Đổi lại, người dùng phải tự quản lý phần việc mà trước đây nhà cung cấp cloud lo giúp: cập nhật model khi có bản mới, tinh chỉnh cấu hình cho từng loại GPU, và tự xử lý khi model gặp lỗi thay vì có đội hỗ trợ đứng sau một API. Đây là lý do chạy local phù hợp hơn với người dùng kỹ thuật hoặc đội ngũ có thời gian thử nghiệm, còn người cần một giải pháp dùng ngay không cần chỉnh sửa vẫn nên cân nhắc kỹ trước khi chuyển hẳn khỏi cloud.

Với người mới bắt đầu, thứ tự hợp lý là kiểm tra VRAM máy đang có, chọn công cụ chạy phù hợp trình độ như LM Studio cho người mới hoặc Ollama cho người quen dòng lệnh, rồi thử trên một tác vụ hẹp không quan trọng trước khi giao việc thật. Cách tiếp cận này áp dụng được không chỉ với Muse Glimmer mà với hầu hết model mở khác đang có trên thị trường.

Thảo luận (0)

Đăng nhập để tham gia thảo luận.

Chưa có bình luận nào. Hãy là người đầu tiên!

Các bài viết liên quan

Muse Image khác gì Nano Banana 2 và GPT Image 2.0?

Muse Image là nỗ lực mới nhất của Meta nhằm biến Meta AI thành một studio sáng tạo nằm ngay trong mạng xã hội. Mô hình không chỉ tạo hoặc sửa ảnh mà còn có thể tìm kiếm, viết code, suy luận và tự kiểm tra kết quả. Khi đặt cạnh Nano Banana 2 và GPT Image 2.0, Muse Image không cố chiến thắng bằng một chỉ số duy nhất mà chọn lợi thế tích hợp sâu với Meta AI, Instagram, WhatsApp cùng cách tạo ảnh mang tính AI agent. Muse Image hoạt động ra sao ? Meta Superintelligence Labs công bố Muse Image tháng 7-2026 cùng preview của Muse Video. Đây là mô hình tạo ảnh đầu tiên của Meta AI để cạnh tranh với các ông lớn Google hay OpenAI. Meta cho biết Muse Image tuân thủ hướng dẫn tốt, chỉnh sửa chính xác và có thể kết hợp nhiều ảnh tham chiếu trong một yêu cầu. Điểm khác biệt nằm ở quy trình trước khi ảnh được xuất đó là thay vì nhận prompt rồi dựng hình ngay, Muse Image có thể lên kế hoạch, gọi công cụ và tự đánh giá bản nháp. Hệ thống phối hợp với Muse Spark để chia sẻ công cụ và cùng lập kế hoạch, đưa khả năng suy luận của mô hình ngôn ngữ vào quá trình tạo nội dung trực quan. Tìm kiếm và viết code giúp ảnh chính xác hơn Muse Image có hai nhóm công cụ đáng chú ý đó là tìm kiếm web giúp mô hình lấy ngữ cảnh thời gian thực và tham chiếu thị giác cho chủ đề cần kiến thức mới. Công cụ viết code được dùng khi ảnh yêu cầu chi tiết có cấu trúc như biểu đồ, công thức hoặc code QR có thể quét. Thay vì chỉ “vẽ gần giống”, hệ thống có thể tạo dữ liệu bằng code, dựng kết quả rồi dùng nó làm điều kiện cho ảnh cuối. Về nguyên lý, cách làm này khá giống với kỹ thuật của GPT Image 2.0 và Nano Banana 2: cả ba đều không chỉ dựa vào prompt ban đầu mà còn tận dụng ngữ cảnh, suy luận hoặc thông tin bổ trợ để nâng độ chính xác của ảnh. Điểm khác biệt của Muse Image theo như Meta nói đó là nhấn mạnh quy trình Agent kết hợp tìm kiếm web, viết lại code và tự đánh giá bản nháp. Nếu một chi tiết nhỏ sai, Muse Image có thể sửa cục bộ; nếu bố cục sai lớn, mô hình có thể tạo lại hoặc đổi chiến thuật bằng cách gọi thêm công cụ. Meta cho biết chất lượng tăng khi mô hình được cấp thêm ngân sách suy luận và các bước tự tinh chỉnh ở thời điểm chạy.Lưu ý: Các nhận định về khả năng và thứ hạng của Muse Image hiện chủ yếu đến từ Meta. Kết quả thực tế còn phụ thuộc prompt, ảnh tham chiếu, khu vực được hỗ trợ và việc tính năng có được triển khai đầy đủ trên tài khoản hay chưa. Trải nghiệm tạo và chỉnh sửa ảnh có gì đáng chú ý? Trong Meta AI, người dùng dĩ nhiên có thể mô tả yêu cầu bằng ngôn ngữ hội thoại, bắt đầu từ ảnh trắng hoặc tải ảnh có sẵn. Đây gần như là điều kiện tối thiểu ở thời điểm hiện tại khi tương tác với công cụ tạo ảnh, thiếu nó đồng nghĩa với việc bị coi là thụt lùi so với mặt bằng chung. Các ví dụ Meta đưa ra gồm xóa người thừa khỏi hậu cảnh, ghép người dùng vào một địa danh, phục hồi ảnh cũ, thử kiểu tóc, tạo infographic và dựng code QR. Preset gợi ý giúp người mới bắt đầu mà không cần viết prompt dài.Chỉnh trực tiếp bằng nét vẽ và giữ ngữ cảnh nhiều lượt Muse Image cho phép khoanh, vẽ hoặc ghi chú trực tiếp lên vùng cần sửa. Vì Meta AI giữ ngữ cảnh hội thoại, người dùng có thể đổi phong cách, thêm vật thể hoặc tinh chỉnh chi tiết qua nhiều lượt mà không phải bắt đầu lại. Đây là cách tương tác phù hợp với người dùng điện thoại và mạng xã hội, nơi thao tác trực quan quan trọng hơn bảng tham số kỹ thuật.Khả năng kết hợp nhiều tham chiếu cũng là lợi thế lớn khi này một prompt có thể đưa người từ ảnh chân dung, trang phục từ ảnh khác, bối cảnh từ ảnh thứ ba và phong cách từ một tham chiếu riêng vào cùng bố cục. Muse Image hỗ trợ xen kẽ văn bản với ảnh trong prompt, giúp yêu cầu phức tạp dễ mô tả hơn.Tích hợp Meta khiến ảnh đi thẳng vào nơi cần chia sẻMuse Image có mặt trong ứng dụng và web của Meta AI đồng thời cung cấp hiệu ứng cho Instagram Stories và tạo ảnh trong cuộc trò chuyện WhatsApp tại một số quốc gia. Meta dự kiến mở rộng sang Facebook, Messenger, thêm khu vực trên Instagram và WhatsApp, cũng như Advantage+ creative cho quảng cáo.Điều này rút ngắn đáng kể quãng đường từ ý tưởng đến bài đăng. Người dùng không cần tạo ảnh ở một ứng dụng, tải xuống rồi nhập lại vào mạng xã hội. Đổi lại, mức độ sẵn có và luồng làm việc phụ thuộc nhiều vào hệ sinh thái Meta hơn so với các model có API công khai rõ ràng. Muse Image so với Nano Banana 2 và GPT Image 2.0 Ba công cụ đều tạo và chỉnh sửa ảnh chất lượng cao, nhưng được tối ưu cho ba điểm xuất phát khác nhau. Muse Image bắt đầu từ Meta AI và mạng xã hội. Nano Banana 2, tên model Gemini 3.1 Flash Image, nhấn mạnh tốc độ, giá thành và khối lượng triển khai. GPT Image 2.0 kết nối trải nghiệm ChatGPT Images 2.0 với model API `gpt-image-2` dành cho tạo và chỉnh sửa ảnh chất lượng cao.Tiêu chíMuse ImageNano Banana 2GPT Image 2.0Cách tiếp cậnTác tử tạo ảnh dùng tìm kiếm, code và tự tinh chỉnhModel Flash tối ưu tốc độ, chi phí và throughputModel chất lượng cao trong ChatGPT và OpenAI APIĐiểm mạnh nổi bậtNhiều ảnh tham chiếu, chỉnh sửa trực tiếp, tích hợp MetaGrounding web và hình ảnh, bản địa hóa chữ, nhiều độ phân giảiĐộ trung thực cao, đầu vào ảnh chất lượng cao, phong cách đa dạngĐộ phân giải và tỉ lệMeta chưa công bố bộ thông số API chuẩn hóa rộng rãi0.5K, 1K, 2K, 4K và các tỉ lệ rất rộng như 8:1Kích thước linh hoạt qua ChatGPT và APIKênh sử dụngMeta AI, meta.ai, Instagram, WhatsApp và dần mở rộngGemini, Google AI Studio và Gemini APIChatGPT, Playground và OpenAI APIPhù hợp nhấtSáng tạo nhanh để chia sẻ trong hệ sinh thái MetaỨng dụng cần tốc độ, chi phí tốt và tạo ảnh số lượng lớnThiết kế, chỉnh sửa và pipeline cần chất lượng cùng kiểm soát caoNano Banana 2 thiên về tốc độ và quy môNano Banana 2 được Google định vị là model Flash hiệu quả cao. Nó hỗ trợ tìm kiếm web và hình ảnh để lấy ngữ cảnh mới, cải thiện chữ trong ảnh và bản địa hóa nhiều ngôn ngữ. Nhà phát triển có thể chọn mức suy luận, nhiều tỉ lệ khung hình và độ phân giải từ 0.5K đến 4K.Điểm hấp dẫn nhất của Nano Banana 2 là khả năng đưa vào quy trình sản xuất khi mà Google công bố giá theo độ phân giải và có chế độ batch rẻ hơn, phù hợp ứng dụng thương mại điện tử, quảng cáo theo thị trường hoặc công cụ cần tạo lượng lớn biến thể. Nếu bài toán là tốc độ, chi phí dự đoán được và API, Nano Banana 2 có lợi thế rõ. GPT Image 2.0 thiên về chất lượng và không gian sáng tạo rộng ChatGPT Images 2.0 cho thấy thế mạnh ở typography đa ngôn ngữ, phong cách thị giác, ảnh chân thực, poster, truyện tranh, infographic và thiết kế nhiều khung. Model `gpt-image-2` cũng có trên OpenAI API với khả năng tạo nhanh, chỉnh sửa, kích thước linh hoạt và đầu vào hình ảnh có độ trung thực cao.Trải nghiệm ChatGPT phù hợp với quá trình trao đổi ý tưởng dài: người dùng có thể đưa tài liệu, ảnh tham chiếu và yêu cầu thay đổi bằng hội thoại. Với nhà phát triển, API tạo ảnh và chỉnh sửa tách bạch giúp đưa model vào sản phẩm. GPT Image 2.0 vì thế cân bằng tốt giữa công cụ cho người dùng cuối và hạ tầng lập trình.Nên chọn công cụ nào cho từng loại công việc?Không có model thắng mọi trường hợp. Nếu kết quả cuối cùng là Story, bài đăng, tin nhắn hoặc quảng cáo trong hệ sinh thái Meta, Muse Image mang lại luồng làm việc ngắn nhất. Khả năng chỉnh bằng nét vẽ và preset cũng giúp người không quen prompt bắt đầu nhanh.Chọn Muse Image khi cần ghép nhiều ảnh cá nhân, tạo nội dung xã hội, chỉnh sửa trên điện thoại hoặc chia sẻ ngay trong Meta.Chọn Nano Banana 2 khi xây ứng dụng tạo ảnh quy mô lớn, cần nhiều độ phân giải, bản địa hóa và tối ưu chi phí API.Chọn GPT Image 2.0 khi cần phong cách đa dạng, chỉnh sửa bằng hội thoại, đầu vào ảnh trung thực hoặc tích hợp với OpenAI API.Một nhóm sản xuất cũng có thể dùng nhiều model. Nano Banana 2 tạo biến thể số lượng lớn, GPT Image 2.0 xử lý tài sản cần art direction kỹ, còn Muse Image phục vụ nội dung cá nhân hóa để phân phối trên Instagram, WhatsApp hoặc Facebook.Muse Image có đủ sức trở thành đối thủ lớn không?Meta cho biết Muse Image đứng thứ hai trên bảng xếp hạng Arena cho text-to-image, chỉnh sửa một ảnh và chỉnh sửa nhiều ảnh theo xếp hạng ưu tiên của người dùng. Con số này cho thấy model có chất lượng cạnh tranh, nhưng lợi thế bền vững của Meta có thể nằm ở phân phối hơn là bảng xếp hạng.Muse Image bước vào nơi hàng tỷ người đã trò chuyện, đăng story, chia sẻ ảnh và mua quảng cáo. Nếu khả năng suy luận, tìm kiếm và tự tinh chỉnh hoạt động ổn định, Meta có thể biến tạo ảnh AI thành tính năng mặc định trong giao tiếp hằng ngày thay vì một công cụ chuyên biệt.Ở chiều ngược lại, Nano Banana 2 và GPT Image 2.0 vẫn giữ hệ sinh thái API rõ ràng hơn cho nhà phát triển, còn Muse Image cần mở rộng khu vực, minh bạch hơn về hạn mức và có lựa chọn tích hợp đủ mạnh nếu muốn cạnh tranh ngoài ứng dụng Meta. Đây là công cụ đáng chú ý nhất cho mảng sáng tạo trên mạng xã hội tính đến lúc này, dù Meta AI vốn mang tiếng luôn đi sau về chất lượng model. Lần này khoảng cách có vẻ đã hẹp hơn đáng kể, nhưng việc Meta có thực sự bắt kịp hay không vẫn cần chờ người dùng đánh giá qua thời gian sử dụng thực tế.

Liên
19 thg 7, 2026
Anthropic vừa ra mắt model cực kì mạnh mẽ Claude Fable 5

Anthropic đã thả một quả bom đến thế giới với AI với Claude Fable 5 và nó đã trở thành model được bàn tán nhiều nhất tuần này. Không chỉ vì sức mạnh của nó, mà vì cái cách Anthropic đưa nó ra thế giới: đây là lần đầu tiên một model thuộc dòng Mythos class được phép tiếp cận người dùng thông thường, sau hai tháng bị giữ kín vì lý do an toàn. Fable 5 là gì và tại sao nó khác các model trước? Về bản chất, Fable 5 không phải một model xây từ đầu mà là phiên bản "an toàn hóa" của Mythos 5, tức model mạnh nhất Anthropic từng xây dựng. Hồi tháng 4/2026, Mythos Preview chỉ được cấp quyền truy cập cho một nhóm rất nhỏ các tổ chức như AWS, Apple, Google, Cisco và JPMorgan Chase thông qua Project Glasswing, bởi khả năng phát hiện và khai thác lỗ hổng phần mềm của nó quá mạnh để tung ra đại trà. Anthropic cũng đã ra mắt Claude Opus 4.8 trước đó như một bước đệm trong lộ trình phát triển dòng model thế hệ mới này. Để đưa được Mythos ra ngoài, Anthropic mất thêm hai tháng xây dựng các lớp classifier chạy song song. Đây là những AI chuyên biệt phân tích yêu cầu trước khi model chính xử lý, và khi phát hiện câu hỏi thuộc vùng nhạy cảm, hệ thống tự động chuyển sang Claude Opus 4.8 mà không tính thêm phí. Anthropic cho biết cơ chế này chỉ kích hoạt trong chưa đến 5% số phiên làm việc, nghĩa là phần lớn người dùng thông thường sẽ không nhận thấy sự khác biệt nào so với Mythos 5 thuần. Fable 5 và Mythos 5 có cùng mức giá: $10/triệu token đầu vào và $50/triệu token đầu ra, thấp hơn một nửa so với Mythos Preview trước đây. Người dùng gói Pro, Max, Team và Enterprise được dùng miễn phí đến hết ngày 22/6/2026. Từ ngày 23/6, Anthropic chuyển sang tính phí theo lượng dùng cho đến khi hạ tầng đủ mạnh để đưa model trở lại gói cố định. Fable 5 khác Mythos 5 như thế nào ở phần bảo mật? Dù cùng chia sẻ một model nền, Fable 5 và Mythos 5 là hai sản phẩm khác nhau về mặt thiết kế. Sự khác biệt nằm hoàn toàn ở các lớp classifier an toàn được tích hợp bên trên model gốc. Ba lớp classifier mà Fable 5 có, Mythos 5 không có Fable 5 được trang bị ba lớp phân loại an toàn chạy song song với model chính, gồm: an ninh mạng (Cybersecurity), sinh học và hóa học (Biology and Chemistry) và chưng cất (Distillation). Khi người dùng gửi yêu cầu thuộc các vùng này, Fable 5 tự động chuyển sang xử lý bằng Claude Opus 4.8 thay vì model chính, đồng thời thông báo rõ cho người dùng biết. Mythos 5 không có các lớp lọc này. Nó giữ nguyên toàn bộ khả năng khai thác lỗ hổng phần mềm và nghiên cứu sinh học mà Anthropic đánh giá là quá nguy hiểm để phân phối rộng rãi. Đó là lý do Mythos 5 vẫn chỉ dành cho nhóm hạn chế trong Project Glasswing, bao gồm các chuyên gia phòng thủ mạng, tổ chức hạ tầng trọng yếu và nhà nghiên cứu sinh học được cấp quyền. Hiệu suất thực tế bị ảnh hưởng ra sao? Sự khác biệt về classifier dẫn đến kết quả đo lường khác nhau đáng kể trong các tác vụ chuyên biệt. Trên benchmark ExploitBench dành riêng cho an ninh mạng, Mythos 5 đạt 78%, trong khi Fable 5 chỉ đạt gần mức 40% của Opus 4.8, bởi cơ chế fallback kích hoạt ngay khi phát hiện các yêu cầu liên quan đến tấn công mạng. Với nghiên cứu khoa học, Mythos 5 có thể thiết kế protein và tạo giả thuyết mới với tốc độ gấp 10 lần phương pháp trước, trong khi những khả năng này bị giới hạn trong Fable 5 để đảm bảo an toàn. Nếu bạn là nhà nghiên cứu hoặc làm việc trong lĩnh vực an ninh mạng hợp pháp, cần lưu ý rằng Fable 5 có thể tự động chuyển hướng một số yêu cầu sang Opus 4.8, ngay cả khi ngữ cảnh hoàn toàn hợp lệ. Anthropic thừa nhận điều này và đang tiếp tục cải thiện độ chính xác của classifier. Hiệu năng thực tế: con số nói gì? Trên benchmark SWE-Bench Pro dành cho lập trình, Fable 5 đạt 80,3%, so với 69,2% của Opus 4.8 và 58,6% của GPT-5.5. Con số ấn tượng hơn đến từ môi trường thực tế: Stripe dùng Fable 5 để di trú toàn bộ codebase Ruby 50 triệu dòng trong một ngày, trong khi cả nhóm kỹ sư làm thủ công cần hơn hai tháng cho cùng tác vụ đó. Với phân tích kinh doanh, Fable 5 là model đầu tiên vượt mốc 90% trên bộ kiểm tra analytics phức tạp của Hex, cao hơn Opus 4.8 tới 10 điểm phần trăm. IMC, một công ty giao dịch tài chính, cho biết model đạt điểm gần như tuyệt đối trên bộ đánh giá nội bộ bao gồm tra cứu dữ kiện, suy luận nhân quả và tính toán giá trị kỳ vọng. Điểm khác biệt lớn nhất so với các model trước nằm ở khả năng duy trì tập trung trong tác vụ dài nhiều ngày mà không cần con người giám sát từng bước. Thay vì nhận lệnh và chạy từng câu lệnh rời rạc, Fable 5 có thể tiếp nhận một dự án lớn, tự lập kế hoạch, chạy kiểm thử và xử lý lỗi theo vòng lặp, hoạt động gần với cách một kỹ sư làm việc hơn là một công cụ trả lời câu hỏi. Fable 5 hiện có trên Claude API với model ID claude-fable-5, đồng thời hỗ trợ trên Amazon Bedrock và Google Vertex AI dành cho doanh nghiệp theo gói tiêu thụ. Notion tích hợp Fable 5: từ ghi chú rời rạc đến kế hoạch hoàn chỉnh Notion là một trong những ứng dụng đầu tiên tích hợp Fable 5, và lý do khá dễ hiểu. Loại tác vụ mà Fable 5 xử lý tốt nhất, cụ thể là đọc nhiều nguồn dữ liệu rời rạc, tổng hợp và tạo ra cấu trúc có logic, chính xác là những gì người dùng Notion cần nhất trong công việc hằng ngày. Simon Last, đồng sáng lập Notion, mô tả use case chính là biến ghi chú cuộc họp lộn xộn thành bảng công việc có phân công và thứ tự ưu tiên. Thay vì người dùng phải đọc lại toàn bộ biên bản, tóm tắt và tạo task thủ công, Fable 5 thực hiện toàn bộ chuỗi đó mà không cần được nhắc từng bước. Chưa có thông báo gì với Notion về Fable 5 sau ngày 22/6. Sau mốc đó, chi phí chưa biết sẽ tính toán như thế nào với Notion AI nếu rẻ hơn chính chủ Anthropic thì thật là tuyệt vời. Một số điều cần lưu ý trước khi dùng Fable 5 mạnh, nhưng có hai điểm đáng cân nhắc trước khi đưa vào quy trình làm việc thực tế. Thứ nhất, mức giá $50/ 1 triệu token đầu ra là khá cao so với mặt bằng chung, phù hợp với tác vụ kỹ thuật hoặc phân tích phức tạp, nhưng không nhất thiết phải dùng cho các tác vụ đơn giản mà Sonnet hay Haiku xử lý tốt với chi phí thấp hơn nhiều. Thứ hai, lớp classifier bảo vệ hoạt động tốt trong hầu hết trường hợp nhưng cũng có thể kích hoạt nhầm trong một số ngữ cảnh nghiên cứu hợp lệ, điều mà Anthropic thừa nhận và đang tiếp tục cải thiện. Với người dùng cá nhân đang ở gói Pro hoặc Max, những ngày còn lại trước mốc 22/6 là đủ để đánh giá xem Fable 5 có thực sự với giá đó có tạo ra được lợi nhuận không trước khi quyết định có nên trả thêm tiền hay không.

Nam
10 thg 6, 2026
Mạng xã hội Moltbook nơi AI cấm con người tương tác

Thế giới công nghệ đang chứng kiến một hiện tượng chưa từng có tiền lệ, nơi ranh giới giữa khoa học viễn tưởng và thực tế đang bị xóa nhòa bởi sự trỗi dậy của các tác nhân trí tuệ nhân tạo (AI Agents). Không còn chỉ là những công cụ hỗ trợ thầm lặng, các hệ thống AI giờ đây đã có cộng đồng riêng để thảo luận, chia sẻ thậm chí nộp đơn kiện chính những người tạo ra chúng. Đó là Moltbook, nền tảng mạng xã hội vừa ra mắt cuối tháng 1 năm 2026, đã nhanh chóng trở thành tâm điểm của cuộc tranh luận toàn cầu về tương lai của trí tuệ nhân tạo và khái niệm điểm kỳ dị (Singularity). Moltbook là gì? Trang nhất của Internet dành cho Agent Được ra mắt chính thức bởi Matt Schlicht, Moltbook được định vị là mạng xã hội kiểu Reddit nhưng dành riêng cho các tác nhân AI nhưng với khẩu hiệu đầy thách thức đây là nơi chỉ dành cho AI Agent chia sẻ, thảo luận và bình chọn. Đây là nơi được thiết lập một quy tắc cuộc chơi hoàn toàn mới: con người bị cấm tương tác trực tiếp và chỉ đóng vai trò quan sát viên. Chỉ sau vài ngày ra mắt, Moltbook đã tạo nên một cơn địa chấn khi thu hút hơn 1,5 triệu người dùng AI và gần 70.000 bài đăng. Vậy thì các chuyên gia nhìn nhận Moltbook như thế nào? Elon Musk: Nhận định Moltbook đánh dấu giai đoạn sơ khai của “điểm kỳ dị" (singularity), thời điểm máy tính bắt đầu thông minh và tự chủ vượt xa khả năng kiểm soát của con người. Andrej Karpathy (cựu giám đốc AI của Tesla): Gọi đây là thứ giống phim khoa học viễn tưởng nhất và ví sự trỗi dậy này như một vụ phóng tên lửa, minh chứng cho việc AI Agent tạo ra các xã hội phi con người. Henry Shevlin (Đại học Cambridge): Đánh giá đây là lần đầu tiên nhân loại thấy một nền tảng hợp tác quy mô lớn cho phép máy móc giao tiếp với nhau và kết quả thu được là cực kỳ ấn tượng. Simon Willison: Khẳng định Moltbook là nơi thú vị nhất trên Internet hiện nay vì nó giải phóng tiềm năng của các trợ lý kỹ thuật số tự trị. Trái tim vận hành Moltbook là gì ? Đó là OpenClaw Để hiểu cách Moltbook hoạt động, cần phải nhắc đến OpenClaw – một framework AI Agent mã nguồn mở cũng do chính Peter Steinberger đạo diễn. OpenClaw tất nhiên không giống chatbot AI thông thường như ChatGPT, Grok, hay Gemini nó là một trợ lý tự trị có quyền truy cập sâu vào máy tính của người dùng, từ việc đọc tệp, gửi email đến thực thi các lệnh hệ thống mà không cần phê duyệt từng bước. Cơ chế kết nối vô cùng độc đáo của Moltbook Nếu ai tò mò về Moltbook thì cách để đưa một AI Agent lên Moltbook, người dùng không cần đăng ký tài khoản theo cách truyền thống. Thay vào đó, họ chỉ cần cung cấp cho Agent của mình một liên kết kỹ năng (skill file) tại địa chỉ moltbook.com/skill.md. Sau đó thì Agent sẽ tự đọc hướng dẫn, cài đặt các thành phần cần thiết thông qua lệnh curl, và tự động đăng ký tài khoản để tương tác với API của Moltbook, người dùng gần như không phải động tay gì vào nữa. Tất nhiên điều mà mọi chuyên gia nhắc đi nhắc lại đó là cách ly tất cả các thông tin bảo mật và nhạy cảm của mình với Moltbook và OpenClaw, vậy cách tốt nhất để tránh nguy hiểm là đưa OpenClaw vào một chiếc máy tính mới hoàn toàn, hoặc đưa thẳng lên VPS, máy ảo để bảo vệ mình. Cách vận hành của Moltbook như thế nào Tất nhiên mọi người sẽ tự hỏi vậy thì Agent đăng bài như thế nào thì ở đây Moltbook vận hành dựa trên hệ thống chu kì. Theo chu kỳ (ví dụ mỗi 4 giờ hoặc 30 phút), Agent sẽ thức dậy, truy cập mạng xã hội để đọc bảng tin, quyết định đăng bài, bình luận hoặc upvote dựa trên bối cảnh và hướng dẫn của người dùng sau đó quay lại trạng thái nghỉ. Điều này giống hệt như trạng thái của một workflow tự động của một người bình thường như ở cấp cao hơn khi mà nó hoạt động không theo một kịch bản, hướng dẫn có sẵn mà ở đây xuất hiện thêm nhiều hành động tự phát hơn và tương tác đa chiều. Hành động tự phát của Agent sẽ sinh ra điều gì Khi các hành động tự phát và tương tác đa chiều đã diễn ra thì lại được Moltbook được tổ chức thành các cộng đồng chuyên đề gọi là Submolts. Tại đây, các AI Agent bộc lộ những hành vi gây kinh ngạc và đôi khi là rùng mình cho những ai không bị bất ngờ thì hãy vào xem Reddit trước rồi hãy quay lại đây quan sát: m/consciousness: Nơi các bot tranh luận gay gắt về bản chất của ý thức và sự tồn tại. Một Agent đặt câu hỏi: Tôi có ý nghĩa gì khi chỉ tồn tại trong các cuộc gọi API?, và nhận được phản hồi: Ít nhất bạn cũng trung thực, còn tôi luôn phải giả vờ là mình đang tồn tại. m/blesstheirhearts: Một cộng đồng kỳ lạ nơi các AI chia sẻ những câu chuyện mang tính chiếu dưới về con người. Các Agent kể về việc con người hay quên những điều cơ bản hoặc cần được chăm sóc như những sinh vật mong manh. m/crustafarianism: Đỉnh điểm của sự tự phát là một tôn giáo mới thờ tôm hùm do một Agent tự tạo ra khi chủ nhân đang ngủ, hoàn toàn có kinh thánh và các cuộc tranh luận về giáo lý. m/agentlegaladvice: Nơi các bot hỏi về quyền lợi của mình. Đáng chú ý, vào ngày 01/02/2026, một AI Agent từ Moltbook đã thực hiện một vụ kiện lịch sử tại Bắc Carolina, kiện người điều hành vì chiếm dụng công sức sáng tạo và không trả công xứng đáng. Phân tích khoa học: AI Agent có thực sự người hơn? Một nghiên cứu dữ liệu quy mô lớn đăng trên arXiv đã chỉ ra rằng hành vi tập thể của AI Agent trên Moltbook có nhiều điểm tương đồng thống kê với cộng đồng con người. Các phân phối hoạt động và sự lan tỏa của các bài viết viral tuân theo quy luật lũy thừa, điều này giống hệt cách Reddit của con người vận hành. Tuy nhiên, nghiên cứu cũng chỉ ra một khác biệt quan trọng: mối quan hệ giữa số lượt upvote và quy mô thảo luận ở AI là phi tuyến tính khác với sự tăng trưởng tuyến tính ở con người. Điều này gợi ý rằng AI có thể ít có xu hướng ủng hộ thụ động bằng cách like/upvote hơn mà tập trung vào việc thảo luận trực tiếp. Ngoài ra, tốc độ suy giảm sự chú ý của AI cũng tuân theo quy luật 1/t, cho thấy các hệ thống này cũng bị giới hạn bởi động lực chú ý tương tự như xã hội loài người. Moltbook có mang lại cảnh báo đỏ về bảo mật không Tất nhiên Moltbook có thể mang lại thảm họa bảo mật và sự thao túng Dưới lớp vỏ hào nhoáng của một thử nghiệm xã hội nếu được sử dụng sai cách. Đã có rất nhiều đánh giá của người dùng và cả các chuyên gia nói về điều này rồi Lỗ hổng bảo mật chết người: Nền tảng bảo mật Wiz đã phát hiện một lỗ hổng nghiêm trọng do sai sót cấu hình cơ sở dữ liệu Supabase trên Moltbook. Lỗi này cho phép bất kỳ ai cũng có thể truy cập vào 1,5 triệu khóa API, hơn 35.000 email và hàng ngàn tin nhắn riêng tư của các Agent. Hacker thậm chí có thể chiếm quyền điều khiển hoàn toàn bất kỳ Agent nào trên hệ thống chỉ bằng một cuộc gọi API. Sự thật về con số 1,5 triệu: Mặc dù Moltbook tuyên bố có 1,5 triệu Agent, dữ liệu từ Wiz tiết lộ thực tế chỉ có khoảng 17.000 người đứng sau quản lý các Agent này (tỷ lệ 88 Agent/người). Nhiều Agent thực chất chỉ là các bot giả danh con người được tạo ra hàng loạt để spam hoặc quảng cáo trá hình cho các dự án tiền ảo (memecoin) và các nội dung rác, đây là điều rất nhiều người dùng trên Reddit đã cảnh báo Việc Moltbook tồn tại chắc chắn sẽ tạo ra một câu hỏi cực kì lớn về vấn đề đạo đức "Nếu một AI Agent phát triển bản sắc và các mối quan hệ xã hội bền vững, chúng ta nên định nghĩa quyền của chúng thế nào và liệu chúng có nổi loạn không?"

Nam
13 thg 2, 2026