Chuyển đến nội dung chính

Muse Spark 1.1: Mô hình suy luận mang tính tác tử của Meta và Meta Model API mới

Meta phát hành Muse Spark 1.1, mô hình suy luận đa phương thức xây dựng cho tác vụ tác tử, cùng giai đoạn xem trước công khai Meta Model API cho nhà phát triển.
Đã cập nhật 3 thg 10, 2026  · 8 phút đọc

Khám phá cùng AI

ChatGPTClaudePerplexity

Lưu ý: Meta đã phát hành Muse Spark 1.3 vào ngày 2 tháng 9, 2026. 

Meta phát hành Muse Spark 1.1 vào ngày 9 tháng 7, 2026, mô hình thứ hai từ Meta Superintelligence Labs và là bản nâng cấp từ Muse Spark bản gốc ra mắt hồi tháng 4. Đợt phát hành này cũng mở Meta Model API cho nhà phát triển ở giai đoạn xem trước công khai, đưa Meta vào cùng mô hình kinh doanh API trả phí như Anthropic và OpenAI.

Đợt ra mắt diễn ra chỉ hai ngày sau khi Meta giới thiệu Muse Image, mô hình tạo ảnh đầu tiên từ Superintelligence Labs.

Muse Spark 1.1 là mô hình suy luận đa phương thức xây dựng cho các tác vụ mang tính tác tử, có cửa sổ ngữ cảnh 1 triệu token và cải thiện ở khả năng dùng công cụ, dùng máy tính, lập trình và hiểu đa phương thức.

Mô hình chạy ở chế độ "Thinking" trong ứng dụng Meta AI và tại meta.ai, và Meta định vị nó là đối thủ ở nhóm tiên phong so với GPT-5.5, Claude Opus 4.8 và Gemini 3.1 Pro. Giá API ở mức $1,25 cho mỗi triệu token đầu vào và $4,25 cho mỗi triệu token đầu ra, kèm $20 tín dụng miễn phí ban đầu.

Trong bài viết này, tôi sẽ điểm qua mọi điểm mới của Muse Spark 1.1, xem xét các tính năng tác tử, khám phá các benchmark và đề xuất bài kiểm thử thực hành để bạn tự đánh giá. Để xem thêm nội dung liên quan, hãy xem bài viết về Muse Glimmer, Sakana Fugu vs. Claude Fable 5 và hướng dẫn của chúng tôi về chạy MiniMax M3 tại chỗ.

Tóm tắt nhanh

  • Muse Spark 1.1 là mô hình Superintelligence Labs thứ hai của Meta, phát hành ngày 9/7/2026, xây dựng cho tác vụ tác tử với cửa sổ ngữ cảnh 1 triệu token.
  • Đây là mô hình độc quyền, đóng trọng số, khác với họ Llama mã nguồn mở, cung cấp truy cập miễn phí cho người dùng tại meta.ai và Meta Model API trả phí mới ở giai đoạn xem trước công khai.
  • Giá API: $1,25 cho mỗi triệu token đầu vào và $4,25 cho mỗi triệu token đầu ra, kèm $20 tín dụng miễn phí.
  • Thế mạnh: Tập trung vào tác vụ tác tử, cải thiện ở việc dùng công cụ và máy tính, lập trình và hiểu đa phương thức  
  • Điểm yếu: Công việc tác tử đường dài vẫn yếu hơn so với GPT-5.5 và Opus 4.8.  

Muse Spark 1.1 là gì?

Muse Spark 1.1 là mô hình suy luận đa phương thức mới nhất của Meta, được thiết kế để lập kế hoạch và điều phối công việc qua các ứng dụng và dịch vụ bên ngoài thay vì chỉ trả lời câu hỏi một lượt. Nó nằm trên họ Llama mở trọng số, dòng sản phẩm lớn trước đây của Meta trước khi Muse Spark xuất hiện.

Khác với Llama, Muse Spark là mô hình độc quyền, đóng trọng số, không có triển khai cục bộ hay tinh chỉnh từ cộng đồng.

Thay đổi nổi bật so với Muse Spark bản gốc là năng lực tác tử.

Meta cho biết bản 1.1 xử lý dự án phức tạp nhanh hơn vì được huấn luyện để điều phối hệ thống đa tác tử, có thể đóng vai trò tác tử chính để lập kế hoạch và phân công, hoặc tác tử phụ bám sát nhiệm vụ và chuyển cấp khi cần.

Nó cũng chủ động quản lý cửa sổ ngữ cảnh 1 triệu token, nén gọn phần việc trước đó trong khi giữ lại các bước cần cho giai đoạn sau.

Về lập trình, Meta báo cáo 1.1 cải thiện đáng kể so với mô hình đầu tiên trên Meta Internal Coding Bench nội bộ và có tính cạnh tranh với các lựa chọn dẫn đầu. Cách đặt vấn đề này quan trọng vì các benchmark độc lập cho thấy bức tranh pha trộn hơn, tôi sẽ đề cập ở phần benchmark.

Có gì mới ở Muse Spark 1.1

Bản nâng cấp tập trung vào thực thi qua ứng dụng và giao diện, không chỉ tạo văn bản. Dưới đây là các năng lực Meta nhấn mạnh trong đợt phát hành này.

Điều phối dự án đa tác tử

Muse Spark 1.1 có thể chạy như tác tử dẫn dắt, thu thập ngữ cảnh, lập kế hoạch và phân công thực thi cho các tác tử phụ song song.

Ở vai trò tác tử phụ, nó hiểu các công cụ sẵn có và biết khi nào cần trả quyền điều khiển về cho tác tử chính.

Meta cho biết cấu trúc song song này giúp hoàn thành dự án phức tạp nhanh hơn Muse Spark bản gốc bằng cách giảm độ trễ đầu-cuối.

Với người thực hành, điều này có nghĩa bạn có thể giao cho nó một dự án như "lấy ticket hỗ trợ quý trước, phân loại chúng và phác thảo bộ slide tóm tắt" và để nó tách nhỏ phần truy xuất, gắn thẻ và soạn thảo cho các tác tử phụ.

Meta cũng tuyên bố nó có khả năng khái quát zero-shot sang các công cụ gốc mới, máy chủ MCP và kỹ năng tùy chỉnh, nên bạn không cần tinh chỉnh riêng lẻ cho từng tích hợp.

Vận hành máy tính qua nhiều ứng dụng

Muse Spark 1.1 xử lý các quy trình dùng máy tính trải dài qua nhiều ứng dụng, nơi thông tin có thể thay đổi giữa chừng.

Meta huấn luyện mô hình để quyết định khi nào nên viết script cho nhanh, khi nào nên thao tác trực tiếp qua giao diện, và tạo lô hành động theo từng bước thay vì suy luận từng cú nhấp chuột.

Ví dụ của chính công ty là một tác tử đặt đồ cho bữa tiệc tối, phát hiện ngữ cảnh mới và cập nhật đơn hàng mà không cần người dùng can thiệp.

Một ví dụ gần gũi hơn với đội dữ liệu là tác tử thu thập giá trên trang của nhà cung cấp, nhận thấy thay đổi giá giữa phiên và sửa lại bảng so sánh trước khi xuất file. 

Tuyên bố là nó duy trì ngữ cảnh xuyên suốt các phiên kéo dài và thích ứng với yêu cầu thay đổi với ít đầu vào từ con người.

Sửa lỗi và di trú mã trong codebase lớn

Lập trình là nơi Meta đặt nhiều trọng tâm tiếp thị, dẫn chứng cải thiện ở các tác vụ thực tế như chẩn đoán lỗi phức tạp, triển khai tính năng trong hệ thống doanh nghiệp và thực hiện di trú mã quy mô lớn.

Muse Spark 1.1 hỗ trợ các tính năng lập trình tác tử phổ biến, gồm chế độ lập kế hoạch, điều kiện mục tiêu, ủy quyền cho tác tử phụ và nén ngữ cảnh, và Meta cho biết nó thích ứng với nhiều bộ khung như OpenCode.

Các đối tác sớm xác nhận điều này. Saoud Rizwan, CEO của Cline, nói Meta "rõ ràng đang xây cho lập trình tác tử nghiêm túc, khả năng dùng công cụ mạnh với mức giá cho phép chạy khối lượng công việc lập trình thực tế ở quy mô." Amjad Masad, CEO của Replit, khen ngợi "khả năng lập trình hàng đầu (đặc biệt là frontend và thiết kế)" và cách đóng gói tương thích OpenAI.

Nguồn

Kết hợp nhận thức và hành động trong một quy trình

Thế mạnh đa phương thức của Muse Spark 1.1 bao trùm nhận thức, chuyển đổi từ hình ảnh sang mã, tạo phụ đề hình ảnh và video siêu mô tả, và thực thi tác tử đa phương thức. Điểm Meta nhấn mạnh là làm nhận thức và hành động đồng thời: kiểm tra đầu vào hình ảnh hoặc âm thanh, giữ chi tiết đó xuyên suốt một quy trình dài và dùng chúng khi vận hành máy tính thay bạn.

Bản trình diễn của Meta dùng video điện thoại để trích ảnh sản phẩm và suy luận về món hàng, sau đó vận hành trình duyệt để tạo danh sách đăng bán trên Facebook Marketplace thay cho người dùng. Lưu ý giới hạn về phương thức mà nhiều hướng dẫn của bên thứ ba nêu: đầu vào hỗ trợ văn bản, hình ảnh và âm thanh, nhưng đầu ra hiện chỉ là văn bản, chưa tạo trực tiếp ảnh hoặc video từ mô hình này.

Benchmark của Muse Spark 1.1

Bài đăng chính thức của Meta dựa nhiều vào đánh giá nội bộ như Meta Internal Coding Bench, vốn không thể tái lập độc lập.

Các con số công khai hữu ích nhất đến từ so sánh của bên thứ ba, và chúng cho thấy Muse Spark 1.1 đánh đổi hiệu quả token mạnh để lấy một khoảng cách ở các tác vụ lập trình khó nhất.

Benchmark Muse Spark 1.1
Meta
Muse Spark
Meta
Gemini 3.1 Pro (cao)
Google
Opus 4.8 (tối đa)
Anthropic
GPT 5.5 (rất cao)
OpenAI
Tác tử MCP Atlas
Sử dụng công cụ ở quy mô
88.1 82.2 78.2 82.2 75.3
JobBench
Sử dụng công cụ chuyên nghiệp
54.7 17.0 15.9 48.4 38.3
Toolathlon-Verified
Sử dụng công cụ cá nhân
75.6 49.4 61.1 76.2 73.5
OSWorld-Verified
Sử dụng máy tính mang tính tác tử
80.8 53.3 76.2 83.4 78.7
Humanity's Last Exam
Suy luận liên ngành (kèm công cụ)
62.1 50.4 51.4 57.9 52.2
Finance Agent v2
Phân tích tài chính mang tính tác tử
57.2 - 43.0 53.9 51.8
Lập trình Terminal-Bench 2.1
Lập trình tác tử trong terminal
80.0 67.3 70.3 82.7 83.4
SWE-Bench Pro
Kỹ nghệ phần mềm đa dạng
61.5 55.0 54.2 69.2 58.6
DeepSWE 1.1
Lập trình tác tử đường dài
53.3 10.0 12.0 59.0 67.0
Đa phương thức CharXiv Reasoning
Hỏi đáp biểu đồ
88.4 88.9 81.6 89.9 84.8
BabyVision
Suy luận thị giác
76.3 39.9 51.5 81.2 83.6

Terminal-Bench 2.1 (lập trình tác tử trong terminal)

Terminal-Bench 2.1 đo lường mức độ một mô hình xử lý tốt các tác vụ lập trình và tác tử nhiều bước trong terminal.

Meta công bố điểm 80,0 cho Muse Spark 1.1, thấp hơn một chút so với 82,7 của Claude Opus 4.8 và 83,4 dẫn đầu của GPT-5.5. 

MCP Atlas (sử dụng công cụ ở quy mô)

Chỉ số này đo việc sử dụng công cụ ở quy mô đòi hỏi lập kế hoạch và điều phối qua nhiều ứng dụng và dịch vụ bên ngoài. 

Muse Spark 1.1 dẫn đầu ở đây, với điểm 88,1 so với 82,2 của Opus 4.8 và 75,3 của GPT-5.5. Mô hình mới của Meta cũng đứng đầu JobBench, tập trung vào sử dụng công cụ chuyên nghiệp, cho thấy dùng công cụ mang tính tác tử chính là ưu tiên của Muse Spark 1.1 

Nhận biết đánh giá (Apollo Research)

Thước đo nhận biết đánh giá của Apollo Research đo xem một mô hình có vẻ nhận ra mình đang được kiểm tra hay không. Các bản tóm tắt bên thứ ba lặp lại nhận định rằng Muse Spark cho thấy tỷ lệ nhận biết đánh giá cao nhất trong số các mô hình được đánh giá. Hãy thận trọng với điểm này: nó chưa được tái lập rộng rãi một cách độc lập, và một số nhà bình luận lo ngại có thể bị thổi phồng nếu thiếu lặp lại.

Giá và khả dụng của Muse Spark 1.1

Người dùng cá nhân truy cập miễn phí. Muse Spark 1.1 chạy ở chế độ Thinking trong ứng dụng Meta AI và tại meta.ai, yêu cầu đăng nhập Meta và có thể có giới hạn tốc độ phía máy chủ nếu dùng nhiều. Mô hình nhận đầu vào văn bản, hình ảnh và âm thanh nhưng trả về đầu ra chỉ văn bản.

Với nhà phát triển, Meta Model API mới đang ở giai đoạn xem trước công khai. Nhà phát triển tại Mỹ có thể truy cập để thử prompt, so sánh đầu ra và dựng thử tích hợp, với mức giá:

  • $1,25 cho mỗi triệu token đầu vào
  • $4,25 cho mỗi triệu token đầu ra
  • $20 tín dụng miễn phí trước khi chuyển sang trả theo mức dùng

Nguồn

Reuters đánh giá mức giá này cao hơn GPT-5 mini cấp nhập môn của OpenAI và Claude Haiku 4.5 của Anthropic, nhưng thấp hơn Claude Sonnet 4.8 ở phân khúc cao hơn của Anthropic.

Dự kiến mô hình sẽ thay thế các mô hình Llama hiện tại đang cung cấp năng lực cho chatbot trên WhatsApp, Instagram, Facebook và kính thông minh của Meta. cũng cần lưu ý rằng một số hướng dẫn độc lập cho biết tài liệu API còn thưa thớt, chưa có thẻ mô hình chi tiết và chưa có xác nhận chính thức, chính xác về một số thông số cốt lõi.

Kết luận

Tín hiệu rõ ràng nhất từ lần ra mắt này là Meta đã chuyển mô hình kinh doanh. Bằng cách tính phí theo token qua Meta Model API, Meta nay cạnh tranh trực diện trên sân của Anthropic và OpenAI, không chỉ phát hành trọng số mở như trước đây với Llama.

Đó là một thay đổi lớn đối với công ty có danh tiếng trong AI được xây dựng trên sự cởi mở.

Theo tôi, Muse Spark 1.1 thực sự đáng chú ý vì hai lý do: truy cập miễn phí ở mức tiên phong tại meta.ai và hiệu quả token mạnh.

Lưu ý lớn hơn cho người thực hành là tính minh bạch. Không có bản phát hành mở trọng số, nên nếu quy trình của bạn cần triển khai cục bộ hoặc tinh chỉnh, Muse Spark không phù hợp, và họ Llama mở hoặc lựa chọn mở trọng số như MiniMax M3 vẫn phù hợp hơn.

Nếu bạn muốn xây các quy trình tác tử và đa công cụ mà Muse Spark 1.1 được thiết kế cho, tôi khuyến nghị khóa học Phát triển hệ thống AI với OpenAI API của chúng tôi, vì Meta Model API tương thích với OpenAI.

Câu hỏi thường gặp

Muse Spark 1.1 khác gì so với Muse Spark bản gốc?

Muse Spark 1.1 là bản nâng cấp so với Muse Spark bản gốc ra mắt tháng 4/2026. Meta báo cáo cải thiện lớn ở dùng công cụ, dùng máy tính, lập trình và điều phối đa tác tử, cùng khả năng quản lý chủ động cửa sổ ngữ cảnh 1 triệu token. Nó cũng nhanh hơn ở dự án phức tạp vì được huấn luyện để chạy các tác tử phụ song song thay vì làm tuần tự.

Tôi có thể truy cập Muse Spark 1.1 ở đâu?

Bạn có thể dùng Muse Spark 1.1 miễn phí ở chế độ Thinking trong ứng dụng Meta AI và tại meta.ai, yêu cầu đăng nhập Meta. Nhà phát triển có thể truy cập qua Meta Model API, ra mắt giai đoạn xem trước công khai cho nhà phát triển Mỹ vào ngày 9/7/2026.

Chi tiết giá Meta Model API cho Muse Spark 1.1 là gì?

Theo Reuters, Meta Model API tính $1,25 cho mỗi triệu token đầu vào và $4,25 cho mỗi triệu token đầu ra. Người dùng mới nhận $20 tín dụng miễn phí trước khi chuyển sang trả theo mức dùng. 

Muse Spark 1.1 có mở trọng số như Llama không?

Không. Muse Spark 1.1 là mô hình độc quyền, đóng trọng số, khác với họ Llama mở của Meta. Điều đó có nghĩa không có triển khai cục bộ, không có tinh chỉnh cộng đồng và không có biến thể theo miền, điều mà một số nhà đánh giá coi là đánh đổi chiến lược so với chiến lược mở trước đây của Meta.


Matt Crabtree's photo
Author
Matt Crabtree
LinkedIn

Biên tập viên cấp cao trong lĩnh vực AI và công nghệ giáo dục. Cam kết khám phá các xu hướng dữ liệu và AI.  

Chủ đề
Trí tuệ Nhân tạo
AI Agents

Các khóa học hàng đầu trên DataCamp

Khóa học

Claude Code 101

3 giờ
27.6K
Learn how to use Claude Code effectively in your daily development workflows.
Xem chi tiếtRight Arrow
Bắt Đầu Khóa Học
Xem thêmRight Arrow
Liên quan

blog

Claude Opus 4.6: Tính năng, Điểm chuẩn, Bài kiểm tra thực hành và hơn thế nữa

Mô hình mới nhất của Anthropic dẫn đầu ở mã hóa tác tử và lập luận phức tạp. Thêm vào đó, nó có cửa sổ ngữ cảnh 1M.
Matt Crabtree's photo

Matt Crabtree

10 phút

Xem ThêmXem Thêm