Microsoft ra mắt MAI-Voice-2-Flash, chi phí GPU giảm tối đa 89%

MSFT-2,24%
Key Takeaways
  • Microsoft đã đưa MAI-Voice-2-Flash và MAI-Image-2.5-Pro vào bản xem trước công khai vào ngày 23 tháng 7, kèm theo mức giảm chi phí đáng kể.
  • Sau khi triển khai MAI-Voice-2-Flash để xử lý giọng nói, các trung tâm dịch vụ khách hàng của Microsoft ghi nhận mức giảm chi phí tính toán 89%.
  • MAI-Code-1-Flash có thể chạy trên các GPU H100 và A100 thế hệ cũ, đồng thời vẫn đạt hiệu năng tương đương GPT-5.6 trong các tác vụ Excel.

Microsoft vào ngày 23 tháng 7 đã phát hành hai mô hình mới để đưa vào bản xem trước công khai: MAI-Image-2.5-Pro và MAI-Voice-2-Flash; đồng thời công bố dữ liệu nội bộ. Sau khi trung tâm chăm sóc khách hàng chuyển sang dùng MAI-Voice-2-Flash, chi phí điện toán giảm 89%. CEO Microsoft Satya Nadella cho biết khi các mô hình của họ có thể cân bằng hoặc vượt qua các phương án tiên tiến thì sẽ hướng lưu lượng truy cập đến MAI.

Định vị chức năng và mức giá của MAI-Image-2.5-Pro và MAI-Voice-2-Flash

MAI-Image-2.5-Pro được định vị cho tạo ảnh cấp cao, giá là 5 đô la Mỹ cho mỗi 170k token đầu vào dạng chữ và 106 đô la Mỹ cho mỗi 1 triệu token đầu ra dạng hình ảnh. Bing Image Creator đã được chuyển toàn diện sang MAI-Image-2.5. WPP Global Chief Creative Officer Rob Reilly cho biết trong thông báo của Microsoft rằng đây là “một bước nhảy vọt lớn của công cụ tạo phương tiện”.

MAI-Voice-2-Flash được định vị cho các tình huống xử lý âm thanh với số lượng lớn (như trung tâm chăm sóc khách hàng), nhanh gấp đôi so với thế hệ trước và chi phí thấp hơn 32%. Sau khi trung tâm chăm sóc khách hàng đổi sang mô hình này, chi phí điện toán giảm 89%. Lần công bố này cũng tiết lộ hiệu quả triển khai của Bing Image Creator, PowerPoint (chi phí GPU so với GPT-Image-2 giảm 84%), OneDrive (tỷ lệ lưu trữ +26%, độ trễ -25%) và Dragon Copilot (tỷ lệ lỗi -50%).

Các thành tích cụ thể về tiết kiệm chi phí GPU

Microsoft trong thông báo đã nêu hiệu quả ở từng kịch bản như sau:

MAI-Voice-2-Flash (giọng nói trung tâm chăm sóc khách hàng): chi phí điện toán giảm 89%; nhanh gấp đôi so với thế hệ trước, chi phí thấp hơn 32%

MAI-Image-2.5-Pro (PowerPoint): chi phí GPU thấp hơn OpenAI GPT-Image-2 là 84%

OneDrive đổi mô hình: tỷ lệ lưu trữ tăng 26%, giảm độ trễ khoảng 25%

Dragon Copilot (MAI-Transcribe-1.5, ghi âm y tế): phục vụ 170k nhân viên y tế; ở quý trước xử lý 28 triệu hồ sơ bệnh nhân; tỷ lệ lỗi trong ghi âm và nhận dạng ngôn ngữ giảm tương đối 50% trên 58 ngôn ngữ

MAI-Code-1-Flash (GitHub Copilot): tỷ lệ áp dụng mã lệnh cao hơn khoảng 10% so với GPT-5.4 Mini và Claude Haiku 4.5; tiêu thụ token ít hơn 10%; có thể chạy trên GPU H100 và cả A100

Chiến lược “bay bánh xe” của Nadella và logic điều hướng lưu lượng khi MAI thay thế mô hình tiên tiến

Nadella trên X đăng bài với chủ đề “Khuếch tán tiên tiến và kiểm soát”, nêu chiến lược mô hình của Microsoft: khi mô hình của họ thể hiện tương đương hoặc vượt qua các phương án thay thế tiên tiến thì sẽ chuyển hướng lưu lượng đến MAI, giúp cung cấp dịch vụ với chi phí thấp hơn và quy mô lớn hơn. Chiến lược này được hỗ trợ bởi phương pháp luận “hill-climbing”: để dữ liệu, mô hình và sản phẩm “tương thích với hệ thống” tạo thành một vòng lặp bay bánh xe được cải tiến liên tục, thay vì dựa vào một lần huấn luyện duy nhất để quyết định sống còn.

Ông cũng cho biết hệ thống đánh giá “dù bỏ đi bất kỳ một mô hình nào cũng vẫn phải tiếp tục leo lên” — giữ lại ký ức và kỹ năng ngoài mô hình, tạo ra quyền kiểm soát mà Microsoft thực sự nắm trong tay. Sau khi MAI-Code-1-Flash được luyện thêm trong môi trường học tăng cường của Excel, có thể cân bằng GPT-5.6 trong phần lớn tác vụ Excel trên các GPU H100 và A100 đời cũ, đồng thời giải phóng cụm GPU GB200 mới nhất cho việc huấn luyện thay vì các yêu cầu dịch vụ.

Câu hỏi thường gặp

Giá của MAI-Image-2.5-Pro và MAI-Voice-2-Flash lần lượt là bao nhiêu?

MAI-Image-2.5-Pro có giá 5 đô la Mỹ cho mỗi 1 triệu token đầu vào dạng chữ và 106 đô la Mỹ cho mỗi 1 triệu token đầu ra dạng hình ảnh, đã được cung cấp trong bản xem trước công khai trên Azure. MAI-Voice-2-Flash nhanh gấp đôi so với thế hệ trước và chi phí thấp hơn 32%; chi tiết định giá theo thông báo chính thức của Azure.

Microsoft cho biết chi phí GPU tối đa giảm được bao nhiêu sau khi chuyển sang mô hình MAI?

Theo dữ liệu nội bộ do Microsoft công bố, sau khi trung tâm chăm sóc khách hàng chuyển sang MAI-Voice-2-Flash, chi phí điện toán giảm 89%; sau khi PowerPoint chuyển sang mô hình hình ảnh MAI, chi phí GPU thấp hơn GPT-Image-2 là 84%; sau khi Dragon Copilot chuyển sang MAI-Transcribe-1.5, tỷ lệ lỗi trong ghi âm và nhận dạng ngôn ngữ giảm tương đối 50%. Tuy nhiên, tất cả các con số trên đều đến từ đánh giá nội bộ của Microsoft, không phải các bài kiểm thử chuẩn độc lập từ bên thứ ba.

Khách hàng doanh nghiệp sử dụng phương pháp huấn luyện MAI của Microsoft qua Azure như thế nào?

Microsoft thông qua các sản phẩm Foundry và Frontier Tuning của Azure để cho phép khách hàng doanh nghiệp dùng dữ liệu của chính họ để huấn luyện mô hình chuyên biệt. Microsoft nhấn mạnh việc huấn luyện các mô hình này dựa trên “dữ liệu doanh nghiệp sạch và có thể truy vết”, không thông qua chưng cất bằng mô hình của bên thứ ba, nhằm giải quyết các vấn đề tuân thủ liên quan đến nguồn dữ liệu huấn luyện.

Tuyên bố miễn trừ trách nhiệm: Thông tin trên trang này có thể đến từ các nguồn bên thứ ba và chỉ mang tính chất tham khảo. Thông tin này không phản ánh quan điểm hoặc ý kiến của Gate và không cấu thành bất kỳ lời khuyên tài chính, đầu tư hoặc pháp lý nào. Giao dịch tài sản ảo tiềm ẩn rủi ro cao. Vui lòng không chỉ dựa vào thông tin trên trang này khi đưa ra quyết định. Để biết thêm chi tiết, vui lòng xem Tuyên bố miễn trừ trách nhiệm.
Bình luận
0/400
Không có bình luận