AI News 06/07/2026: Seedance 2.5 phá rào cản video 30 giây, Amazon ngừng nhận khách mới cho Mechanical Turk, pxpipe cắt chi phí Claude Code

Ngày 6 tháng 7, 2026 · ~6 phút đọc

Hình chụp buổi ra mắt sản phẩm trên sân khấu tối, một diễn giả đứng trước màn hình lớn hiển thị đầu robot humanoid màu trắng mắt phát sáng xanh, kèm logo ByteDance và chữ "Introducing Seedance 2.5". Tin chính ngày 06/07/2026: ByteDance giới thiệu Seedance 2.5, mô hình tạo video AI liền mạch tới 30 giây trong một lần chạy mà không cần ghép cảnh.

Ngày 6/7, ba tin tức AI đáng chú ý bao gồm: ByteDance giới thiệu Seedance 2.5, mô hình tạo được video AI liền mạch tới 30 giây trong một lần chạy mà không cần ghép cảnh; Amazon ngừng nhận khách hàng mới cho Mechanical Turk sau 21 năm; và một lập trình viên phát hành pxpipe, công cụ mã nguồn mở giúp giảm 59–70% chi phí token khi dùng Claude Code. Ba tin tức trải trên ba tầng khác nhau của ngành AI: sáng tạo nội dung, dữ liệu huấn luyện và chi phí vận hành.

1. ByteDance Seedance 2.5: video AI 30 giây liền mạch, không ghép cảnh

Từ trước đến nay, các mô hình tạo video AI đều bị giới hạn ở những đoạn clip ngắn. Muốn video dài hơn, người dùng phải ghép nhiều clip, và mỗi điểm nối thường lộ rõ sự thiếu nhất quán về nhân vật, ánh sáng hay chuyển động. Seedance 2.5 của ByteDance phá vỡ giới hạn đó.

Mô hình tạo một clip dài tới 30 giây trong một lần chạy duy nhất, không cần ghép cảnh, kèm cả chuyển cảnh và thay đổi nhịp độ ngay trong clip. Nó có thể nhận cùng lúc tối đa 50 đầu vào tham chiếu như hình ảnh, âm thanh và các nguồn khác, hữu ích cho những cảnh phim nhiều nhân vật. Người dùng cũng có thể chỉnh sửa video sau khi tạo mà vẫn giữ nguyên phong cách hình ảnh.

Seedance 2.5 được giới thiệu tại hội nghị FORCE do Volcano Engine tổ chức và dự kiến ra mắt vào đầu tháng 7. Cùng dịp, ByteDance công bố thêm vài mô hình khác; đáng chú ý, bản Seedance 2.0 nay đã hỗ trợ 4K với độ sâu màu 10-bit.

Nguồn: The Decoder

Ghi chú thuật ngữ

  • Volcano Engine: Mảng điện toán đám mây của ByteDance, cung cấp các mô hình AI của hãng dưới dạng dịch vụ cho doanh nghiệp.

2. Amazon ngừng nhận khách hàng mới cho Mechanical Turk sau 21 năm

Amazon Mechanical Turk ra đời năm 2005, là một chợ trực tuyến kiểu crowdsourcing nơi người dùng được trả những khoản tiền nhỏ để làm các tác vụ đơn giản mà máy móc khi đó chưa tự động hóa được, như giải CAPTCHA hay nhận diện sắc thái của một câu. Phải đến năm 2018, Amazon mới định vị lại nền tảng như một công cụ để các công ty gắn nhãn dữ liệu huấn luyện mạng nơ-ron.

Từ ngày 30/7/2026, Amazon sẽ ngừng nhận khách hàng mới cho Mechanical Turk. Khách hàng hiện tại vẫn dùng dịch vụ bình thường, và Amazon cho biết sẽ không phát triển thêm tính năng mới, tức nền tảng chưa bị khai tử hoàn toàn nhưng gần như chỉ còn “thoi thóp”.

Mechanical Turk từ lâu được xem là “bệ đỡ ngầm” cho kiểu làm AI “giả cho đến khi thành thật”: nhiều sản phẩm quảng cáo là AI thực chất do chính đội ngũ người làm trên Mechanical Turk thực hiện. Chi tiết này càng trớ trêu vì “Mechanical Turk” nguyên gốc là một trò bịp thế kỷ 18, một cỗ máy chơi cờ giả có người thật giấu bên trong điều khiển.

Nhưng nghịch lý lớn nhất nằm ở chỗ khác: dữ liệu vốn để huấn luyện AI nay lại do chính AI tạo ra. Một phân tích năm 2023 cho thấy 33% đến 46% người làm trên Mechanical Turk đã dùng mô hình ngôn ngữ lớn để hoàn thành công việc, làm dấy lên nghi ngờ về độ tin cậy của dữ liệu được gắn nhãn, và cả câu hỏi liệu có còn cần con người trong quy trình hay không.

Nguồn: TechCrunch

Ghi chú thuật ngữ

  • Crowdsourcing: Huy động đông người thực hiện các công việc nhỏ lẻ qua internet, ở đây thường là gắn nhãn dữ liệu.

3. pxpipe: công cụ mã nguồn mở giảm 59–70% chi phí token Claude Code

Lập trình viên Steven Chong vừa phát hành pxpipe, một proxy cục bộ đứng giữa ứng dụng và API của Claude Code. Cách hoạt động khá khác thường: thay vì gửi các phần văn bản cồng kềnh dưới dạng chữ, pxpipe kết xuất chúng thành ảnh PNG.

Mấu chốt nằm ở cách Anthropic tính phí: văn bản tốn khoảng một token cho mỗi ký tự, nhưng ảnh chỉ tốn một số token cố định theo kích thước điểm ảnh, bất kể chứa bao nhiêu chữ. Nhờ đó, pxpipe dồn các phần tĩnh và lặp lại như system prompt, tài liệu công cụ và lịch sử hội thoại cũ vào ảnh, chỉ để tin nhắn gần đây và đầu ra chạy dưới dạng văn bản. Ví dụ, khoảng 48.000 ký tự system prompt nếu ở dạng chữ tốn chừng 25.000 token, nhưng khi nén thành một ảnh PNG chỉ còn khoảng 2.700 token.

Kết quả: Steven Chong cho biết mức tiết kiệm trung bình 59–70%; trong một demo với Fable 5, chi phí một phiên làm việc giảm từ 42,21 USD xuống còn 6,06 USD. Với đội ngũ dùng Claude Code thường xuyên, đây là công cụ đáng thử, nhất là cho các tác vụ không đòi hỏi độ chính xác tuyệt đối.

Đánh đổi là độ chính xác và tốc độ. Phương pháp này “có mất mát”: những chuỗi ký tự cần chính xác tuyệt đối như mã băm (hash) có thể bị đọc sai khi lấy ra từ ảnh, và tốc độ chậm hơn vì mô hình phải xử lý ảnh qua bộ mã hóa thị giác thay vì đọc chữ trực tiếp. pxpipe hiện bật sẵn cho Fable 5 và GPT-5.6, hai mô hình đọc ảnh chính xác nhất. Mã nguồn công khai tại GitHub: teamchong/pxpipe.

Nguồn: The Decoder

Ghi chú thuật ngữ

  • Proxy (cục bộ): Phần mềm trung gian chạy trên máy tính người dùng, đứng giữa ứng dụng và API.
  • Token: Đơn vị xử lý của mô hình ngôn ngữ, khoảng 0,75 từ tiếng Anh; chi phí dùng mô hình thường tính theo số token.
  • System prompt: Hướng dẫn cài đặt hành vi ban đầu gửi cho mô hình AI trước khi bắt đầu hội thoại.

Bài viết của đội ngũ ZTO Labs, chuyên đào tạo và nghiên cứu AI tại Việt Nam.

Chia sẻ bài viết
Facebook LinkedIn Threads