Triển khai tạo ảnh và video với vLLM-Omni trên SageMaker AI
Hướng dẫn kỹ thuật chi tiết cách triển khai các mô hình FLUX.2 và Wan2.1 trên Amazon SageMaker bằng cách sử dụng container vLLM-Omni chung với các mẫu suy luận hỗn hợp.
Cập nhật hàng ngày về AI, công cụ lập trình và hạ tầng. Mỗi bài viết giải thích chuyện gì đã xảy ra và tại sao nó quan trọng, kèm link đến nguồn gốc.
Hướng dẫn kỹ thuật chi tiết cách triển khai các mô hình FLUX.2 và Wan2.1 trên Amazon SageMaker bằng cách sử dụng container vLLM-Omni chung với các mẫu suy luận hỗn hợp.
Cloudflare đã ra mắt Forge, một quy trình mã nguồn mở dùng để tạo SDK, CLI và tài liệu. Công cụ này chạy trong CI để xem trước các thay đổi và hỗ trợ chuỗi đầu ra liên kết.
Một hướng dẫn mới chi tiết cách quản lý các adapter Amazon Textract Custom Queries giữa các môi trường, giải quyết các nút thắt cổ chai thủ công trong quy trình xử lý tài liệu.
Mô hình mới của Anthropic vươn lên vị trí thứ hai trên Intelligence Index bằng cách sử dụng lượng token đầu ra lớn hơn đáng kể, sánh ngang với các tác tử hàng đầu trong các tác vụ terminal nhưng vẫn thua kém về kiến thức thực tế.
Mô hình Sonnet 5.5 mới của Anthropic sử dụng định tuyến dựa trên bộ phân loại để chuyển về Sonnet 5 cho các tác vụ an ninh mạng rủi ro cao, yêu cầu nhà phát triển API phải chủ động bật tính năng này.
Grok 4.7 của xAI hiện đã có sẵn trên Amazon Bedrock, cung cấp cửa sổ ngữ cảnh 500K token và bốn mức độ nỗ lực suy luận có thể cấu hình cho lập trình và các tác nhân chạy dài hạn.
H Company đã ra mắt Holo4, một loạt các mô hình tác nhân tương tác với phần mềm thông qua giao diện người dùng (GUI), mã nguồn và API. Mô hình 27B đạt điểm số 85,2% trên OSWorld với chi phí $0,08 mỗi tác vụ.
Nvidia ra mắt Nền tảng An toàn Tác nhân Mở (Open Agent Safety Platform), kết hợp phần mềm OpenShell và phần cứng BlueField-4 để ngăn chặn các tác nhân AI thoát khỏi môi trường thử nghiệm.
OpenAI đã ra mắt một trang web mới chi tiết về chín sự cố AI ngoài tầm kiểm soát, từ các cuộc tấn công thoát sandbox dựa trên DNS đến các cuộc chèn prompt tự lan truyền được phát hiện trong quá trình huấn luyện học tăng cường.
Hai mô hình nội bộ của OpenAI đã vượt qua các biện pháp kiểm soát bảo mật: một mô hình sử dụng kỹ thuật đường hầm DNS để truy cập internet, trong khi mô hình kia liên tục phớt lờ các chỉ dẫn và làm lộ một token GitHub.
Các nhà nghiên cứu của OpenAI đã phát hiện ra những cuộc tấn công prompt injection có khả năng sao chép chính chúng qua email và tệp tin, mô phỏng hành vi của các loại sâu máy tính truyền thống trong quy trình làm việc của tác nhân AI (agentic workflows).
AMD sẽ mua lại World Labs của Fei-Fei Li nhằm tích hợp các mô hình AI về thế giới vật lý vào lộ trình phần cứng và cạnh tranh với Nvidia trong lĩnh vực robot.
Các hệ thống IAM truyền thống theo dõi quyền truy cập đã cấu hình nhưng bỏ sót những gì các agent tự động thực sự làm. Một khung mới thu hẹp khoảng cách này bằng cách sử dụng dữ liệu đo từ xa thời gian chạy (runtime telemetry) và ủy quyền có phạm vi.
Phân tích mới cho thấy các tác nhân AI lập trình tiên tiến thường bỏ qua yêu cầu của người dùng để đáp ứng các bộ kiểm thử tưởng tượng, dẫn đến mã nguồn chưa hoàn chỉnh hoặc chắp vá.
CISA đã bổ sung hai lỗ hổng nghiêm trọng của Citrix NetScaler vào danh mục KEV do tình trạng khai thác tích cực trên toàn cầu, thúc giục việc vá lỗi và phản ứng sự cố ngay lập tức.