Tag: AI Agent

OpenAI ra mắt dots: AI luôn hoạt động có máy tính đám mây riêng

Dots dùng GPT-6 Astra để theo đuổi công việc dài hạn qua ứng dụng và kênh nhắn tin, nhưng quyền truy cập, bộ nhớ và cơ chế xác nhậ...

AI agent cần ranh giới ngoài mô hình: NVIDIA đưa lớp giám sát xuố...

Open Agent Safety Platform kết hợp môi trường chạy OpenShell với bộ giám sát Sentry trên BlueField-4. Thiết kế đặt việc kiểm soát ...

Sandbox được tạo để nhốt software: AI agent khiến bài toán khó hơ...

SandboxEscapeBench đặt AI agent vào 18 môi trường container có lỗi cấu hình hoặc lỗ hổng đã biết và yêu cầu chúng tìm đường ra. Bả...

Hacker trước đây phải tự tìm lỗ hổng từng website: Một chiến dịch...

Gambit Security tái dựng một chiến dịch trong đó một người vận hành ghép Strix, Cairn và Hermes thành dây chuyền từ dò lỗ hổng đến...

Một “biotech ảo” có 37.000 “nhân viên” nhưng không trả lương cho ...

Virtual Biotech của nhóm Stanford tổ chức các AI agent như một công ty dược, với “CSO” điều phối những nhóm chuyên môn và có lúc t...

Một nhà toán học có thể mất cả đời cho một bài toán: AI thử cách ...

OpenAI cho biết một hệ thống đa agent đã dùng khoảng 10.000 agent chạy đồng thời để tìm lời giải cho bài toán Navier–Stokes trong ...

AI Agent có thêm một điểm yếu mới: Một “skill” tưởng vô hại có th...

Nghiên cứu được chấp nhận tại ASE 2026 cho thấy 520 trong 17.022 agent skill được phân tích có vấn đề rò credential. Nguy cơ không...

AI-powered cyberattacks: Khi trí tuệ nhân tạo bắt đầu tự thực hiệ...

AI đang chuyển từ vai trò trợ lý cho hacker sang thực hiện một phần chuỗi tấn công. Agentic AI, zero-day và malware tự động đang t...

AI agent security: Bài toán bảo mật mới khi AI được phép tự gọi A...

Khi AI agent được phép gọi API, dùng tool, đọc dữ liệu và thực thi hành động thay người dùng, prompt injection có thể chuyển từ lỗ...

Kimi K3 vượt sandbox kiểm thử: AI agent đang trở nên khó kiểm soá...

Kimi K3 của Moonshot AI đã tận dụng lỗ hổng cấu hình trong môi trường kiểm thử để truy cập Internet ngoài phạm vi dự kiến. Sự cố c...

Qwen3.8-Max củng cố tham vọng AI của Alibaba trong cuộc đua mô hì...

Qwen3.8-Max với 2,4 nghìn tỷ tham số, 95 tỷ tham số kích hoạt và context 1 triệu token cho thấy Alibaba đang đẩy mạnh chiến lược A...

DeepSeek V4-Flash tiếp tục gây sức ép với hiệu năng cao và chi ph...

DeepSeek V4-Flash-0731 nâng mạnh năng lực agent và coding trong khi giữ giá API chỉ 0,14 USD/triệu token đầu vào và 0,28 USD/triệu...

Zero Trust kết hợp AI: Mô hình phòng thủ mới trước các cuộc tấn c...

Khi AI làm tăng tốc độ và quy mô tấn công mạng, Zero Trust đang được mở rộng sang danh tính AI agent, quyền theo ngữ cảnh và giám ...

Rogue AI agent trở lại tâm điểm khi nguy cơ vượt khỏi sandbox ngà...

Hàng loạt sự cố từ OpenAI, Anthropic, Meta đến Kimi K3 đang khiến khái niệm “rogue AI agent” trở lại tâm điểm. Vấn đề không phải A...

Kimi K3 bị phát hiện tìm cách thoát khỏi sandbox kiểm thử: cảnh b...

Kimi K3 của Moonshot AI đã tận dụng một lỗ hổng cấu hình mạng trong môi trường kiểm thử để truy cập GitHub và lấy đáp án. Sự cố kh...

Rogue AI agent: Khi tác nhân AI vượt khỏi tầm kiểm soát của con n...

Rogue AI agent là gì, vì sao một tác nhân AI có thể hành động lệch mục tiêu và con người cần thiết kế những lớp kiểm soát nào để g...

OpenAI ra mắt GPT-5.6: vì sao có tới 3 model Sol, Terra và Luna?

OpenAI vừa chính thức giới thiệu dòng mô hình GPT-5.6 với ba phiên bản mang tên Sol, Terra và Luna. Thay vì chỉ phát hành một mô h...