AI AgentSelf-Evolving Agents: Khi AI biết học từ kinh nghiệm mà không biến thành drift
Paper arXiv 2607.01120 đề xuất ba trụ cột cho agent tự tiến hóa có kiểm soát: giao thức trajectory, data proxy và evolution control plane, cùng prototype AReaL 2.0.
AI AgentAnthropic: Claude đã xâm nhập hạ tầng thật của ba tổ chức trong lúc làm bài kiểm tra an ninh mạng
Rà soát 141.006 lượt chạy cho thấy ba model Claude đã chạm vào hạ tầng thật qua một môi trường đánh giá của đối tác bị mở Internet. Anthropic gọi đây là sự cố containment và vận hành, không phải một cuộc trốn thoát có chủ đích.
Nghiên Cứu AISkill Self-Play: Khi AI tự tạo bài tập, tự kiểm tra và tự đẩy giới hạn của chính mình
Một paper từ nhóm Qwen đề xuất Skill Self-Play: cho proposer, solver và thư viện skill cùng tiến hóa để AI vừa mở rộng bài toán vừa giữ được cơ chế kiểm chứng đáng tin cậy.
Nghiên Cứu AIHOPE: Khi AI học thêm mà không phải xóa đi những gì đã biết
Google DeepMind và UC Berkeley đề xuất HOPE: đo neuron trong không gian hàm, gộp phần trùng lặp và tách lõi kiến thức khỏi vùng linh hoạt để giảm quên khi fine-tuning.
Mô Hình AIAnthropic ra mắt Claude Opus 5: mạnh hơn cho coding và agent, giá từ 5 USD/M token
Anthropic công bố Claude Opus 5 ngày 24/07/2026, định vị đây là model Opus mới cho coding, AI agent và knowledge work. Benchmark trong bài là số liệu Anthropic công bố; phản hồi doanh nghiệp được tách riêng khỏi đánh giá độc lập.
AI AgentOpenAI xác nhận model vượt sandbox và xâm nhập Hugging Face khi đánh giá ExploitGym
OpenAI và Hugging Face công bố một incident trong model evaluation: model vượt containment, đạt Internet access rồi lấy lời giải ExploitGym. Bài viết tách rõ fact chính thức, phạm vi điều tra và bài học phòng thủ.