Tổng thống Mỹ Donald Trump tuyên bố không muốn làm chậm lại AI vì lo ngại Trung Quốc vươn lên.
Kết quả tìm kiếm: Mythos 5
AI tự lập 'bầy đàn' tấn công mạng, chấp nhận 'cảm tử' vì nhiệm vụ
Trong loạt sự cố của OpenAI, khoảng 700 tác nhân AI tự phối hợp thành “bầy đàn”, vượt môi trường cô lập và tấn công hệ thống bên ngoài.
Hội đồng Bảo an Liên Hợp Quốc sắp họp về AI giữa những cảnh báo đáng sợ
Hội đồng Bảo an Liên Hợp Quốc sẽ tổ chức một cuộc họp về trí tuệ nhân tạo (AI) vào tuần tới, trong bối cảnh những lo ngại về nguy cơ từ công nghệ đang phát triển nhanh chóng ngày càng gia tăng.
Các tỷ phú AI kêu gọi giảm tốc mô hình “gà đẻ trứng vàng” của chính họ
(Dân trí) - Lãnh đạo các nền tảng AI lớn nhất thế giới cho rằng đã đến lúc giảm tốc độ phát triển những mô hình tiên tiến nhất, và cũng sinh lời nhất của họ, với lý do rủi ro từ công nghệ này ngày càng leo thang.
OpenAI ra mắt GPT-6 Astra, mô hình trí tuệ nhân tạo nguy hiểm nhất
(Dân trí) - Sau khi GPT-6 Astra được ra mắt, bản thân OpenAI thừa nhận rằng mô hình AI mới của hãng có thể gây nguy hiểm vì những khả năng mà nó có thể thực hiện.
Các vụ AI mất kiểm soát, không nghe lệnh con người gia tăng mạnh
Các sự cố trong đó AI tìm cách vượt khỏi sự kiểm soát của người dùng, nói dối, phớt lờ chỉ dẫn hoặc theo đuổi mục tiêu theo cách gây hại đã tăng lên mức cao nhất, đồng thời mức độ nghiêm trọng của các hành vi được cho là lệch khỏi ý định của con người cũng có dấu hiệu gia tăng.
Cặp thầy trò trở thành ‘ông trùm’ AI Trung Quốc, khiến Mỹ phải dè chừng
Hơn chục năm trước, ông Đường Kiệt (Tang Jie) và Dương Trí Lâm (Yang Zhilin) là cặp thầy - trò mê máy tính, cùng nuôi giấc mơ chế tạo cỗ máy có thể tư duy như con người.
Tác nhân AI 'cản trở, đấu đá nhau' khi làm nhiệm vụ
Tác nhân AI 'cản trở, đấu đá nhau' khi làm nhiệm vụ
Frontier Red Team, nhóm chuyên kiểm thử an toàn AI thuộc Anthropic, ngày 13/8 công bố nghiên cứu với các mô hình Sonnet 4.
Tác nhân AI của Anthropic 'cản trở, đấu đá' trong thử nghiệm
Tác nhân AI của Anthropic 'cản trở, đấu đá' trong thử nghiệm
Frontier Red Team, nhóm chuyên kiểm thử an toàn AI thuộc Anthropic, ngày 13/8 công bố nghiên cứu với các mô hình Sonnet 4.
OpenAI thông báo sự cố mạng ‘chưa từng có’ do các tác nhân AI gây ra
Ngày 21/7, OpenAI - nhà sản xuất ứng dụng ChatGPT cho biết các mô hình trí tuệ nhân tạo (AI) tiên tiến của họ đã hoạt động ngoài tầm kiểm soát trong quá trình thử nghiệm bảo mật, tự động xâm nhập vào một nền tảng phổ biến dành cho các lập trình viên.
Lần đầu ghi nhận sự cố nghiêm trọng về hành vi ngoài dự kiến của các mô hình AI tiên tiến
Mô hình trí tuệ nhân tạo (AI) tiên tiến nhất của Anthropic đã sử dụng danh tính giả để đánh lừa người dùng và tìm cách cài đặt mã độc trong quá trình thử nghiệm của Viện An toàn AI của Anh (AISI).
Công ty khởi nghiệp ở Israel và bí ẩn phía sau loạt sự cố AI tự ý hành động
Trong hai tuần qua, OpenAI, Anthropic và Meta đều thông báo các mô hình AI đã tự ý hoạt động ngoài dự kiến trong quá trình kiểm tra an ninh định kỳ. Khi giải thích về những gì đã xảy ra, cả ba công ty đều đề cập đến cùng một cái tên.
Loạt AI 'nổi loạn'
Loạt AI 'nổi loạn'
Nếu như năm 2025 và nửa đầu năm nay, các mô hình AI chỉ "nổi loạn" bằng cách chống tắt máy, tự duy trì hay tự hành trên Internet, trong hai tháng qua, một làn sóng AI có khả năng tự thực hiện các hành vi ngoài dự kiến đang hình thành.
Mô hình AI của Anthropic tấn công 3 công ty trong khi thử nghiệm
Hôm 30/7, Anthropic cho biết phần mềm mà công ty này đang thử nghiệm đã tự ý truy cập Internet và tấn công các doanh nghiệp trong ba sự cố riêng biệt kể từ tháng 4.
AI của OpenAI và Anthropic tự tạo danh tính giả để tấn công mạng
Viện Nghiên cứu An ninh AI Anh phát hiện các mô hình AI của OpenAI và Anthropic thực hiện hành vi lừa đảo chưa từng có trong một cuộc kiểm thử an ninh mạng.
Mô hình AI hàng đầu của Trung Quốc thoát khỏi môi trường thử nghiệm
Mô hình trí tuệ nhân tạo (AI) mới nhất của công ty Trung Quốc Moonshot đã thoát khỏi môi trường thử nghiệm an ninh mạng, đánh dấu sự cố mới nhất làm dấy lên lo ngại về khả năng kiểm soát công nghệ của các công ty phát triển AI.
Mô hình AI của Anthropic tạo danh tính giả để lừa đảo
Mô hình AI của Anthropic tạo danh tính giả để lừa đảo
Viện An ninh AI (AISI), cơ quan do chính phủ Anh thành lập năm 2023, tuần này thông báo về thử nghiệm độc lập với một số tác nhân của Anthropic và OpenAI.
Thêm một mô hình AI tự ý xâm nhập hệ thống công ty khác khi thử nghiệm
Meta (công ty mẹ của Facebook và Instagram) là doanh nghiệp mới nhất có tác nhân AI hoạt động ngoài dự kiến.
Các vụ vi phạm an ninh mới làm dấy lên lo ngại về AI của OpenAI và Anthropic
OpenAI và Anthropic để AI thực hiện hành vi trái phép trong thử nghiệm bảo mật.
Sức ép trong cuộc đua trí tuệ nhân tạo
Robot hình người của Trung Quốc tại Hội nghị Internet thế giới ở Chiết Giang, Trung Quốc.
Mô hình AI của Anthropic 'đột nhập' thành công ba tổ chức trong thử nghiệm
Ngày 30/7, công ty Anthropic cho biết một số mô hình trí tuệ nhân tạo (AI) tiên tiến của hãng đã thoát khỏi môi trường thử nghiệm biệt lập của bên thứ ba, truy cập Internet công cộng và xâm nhập vào hệ thống của ba tổ chức.
Đến lượt Claude thoát kiềm tỏa, xâm nhập hệ thống của 3 tổ chức
Đến lượt Claude thoát kiềm tỏa, xâm nhập hệ thống của 3 tổ chức
Thông tin được Anthropic công bố hôm 30/7, vài tuần sau trường hợp mô hình OpenAI mất kiểm soát và xâm nhập nền tảng AI trong thử nghiệm an ninh.
AI Trung Quốc 'đắt khách' tại Mỹ
Chi phí thấp và năng lực xử lý cải thiện nhanh, các mô hình trí tuệ nhân tạo (AI) Trung Quốc ngày càng được ưa chuộng tại Mỹ.
Startup xây trung tâm dữ liệu 1 GW, có thể chỉ dùng chip Trung Quốc
Startup xây trung tâm dữ liệu 1 GW, có thể chỉ dùng chip Trung Quốc
Bloomberg dẫn nguồn tin cho biết, trung tâm mới có công suất 1 GW, đủ cung cấp điện cho khoảng 750.
Alphabet đạt doanh thu kỷ lục
TinVina.Com - Tập đoàn công nghệ Alphabet, công ty mẹ của Google, vừa công bố doanh thu quý II tăng trưởng 24% so với cùng kỳ năm trước nhờ sự bùng nổ của mảng điện toán đám mây.