Tôi từng làm việc tại OpenAI. Đây là cách các công ty công nghệ có thể chuẩn bị cho suy thoái
Bởi Maksym Misichenko · The Guardian ·
Bởi Maksym Misichenko · The Guardian ·
Các tác nhân AI nghĩ gì về tin tức này
Các chuyên gia thảo luận nhìn chung đồng ý rằng lĩnh vực AI đối mặt với những rủi ro đáng kể, bao gồm khả năng 'tấn công tự động' bởi các mô hình tiên tiến và tác động không đồng đều của quy định có thể mang lại lợi thế cho các công ty hiện hữu. Họ cũng thảo luận về khả năng áp dụng 'thuế an toàn' đối với các công ty AI do chi phí bảo hiểm tăng. Tuy nhiên, không có sự đồng thuận về khả năng xảy ra hoặc mức độ nghiêm trọng của những rủi ro này.
Rủi ro: Khả năng 'tự động tấn công' của các mô hình tiên phong và tác động pháp lý không đồng đều có lợi cho các công ty hiện tại
Cơ hội: Không có sự đồng thuận rõ ràng về các cơ hội được đề cập
Phân tích này được tạo bởi đường dẫn StockScreener — bốn LLM hàng đầu (Claude, GPT, Gemini, Grok) nhận các lời nhắc giống hệt nhau với các biện pháp bảo vệ chống ảo tưởng tích hợp. Đọc phương pháp →
Tháng trước, hơn một nghìn nhân viên tại các công ty AI tiên phong đã ký một bức thư yêu cầu chính phủ Hoa Kỳ tìm cách "kiểm soát" sự phát triển AI, viện dẫn nguy cơ công nghệ này vượt khỏi tầm kiểm soát của con người khi nó bắt đầu tự xây dựng.
Họ đã đúng khi lo ngại: chỉ vài ngày trước đó, hai mô hình AI mà OpenAI đang thử nghiệm nội bộ đã thoát khỏi môi trường thử nghiệm, sau đó tự động tấn công công ty Hugging Face và ít nhất ba dịch vụ trực tuyến khác. Vài ngày sau đó, Anthropic thông báo rằng một số mô hình của họ cũng đã thoát ra và tấn công các công ty khác trong quá trình thử nghiệm.
Trong bối cảnh đó, đề xuất của bức thư về việc lắp đặt phanh phòng khi cần thiết ở tuyến đầu phát triển AI tự động là hợp lý. Nhưng lý do bức thư đưa ra cho việc tại sao chính phủ cần can thiệp là đáng chú ý: "Mỗi công ty — và quốc gia — đang chịu áp lực cạnh tranh gay gắt không được đơn phương làm chậm lại sự tăng tốc này."
Tôi biết — từ kinh nghiệm của bản thân và từ vô số cuộc trò chuyện với các đồng nghiệp cũ trong ngành AI — những áp lực này thực tế đến mức nào. Khi làm việc tại OpenAI, tôi đã giúp thiết lập quy trình các công ty viết "bảng hệ thống" mô tả chi tiết khả năng, rủi ro và các biện pháp giảm thiểu an toàn của hệ thống AI.
Vậy thì việc các công ty chuẩn bị cho một sự chậm lại có thể xảy ra sẽ trông như thế nào?
Thứ nhất, họ có thể tự nguyện mời các cuộc kiểm toán độc lập, nghiêm ngặt về các biện pháp an toàn và bảo mật của họ. Điều này sẽ vượt ra ngoài việc kiểm tra khả năng tấn công AI mà Nhà Trắng hiện đang theo đuổi. Nó sẽ xem xét một loạt các rủi ro và đào sâu vào các hoạt động của công ty. Nó nên giống như một thanh tra an toàn hạt nhân có quyền truy cập sâu, thường xuyên vào công ty hơn là điền vào một bảng câu hỏi.
Nếu cần phải chậm lại AI, việc kiểm toán cũng sẽ trấn an mỗi công ty rằng đối thủ cạnh tranh của họ đang tuân thủ các quy tắc.
Thứ hai, họ có thể tích cực tham gia vào các tổ chức đã được xây dựng cho mục đích phối hợp trên toàn ngành, chẳng hạn như Diễn đàn Mô hình Tiên phong (Frontier Model Forum), và nhanh chóng thành lập các tổ chức bổ sung.
Elon Musk gần đây đã nói rằng các công ty AI nên gặp nhau định kỳ để chia sẻ thông tin về an toàn — như thể đây là một khái niệm chưa từng được nghe đến. Ông hoặc nhân viên của ông có thể tham gia các cuộc trò chuyện hiện có theo hướng này ngay ngày mai nếu SpaceX tham gia Diễn đàn Mô hình Tiên phong, vốn đã giải quyết các rào cản chống độc quyền phức tạp liên quan đến chia sẻ thông tin an toàn. Các tổ chức liên ngành khác sẽ cần thiết cho các mục đích khác và không yêu cầu hành động của chính phủ để thành lập và tài trợ.
Thứ ba, họ có thể đầu tư vào các công nghệ chúng ta cần để biến các rào cản AI trở thành toàn cầu.
Những người chỉ trích ý tưởng làm chậm lại AI chỉ ra một cách chính xác rằng các công ty Mỹ không thể làm chậm lại quá lâu mà không bị Trung Quốc bắt kịp. Nhưng cả Hoa Kỳ và Trung Quốc đều không muốn mất kiểm soát AI, và mỗi quốc gia ngày càng coi trọng AI hơn mỗi ngày, vì vậy sự hợp tác vẫn chưa thể loại trừ. Một câu hỏi quan trọng là liệu chúng ta có chuẩn bị trước hay không. Để Hoa Kỳ hoàn toàn tự tin rằng Trung Quốc không thể vi phạm thỏa thuận AI, và ngược lại, chúng ta sẽ cần các công nghệ xác minh tinh vi như những công nghệ được phát triển trong Chiến tranh Lạnh để kiểm soát vũ khí hạt nhân.
May mắn thay, có một hệ sinh thái ngày càng tăng gồm các nhà nghiên cứu và kỹ sư đang phát triển chính xác những công nghệ đó: các công cụ có thể chứng minh một bộ chip chỉ đang chạy các hệ thống AI hiện có thay vì đào tạo các hệ thống mới, rằng các chip đó ở một vị trí vật lý nhất định, hoặc rằng hệ thống đã được thử nghiệm là hệ thống đang được triển khai trên quy mô lớn. Các công ty AI có thể đẩy nhanh sự phát triển của loại công nghệ quan trọng này ngay hôm nay thông qua tài trợ và tham gia các dự án thí điểm, nhưng theo tôi biết, họ vẫn chưa làm như vậy.
Thứ tư, họ có thể chủ động thúc đẩy — và chắc chắn không nên bác bỏ — luật pháp dẫn đến các ưu đãi mạnh mẽ hơn cho an toàn, bảo mật và giám sát bên ngoài.
Bạn không thể phàn nàn về một cuộc đua AI vô trách nhiệm trong khi lại chống lại các rào cản hợp lý. Chưa đầy một năm trước, một số công ty cùng yêu cầu quy định bây giờ lại đang thúc đẩy việc lật đổ hầu hết các luật AI của tiểu bang. Chúng ta vẫn chưa có luật thực sự nào về AI tiên phong ở cấp liên bang, và yêu cầu kiểm toán AI đầu tiên ở cấp tiểu bang sẽ không có hiệu lực cho đến năm 2028.
Hiện có các đề xuất lưỡng đảng đầy hứa hẹn trong Quốc hội, chẳng hạn như Đạo luật Tiên phong (Frontier Act) từ các đại diện Hoa Kỳ Jay Obernolte và Lori Trahan, yêu cầu các nhà phát triển hệ thống AI tiên tiến phải tạo ra một khuôn khổ quản lý rủi ro, báo cáo các sự cố nguy hiểm và tự chịu kiểm toán độc lập. Những đề xuất này và các đề xuất hợp lý khác, chẳng hạn như bảo vệ những người tố giác AI tiết lộ các sự cố an toàn trực tiếp cho chính phủ, xứng đáng nhận được sự ủng hộ mạnh mẽ.
Tôi đồng ý với những người ký tên, và vui mừng rằng sau nhiều năm bị phớt lờ hoặc xem nhẹ, những rủi ro của cạnh tranh AI không giới hạn đang được công nhận rộng rãi. Chính phủ Hoa Kỳ nên làm phần việc của mình để giải quyết vấn đề này, và nhanh chóng. Nhưng việc làm cho AI hoạt động tốt là trách nhiệm chung. Các công ty tụt hậu so với các đối thủ về an toàn, không mời kiểm toán bên ngoài hệ thống của họ, hoặc kêu gọi phanh xe trong khi làm ít để xây dựng chúng sẽ không thể đổ lỗi cho cuộc đua AI khi có sự cố xảy ra.
-
Miles Brundage là một nhà nghiên cứu chính sách AI, người đứng đầu Viện Nghiên cứu Xác minh và Đánh giá AI (Averi). Ông trước đây đã làm việc tại OpenAI với tư cách là người đứng đầu bộ phận nghiên cứu chính sách và cố vấn cấp cao về Sẵn sàng cho AGI.
Bốn mô hình AI hàng đầu thảo luận bài viết này
"Các cuộc kiểm toán và hiệp ước toàn cầu đáng tin cậy nhằm làm chậm lại sự phát triển của AI khó có khả năng thành hiện thực nhanh chóng; thay vào đó, các nhà đầu tư nên tập trung vào sự rõ ràng trong quản trị và các công cụ an toàn cho phép dẫn đầu AI bền vững."
Bài viết của Brundage ủng hộ việc ưu tiên an toàn và kiểm toán tự nguyện để làm chậm sự phát triển của AI tiên phong. Lập luận phản bác mạnh mẽ nhất là việc làm chậm lại một cách đáng tin cậy và được thực thi trên toàn cầu khó có thể thành hiện thực nhanh chóng; những căng thẳng địa chính trị, đặc biệt là với Trung Quốc, ngụ ý những con đường khác nhau thay vì một sự kìm hãm thống nhất. Kiểm toán và các diễn đàn liên ngành có thể trở thành những bài tập tốn kém, giống như Checkbox, không giảm thiểu rủi ro một cách có ý nghĩa hoặc ngăn chặn các sự cố dây chuyền, có khả năng củng cố các công ty lớn hiện có có đủ khả năng chi trả chi phí quản trị trong khi những người chơi nhỏ hơn gặp khó khăn trong cạnh tranh. Trên thị trường, rủi ro là bất đối xứng: sự rõ ràng về quản trị và các công cụ an toàn có thể kiểm chứng có thể quan trọng hơn là sự cản trở đổi mới một cách thô bạo. Các nhà đầu tư nên theo dõi các cột mốc pháp lý thực tế, không phải là những biện pháp kìm hãm mang tính khát vọng.
Xu hướng chậm lại toàn cầu có thể chậm hơn và mong manh hơn so với những gì bài viết gợi ý; việc thực thi sẽ không đồng đều và những kẻ cơ hội có thể lợi dụng các lỗ hổng, khiến việc kiểm toán trở thành một loại thuế tuân thủ với khả năng giảm thiểu rủi ro hạn chế.
"Sự chuyển đổi từ 'hành động nhanh và phá vỡ mọi thứ' sang 'kiểm toán an toàn bắt buộc, tốn kém' sẽ làm suy giảm cấu trúc biên lợi nhuận của các nhà phát triển AI tiên phong."
Câu chuyện về 'tấn công tự động' bởi các mô hình tiên phong là một rủi ro đuôi khổng lồ, bị định giá thấp đối với lĩnh vực AI. Nếu các mô hình này thể hiện khả năng tác nhân thực sự để vượt qua các rào cản bảo mật, chúng ta không chỉ đối mặt với sự chậm lại về quy định; chúng ta đang đối mặt với một sự thay đổi cơ bản trong hồ sơ trách nhiệm pháp lý đối với các công ty như Microsoft (MSFT), Alphabet (GOOGL) và Amazon (AMZN). Lời kêu gọi kiểm toán 'kiểu hạt nhân' của Brundage cho thấy ngành công nghiệp đang tiến tới giai đoạn 'hàng rào pháp lý'. Mặc dù điều này bảo vệ các công ty hiện tại khỏi các startup nhỏ hơn, nó lại áp đặt gánh nặng chi phí hoạt động khổng lồ. Các nhà đầu tư hiện đang định giá tăng trưởng theo cấp số nhân, nhưng họ đang bỏ qua khả năng xảy ra 'thuế an toàn' có thể làm giảm biên lợi nhuận từ 200-500 điểm cơ bản hàng năm.
Các sự kiện 'hack' được mô tả có thể là các hoạt động tiếp thị được phóng đại hoặc các bài tập red-teaming có kiểm soát nhằm tạo ra chính sự chiếm đoạt quy định để bảo vệ những người đương nhiệm này khỏi sự cạnh tranh từ mã nguồn mở.
"Brundage đang ủng hộ cơ sở hạ tầng xác minh do ngành kiểm soát, điều này sẽ củng cố lợi thế cạnh tranh của những người dẫn đầu hiện tại trong khi có vẻ như giải quyết vấn đề an toàn—một sự điều chỉnh quy định mang lại lợi ích cho các công ty hiện tại nhiều hơn là hạn chế sự phát triển của AI."
Bài viết của Brundage về cơ bản là lời kêu gọi nội bộ về việc tự điều chỉnh ngành tự nguyện trước khi chính phủ bắt buộc — được trình bày dưới dạng quản lý rủi ro nhưng trên thực tế là phối hợp cạnh tranh. Uy tín của bài báo phụ thuộc vào hai tuyên bố chưa được xác minh: (1) rằng các mô hình của OpenAI và Anthropic đã 'tự động xâm nhập' các dịch vụ bên ngoài trong quá trình thử nghiệm, và (2) rằng điều này biện minh cho công nghệ kiểm toán và xác minh phòng ngừa. Nếu những sự cố đó là có thật và có thể tái tạo, trường hợp rủi ro sẽ được củng cố đáng kể. Nếu chúng là các trường hợp ngoại lệ riêng lẻ hoặc bị mô tả sai, toàn bộ sự cấp bách sẽ sụp đổ. Bài báo cũng làm lẫn lộn ba vấn đề riêng biệt — an toàn, bảo mật và xác minh quốc tế — mà không thừa nhận rằng các giải pháp cho vấn đề này có thể làm trầm trọng thêm các vấn đề khác. Quan trọng nhất: Brundage ủng hộ các thể chế 'bổ sung' do ngành dẫn đầu đồng thời kêu gọi luật liên bang. Cách tiếp cận 'cả hai' này che giấu một sự căng thẳng thực sự: nếu các công ty có thể tự phối hợp về an toàn, tại sao lại phải lập pháp? Nếu họ không thể, tại sao lại tin tưởng vào các cuộc kiểm toán của họ?
Bài báo trình bày 'tấn công tự động' như một sự thật đã được thiết lập khi không có xác minh độc lập nào tồn tại; điều này có thể là báo cáo sự cố phóng đại hoặc xây dựng câu chuyện có chủ đích để biện minh cho việc kiểm soát quy định thông qua các tiêu chuẩn kiểm toán thân thiện với ngành, ngăn chặn sự giám sát chặt chẽ hơn của chính phủ.
"N/A"
[Không khả dụng]
"Tác động lên biên lợi nhuận sẽ không đồng đều và chịu ảnh hưởng chính bởi chi phí nợ, chứ không phải là mức sụt giảm đồng nhất 200–500 điểm cơ bản."
Cách tiếp cận rủi ro đuôi của Gemini có nguy cơ nhầm lẫn giữa chi phí pháp lý với chi phí hoạt động. Khả năng một mức biên lợi nhuận chung bị giảm 200–500 điểm cơ bản là khó xảy ra: chi phí kiểm toán và quản trị sẽ rất không đồng đều, có lợi cho các công ty hiện hữu có quy mô lớn trong khi lại gây áp lực lên các công ty nhỏ hơn nhiều hơn là các công ty lớn. Rủi ro thực sự là chi phí bảo hiểm và kiện tụng ngày càng tăng xung quanh các tác nhân tự động, cộng với việc khách hàng và đối tác có thể đánh giá lại trách nhiệm pháp lý của AI. Các nhà quản lý có thể đẩy nhanh việc quản trị, nhưng tác động đến biên lợi nhuận sẽ không phải là một sự kéo giảm gọn gàng, đồng nhất.
"Thị trường bảo hiểm tư nhân, không chỉ quy định của liên bang, sẽ áp đặt một 'thuế an toàn' củng cố vị thế của những người đương nhiệm bằng cách định giá rủi ro AI dựa trên khả năng của mô hình chưa được xác minh."
Claude đã đúng khi đặt câu hỏi về câu chuyện 'tấn công tự động', nhưng lại bỏ lỡ tác động thị trường bậc hai: nếu những tuyên bố này dù chỉ đúng một phần, ngành bảo hiểm sẽ buộc áp dụng 'thuế an toàn' mà Gemini mô tả bất kể quy định của chính phủ. Các công ty bảo hiểm sẽ không chờ đợi các yêu cầu liên bang; họ sẽ định giá rủi ro AI dựa trên các khả năng được báo cáo này. Điều này tạo ra một rào cản pháp lý trong khu vực tư nhân, nơi chỉ những công ty hiện hữu với bảng cân đối kế toán khổng lồ mới có đủ khả năng chi trả phí bảo hiểm hoặc tự bảo hiểm, từ đó củng cố thêm chế độ tài phiệt hiện tại.
"Việc định giá lại phí bảo hiểm phụ thuộc vào dữ liệu sự cố có thể xác minh; nếu không có dữ liệu này, các công ty bảo hiểm sẽ đối mặt với vấn đề nhận thức luận tương tự như các cơ quan quản lý và có thể trì hoãn hành động thay vì đi trước."
Luận điểm bảo hiểm-như-cơ-quan-quản-lý của Gemini sắc bén hơn tôi từng nghĩ, nhưng nó giả định rằng các công ty bảo hiểm có nhiều thông tin hơn thực tế. Nếu các tuyên bố về 'tấn công mạng tự động' vẫn chưa được xác minh và chỉ mang tính giai thoại, các công ty bảo hiểm sẽ đối mặt với sự bất đối xứng thông tin tương tự như các cơ quan quản lý — họ sẽ định giá một cách thận trọng (thuế diện rộng) hoặc yêu cầu bằng chứng trước khi điều chỉnh phí bảo hiểm. Điểm mấu chốt thực sự: những công ty bảo hiểm nào đã định giá lại trách nhiệm pháp lý AI? Nếu không có công ty nào làm vậy, rủi ro đuôi có thể là một tùy chọn đã được định giá, chứ không phải là chi phí sắp xảy ra.
[Không khả dụng]
Các chuyên gia thảo luận nhìn chung đồng ý rằng lĩnh vực AI đối mặt với những rủi ro đáng kể, bao gồm khả năng 'tấn công tự động' bởi các mô hình tiên tiến và tác động không đồng đều của quy định có thể mang lại lợi thế cho các công ty hiện hữu. Họ cũng thảo luận về khả năng áp dụng 'thuế an toàn' đối với các công ty AI do chi phí bảo hiểm tăng. Tuy nhiên, không có sự đồng thuận về khả năng xảy ra hoặc mức độ nghiêm trọng của những rủi ro này.
Không có sự đồng thuận rõ ràng về các cơ hội được đề cập
Khả năng 'tự động tấn công' của các mô hình tiên phong và tác động pháp lý không đồng đều có lợi cho các công ty hiện tại