Hoàn Mỹ Đồng Thuận

Giá thị trường

BTC Bitcoin
$78,784.6 +0.79%
ETH Ethereum
$2,470.9 -0.61%
SOL Solana
$98.05 +2.73%
BNB BNB Chain
$693.4 -1.23%
XRP XRP Ledger
$1.47 -1.39%
DOGE Dogecoin
$0.0897 -2.27%
ADA Cardano
$0.2164 -2.61%
AVAX Avalanche
$7.5 -0.20%
DOT Polkadot
$0.8858 -2.60%
LINK Chainlink
$11.52 -1.25%

Lịch sự kiện blockchain

{{年份}}
12
05
halving BCH Halving

Sự kiện giảm một nửa phần thưởng khối

30
04
upgrade Nâng cấp Celestia Mainnet

Cải thiện hiệu quả lấy mẫu tính khả dụng dữ liệu

15
04
halving Bitcoin Halving

Phần thưởng khối giảm xuống 3,125 BTC

28
03
unlock Mở khóa token Arbitrum

Giải phóng 92 triệu ARB

22
03
unlock Mở khóa Optimism

Lượng cung lưu hành tăng khoảng 2%

10
05
upgrade Nâng cấp Ethereum Pectra

Tăng giới hạn validator và trừu tượng hóa tài khoản

18
03
unlock Mở khóa token Sui

Phần đội ngũ và nhà đầu tư sớm được giải phóng

08
04
upgrade Solana Firedancer

Trình xác thực độc lập ra mắt trên mainnet

Theo dõi phí Gas

Ethereum 28 Gwei
BNB Chain 3 Gwei
Polygon 42 Gwei
Arbitrum 0.5 Gwei
Optimism 0.3 Gwei

💡 Smart Money

0xdd0e...3674
Bot chênh lệch giá
+$0.4M
89%
0x914d...9091
Nhà tạo lập thị trường
+$3.9M
87%
0x5dba...e43e
Nhà tạo lập thị trường
+$4.1M
81%

Công cụ

Tất cả →

Anthropic nới lỏng giới hạn sinh học trên Fable 5: 85% ca bị hạ cấp biến mất, cánh cửa an toàn vừa hé mở

Bùi Yến Học tập
“Tôi đã thấy đồ thị này vẽ ra trước khi ai kịp thở.” Khi con số 85% xuất hiện trên màn hình, tôi biết một bộ phân loại an toàn nào đó vừa bị xoay ngưỡng. Không phải một mô hình được huấn luyện lại. Không phải một kiến trúc mới. Chỉ là một đường cong quyết định bị đẩy sang phải, và hàng loạt câu hỏi từng nằm trong vùng cấm lặng lẽ trở thành bình thường. Theo một bản tin theo dõi ngành, Anthropic đã nới lỏng các hạn chế sinh học trên mô hình có tên mã Fable 5. Cụ thể hơn: các câu hỏi sức khỏe hàng ngày – như đọc hiểu kết quả xét nghiệm, tìm hiểu triệu chứng, học sinh học cơ bản – giờ đây sẽ nhận được phản hồi bình thường từ Fable 5, thay vì bị chuyển xuống Opus 5, một mô hình bị đánh giá là yếu hơn trong cùng hệ thống. Hãy dừng lại ở cái tên trước đã. Fable 5 và Opus 5 không phải tên sản phẩm chính thức mà Anthropic công bố. Trong 13 năm săn tin, tôi học được rằng khi một mô hình chưa xuất hiện trên API changelog, cái tên đó là một tín hiệu rò rỉ, không phải một thông cáo báo chí. Nó có thể là mã nội bộ, có thể là tên đã được biên tập lại, nhưng bản chất vẫn là: thông tin đến từ một nguồn không chính thức. Với một quyết định liên quan đến an toàn sinh học, điều đó đáng để chúng ta nâng lông mày. Vậy điều gì đang thực sự xảy ra về mặt kỹ thuật? Mô hình ngôn ngữ lớn của Anthropic không đơn độc trả lời mọi câu hỏi. Phía trước nó là một lớp bộ phân loại an toàn – một hệ thống con học máy riêng, gán điểm rủi ro cho từng yêu cầu. Khi điểm rủi ro vượt ngưỡng, hệ thống không chặn câu hỏi hoàn toàn; nó thực hiện một cơ chế định tuyến kiểu xếp tầng: chuyển câu hỏi từ mô hình mạnh hơn sang mô hình yếu hơn. Đây là một thiết kế nhằm giảm thiểu tác hại, nhưng nó tạo ra một trải nghiệm khó chịu cho người dùng: bạn hỏi một câu về sức khỏe, và đột nhiên bạn bị giao cho một AI kém thông minh hơn. Tôi đã thấy đồ thị này vẽ ra trước khi ai kịp thở. Nó không phải đồ thị giá. Nó là đồ thị tỷ lệ fallback, và con số 85% là độ dốc của sự thay đổi. Anthropic báo cáo rằng sau khi triển khai bộ phân loại mới, tỷ lệ bị hạ cấp trong các truy vấn sinh học đã giảm khoảng 85%. Một con số ấn tượng. Nhưng với một người quen đọc báo cáo audit, con số này đặt ra nhiều câu hỏi hơn là câu trả lời. Câu hỏi đầu tiên: bộ phân loại mới có còn giữ được tỷ lệ chặn đúng – true positive rate – với các truy vấn thực sự nguy hiểm hay không? Một bộ phân loại nhị phân không bao giờ có thể hoàn hảo. Khi bạn giảm tỷ lệ dương tính giả, bạn thường phải trả giá bằng việc tăng tỷ lệ âm tính giả. Nếu trước đây cứ 1.000 câu hỏi sinh học thì có 100 câu bị hạ cấp để chặn 5 câu nguy hiểm, thì giờ đây, với 85% ca hạ cấp biến mất, liệu chúng ta đã chấp nhận bỏ lọt bao nhiêu trong số 5 câu đó? Bản tin không nói. Bản tin cũng không nói bộ test đánh giá được xây dựng thế nào. Nếu test set chứa quá nhiều câu hỏi sức khỏe thông thường, con số 85% phản ánh đúng nhu cầu người dùng, nhưng không phản ánh đúng mức độ an toàn. Câu hỏi thứ hai là câu hỏi về chi phí vận hành. Nếu Fable 5 là mô hình cao cấp hơn, mỗi lần không bị hạ cấp đồng nghĩa với việc người dùng tiêu thụ nhiều token đắt đỏ hơn trên hạ tầng của Anthropic. Với khách hàng API, hóa đơn của họ có thể tăng. Với chính Anthropic, biên lợi nhuận có thể bị bào mòn nếu họ không tăng giá. Nhưng với trải nghiệm người dùng, đây là một bản nâng cấp rõ rệt. Bạn không còn bị đối xử như một kẻ tình nghi khi hỏi “triệu chứng này có nguy hiểm không”. Điều ngược đời ở đây là: việc nới lỏng giới hạn an toàn lại có thể là một quyết định giữ chân người dùng, chứ không phải một quyết định kỹ thuật thuần túy. Trong các sản phẩm AI tiêu dùng, người dùng cảm nhận độ thông minh qua các cuộc trò chuyện hằng ngày. Nếu họ bị hạ cấp mỗi khi hỏi về một tờ giấy xét nghiệm, họ sẽ nghĩ rằng sản phẩm này ngu hơn đối thủ. Họ không quan tâm đó là bộ phân loại an toàn. Họ chỉ thấy một AI không trả lời được câu hỏi của họ. Với một công ty định vị bằng sự an toàn, đây là một vết nứt thương mại. Có một chi tiết mà bản tin không hề đề cập: sự thay đổi này có thể khiến Fable 5 trở nên hấp dẫn hơn trong mắt các công ty xây dựng ứng dụng sức khỏe. Các startup “AI + y tế” đang chạy đua để giải thích kết quả xét nghiệm, tóm tắt bệnh án, hỗ trợ học sinh học. Trước đây, những câu hỏi đó có thể bị chuyển sang mô hình yếu hơn, khiến chất lượng trả lời giảm, và startup phải vật lộn để hiệu chỉnh prompt. Giờ đây, nếu tin đồn là chính xác, họ có thể dùng Fable 5 cho toàn bộ hành trình trò chuyện. Điều đó biến Anthropic thành một lựa chọn tự nhiên hơn cho một thị trường đang nóng. Nhưng đó cũng chính là nơi nguy hiểm bắt đầu. Tôi đã thấy đồ thị này vẽ ra trước khi ai kịp thở. Lần này nó là đồ thị đường cong ranh giới giữa “hỏi về sức khỏe” và “hỏi cách chế tạo thứ gì đó nguy hiểm”. Ranh giới đó không bao giờ là một đường thẳng. Nó là một vùng xám rất rộng. Một câu hỏi về “chức năng của trình tự gene” nghe có vẻ học thuật. Nhưng khi được đặt trong một cuộc hội thoại nhiều vòng, với ngữ cảnh được bồi đắp dần, nó có thể trở thành một câu hỏi về cách lợi dụng trình tự gene. Bộ phân loại an toàn dựa trên ngữ cảnh có thể nắm bắt được điều đó ở vòng một. Nhưng ở vòng năm, vòng mười, nó có thể đánh mất dấu vết. Đây là lý do vì sao tôi gọi đây là một vụ “đánh đổi sự im lặng”. Trước đây, chính sách quá thô: bất cứ thứ gì dính dáng đến sinh học phân tử đều bị hạ cấp. Điều đó bảo vệ Anthropic khỏi những cáo buộc an toàn, nhưng lại khiến người dùng phải chịu đựng. Giờ đây, họ tinh chỉnh để phân biệt “học sinh học” với “thiết kế tác nhân gây bệnh”. Về mặt sản phẩm, đó là một cải tiến. Về mặt an toàn, đó là một phép đặt cược: hệ thống của họ phải đủ thông minh để nhận ra ý định xấu sau một loạt câu hỏi tưởng chừng vô hại. Tôi đã thấy nhiều giao thức crypto sụp đổ vì cùng một kiểu tự tin. Một nhóm phát triển tăng hạn mức vay, nới lỏng điều kiện thanh khoản, rồi tin rằng hệ thống của họ vẫn an toàn. “Số liệu sử dụng vẫn tốt”, họ nói. Ba tháng sau, một kẻ nắm được điểm mù thanh khoản rút sạch tiền. Thị trường tiền mã hóa dạy tôi rằng: bất kỳ ngưỡng rủi ro nào cũng là một lời mời gọi để ai đó thử nghiệm ở phía bên kia ngưỡng. AI cũng không khác. Chỉ có điều, thứ bị rút sạch có thể không phải tiền, mà là quyền kiểm soát thông tin nguy hiểm. Nhưng hãy công bằng. Việc nới lỏng này không phải là một bước đi điên rồ. Nó là một bước hiệu chỉnh cần thiết trong ngành. Nếu một mô hình quá an toàn đến mức vô dụng, người dùng sẽ bỏ đi, và một mô hình vô dụng cũng chẳng bảo vệ được ai. Câu chuyện “an toàn tuyệt đối” không bao giờ tồn tại trong thực tế. Nó chỉ tồn tại trong những bài đăng blog. Còn ở ngoài kia, các phòng thí nghiệm AI đang cạnh tranh bằng trải nghiệm, và một trải nghiệm kém vì quá sợ hãi cũng là một rủi ro. Điều khiến tôi trăn trở là sự thiếu vắng một lớp bảo vệ thứ hai. Nếu một bộ phân loại an toàn thay đổi ngưỡng, nó cần đi kèm với một hệ thống giám sát độc lập: theo dõi các truy vấn bị chặn đúng, các truy vấn bỏ lọt, và tỷ lệ trung bình sau khi nới lỏng. Không phải một bảng điều khiển nội bộ, mà là một báo cáo công khai, có thể kiểm toán. Nhưng trong bản tin này, không có báo cáo như vậy. Chỉ có một con số 85% và ba ví dụ dễ thương: đọc kết quả xét nghiệm, hiểu triệu chứng, học sinh học. Điều đó giống như một công ty tài chính công bố “số lượng giao dịch bị chặn giảm 85%” mà không đề cập đến số tiền bị rửa đã tăng bao nhiêu. Chi tiết thứ hai khiến tôi dừng lại: tên mã Fable 5. Trong giới săn tin, tên mã thường xuất hiện trước khi sản phẩm chính thức từ sáu đến mười hai tháng. Nhưng đôi khi, tên mã bị lộ ra từ một bản tin nội bộ, và nó không bao giờ trở thành tên chính thức. Nếu “Fable 5” là một mô hình đang được thử nghiệm, việc nới lỏng giới hạn sinh học trên một mô hình chưa hoàn thiện có thể tạo ra một vùng mù mà chính Anthropic cũng chưa lường hết. Nếu đó chỉ là tên được bịa ra để bảo vệ nguồn tin, thì chúng ta đang phân tích một câu chuyện dựa trên một cái tên không có gốc. Vậy nhà đầu tư nên đọc tin này thế nào? Với tôi, đây không phải là một tín hiệu đầu tư trực tiếp. Anthropic không phải công ty đại chúng, và thông tin về một bộ phân loại an toàn không thay đổi định giá. Nhưng nó là một tín hiệu chiến lược: Anthropic đang dịch chuyển từ định vị “an toàn nhất” sang định vị “an toàn trong mức hợp lý”. Sự dịch chuyển này có thể giúp họ cạnh tranh tốt hơn với OpenAI và Google trong các tình huống hằng ngày. Nó cũng có thể mở ra cánh cửa cho các nhóm red team, những người sẽ không ngừng tìm cách lách qua ranh giới mới. Có một câu hỏi quan trọng hơn câu hỏi về kỹ thuật: liệu người dùng có được thông báo khi một câu hỏi của họ bị hạ cấp hay không? Nếu hệ thống giữ im lặng, người dùng sẽ tin rằng câu trả lời họ nhận được đến từ mô hình mạnh nhất. Điều đó làm sai lệch nhận thức của họ về độ tin cậy. Một hệ thống an toàn có trách nhiệm phải minh bạch về việc nó đang giữ lại thông tin, hoặc đang chuyển hướng người dùng. Nếu không, sự tin tưởng sẽ sụp đổ theo một cách khác. Trong bối cảnh thị trường đang giảm nhiệt – cả crypto lẫn AI – các công ty có xu hướng nới lỏng tiêu chuẩn để giữ chân khách hàng. Tôi đã thấy điều đó vào năm 2022, khi các giao thức vay tăng hạn mức để giữ TVL, và tôi thấy hậu quả. Không phải ai cũng sụp đổ, nhưng những ai sống sót là những ai giữ được một lớp kiểm soát độc lập. Anthropic hiện vẫn đang giữ hình ảnh là một trong những phòng thí nghiệm cẩn trọng nhất. Việc nới lỏng một phần là điều bình thường. Vấn đề chỉ bắt đầu khi cẩn trọng trở thành một chiến dịch marketing, còn những con số an toàn được chọn lọc để kể một câu chuyện đẹp. Trong những tuần tới, tôi sẽ không ngồi chờ một thông cáo báo chí. Tôi sẽ mở API changelog của Anthropic, tìm kiếm bất kỳ thay đổi nào liên quan đến tên mã, và so sánh với các báo cáo từ các nhóm red team độc lập. Nếu Fable 5 thực sự tồn tại, nó sẽ xuất hiện trong một bản cập nhật chính thức, kèm theo tài liệu kỹ thuật. Nếu không, câu chuyện này sẽ chìm vào danh sách những tin đồn không có gốc rễ. Tôi cũng sẽ theo dõi xem các nhà phát triển ứng dụng sức khỏe có bắt đầu chuyển hướng sang Claude hay không. Khi một mô hình được nới lỏng ở đúng phân khúc mà thị trường đang cần, dòng vốn và người dùng sẽ di chuyển rất nhanh. Nhưng tốc độ di chuyển đó cũng là một tín hiệu rủi ro: càng nhiều người dùng đổ vào một vùng an toàn vừa được mở rộng, thì càng nhiều kẻ xấu có động cơ để tìm ra lỗ hổng ở vùng ranh giới. Tôi đã thấy đồ thị này vẽ ra trước khi ai kịp thở. Ở góc nhìn của tôi, đồ thị quan trọng không phải là 85% fallback giảm. Đó là đồ thị của các truy vấn nguy hiểm bị chặn đúng, nếu nó được vẽ ra. Nếu đường cong đó nằm ngang hoặc đi lên, tôi sẵn sàng tin rằng Anthropic đã tìm được một phép cân bằng tốt. Nếu đường cong đó bắt đầu dốc xuống, thì 85% kia chỉ là một lời hứa hẹn trước khi sự cố. Nhưng vì chúng ta không có đồ thị đó, tôi phải kết luận theo cách một kẻ săn tin vẫn làm: đừng tin vào con số, hãy tin vào thiết kế kiểm toán. Và khi thiết kế kiểm toán không được công bố, hãy chuẩn bị cho một thế giới nơi những câu hỏi tưởng chừng vô hại trở thành mảnh ghép của một cuộc tấn công đa tầng. Câu hỏi cuối cùng không dành cho Anthropic. Nó dành cho những ai đang xây dựng ứng dụng trên Fable 5, hoặc bất kỳ mô hình nào vừa được nới lỏng: bạn có đang kiểm tra chất lượng câu trả lời y tế của mô hình, hay bạn chỉ đang tận dụng sự tiện lợi mới? Một bộ phân loại an toàn nới lỏng không có nghĩa là mô hình trở nên đúng về mặt y khoa. Nó chỉ có nghĩa là mô hình được phép trả lời nhiều hơn. Trách nhiệm phân biệt giữa “được phép” và “đúng” vẫn thuộc về bạn. Và trong một thị trường mà mọi người đang chạy đua để tích hợp AI vào sức khỏe, thứ bạn cần không phải là một cái ngưỡng an toàn lỏng hơn; thứ bạn cần là một hệ thống đo lường lỗi y tế nghiêm túc hơn. Còn với tôi, một kẻ săn tin đã nhìn thấy quá nhiều cú sốc đến từ những chi tiết tưởng chừng nhỏ nhặt, tôi chỉ muốn ghi lại một dòng duy nhất: khi một cánh cửa an toàn được mở rộng, đừng hỏi nó được mở rộng bao nhiêu, hãy hỏi ai đang đứng phía bên kia hành lang. Bởi vì trong thế giới của những bộ phân loại, ngưỡng rủi ro không phải là một bức tường. Nó chỉ là một tấm rèm. Và tấm rèm thì luôn có thể bị kéo sang một bên bằng một câu hỏi được đặt đúng chỗ.

Sợ & Tham

74

Tham lam

Tâm lý thị trường

Chỉ số mùa altcoin

40

Mùa Bitcoin

Sự thống trị BTC Mùa altcoin

Vốn hóa thị trường

Tất cả →
# Tiền điện tử Giá
1
Bitcoin BTC
$78,784.6
1
Ethereum ETH
$2,470.9
1
Solana SOL
$98.05
1
BNB Chain BNB
$693.4
1
XRP Ledger XRP
$1.47
1
Dogecoin DOGE
$0.0897
1
Cardano ADA
$0.2164
1
Avalanche AVAX
$7.5
1
Polkadot DOT
$0.8858
1
Chainlink LINK
$11.52

🐋 Theo dõi cá voi

🔴
0xfcaf...9b21
5 phút trước
Chuyển ra
5,698,508 DOGE
🔴
0xa6d7...1624
6 giờ trước
Chuyển ra
4,362 ETH
🟢
0x840c...5cb8
6 giờ trước
Chuyển vào
10,928 SOL