Altcoin Decrypt · 29/09/2026 03:06 Claude Sonnet 5.5 của Anthropic đã ra mắt, đánh bại Opus 5.5 ở mức mã hóa với giá chỉ bằng một nửa ◉ 2 lượt xem 👍 Thích 0 👎 Không thích 0 Mô hình tầm trung của Anthropic đứng đầu bảng xếp hạng của chính nó trên Terminal-Bench 4.0 và có giá chỉ bằng một nửa cho mỗi mã thông báo, nhưng một người thử nghiệm độc lập nhận thấy nó đốt nhiều mã thông báo hơn bất kỳ mô hình nào mà nó đã đo được. Anthropic đã phát hành Claude Sonnet 5.5 vào thứ Hai, bản nâng cấp lên Sonnet 5 từ tháng Sáu. Anthropic cho biết mẫu máy tầm trung này chạy nhanh hơn 30% so với phiên bản tiền nhiệm. Anthropic viết: "Sonnet 5.5 mạnh nhất trong các tác vụ hàng ngày có phạm vi rộng, sửa lỗi và tạo các tài liệu, trang trình bày và bảng tính bóng bẩy. Nó cũng có con mắt tinh tường về thiết kế". Vô số: Nvidia sẽ xuống thấp đến mức nào? Bấm vào để đưa ra dự đoán của bạn. Giá vẫn ở mức 2 triệu mã thông báo đầu vào và mã thông báo đầu ra trị giá 10 USD trên một triệu. Mã thông báo là những đoạn văn bản mà AI đọc và viết, ngắn hơn một từ một chút và các công ty lập hóa đơn hàng triệu đô la. Đó là một nửa số tiền mà Opus 5.5 tính phí. Tuy nhiên, nó sử dụng ít mã thông báo hơn gần một phần ba cho mỗi tác vụ, điều đó có nghĩa là nó sẽ rẻ hơn khi chạy so với Sonnet 5. Điều đó nói lên rằng, mô hình này tỏa sáng trong lĩnh vực mã hóa. Trên Terminal-Bench 4.0—một bài kiểm tra xem liệu tác nhân AI có thể hoàn thành các nhiệm vụ chuyên môn phức tạp bằng cách đánh máy hay không ng ra lệnh riêng, được tính điểm khi tỷ lệ nhiệm vụ được hoàn thành—Sonnet 5.5 đạt 70,6%. Opus 5.5 đạt 66,4% và Sonnet 5 đạt 10,3%. Nói một cách dễ hiểu, mô hình rẻ hơn đã hoàn thành được nhiều công việc hơn. Phân tích nhân tạo, một công ty thử nghiệm độc lập, đã chạy phiên bản của riêng mình và đồng ý: 63,6% cho Sonnet 5.5, 59,6% cho Opus 5.5 và 59,1% cho GPT-6 Astra của OpenAI. Claude Sonnet 5.5 (tối đa) có bước tiến lớn trên Terminal-Bench, nằm trong top những mẫu bot hàng đầu h Terminal-Bench 4.0 và Terminal-Bench-Science. Trong Terminal-Bench 4.0, nó đạt 64%, tăng 50 điểm so với Claude Sonnet 5 (tối đa) và trên 60% một chút đối với Opus 5.5 và GPT-6… /7CPrhgmfxe - Phân tích nhân tạo (@ArtificialAnlys) Ngày 28 tháng 9 năm 2026 Điểm cũng phụ thuộc vào cài đặt nỗ lực, mặt số khiến người mẫu suy nghĩ lâu hơn để có câu trả lời tốt hơn và hóa đơn lớn hơn. Anthropic cho biết Sonnet 5.5 ở mức Nỗ lực cao phù hợp với GPT-6 Sol trên FrontierCode với giá khoảng 1/5 chi phí cho mỗi nhiệm vụ. Trên GDPval-AA, hệ thống chấm điểm công việc chuyên môn trong thế giới thực của 44 ngành nghề bằng cách sử dụng Elo—hệ thống kiểu cờ vua xếp hạng kỹ năng tương đối—Sonnet 5.5 đạt điểm từ 1844 đến 1846 của Opus 5.5, thực sự là hòa. GPT-6 Sol đạt 1487 điểm. Các đối thủ ngang tầm về giá. OpenAI đã giảm GPT-6 Sol xuống còn 2 USD và 10 USD vào tuần trước, còn GPT-5.6 Terra, mẫu máy tầm trung của nó, được niêm yết ở mức 2 USD và 12 USD. Anthropic không công bố điểm chuẩn của Terra. các Catch Sonnet 5.5 là một kẻ nói nhiều. Với nỗ lực tối đa, nó đã viết được khoảng 193.000 mã thông báo cho mỗi nhiệm vụ thử nghiệm, Phân tích nhân tạo nhất đã đo lường được và nhiều hơn khoảng 60% so với Opus 5.5. Con số đó lên tới 7,60 USD cho mỗi nhiệm vụ, cao hơn khoảng 50% so với Sonnet 5, thấp hơn so với yêu cầu tiết kiệm tới 30% của Anthropic. Khoản tiết kiệm của Anthropic đến từ các cài đặt thấp hơn: ở mức nỗ lực Trung bình, mặc định trong các ứng dụng của nó, nó cho biết Sonnet 5.5 đánh bại điểm mã hóa tốt nhất của Sonnet 5 với chi phí thấp hơn một chiếc lều h về chi phí. Phân tích nhân tạo cho rằng nỗ lực cao là giá trị tốt nhất. Đối với người dùng hàng ngày, điều đó có nghĩa là mã hóa gần như hàng đầu với mức giá chỉ bằng một phần nhỏ, miễn là mặt số ở mức thấp. Bảng của Anthropic là bảng tự báo cáo và Phân tích nhân tạo đã thử nghiệm bản dựng trước khi phát hành với một lỗi mà Anthropic cho rằng sẽ thay đổi ít hoặc đánh giá thấp điểm số của nó một chút. Anthropic cho biết Opus 5.5 rõ ràng vẫn mạnh mẽ hơn ở những công việc phức tạp cần khả năng phán đoán bền vững. Cla ude Haiku 5.5, được xây dựng cho các ứng dụng có khối lượng lớn, nhạy cảm về chi phí, sẽ ra mắt trong vài tuần tới Nguồn Decrypt Bài viết được biên tập từ dữ liệu nguồn. Nội dung chỉ nhằm mục đích thông tin và không phải lời khuyên đầu tư. Có thể bạn quan tâm Altcoin Ran Neuner cho biết các ứng dụng giao dịch xã hội sẽ thay thế các sàn giao dịch như Binance ◉ 0 29/09/2026 03:57 Altcoin Coinbase giới thiệu các gói thẻ Pokémon được hỗ trợ bởi các bộ sưu tập vật lý ◉ 0 29/09/2026 03:48 Altcoin ‘Vua tiền điện tử’ người Canada chuẩn bị đại diện cho mình tại phiên tòa xét xử gian lận ◉ 0 29/09/2026 03:41 Altcoin ĐÊM của Cardano sẽ lớn hơn Zcash: Charles Hoskinson ◉ 0 29/09/2026 03:34 Altcoin Sau khi đặc vụ AI tấn công chính phủ của mình, Úc kêu gọi Altman và Amodei làm chứng ◉ 1 29/09/2026 02:36 Altcoin Michael Dell cảnh báo các đại lý AI cần có giới hạn cứng ◉ 1 29/09/2026 02:11