Anthropic telah melancarkan Claude Fable 5.1 dan Claude Mythos 5.1 pada 1 September. Kedua-dua model kini menerima 1 juta token konteks, boleh menghasilkan sehingga 128k token, dan melaraskan kedalaman penaakulan mereka secara langsung—semuanya sambil mengurangkan kos setiap panggilan. Naik taraf ini menyasarkan pengekodan berbantuan AI yang lebih murah dan boleh dipercayai serta penyelidikan berisiko tinggi, bukan sekadar skor penanda aras yang lebih pantas.

Mengapa versi baharu ini penting

Generasi Claude sebelum ini mengehadkan tetingkap konteks kepada beberapa ribu token sahaja, memaksa pembangun membahagikan kod atau data secara manual. Pengguna juga perlu menetapkan kedalaman penaakulan secara manual, menjadikan prom ringkas sebagai satu proses cubaan dan ralat. Caj bacaan cache menjadikan sesi yang panjang dan panggilan alat yang berulang menjadi mahal, manakala pasukan keselamatan pula mengadu tentang lambakan amaran positif palsu yang melambatkan semakan kod.

Claude Fable 5.1 dan Claude Mythos 5.1 menangani masalah tersebut secara langsung. Kedua-duanya berkongsi teras pemprosesan yang sama, tetapi Anthropic menerapkan kawalan keselamatan (guardrails) yang berbeza bagi setiap model untuk audiens sasarannya.

Apa yang sebenarnya dilakukan oleh perubahan ini

  • Kos lebih rendah – Anthropic mengurangkan harga bacaan cache, jadi sesi pengekodan iteratif yang panjang dan panggilan alat yang berulang kini menelan kos yang jauh lebih rendah—satu faktor penentu bagi syarikat pemula (startups) dan pasukan pembangunan dalaman.
  • Pemikiran adaptif – Model ini memutuskan secara langsung berapa banyak penaakulan yang diperlukan untuk sesuatu tugasan. Pengguna tidak lagi perlu menukar "tahap usaha" atau meneka berapa banyak prom rantaian pemikiran (chain-of-thought) yang diperlukan.
  • Mesej berasaskan giliran (Turn-scoped messages) – Arahan peringkat sistem hanya terpakai kepada satu pertukaran sahaja, menghalang arahan lama daripada mencemari giliran seterusnya.
  • Penambahbaikan keselamatan – Pengguna Claude Code melaporkan kira-kira 60% kurang positif palsu keselamatan siber, sekali gus mengurangkan masa yang dihabiskan untuk mengejar amaran palsu.
  • Pengesanan kerentanan – Fable 5.1 dapat mengesan kecacatan perisian tetapi dilarang daripada menjana kod eksploitasi, memastikan juruaudit kekal produktif tanpa membuka ruang kepada pelaku berniat jahat.
  • Fokus penyelidikan berisiko tinggi – Mythos 5.1 berkhidmat untuk program dipercayai dalam bidang keselamatan siber dan sains hayat. Anthropic menguji tahap ketahanannya pada tugasan seperti reka bentuk sifir, kemudian menyalurkan maklumat tersebut kembali ke dalam model Fable yang bersifat umum.

Siapa yang mendapat manfaat dan siapa yang mungkin ketinggalan

Pembangun yang membina pembantu IDE, saluran paip CI, atau bot tersuai akan menjimatkan wang dan melihat kurang gangguan keselamatan. Penganalisis keselamatan dan penyelidik bioteknologi yang memenuhi kriteria kepercayaan Anthropic boleh memanfaatkan kawalan keselamatan Mythos 5.1 yang lebih ketat untuk beban kerja sensitif. Imbalannya: Mythos kekal tertutup kepada orang awam, jadi pasukan yang lebih kecil tanpa hubungan program dipercayai mesti bergantung kepada Fable 5.1 yang lebih permisif.

Potensi kelemahan atau persoalan terbuka

Menyekat penjanaan eksploitasi mungkin mengecewakan pengguna pasukan merah (red-team) yang memerlukan kod serangan realistik untuk menguji pertahanan. Halangan "program dipercayai" boleh mewujudkan pasaran AI bertingkat, di mana hanya organisasi yang mempunyai dana besar sahaja yang mendapat model paling selamat dan berkapasiti tinggi. Walaupun harga bacaan cache telah turun, Anthropic belum mendedahkan model kos sepenuhnya, menyebabkan pembangun tidak pasti tentang penjimatan bersih untuk beban kerja yang besar.

Apa yang perlu diperhatikan seterusnya

Kadar penggunaan akan menunjukkan sama ada janji kos dan keselamatan diterjemahkan kepada peningkatan produktiviti dunia nyata. Jika pembangun lebih menyukai tetingkap 1 juta token untuk pangkalan kod yang besar, Anthropic mungkin akan berasa tertekan untuk membuka kawalan keselamatan tahap Mythos kepada audiens yang lebih luas. Perhatikan kekerapan pengurangan positif palsu dan impaknya terhadap saluran paip imbasan kerentanan untuk menilai sejauh mana postur keselamatan baharu ini bertahan di bawah penggunaan yang kerap diserang.

Rumusan: Claude Fable 5.1 dan Claude Mythos 5.1 kurang bertujuan untuk memecahkan penanda aras dan lebih kepada mengurangkan kos bagi aliran kerja AI yang berdurasi panjang sambil memperketat jaring keselamatan untuk aplikasi yang paling sensitif.