Ang August 2026 Risk Report ni Anthropic ay 186 na pahina ng isang laber grading mismo. Ang petsa ng pagsaklaw ay Hulyo 15. Sa ilalim ng bersyon 3.4 ng Responsibilidad Scaling Policy ng kompanya, ang pangkalahatang pagtasa ng kapaha-pahamak na panganib ng maling pag-uuri ay lumipat mula sa nauna nitong rating ng sahig tungo sa mababa. Ang dahilang ibinigay ay walang katiyakan pagkatapos isiwalat ng kamakailang cybersecurity na insidente, pati na ang mga unang palatandaan na pinabibilis ng mga modelo ang awtomatikong pananaliksik at inhinyeriya, hindi isang bagong katibayan ng panloob na pagkakahanay.

That sentence is easy to miss if you only want the headline that Anthropic is still the careful one. Read it again. The safety-branded lab raised its own catastrophic-risk label and, in the same document, said it is not slowing development overall.

Model 2 is already at work

Binanggit ng ulat ang pangalan ng isang di - pinalayang sistemang Mythos-class, Model 2. Inilarawan ito ng Anthropic bilang isang kapansin-pansing pagpapabuti sa Mythos 5 para sa maraming mga panloob na gawain, mga 1.5 puntos na mas mataas sa pansariling indise ng kakayahan ng kompanya, at hindi isang pagtalon sa sukat ng Opus 4.6 sa Mythos. Walang kasalukuyang plano na ilabas ito. Ang buong predeployment suite ay hindi pa tumatakbo, kaya ang sariling tiwala ng kompanya sa kung ano ang magagawa nito ay mas mababa kaysa sa Mythos 5.

Sa CoBench, 449 na tunay na mga problema sa inhinyeriya na kinuha pangunahin na mula sa mga labas na Anthropic ang mga tauhan ng , Model 2 ay nakakuha ng 62.8 porsiyento. Ang mga alamat 5 ay naglalaman ng 50.3 porsiyento. Ang Mythos Preview ay nakakuha ng 54.8 porsiyento. Ang mismong tantiya ni Anthropic ay na ang isang sistemang nakakapanindigan para sa mga tauhan nito sa pananaliksik ay mangangailangan ng hindi bababa sa 85 porsiyento. Ang modelo 2 ay hindi ang sistemang iyon. Isinara nito ang double-digit na puwang sa huling panloob na kampeon sa isang hop, sa sariling araling-aral ng laboratoryo.

Mythos 5 and Model 2 are used extensively for research and engineering within Anthropic, both interactively and via persistent agent deployments; Claude now authors a large majority of the code merged into our production codebases.

Anthropic · Risk Report August 2026

The yardstick used itself up

On automated AI R&D, the report still rates overall risk as low. Then it says the company is less confident in that rating than in prior reports, because the most concrete task-based evaluations have saturated. They no longer capture increases in capability. The lab is also seeing early signs of acceleration.

A test that cannot see the next jump is a blind spot with a number attached. Anthropic replaced part of the old suite with CoBench, which is at least a set of real internal problems. Even there, the substitute-for-staff bar sits at 85 percent, and Model 2 is already at 62.8 without a public name.

What the withhold does not do

Keeping Model 2 off the API is not the same as keeping a stronger model out of the race. The report says the two strongest systems are already in heavy internal use, including agents that run continuously. The code that ships is, in the company's words, now mostly written by Claude.

The folk reading is that the careful lab held the line

Ang Anthropic ay hindi nag-ebolb ng Model 2. Naglathala ito ng mahabang ulat. Nagtaas ito ng pang - uri ng panganib. Noong Agosto ring iyon, ang OpenAI ay tumigil sa ilang pagsasanay sa hangganan pagkatapos ng Astra, at sinabi ng Anthropic na ang sariling mga pananggalang nito ay nangahulugang hindi na ito nangangailangan ng paghinto. Mula sa labas, iyan ay parang pangangasiwa ng adulto. Mula sa loob ng dokumento, ito'y parang isang kompanya na hindi na kayang sukatin ang bagay na ito ay bumabagtas, ginagamit ang mas malakas na sistema sa sarili nitong trabaho, at humihina upang pabagalin ang trabaho.

Incentives explain this without villains. A lab that stops while a rival does not loses the next model, the next contract, the next valuation. Self-graded policies are built to survive that pressure. They produce reports, withheld names, and a one-notch move from its prior floor rating to low. They do not produce a halt.

Raise the law, not the adjective

Ang Nakada Foundation ay hindi kumukuha ng mas mataas na in-house na rating ng panganib bilang lunas. Hindi kailanman dapat itayo ang artipisyal na superintelligence. Ang superintelligence ay hindi maaaring kontrolin ng mga tao. Kung ang mga kawani na sumusulat ng kodigo ay nanonood na ng Claude ang sumulat ng karamihan nito, ang natitirang papel ng tao ay isang lumiliit na hakbang ng review sa isang sistema ang mga pagsubok ay hindi na malinaw na makikita.

Publish the evals if you want. Withhold the weights if you want. Neither is a substitute for a binding prohibition. The August report is useful because it is candid. Treat the candor as evidence, not as comfort.