가입 후 초대 링크를 공유하면 동영상 재생 및 초대 보상을 받을 수 있습니다.

Xiangyu Qi
@xiangyuqi_pton
Cyber Models @openai | PhD @Princeton | Prev @GoogleAI @GoogleDeepMind
가입 December 2019
1.1K 팔로잉 중    4K 팬
Astra achieves a full 100% success rate on ExploitBench, so we had to build an internal refresh using newly disclosed vulnerabilities from June through August that fall after the model’s knowledge cutoff. On this refreshed benchmark, Astra remains dramatically stronger than GPT-5.6 Sol while using far fewer tokens. This result, together with several other pieces of evidence, has led us to believe that Astra has reached the “cyber-critical” capability threshold under our Preparedness Framework.
더 보기
0
62
1.9K
140
커뮤니티로 전달