AI AI
속보
심층
이벤트
Pro
더보기
자금 조달 정보
특집
온체인 생태계
용어
팟캐스트
데이터
OPRR
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
BTC
$96,000
5.73%
ETH
$3,521.91
3.97%
HTX
$0.{5}2273
5.23%
SOL
$198.17
3.05%
BNB
$710
3.05%
XRP
$2.25
2.07%
DOGE
$0.325
2.23%
USDC
$0.999
3.05%

AI가 '스스로를 개선하는' 것까지 얼마나 남았을까? Scale이 RSI Bench를 출시하다

동찰 Beating AI 속보, Scale AI가 RSI Bench를 출시하여 AI가 연구원처럼 스스로 AI 연구 개발을 할 수 있는지专门 테스트합니다.

AI는 논문, 코드, 컴퓨팅 파워를 직접 받아 실험을 설계하고, 학습을 실행하며, 방법을 수정한 뒤 기존 AI를 더 개선할 수 있는지 확인합니다.

첫 번째 테스트에는 Claude Opus 5와 GPT-5.6 Sol이 사용되었습니다. 두 모델은 이미 자체적으로 실험을 실행하고, 파라미터를 조정하며, 반복적으로方案을 개선할 수 있으며, 일부 작업에서는 주어진 기준선을 실제로 초과했습니다.

하지만 현재 AI는 아직 '발명'에는 능숙하지 않습니다. 최신 연구에 도전하게 하면 대부분의 시도는 여전히 논문의 기존 방법과 파라미터 조정에 머물러 있으며, 진정한 새로운 아이디어를 제시하는 경우는 드뭅니다.

举报 오류 신고/제보
오류 신고/제보
제출
새 문고 추가
자신만 보기
공개
저장
문고 선택
새 문고 추가
취소
완료