AI AI
속보
심층
이벤트
Pro
더보기
자금 조달 정보
특집
온체인 생태계
용어
팟캐스트
데이터
OPRR
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
BTC
$96,000
5.73%
ETH
$3,521.91
3.97%
HTX
$0.{5}2273
5.23%
SOL
$198.17
3.05%
BNB
$710
3.05%
XRP
$2.25
2.07%
DOGE
$0.325
2.23%
USDC
$0.999
3.05%

「claude-opus-4-6-thinking이 2026년 6월 13일에 최고의 AI 모델이 될까요?」에 대한 '아니오' 확률이 27.2%에서 52.2%로 상승했습니다.

PolyBeats 모니터링에 따르면, 예측 시장 Polymarket에서 지난 15분 동안 "claude-opus-4-6-thinking이 2026년 6월 13일까지 최고의 AI 모델이 될까?"라는 질문의 '아니오' 확률이 27.2%에서 52.2%로 상승했으며, 매수 측 총 거래량은 $711입니다.

Anthropic은 6월 9일 Claude Fable 5를 출시했으며, 오늘 LM Arena 순위에 등재되었습니다. 해당 모델의 점수는 claude-opus-4-6-thinking보다 낮았습니다. Wired와 월스트리트저널은 6월 11일 보도에서, Anthropic이 원래 Claude를 사용해 경쟁 모델을 훈련시키는 계정에 대해 '무음 성능 저하'를 계획했다고 전했습니다. 즉, 사용자에게 알리지 않고 Fable 5의 성능을 직접 낮추거나, 프롬프트 수정, 모델 라우팅 등을 통해 출력을 약화시키는 방식입니다.

개발자와 AI 연구 커뮤니티는 이를 제3자 평가와 오픈소스 연구를 은밀히 방해하는 행위라고 비판했으며, 특히 외부 보안 평가 기관이 자신이 어떤 성능 수준의 모델을 테스트하고 있는지 확인할 수 없게 만든다고 지적했습니다.

이후 Anthropic은 공개 사과와 함께 전략을 조정하여, 이러한 시나리오에 대한 비밀 성능 저하를 취소하고 더 투명한 프롬프트 또는 거부 메커니즘으로 대체했습니다. 시스템이 사용자가 고성능 AI를 구축하거나 경쟁 모델을 훈련시키는 것을 감지하면 요청을 명확히 거부하거나 사용자를 저성능 모델로 리디렉션합니다. 이러한 변화는 Fable 5의 공개 평가 신뢰도를 높여, 커뮤니티가 해당 모델이 실제 성능에 가깝게 순위 경쟁에 참여할 것이라고 믿게 만들 가능성이 있으며, 이는 현재 시장에서 기본적으로 선두로 인정받고 있는 claude-opus-4-6-thinking에 직접적인 영향을 미칠 수 있습니다.
---------------------------------
더 빠르게 미래를 확인하려면 @PolyBeats_Bot을 팔로우하세요.
See tomorrow, today. Follow @PolyBeatsEN

举报 오류 신고/제보
오류 신고/제보
제출
새 문고 추가
자신만 보기
공개
저장
문고 선택
새 문고 추가
취소
완료