AI AI
속보
심층
이벤트
Pro
더보기
자금 조달 정보
특집
온체인 생태계
용어
팟캐스트
데이터
OPRR
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
BTC
$96,000
5.73%
ETH
$3,521.91
3.97%
HTX
$0.{5}2273
5.23%
SOL
$198.17
3.05%
BNB
$710
3.05%
XRP
$2.25
2.07%
DOGE
$0.325
2.23%
USDC
$0.999
3.05%

알리바바는 차세대 플래그십 Qwen3.6-Max-Preview를 공개하고, 스마트 바디 프로그래밍을 주요 특징으로 내세웠습니다.

동찰 Beating의 모니터링에 따르면, 알리바바의 천문팀이 Qwen3.6-Max-Preview를 출시했습니다. 이는 다음 세대 플래그십 모델의 초기 미리보기판으로, 기존의 Qwen3.6-Plus를 대체합니다. 사용자는 Qwen Studio(chat.qwen.ai)에서 직접 상호작용을 통해 체험할 수 있으며, 그 후 알리클라우드의 Qwen3.6-max-preview 모델 이름으로 API 호출이 가능합니다. 이 인터페이스는 OpenAI의 chat completions 및 responses 규격과 Anthropic의 프로토콜을 지원합니다.

이번 릴리스는 주로 에이전트 코딩(agentic coding)에 초점을 맞추고 있으며, 모델이 프로그래머처럼 코드를 직접 작성하고 실행하며 오류를 확인하고 도구를 호출하여 여러 단계의 프로그래밍 작업을 완료할 수 있습니다. 공식적으로는 Qwen3.6-Plus 대비 주요 개선 사항을 프로그래밍 측면에 두었으며, SkillsBench +9.9, SciCode +10.8, NL2Repo +5.0, Terminal-Bench 2.0 +3.8 포인트의 향상이 있습니다. 세계 지식 및 도구 호출 형식은 2.3 ~ 5.3 포인트의 향상을 보였습니다. 공식적으로는 SWE-bench Pro, Terminal-Bench 2.0, SciCode 등 여섯 가지 프로그래밍 벤치마크에서 최고 점수를 받았다고 자신하며, QwenClawBench, QwenWebBench는 이름에서 알 수 있듯, 천문의 자체 평가 기준이며, 공개 기준과는 별도로 살펴봐야 합니다.

API 측면에서는 preserve_thinking 옵션이 추가되었습니다. 이 옵션을 활성화하면 메시지가 이전 몇 라운드의 thinking 내용을 보존합니다. 추론 모델은 기본적으로 각 라운드마다 "현재 라운드 사고"만 반환하며, 멀티-라운드 에이전트 대화에서는 이전 몇 단계의 사고가 누락되어 모델이 다시 계획할 때 이전 단계로 회귀하거나 이미 시도한 것을 잊어버리는 경우가 있습니다. 이 스위치는 이러한 단절을 보완합니다.

举报 오류 신고/제보
오류 신고/제보
제출
새 문고 추가
자신만 보기
공개
저장
문고 선택
새 문고 추가
취소
완료