Qwen3.6 35B A3B

obsidian/Qwen3.6-35B-A3B
비전도구JSON추론
제공 obsidian · 2026-07-02

Qwen3.6 35B A3B는 Alibaba의 Qwen3.6(총 350억 개 파라미터, 토큰당 약 30억 개 활성 파라미터)을 기반으로 구축된 혼합 전문가(Mixture-of-Experts) 모델로, 262K 토큰 컨텍스트 윈도우와 텍스트, 이미지, 비디오 입력을 지원합니다. 원본 모델의 추론, 코딩, 다국어 성능 및 도구 사용 능력을 그대로 유지합니다. 다양한 프롬프트에 대해 직접적이고 완전한 응답을 제공하도록 설계되었습니다. 이 모델은 때때로 기본 모델 학습에서 비롯된 간단한 정보성 면책 조항을 추가할 수 있습니다. AI 연구, 보안 테스트, 레드 팀(red teaming), 에이전트 개발, 코딩 어시스턴트 및 최대 출력 유연성이 필요한 기타 고급 AI 애플리케이션에 적합합니다.

추천 용도:reasoningvision
엔드포인트:/v1/chat/completions
컨텍스트262K 토큰
입력text + image + video
출력text
추천 용도reasoning, vision
p50 TTFT2.09 s
입력$0.31/ 100만 토큰
출력$4.21/ 100만 토큰
p50 TTFT2.09 s7일
p95 TTFT10.00 s7일
트래픽829.2M토큰 / 7일

코드 샘플

어떤 SDK에서도 호출

OpenAI 호환 — 쓰던 SDK 그대로

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="obsidian/Qwen3.6-35B-A3B",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

지원되는 매개변수

  • include_reasoning
  • reasoning
  • max_tokens
  • temperature
  • top_p
  • top_k
  • min_p
  • presence_penalty
  • frequency_penalty
  • stop
  • seed
  • response_format
  • structured_outputs
  • tools
  • tool_choice

가격

가격
입력 / 1M tokens$0.310
출력 / 1M tokens$4.21
통화USD

비용 계산기

월 토큰 수10MM
입력 비율70%%
월 예상 $14.80

정가 기준 추정치

토큰 및 비용 추정기

입력 토큰: 9요청당 비용: $0.002108

추정치일 뿐입니다 — 실제 토큰 수는 제공자의 토크나이저에 따라 달라집니다.

성능

p50 TTFT
2.09 s
출력 속도
122 tok/s
p95 TTFT
10.00 s
오류율
2.3%

공개 벤치마크

41.9
AA Coding
비교된 모델 중 41%보다 우수
138개 중 80위
26.2
AA Intelligence
비교된 모델 중 35%보다 우수
140개 중 89위
GPQA Diamond
84.1
Humanity's Last Exam
22.2
IFBench
64.4
Long-Context Recall
71.7
SciCode
35.8
tau_banking
9.3
TerminalBench Hard
34.8
terminalbench_v2_1
44.9
τ²-Bench
95.3
소스: artificialanalysis.ai

커뮤니티 화제

이번 주 개발자들의 이야기

Hacker News0 회 언급 · 7일

비교

Qwen3.6 35B A3BQwen3.8 27BGemma 4 26B A4B
입력 $/100만$0.31$0.40$0.25
출력 $/100만$4.21$4.21$2.90
컨텍스트262K262K262K
품질4/104/104/10
나란히 비교나란히 비교나란히 비교

FAQ

OrcaRouter에서 Qwen3.6 35B A3B 비용은 얼마인가요?
Qwen3.6 35B A3B는 OrcaRouter를 통해 1M 입력 토큰당 $0.31, 1M 출력 토큰당 $4.21에 가격이 책정되어 있습니다. 가격은 라우팅 레이어에서 실시간으로 가져옵니다.
Qwen3.6 35B A3B의 컨텍스트 윈도우는 얼마인가요?
Qwen3.6 35B A3B는 262K 토큰의 컨텍스트 윈도우를 지원합니다. 해당 제한까지 롱 컨텍스트 기능(RAG, 요약)을 사용하세요.
OpenAI SDK를 통해 Qwen3.6 35B A3B를 호출하려면 어떻게 하나요?
OpenAI base_url을 https://api.orcarouter.ai/v1로 설정하고, OrcaRouter API 키를 제공한 후, chat.completions.create 호출에서 model="obsidian/Qwen3.6-35B-A3B"를 전달하세요.
OrcaRouter가 Qwen3.6 35B A3B를 속도 제한합니까?
모델별 속도 제한은 OrcaRouter 플랜을 따릅니다. 무료 티어는 보수적인 한도로 제공되며, 유료 티어는 한도를 높입니다. 현재 할당량은 /pricing에서 확인하세요.

이 배지 임베드

Qwen3.6 35B A3B$0.31/M in2087ms p50OrcaRouter를 통해
HTML <a href="https://www.orcarouter.ai/models/obsidian/Qwen3.6-35B-A3B" target="_blank"> <img src="https://www.orcarouter.ai/embed/obsidian/Qwen3.6-35B-A3B.svg" alt="OrcaRouter 의 Qwen3.6 35B A3B" /> </a>
Markdown [![Qwen3.6 35B A3B](https://www.orcarouter.ai/embed/obsidian/Qwen3.6-35B-A3B.svg)](https://www.orcarouter.ai/models/obsidian/Qwen3.6-35B-A3B)

모델 카드를 데이터로

GET /api/public/models/obsidian/Qwen3.6-35B-A3B열기
기계 판독 가능:/llms.txt/llms-full.txt