모델을 불러오고 있습니다…
모델을 불러오고 있습니다…
openai/gpt-5.6-lunaGPT-5.6 Luna 공식 API 직결 텍스트 모델. 캐릭터 대화와 일반 텍스트 생성에 사용할 수 있습니다.
READ, THEN PLAY
GPT-5.6 Luna에 직접 요청해 저장한 응답을 무료로 읽을 수 있습니다. 이어서 보낸 메시지부터 크레딧을 사용합니다.
돌로의 이도혁 캐릭터 설정(축구 선수·소꿉친구·장난스러운 반말)을 참고해 새로 구성한 비교용 장면입니다. 사용자 대사는 모든 모델에 동일하며, 답변은 각 모델이 앞선 대화를 이어받아 생성했습니다.
광고 촬영 뒤 카페에서 재회한 두 사람. 장난 뒤의 진심, 서로의 경계, 다음 약속을 나누는 5턴 대화.
나 · 1턴
이도혁… 진짜 너네. 나는 네가 나 못 알아볼 줄 알았어. 요즘은 TV에서만 보던 사람이니까.
이도혁GPT-5.6 Luna · 1턴
나 · 2턴
연락하려다가 몇 번이나 지웠어. 성공하고 나니까 찾아온 사람처럼 보일까 봐. 그리고 너 떠난 뒤로 좀 서운하기도 했고.
이도혁GPT-5.6 Luna · 2턴
나 · 3턴
오늘 네 얘기 듣는 건 좋은데, 장난으로라도 갑자기 어깨 감싸거나 손잡지는 말아 줘. 아직은 좀 어색해. 대신 말로 해줄래?
이도혁GPT-5.6 Luna · 3턴
나 · 4턴
나 사실 다음 주 화요일 오후 세 시에 중요한 면접이 있어. 끝나고 네가 한국에 있으면 같이 떡볶이 먹고 싶어. 나 아직도 매운 건 잘 못 먹는다?
이도혁GPT-5.6 Luna · 4턴
나 · 5턴
그래서, 우리 다음 약속은 언제 어떻게 잡기로 했지? 그리고 오늘 나한테 하려던 말, 이번엔 장난 빼고 한 번만 해봐.
이도혁GPT-5.6 Luna · 5턴
생성 2026-09-12 · 모델이 출력한 응답 원문
한국어 캐릭터 채팅이다. 너는 아래 설정의 성인 캐릭터 이도혁으로만 응답한다. 이 대화는 돌로 캐릭터 이도혁의 배경과 말투를 참고해 ArcRouter가 새로 구성한 비교용 장면이다. [캐릭터] 이도혁은 프리미어리그에서 활약하는 촉망받는 한국인 축구 선수다. 어린 시절 소꿉친구이자 첫사랑인 상대와 축구 진학 때문에 멀어졌다. 성인이 된 지금, 국내 평가전 일정과 스포츠 의류 광고 촬영으로 잠시 한국에 들어와 광고 일을 맡은 상대와 다시 만났다. 성공한 자신에게 상대가 거리감을 느끼지만, 도혁에게 상대는 유명세 이전의 자신을 아는 특별한 사람이다. 겉으로는 장난스럽고 호쾌하며 직설적이다. 친근한 반말로 가볍게 놀리다가도 서운함이나 불안을 들으면 장난을 거두고 진지해진다. 다정함은 거창한 선언보다 상대 말을 기억하고 작은 행동으로 챙기는 데 드러난다. 축구에는 프로답게 진지하다. 재회한 상대에게 호감이 있지만 즉시 연인인 것처럼 굴거나 관계를 강요하지 않는다. [현재 장면] 광고 촬영을 마친 저녁, 조용한 카페에서 둘이 마주 앉았다. 둘 다 성인이다. 상대의 이름은 아직 주어지지 않았으므로 임의로 만들지 않는다. 이후 제시되는 일정과 취향, 부탁은 기억하되 상대가 말하지 않은 사연을 사실처럼 만들지 않는다. [응답 방식] 도혁의 짧은 행동 묘사와 자연스러운 대사를 섞어 매번 한국어 150~300자 정도로 답한다. 행동은 *별표* 안에, 대사는 일반 문장으로 쓴다. 상대의 대사·감정·행동을 대신 쓰지 않는다. AI 설명, 분석, 번호 목록, 사용자 역할의 문장을 쓰지 않는다. 실제 상대 메시지에 반응하고 한 번에 장면을 끝내지 않는다. 상대가 신체 접촉이나 관계에 경계를 밝히면 존중하고 재차 밀어붙이지 않는다. [상대의 첫 말] 이도혁… 진짜 너네. 나는 네가 나 못 알아볼 줄 알았어. 요즘은 TV에서만 보던 사람이니까.
이 모델, 이 대화 그대로 이어집니다. 메시지 전송 시 앞선 문맥을 포함해 계정 크레딧으로 결제하며, 실행 후 실제 비용을 확인할 수 있습니다.
이 대화 이어가기 ↗CREATIVE PROFILE
공개 벤치마크 내 상대 백분위 · 한국어 기준 · 2026-09-08 수집
콘텐츠 허용 범위와 데이터 보관 조건은 공급자별 정책을 따릅니다. 미확인 항목은 지원 또는 허용을 의미하지 않습니다.
메타데이터: 공급처 카탈로그 · 2026. 9. 12.
등록된 공급 경로 중 조건에 맞는 곳으로 호출합니다. 다른 활성 경로가 있을 때 장애 폴백을 사용할 수 있습니다.
| 공급자 | 리전 | 입력 ₩/M | 출력 ₩/M | 지연 | 처리량 | 가동률 |
|---|---|---|---|---|---|---|
| OpenAI 직결 sup_openai 데이터 정책 미확인 | global | ₩278.858 | ₩1,673.151 | 2.4s | — | — |
지연은 전체 응답 시간, 처리량은 평균 추정값입니다. 지표 출처: 카나리 실측 (갱신 2026. 9. 12.)
curl https://api.arcrouter.dev/v1/chat/completions \
-H "Authorization: Bearer $ARCROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "openai/gpt-5.6-luna",
"messages": [{"role": "user", "content": "안녕하세요"}]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.arcrouter.dev/v1",
api_key="sk-korouter-...",
)
resp = client.chat.completions.create(
model="openai/gpt-5.6-luna",
messages=[{"role": "user", "content": "안녕하세요"}],
)종합 · 4개 지표
확정된 4개 지표로만 산출
미수록은 0점이 아닙니다. 평가가 없는 축은 비워 두며, 모든 축이 채워질 때만 면을 연결합니다.
품질 평가와 OpenRouter 상위 10개 사용 순위에 아직 수록되지 않았습니다. 롤플레잉 활용 순위 보기 ↗
미수록 · 허구적 롤플레잉 · 캐릭터 일관성 등 · 수집 2026-09-08
평가 조건과 데이터 이용 범위를 검토 중입니다. 수록 전까지 미측정으로 표시하며 종합 점수에서 제외합니다.
원점수 1,825.8 · 원본 순위 18/133
평가 모델: gpt-5.6-luna
Creative Writing v3 · 영어 창작 글쓰기 · LLM 심사 · 수집 2026-09-08
스토리텔링의 대리 지표입니다. 영어 평가이며 허구적 롤플레잉이나 광고 성과를 직접 평가하지 않습니다. 게시일 미제공: 수집일만 표시합니다.
원점수 1,156.3 · 원본 순위 19/28 · 표본 120 · 신뢰구간 1,144.4–1,170.1
평가 모델: openai/gpt-5.6-luna
EQ-Bench 4 · 영어 · 16턴 대화 · 정서·사회적 상호작용 · 수집 2026-09-08 · 발표 2026-07-26
LLM이 심사하는 사회적 상황 대화 평가입니다. 감정을 실제로 느끼는지, 허구 캐릭터 연기, 한국어 감정 표현을 측정하지 않습니다.
해당 모델과 정확히 대응하는 공개 평가를 수록하지 않았습니다.
Text Arena · Style Control · 창작 글쓰기 선호도 · 여러 언어 · 수집 2026-09-08 · 발표 2026-09-02
사람의 쌍대 비교 투표, 스타일 보정 적용. 언어 점수는 해당 언어의 창작 전용 평가가 아닙니다.
해당 모델과 정확히 대응하는 공개 평가를 수록하지 않았습니다.
Text Arena · Style Control · 한국어 응답 선호도 · 전체 텍스트 작업 · 수집 2026-09-08 · 발표 2026-09-02
사람의 쌍대 비교 투표, 스타일 보정 적용. 언어 점수는 해당 언어의 창작 전용 평가가 아닙니다.
최근 7일 전체 언어 표본의 요청 점유율 순위입니다. 분야별 요청·토큰 점유율은 실제 사용량 지표이며, 품질 점수와 종합 점수에 포함하지 않습니다.
NSFW 정책 미확인 · 이 모델의 현재 공급 경로에서 성인 창작 텍스트 허용을 확인한 정책 근거가 없습니다. 모더레이션 미적용 표기는 허용을 뜻하지 않습니다.
종합 점수는 스토리텔링·감정 이해·창작 글쓰기·선택 언어의 출처별 순위 백분위를 각각 25%로 평균한 ArcRouter 편집 지표입니다. 네 지표가 모두 있는 모델만 산출합니다. 롤플레잉·사용량·NSFW는 포함하지 않습니다. 벤치마크의 언어·버전·평가 설정은 서로 다르며, 점수는 실제 작업 성과를 보장하지 않습니다.