KO ▾
API 키 받기

Abliterated: 무검열 LLM API 통합

abliterated API를 몇 분 안에 시작하세요. 이 가이드는 기본 URL, 인증, 채팅 완료, 스트리밍 및 구조화된 출력의 핵심 엔드포인트를 다룹니다.

기본 URL 및 인증

당사의 API는 표준 OpenAI 채팅 완료 인터페이스를 따릅니다. 즉, 기본 URL과 API 키를 단순히 업데이트하여 기존 클라이언트, SDK 및 코드 스니펫을 재사용할 수 있습니다. 사용자 정의 헤더나 복잡한 인증 흐름이 필요하지 않습니다.

기본 URL로 https://api.abliterated.cc/v1를 사용하세요. API 키 페이지에서 단일 API 키를 생성할 수 있습니다. Google 로그인 또는 이메일과 비밀번호를 사용하여 계정을 생성하세요. 키는 생성 직후 표시됩니다. 이 키는 선불 크레딧에 직접 접근할 수 있으므로 안전하게 보관하세요. 가입 시 전화번호가 필요하지 않습니다.

이 서비스는 코딩 작업과 일반 추론에 최적화된 단일 무검열 대규모 언어 모델을 제공합니다. 모델 버전을 선택할 필요가 없습니다. 엔드포인트는 자동으로 abliterated 모델로 라우팅합니다.

채팅 완료 엔드포인트

주요 상호작용 지점은 POST /v1/chat/completions 엔드포인트입니다. 대화 기록을 메시지의 JSON 배열로 전송하세요. 모델이 입력을 처리하여 텍스트 완성을 반환합니다. 이는 순수한 텍스트 입력 및 출력 인터페이스입니다.

요청 본문이 8 MB 제한 내에 있도록 하세요. 컨텍스트 창은 결합된 프롬프트와 완성에 최대 100,000 토큰을 지원합니다. max_tokens 값을 지정하지 않으면 모델은 2,048 토큰을 생성하는 것으로 기본값이 설정됩니다.

curl https://api.abliterated.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

토큰 비용에 대한 자세한 내용은 가격 페이지를 참조하세요. 오류와 거절은 선불 크레딧을 소모하지 않습니다.

스트리밍 응답

낮은 지연 시간과 실시간 사용자 경험을 위해 stream 매개변수를 true로 설정하여 스트리밍을 활성화하세요. API는 서버 전송 이벤트(SSE) 스트림을 반환합니다. 각 청크에는 부분 텍스트 업데이트가 포함됩니다.

스트림의 마지막 청크에는 요청에 대한 전체 토큰 사용량 통계가 포함됩니다. 이를 통해 실시간으로 비용을 정확하게 추적할 수 있습니다. 스트리밍은 채팅 인터페이스나 긴 무검열 AI 모델 출력 처리에 이상적입니다.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

스트림 오류를 우아하게 처리하세요. 네트워크 중단이 발생할 수 있으므로 애플리케이션에서 전체 완료가 필요한 경우 재시도 로직을 구현하세요.

함수 호출 및 도구

abliterated 모델은 구조화된 도구 사용을 지원합니다. tools 매개변수에서 도구를 정의하고 tool_choice 전략을 지정하세요. 모델은 도구 스키마를 따르는 JSON 객체를 반환할 수 있습니다.

이 기능은 외부 API와 상호작용해야 하는 에이전트 또는 애플리케이션을 구축하는 데 필수적입니다. 무검열 코딩 LLM은 복잡한 JSON 구조를 신뢰할 수 있게 처리합니다. temperature 및 top_p과 같은 매개변수를 사용하여 창의성과 결정론 사이의 균형을 조절할 수 있습니다.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.abliterated.cc/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

도구 정의가 유효한 JSON인지 확인하세요. 유효하지 않은 스키마는 응답에서 구문 분석 오류를 유발할 수 있습니다.

JSON 모드

엄격한 구조적 출력을 위해 response_format을 {"type": "json_object"}로 설정하세요. 모델은 출력을 유효한 JSON으로 강제합니다. 이는 결과를 프로그래밍 방식으로 구문 분석해야 하는 API 통합에 유용합니다.

JSON 모드는 함수 호출 및 스트리밍과 함께 작동합니다. 이는 하류 파서가 잘못된 텍스트로 인해 중단되지 않도록 보장합니다. 이는 신뢰할 수 있는 데이터 추출이 필요한 무검열 LLM 온라인 애플리케이션에 특히 가치 있습니다.

from openai import OpenAI

client = OpenAI(base_url="https://api.abliterated.cc/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

JSON 모드를 강제하면 모델의 추론에서 지연 시간이 약간 증가하거나 창의성이 약간 감소할 수 있음을 유의하세요. 엄격한 형식이 필요한 경우에만 사용하세요.

매개변수 및 제한

지원되는 매개변수에는 temperature, top_p, stop, seed, presence_penalty 및 frequency_penalty이 포함됩니다. 모델의 출력 스타일을 미세 조정하려면 이를 조정하세요.

속도 제한은 분당 300개 요청 및 API 키당 8개의 동시 요청으로 설정됩니다. 요청 본문은 8 MB를 초과할 수 없습니다. 이러한 제한을 초과하면 API는 429 오류를 반환합니다. 401 오류는 유효하지 않거나 누락된 API 키를 나타냅니다. 선불 크레딧은 성공적인 토큰 사용에만 청구되며 오류와 거절은 무료입니다.

경계 콘텐츠 제한은 미성년자가 포함된 성적인 콘텐츠를 차단합니다. 이 규칙을 위반하는 요청은 청구 없이 거절됩니다. 크레딧은 만료되지 않으며 USDT(TRC20) 또는 USDC(Base)로 충전할 수 있습니다. 7일 동안 유효한 $0.50의 체험 크레딧으로 시작하세요.

API 사양

크레딧을 구매하기 전에 확인할 수 있도록 API의 실제 한도와 기능을 한곳에 정리했습니다.

항목내용
형식OpenAI 호환: 어떤 OpenAI SDK든 base URL과 키만 바꾸면 동작
엔드포인트POST /v1/chat/completions · GET /v1/models
Base URLhttps://api.abliterated.cc/v1
인증Authorization: Bearer YOUR_KEY
모델 IDuncensored
최대 출력100,000 토큰 윈도우의 남은 만큼; max_tokens는 선택 사항(별도 상한 없음)
컨텍스트 창100,000 토큰 (입력 + 출력)
파라미터temperature, top_p, stop, seed, presence_penalty, frequency_penalty
스트리밍지원 — SSE, 마지막 청크에 토큰 사용량 포함
함수 호출지원 — tools, tool_choice; 응답에 tool_calls (스트리밍 포함), 결과는 role: tool로 전송
JSON 모드response_format: {"type": "json_object"}
동시 요청키당 동시 8개
요청 크기최대 8 MB
속도 제한키당 분당 300회
응답 헤더X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
과금선불 크레딧에서 실제 사용량만큼 차감, 오류·거부는 무료
충전USDT (TRC20) 또는 USDC (Base), $10~$500 사이 원하는 정수 금액
보너스$50 이상 +5%, $100 이상 +10%
가격입력 100만 토큰당 $0.25 · 출력 100만 토큰당 $1.00
무료 체험$0.50, 7일, 카드 불필요 · 체험 키: 동시 요청 2건, 분당 60건. 첫 충전 후 전체 한도(8건, 300건) 적용
유효기간유료 크레딧은 만료되지 않으며 구독 없음
콘텐츠성인 콘텐츠 허용, 미성년자가 관련된 성적 콘텐츠는 거부
키계정당 활성 키 1개, 새 키를 만들면 이전 키는 무효
로그인Google 또는 이메일과 비밀번호

오류 코드

오류는 고정된 type을 가진 JSON으로 반환되며, 실패하거나 거부된 요청은 과금되지 않습니다.

코드유형의미
400bad_request잘못된 JSON, 빈 메시지, 잘못된 파라미터 또는 컨텍스트 초과
401missing_key · invalid_key · key_revoked키 없음·잘못됨·새 키로 교체됨
402no_credit잔액 없음 — 충전하면 즉시 재개
403content_blocked미성년자 관련 성적 콘텐츠 — 거부, 과금 없음
404not_found알 수 없는 엔드포인트
413request_too_large본문 8 MB 초과
429rate_limited · concurrency분당 300회 또는 동시 8개 초과 — 잠시 후 재시도
503upstream_busy모델 혼잡 — 몇 초 후 재시도

질문과 답변

인증은 어떻게 처리하나요?

<code>Authorization</code> 헤더에 <code>Bearer YOUR_API_KEY</code> 형식으로 API 키를 포함하세요. Google 또는 이메일로 API 키 페이지에서 키를 생성하세요. 각 계정에는 활성 키가 하나만 있으며, 새 키를 생성하면 기존 키가 대체됩니다.

크레딧이 부족하면 어떻게 되나요?

요청이 실패하지만 오류와 거절은 잔액을 소모하지 않습니다. 언제든지 암호화폐(USDT 또는 USDC)로 충전할 수 있습니다. 선불 크레딧은 만료되지 않으므로 언제든지 사용할 수 있습니다.

모델이 코딩에 적합한가요?

네. 무검열 코딩 LLM은 코드 생성, 디버깅 및 설명을 포함한 기술 작업에 최적화되어 있습니다. 합법적인 성인 콘텐츠에 대한 불필요한 거절 없이 복잡한 JSON과 도구 정의를 신뢰할 수 있게 처리합니다.

키는 양식 하나만 작성하면 받을 수 있습니다

계정을 생성하고 키를 복사한 후 기본 URL을 변경하세요. 설정은 이것뿐입니다.