PL ▾
API bez cenzury dla IA bez filtrówllmsincensura.com
$0,25za 1 mln tokenów wejściowych
100 000okno kontekstu tokenów
Pobierz klucz API

Strona głównaPrzewodnik

Jak zintegrować IA bez cenzury ze swoją aplikacją

Integracja IA bez cenzury z Twoją aplikacją pozwala na uzyskiwanie bezpośrednich odpowiedzi od modelu bez częstych odmów typowych dla dużych dostawców. Ten przewodnik techniczny wyjaśnia, jak połączyć endpoint kompatybilny z OpenAI, zarządzać kontekstem i obsługiwać strumieniowanie, aby zbudować płynne i bezcenzurowe doświadczenia użytkownika.

Czym jest AI bez cenzury?

AI bez cenzury odnosi się do dużego modelu językowego (LLM), który został dostrojony lub skonfigurowany tak, aby nie odrzucał treści dla dorosłych, kontrowersji lub wąskich tematów na podstawie sztywnych polityk korporacyjnych. W przeciwieństwie do standardowych modeli komercyjnych, które mogą zwracać błędy 400 lub ogólny tekst, gdy wykryją określone wzorce, model bez cenzury zwraca dokładnie to, o co poprosisz, o ile jest to zgodne z prawem.

Ta funkcja jest kluczowa dla aplikacji twórczych, badawczych lub środowisk, w których wolność wypowiedzi modelu jest priorytetem. Nie oznacza to, że model jest 'głupi' lub pozbawiony inteligencji; po prostu usuwa warstwy powierzchownej moderacji, które czasem blokują ważne odpowiedzi. Dla programisty oznacza to uproszczenie logiki obsługi błędów, ponieważ nie musisz przewidywać, jaka treść zostanie odrzucona przez zewnętrzny filtr.

  • Przewidywalność: Otrzymujesz pełny tekst bez arbitralnych przerw.
  • Kontrola: Ty decydujesz, jaką treść wyświetlić, a nie API.
  • Wydajność: Mniej nieudanych wywołań API z powodu błędnej moderacji.

Początkowa konfiguracja SDK

Aby zintegrować naszą AI bez cenzury, użyjesz standardowego SDK OpenAI, ponieważ nasz endpoint jest w 100% kompatybilny z ich protokołem. Pozwala to na korzystanie z bibliotek, które już znasz, takich jak openai w Pythonie lub openai w Node.js. Musisz tylko dostosować URL bazowy i podać swój klucz API.

Zaletą tego podejścia jest przenośność. Jeśli w przyszłości zdecydujesz się zmienić dostawcę, który również oferuje kompatybilny endpoint, zmiana w Twoim kodzie będzie minimalna. Oto jak skonfigurować klienta w Pythonie wskazując na naszą usługę:

from openai import OpenAI

client = OpenAI(base_url="https://api.llmsincensura.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Pamiętaj, że kompatybilność oznacza, że używamy tego samego formatu zapytania i odpowiedzi JSON, co ułatwia migrację z innych platform lub tworzenie testów jednostkowych przy użyciu standardowych mocków.

Uwierzytelnianie kluczem API

Bezpieczeństwo w naszym API jest zarządzane za pomocą jednego klucza API na konto. Ten klucz jest generowany natychmiast po rejestracji i wyświetlany raz. Ważne jest, aby zrozumieć, że nie ma domyślnie wielu kluczy; Twoje konto ma główny identyfikator dla Twoich zapytań.

Jeśli musisz unieważnić dostęp lub wygenerować nowy token dla bezpieczeństwa, możesz wygenerować klucz ponownie w ustawieniach swojego konta. Pamiętaj, że to natychmiast unieważnia poprzedni klucz. Nie jest to sposób na zwiększenie limitu szybkości, lecz środek bezpieczeństwa mający na celu utrzymanie tylko jednego aktywnego punktu kontrolnego. Przechowuj swój klucz w zmiennych środowiskowych i nigdy nie udostępniaj go w kodzie po stronie klienta, jeśli Twoja aplikacja jest publiczna.

  • Generowanie: Wyświetlane przy rejestracji.
  • Regeneracja: Unieważnia poprzedni klucz.
  • Użycie: Wysyłany w nagłówku Authorization: Bearer YOUR_KEY.

Wysłanie pierwszego zapytania

Podstawową operacją jest żądanie POST do /v1/chat/completions. Musisz określić model jako uncensored, zdefiniować prompt systemowy, jeśli jest to konieczne, aby ustalić ton, i dostarczyć historię wiadomości lub proste zapytanie użytkownika. Model przetworzy wejście i zwróci pełną odpowiedź w formacie JSON.

Jest to najprostszy przepływ do sprawdzenia, czy Twoja integracja działa. Upewnij się, że Twoja aplikacja poprawnie obsługuje odpowiedzi modelu, które zawierają wygenerowaną treść i metadane użycia, takie jak liczba zużytych tokenów.

curl https://api.llmsincensura.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

To zapytanie jest podstawą każdej aplikacji czatu, generowania treści lub analizy tekstu. Jeśli model poprawnie odpowie, Twoja konfiguracja sieci i uwierzytelniania jest poprawna.

Obsługa strumieniowania

W przypadku aplikacji interaktywnych, takich jak boty czatu, kluczowe jest wykorzystanie strumieniowania. Pozwala to na wysyłanie tokenów do klienta w miarę ich generowania, co poprawia postrzeganie opóźnienia. Nasze API obsługuje Server-Sent Events (SSE) do tego celu.

Włączając strumieniowanie w swoim SDK, otrzymasz wiele zdarzeń częściowych. Musisz połączyć te fragmenty, aby zbudować pełną odpowiedź. Jest to szczególnie przydatne, gdy model generuje długie teksty, ponieważ użytkownik zaczyna widzieć tekst niemal natychmiast.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Strumieniowanie nie zużywa więcej tokenów niż zapytanie bez strumieniowania; zmienia tylko sposób transportu danych. Jest to zalecana praktyka dla każdego nowoczesnego interfejsu użytkownika opartego na AI.

Zarządzanie kontekstem 100k

Jednym z największych wyzwań w rozwoju z LLM jest limit kontekstu. Nasze API oferuje okno kontekstu 100 000 tokenów. To wystarczy na załadowanie rozległych dokumentów, długich historii rozmów lub dużych baz wiedzy w jednym zapytaniu.

Aby wykorzystać to efektywnie, musisz zarządzać oknem przesuwającym (sliding window) w swojej aplikacji. W miarę wzrostu rozmowy możesz usuwać najstarsze wiadomości z historii wysyłanej do modelu, aby utrzymać się w limicie. Kontekst obejmuje zarówno tokeny wejściowe (prompt), jak i wyjściowe (completion).

  • Pojemność: 100k tokenów łącznie.
  • Strategia: Zaimplementuj bufor kołowy dla wiadomości.
  • Koszt: Tokeny są rozliczane za użycie, więc optymalizuj przesyłanie zbędnego kontekstu.

Używanie wywoływania funkcji

Funkcje (wywoływanie funkcji) pozwalają modelowi na interakcję z Twoim zewnętrznym kodem. Możesz zdefiniować funkcje takie jak get_weather lub search_database, a model zwróci argument strukturalny do ich wywołania. Jest to kluczowe dla aplikacji wymagających danych w czasie rzeczywistym lub konkretnych akcji.

Nasza AI bez cenzury obsługuje wywoływanie funkcji w taki sam sposób, jak standard OpenAI. Definiujesz narzędzia w parametrze tools, a model zwraca identyfikator wywołania. Twój kod wykonuje funkcję, a następnie wysyła wynik z powrotem do modelu, aby wygenerował ostateczną odpowiedź na podstawie tych danych.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmsincensura.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

To podejście przekształca pasywny model językowy w aktywnego agenta zdolnego do wykonywania złożonych zadań w Twojej aplikacji.

Limity i Kwoty

Aby zapewnić stabilność usługi, nasza API ma limity szybkości i rozmiaru. Każdy klucz API jest ograniczony do 300 zapytań na minutę. To wystarczy dla większości aplikacji o średnim obciążeniu, ale jeśli Twoja aplikacja ma szczytowe ruchy, powinieneś rozważyć implementację kolejki zapytań po swojej stronie.

Dodatkowo, ciało żądania nie powinno przekraczać 8 MB. Ogranicza to rozmiar plików tekstowych lub JSON, które możesz wysłać w jednym żądaniu. Jeśli potrzebujesz wysłać więcej danych, rozważ podzielenie ich na wiele żądań lub skrócenie przed wysłaniem.

ZasóbLimit
Limit zapytań300 req/min
Rozmiar żądania8 MB
Modelbez cenzury

Rozliczenie i doładowania

Model cenowy to pay-as-you-go, bez obowiązkowych subskrypcji miesięcznych. Płatność naliczana jest za milion tokenów. Kosto wynosi $0.25 za 1M tokenów wejściowych i $1.00 za 1M tokenów wyjściowych. Ta struktura jest przejrzysta i przewidywalna.

Możesz doładować swoje konto kwotą minimalną $10, używając kryptowalut (USDT lub USDC). Jeśli doładujesz większe kwoty, otrzymasz bonusy: 5% ekstra za doładowania od $50 i 10% ekstra za doładowania od $100. Kredyt nie wygasa, więc możesz go użyć, gdy tylko będzie potrzebny, bez presji czasu.

  • Cena wejścia: $0.25 / 1M tokenów.
  • Cena wyjścia: $1.00 / 1M tokenów.
  • Bonusy: +5% od $50, +10% od $100.

Najczęściej zadawane pytania

Czy ten model jest kopią GPT czy Claude?

Nie. To model o otwartych wagach (open-weight) uruchamiany na naszych serwerach, dostrojony specjalnie, aby był bez cenzury. Nie jest to GPT, Claude, Gemini ani żaden inny model zewnętrznego dostawcy, choć jest w pełni kompatybilny z ich formatem API.

Co się stanie, jeśli przekroczę limit 300 zapytań na minutę?

API zwróci błąd limitu zapytań (rate limit). Będziesz musiał poczekać, aż licznik się zresetuje, lub zaimplementować logikę ponawiania z wykładniczym backoffem w swojej aplikacji. Wygenerowanie klucza ponownie nie zwiększa tego limitu, ponieważ jest on przypisany do konta i klucza.

Czy moje prompty są używane do trenowania modelu?

Nie. Nasza polityka prywatności jest ścisła. Prompty, które wysyłasz do API, nie są używane do trenowania modelu, co gwarantuje poufność Twoich danych i rozmów.

Czy mogę używać tej API do treści NSFW?

Tak, model jest zaprojektowany tak, aby nie cenzurować treści dla dorosłych. Jednak zawsze blokowane są treści seksualne z udziałem małoletnich, niezależnie od jurysdykcji. W przypadku pozostałych treści dla dorosłych model nie odrzuca ich z powodów wygody.

Twój klucz jest o krok

Stwórz konto, skopiuj klucz i zmień URL bazowy. To takie proste.

Pobierz klucz API