Mock LLM API juhend
Loo tasuta LLM voogesituse lõpp-punkte, mis jäljendavad OpenAI-d, Claude'i ja teisi AI teenusepakkujaid. Ehita ja testi AI-funktsioone ilma tuhandeid API-päringutele kulutamata.
Alustamine
Mock LLM voogesituse lõpp-punkti loomine võtab vähem kui 30 sekundit. Järgi neid lihtsaid samme:
- 1
Külasta LLM mock lehte
Mine mockapi.dog/llm-mock. Sinu lõpp-punkti jaoks genereeritakse automaatselt unikaalne 6-tähemärgiline kood.
- 2
Vali LLM teenusepakkuja profiil
Vali, millise teenusepakkuja vastusevormingut emuleerida:
- • OpenAI - Chat Completions või Responses API vorming vastavalt teele, mida su SDK kutsub
- • Anthropic Claude - Messages API voogesituse vorming
- • Generic Stream - Teenusepakkujast sõltumatu tokenite voog
- • Generic JSON - Lihtne JSON-vastus (ilma voogesituseta)
- 3
Vali sisurežiim
Vali, kuidas vastuse sisu genereeritakse:
- • Genereeritud - Genereeri automaatselt LLM-laadset teksti (Vestlus, Tehniline või Markdown stiil)
- • Staatiline - Kasuta oma esitatud teksti täpselt nii nagu on
- • Hübriid - Sinu tekst, millele järgneb genereeritud jätk
- 4
Seadista tokenite genereerimine (valikuline)
Genereeritud või Hübriid režiimide jaoks sea minimaalsed ja maksimaalsed tokenid (10-2000, vaikimisi 100-300). Genereeritud teksti pikkus on juhuslikult nende väärtuste vahel. Staatilise režiimi jaoks pole vaja.
- 5
Lõpeta kontroll ja salvesta
Lõpeta Turnstile kontroll ja seejärel klõpsa "Salvesta mock-lõpp-punkt". Sinu lõpp-punkti URL kopeeritakse automaatselt!
https://abc123.mockapi.dog/v1/chat/completions
Ongi kõik! Hakka koheselt voogesitama
Sinu lõpp-punkt on kasutusvalmis. Asenda oma OpenAI/Claude baseURL mock-lõpp-punktiga ja alusta testimist. Autentimist ega API võtmeid pole vaja.
Kuluprobleem
Päris LLM API-d on kallid. Arenduse, testimise ja prototüüpimise ajal võivad kulud kiiresti kontrolli alt välja kasvada. Siin on, mida maksaksid päris teenusepakkujatega:
OpenAI GPT-4
KallisNäide: Vestlusroboti testimine 1000 vestlusega (keskmiselt 500 tokenit igaüks) = $20+
Anthropic Claude
KulukasCI/CD konveier: Testide käivitamine 100 korda päevas = $300+/kuu
MockAPI Dog'iga: $0
Tasuta voogesituse vastused arenduseks ja testimiseks. Säästa arenduse faasis tuhandeid. Lülita päris API-dele alles tootmisesse minekuks.
Miks kasutada LLM mock API-t?
Säästa raha
Väldi arenduse ajal tuhandete dollarite kulutamist. Testi oma kasutajaliidest, voogesituse loogikat ja vigade käsitlust ilma API krediite raiskamata.
- Pole vaja API võtmeid ega arvelduse seadistust
- Tasuta päringud arenduse ajal
- Ideaalne indie-arendajatele ja idufirmadele
Kohene testimine
Testi voogesituse vastuseid, kasutajaliidese animatsioone ja veaolekuid koheselt, ilma päris mudeli latentsuse või teenusepakkuja päringukiiruse limiitideta.
- Konfigureeritav vastuse kiirus ja tokenid
- Testi äärejuhtumeid ja veastsenaariume
- Uuri rakenduse saadetud päringuid reaalajas
Mitu teenusepakkujat
Testi oma rakendust erinevate LLM teenusepakkujatega ilma mitut API võtit haldamata. Vaheta sujuvalt OpenAI, Claude'i ja üldiste vormingute vahel.
- OpenAI-ga ühilduvad lõpp-punktid
- Anthropic Claude vormingu tugi
- Üldine SSE voogesituse vorming
CI/CD integratsioon
Käivita automaattestid oma CI/CD konveieris ilma API kulude või päringukiiruse limiitide pärast muretsemata. Testi oma AI-funktsioone igal commit'il.
- Autentimist ei nõuta
- Järjepidevad, prognoositavad vastused
- Kiire käivitamine kiireks tagasisideks
Toetatud teenusepakkujad
MockAPI Dog toetab populaarsete LLM teenusepakkujate voogesituse vorminguid. Sea lihtsalt oma lõpp-punkt eelistatud SDK-s baseURL-iks.
OpenAI vorming
Ühildub ametliku OpenAI SDK-ga. Üks lõpp-punkt vastab nii Chat Completions kui ka Responses API päringutele, voogesitusega või ilma. Vastustes on mudeliks gpt-5.4 ning Chat Completions API puhul lisab stream_options.include_usage lõppu kasutusandmete tüki.
Anthropic vorming
Ühildub ametliku Anthropic SDK-ga. Emuleerib Messages API-t, voogesitusega või ilma, samas sündmuste järjekorras, mida SDK ootab. Vastustes on mudeliks claude-sonnet-5.
Üldine SSE vorming
Standardne Server-Sent Events (SSE). Iga sündmus sisaldab {"token": "..."} ja voog lõpeb sündmusega {"done": true}. Kasuta iga voogesituse kliendiga või ehita oma kohandatud integratsioon.
- Kohandatud LLM integratsioonid
- EventSource implementatsioonide testimine
- Voogesituse protokollide õppimine
Kuidas päringud sinu lõpp-punktini jõuavad
SDK-d lisavad baseURL väärtusele oma tee. MockAPI Dog eemaldab need järelliited enne sobitamist, seega sea baseURL väärtuseks täpselt salvestatud URL.
POST https://xyz789.mockapi.dog/llm/chat/completions → /llm- Üldised profiilid sobitavad salvestatud teed täpselt, seega kutsu seda URL-i otse.
- LLM lõpp-punktid salvestatakse meetodiga POST, mida kasutavad kõik SDK-d.
Voogesitus või JSON?
Vastus voogesitatakse, kui päringu kehas on "stream": true. Kui kehas välja stream pole, voogesitatakse vastus siis, kui päis Accept sisaldab text/event-stream. Muul juhul saad ühe JSON-vastuse.
Sisurežiimid
Vali, kuidas su mock LLM lõpp-punkt vastuse sisu genereerib. Iga režiim pakub erinevat kontrolli voogesitatava teksti üle.
Genereeritud
Genereeri automaatselt LLM-laadset teksti erinevates stiilides. Vali Vestluse (vestluslik toon), Tehnilise (programmeerimisele keskendunud) või Markdown'i (vorminduse, loendite ja koodiplokkidega) vahel.
Staatiline
Kasuta oma esitatud täpset teksti vastusena. Tekst voogesitatakse täpselt nii, nagu on kirjutatud, ilma genereerimise või muutmiseta.
Hübriid
Ühendab sinu esitatud teksti automaatselt genereeritud jätkuga. Sinu tekst voogesitatakse esimesena, millele järgneb genereeritud LLM-laadne sisu.
Tekstistiilid genereeritud sisu jaoks
Genereeritud või Hübriid režiimide kasutamisel saad valida Vestluse (vestluslik), Tehnilise (programmeerimisele keskendunud) või Markdown'i (sisaldab vormindust, loendeid, koodiplokke) stiili vahel.
Tokenite genereerimise seaded
Häälesta täpselt, kuidas su mock LLM lõpp-punkt tokeneid genereerib ja voogesitab, et see vastaks su testimisvajadustele.
Tokenite arv
Sea genereeritavate tokenite arv, arvestades umbes 4 tähemärki tokeni kohta. Kasulik erinevate vastuste pikkuste testimiseks.
Voogesituse kiirus
Tekst voogesitatakse 5-20 tähemärgi kaupa. Sea tükkide vahele minimaalne ja maksimaalne viivitus (10-500ms) ning iga viivitus valitakse selles vahemikus juhuslikult. Tühjaks jätmisel on vaikeväärtus 30-120ms.
Profi nõuanne
Testi erinevate kiirustega, et tagada, et su kasutajaliides käsitleb sujuvalt nii kiiret kui aeglast voogesitust. Päris LLM API-d võivad vastusajas oluliselt erineda.
Koodinäited
Siin on, kuidas kasutada oma mock LLM lõpp-punkti populaarsete SDK-de ja teekidega.
OpenAI SDK
Asenda baseURL oma mock-lõpp-punktiga. API võtit pole vaja!
import OpenAI from 'openai'; const openai = new OpenAI({baseURL: 'https://xyz789.mockapi.dog/llm',apiKey: 'dummy-api-key', // Mock endpoint doesn't check API keys }); async function main() { const stream = await openai.chat.completions.create({ model: 'gpt-5.4', messages: [{ role: 'user', content: 'Hello!' }], stream: true, }); for await (const chunk of stream) { const content = chunk.choices[0]?.delta?.content || ''; process.stdout.write(content); } } main();
OpenAI SDK (Responses API)
Sama lõpp-punkt vastab ka Responses API päringutele. Loe teksti sündmustest response.output_text.delta.
import OpenAI from 'openai'; const openai = new OpenAI({baseURL: 'https://xyz789.mockapi.dog/llm',apiKey: 'dummy-api-key', // Mock endpoint doesn't check API keys }); async function main() { const stream = await openai.responses.create({ model: 'gpt-5.4', input: 'Hello!', stream: true, }); for await (const event of stream) { if (event.type === 'response.output_text.delta') { process.stdout.write(event.delta); } } } main();
Anthropic SDK
Kasuta Anthropic SDK-ga, seades kohandatud baseURL-i.
import Anthropic from '@anthropic-ai/sdk'; const anthropic = new Anthropic({baseURL: 'https://xyz789.mockapi.dog/claude',apiKey: 'dummy-api-key', // Mock endpoint doesn't check API keys }); async function main() { const stream = await anthropic.messages.stream({ model: 'claude-sonnet-5', max_tokens: 1024, messages: [{ role: 'user', content: 'Hello!' }], }); for await (const chunk of stream) { if (chunk.type === 'content_block_delta' && chunk.delta.type === 'text_delta') { process.stdout.write(chunk.delta.text); } } } main();
Üldine Fetch (SSE)
Kasuta vanilla JavaScript/TypeScript'iga maksimaalseks paindlikkuseks.
async function streamResponse() {const response = await fetch('https://xyz789.mockapi.dog/llm/stream', {method: 'POST', headers: { 'Content-Type': 'application/json', }, body: JSON.stringify({ prompt: 'Hello, world!', stream: true, // without this (or Accept: text/event-stream) you get plain JSON }), }); const reader = response.body?.getReader(); const decoder = new TextDecoder(); while (true) { const { done, value } = await reader.read(); if (done) break; const chunk = decoder.decode(value); const lines = chunk.split('\n'); for (const line of lines) { if (line.startsWith('data: ')) { try { const json = JSON.parse(line.slice(6)); if (json.done) return; console.log(json.token); } catch (e) { // Skip invalid JSON } } } } } streamResponse();
Nii lihtne see ongi!
Asenda lihtsalt baseURL ja oledki valmis. Sinu olemasolev kood töötab ilma muudatusteta.
Päriselu kasutusjuhud
Vestlusroboti arendus
Ehita ja testi vestlusroboti kasutajaliideseid ilma API-päringutele kulutamata. Testi sõnumite lõimimist, voogesituse animatsioone ja vigade käsitlust.
- Testi voogesituse sõnumite animatsioone
- Veendu vestluse lõimimises
- Silu kasutajaliidese äärejuhtumeid
Testimine ja QA
Käivita automaatteste ja käsitsi QA-d ilma API kuludeta. Testi erinevaid vastusestsenaariume ja äärejuhtumeid järjepidevalt.
- Automatiseeritud E2E testid CI/CD-s
- Järjepidevad testandmed
- Kiire testide käivitamine
Õppimine ja õpetused
Õpi AI integratsiooni ilma raha kulutamata. Ideaalne õpetuste, kursuste ja hariduslike materjalide jaoks.
- Pole API võtme seadistust õpilastele
- Tasuta harjutamine
- Turvaline õppekeskkond
MVP-d ja demod
Ehita kontseptsiooni tõestusi ja demosid ilma esialgsete kuludeta. Näita oma visiooni investoritele ja sidusrühmadele enne tasulistele API-dele kohustumist.
- Kiire prototüüpimine
- Investorite demod
- Valideeri ideid odavalt
Täiustatud funktsioonid
Request Inspector
Lülita logimine sisse, et jälgida reaalajas rakenduse saadetud viipasid, päiseid ja parameetreid. Authorization- ja küpsisepäised peidetakse, kuid teised päised, näiteks x-api-key, salvestatakse saadetud kujul, seega kasuta fiktiivset API võtit.
Konfigureeritavad viivitused
Lisa enne vastuse algust fikseeritud viivitus ja häälesta voogesituse kiirust, et testida laadimisolekuid ja ajalõpu käsitlemist.
Vigade simuleerimine
Lase protsendil päringutest ebaõnnestuda või käivita viga vajadusel päringu päisega, kasutades olekukoode nagu 401, 429 või 503. Vead saadetakse JSON-ina enne voogesituse algust, seega tõstatab su SDK need API vigadena.
Pole autentimist
Mock-lõpp-punktid ei nõua API võtmeid ega autentimist. Ideaalne CI/CD konveierite ja avalike demode jaoks.
Veaotsing
Voogesitus ei tööta
Vastus voogesitatakse ainult siis, kui päringu keha sisaldab "stream": true või kui välja stream pole ja päis Accept sisaldab text/event-stream. Muul juhul tagastab lõpp-punkt ühe JSON-vastuse. Kontrolli ka, et su klient loeb vastust voona.
// Make sure to set stream: true
const stream = await openai.chat.completions.create({
stream: true, // This is required!
// ...
});Vastus liiga kiire/aeglane
Ava "Viivituste, voogesituse kiiruse ja vigade simuleerimise seaded" ja muuda vahekaardil "Voogesituse kiirus" min ja max viivitust. Kontrolli ka vahekaardilt "Viivitused", kas enne vastust on fikseeritud viivitus.
SDK ühilduvuse probleemid
Veendu, et lõpp-punkti teenusepakkuja profiil vastab su SDK-le (OpenAI SDK vajab OpenAI profiili, Anthropic SDK vajab Anthropic profiili). Sea baseURL väärtuseks salvestatud URL ja lase SDK-l oma tee ise lisada.
CORS vead brauseris
Mock-lõpp-punktid on konfigureeritud lubavate CORS päistega. Kui sa endiselt CORS vigu saad, kontrolli oma päringupäiseid ja veendu, et ei saada piiratud päiseid.
SDK saab vastuseks 404 ei leitud
LLM lõpp-punktid vastavad ainult POST päringutele, mis on tehtud salvestatud teele koos SDK oma järelliitega. 404 vastuse keha näitab koodi, ressurssi ja meetodit, mille server sai, seega võrdle neid oma salvestatud lõpp-punktiga.
Päringud tagastavad 429 liiga palju päringuid
Igal lõpp-punktil on päevane päringulimiit. Kui see täitub, tagastavad päringud 429 ning keha sisaldab limiiti ja resetAt aega (kesköö serveri aja järgi). Lisaks on iga IP-aadress kogu teenuses piiratud 100 päringuga minutis.
Nõuanded ja parimad praktikad
Testi erinevate kiirustega
Päris LLM API-d varieeruvad kiiruses. Testi oma kasutajaliidest nii kiire kui aeglase voogesitusega, et tagada sujuv kasutajakogemus kõigis tingimustes.
Kasuta keskkonnamuutujaid
Salvesta oma baseURL keskkonnamuutujatesse. Vaheta mock ja tootmise API-de vahel ühe muutuja muutmisega.
// .env.development
OPENAI_BASE_URL=https://xyz789.mockapi.dog/llm
// .env.production
OPENAI_BASE_URL=https://api.openai.com/v1Testi veastsenaariume
Ära testi ainult õnnestumise teid. Kasuta vigade simuleerimist, et testida päringukiiruse limiite (429), autentimisvigu (401) ja katkestusi (503), ning fikseeritud viivitust ajalõppude testimiseks.
LLM arenduse töövoog
Järgi seda töövoogu efektiivseks AI arenduseks:
- Ehita kasutajaliides ja voogesituse loogika mock-lõpp-punktidega
- Testi põhjalikult erinevate sisurežiimide ja kiirustega
- Käivita automaattestid CI/CD-s mock-lõpp-punktidega
- Lülita päris API-le alles lõpliku integratsioonitestimise jaoks
- Juuruta tootmise API võtmetega
Valideeri enne tootmist
Enne tootmise API-dele lülitumist valideeri oma implementatsioon päris teenusepakkuja API-ga staging-keskkonnas, et püüda kinni võimalikud käitumiserinevused.
Sõnastik
LLM (suur keelemudel)
AI mudelid nagu GPT-4 ja Claude, mis genereerivad inimlikke tekstivastuseid. Näited: OpenAI GPT seeria, Anthropic Claude, Google Gemini.
Voogesituse API
API, mis saadab andmeid tükkidena, selle asemel et oodata täielikku vastust. Võimaldab AI-genereeritud teksti reaalajas kuvada selle loomise käigus.
Token
Põhiline tekstiühik LLM-ides. Umbkaudu sõna või sõnatüki ekvivalent. LLM-ide hinnakujundus põhineb tavaliselt tokenite arvul.
SSE (Server-Sent Events)
Tehnoloogia, mis võimaldab serveritel klientidele andmeid reaalajas saata. Kasutatakse LLM API-de poolt vastuste voogesitamiseks.
baseURL
API-päringute baasaadress. Asenda see oma mock-lõpp-punkti URL-iga, et suunata päringud MockAPI Dog'i, mitte päris teenusepakkujale.
Teenusepakkuja
Ettevõtted, mis pakuvad LLM API-sid, näiteks OpenAI (GPT), Anthropic (Claude), Google (Gemini) jne.
Valmis ehitamist alustama?
Loo oma esimene mock LLM voogesituse lõpp-punkt sekunditega. Pole registreerimist, pole krediitkaarti, pole tüli. Alusta AI-funktsioonide ehitamist ilma tuhandeid API-päringutele kulutamata.