Ghid operator pentru Venice Augment
Ce face
venice-augment acoperă trei endpoint-uri Venice pentru pipeline-uri cu agenți: extragere de text din documente, transformare de pagini web în markdown și căutare web structurată.
Endpoint-urile sunt:
POST /augment/text-parser — primește un fișier prin multipart/form-data: PDF, DOCX, XLSX sau plain text, maximum 25 MB. Returnează JSON cu { text, tokens } sau text simplu, în funcție de response_format.
POST /augment/scrape — primește { "url": "..." } și returnează pagina în markdown: { url, content, format: "markdown" }.
POST /augment/search — primește { query, limit?, search_provider? } și returnează { query, results }, unde fiecare rezultat are title, url, content și date. limit poate fi 1–20, default 10.
Toate trei acceptă Bearer API key sau SIWE prin x402 wallet și sunt taxate dinamic. Nu sunt interfețe finale pentru utilizatori; sunt piese de infrastructură pentru a pregăti material curat pentru modele.
Când îmi folosește
Folosește text-parser când ai un document și vrei să-l trimiți într-un model fără parsing local: contract, raport, tabel exportat sau fișier text.
Folosește scrape când ai un URL și vrei conținut citibil în markdown, nu HTML brut. După scrape poți sumariza, clasifica, compara sau extrage date.
Folosește search când construiești un agent de cercetare: cauți surse, iei URL-urile, apoi rulezi scrape pe rezultate. Pentru “search + read”, acesta este traseul normal.
Cum îl invoc / declanșez
Nu există un trigger conversațional public unic garantat pentru acest skill. Invocarea exactă depinde de runtime-ul în care este instalat. Capabilitatea stabilă este API-ul Venice.
Endpoint-urile complete sunt:
POST https://api.venice.ai/api/v1/augment/text-parser
POST https://api.venice.ai/api/v1/augment/scrape
POST https://api.venice.ai/api/v1/augment/search
Autentificarea se face cu Authorization: Bearer $VENICE_API_KEY sau prin SIWE/x402. Nu pune cheia în ghiduri, loguri, commituri sau mesaje publice. Folosește variabile de mediu sau mecanismul de secrets al runtime-ului.
Exemplu practic
Document către text:
curl -X POST https://api.venice.ai/api/v1/augment/text-parser \
-H "Authorization: Bearer $VENICE_API_KEY" \
-F "file=@./document.pdf" \
-F "response_format=json"Răspuns JSON:
{
"text": "…extracted plaintext…",
"tokens": 3821
}Pagină web către markdown:
curl -X POST https://api.venice.ai/api/v1/augment/scrape \
-H "Authorization: Bearer $VENICE_API_KEY" \
-H "Content-Type: application/json" \
-d '{"url":"https://example.com"}'Search web:
curl -X POST https://api.venice.ai/api/v1/augment/search \
-H "Authorization: Bearer $VENICE_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"query": "venice ai api pricing",
"limit": 5,
"search_provider": "brave"
}'Output / unde aterizează
text-parser returnează textul extras și tokens. Valoarea tokens ajută la bugetarea requestului următor către chat. Cu response_format=text, corpul răspunsului este plaintext.
scrape returnează markdown. Verifică lungimea și conținutul rezultatului înainte să-l bagi într-un model; unele site-uri pot întoarce doar conținut parțial.
search returnează rezultate structurate. Providerul implicit este brave, cu Zero Data Retention. Alternativa este google, proxat și anonimizat prin Venice. Pentru răspunsuri citate, poți combina rezultatele cu /chat/completions și venice_parameters.enable_web_citations.
Limite / gotchas
Fișierele pentru text-parser au limită de 25 MB. PDF-urile scanate ca imagini nu sunt OCR-uite; pentru imagini folosește un model vision prin /chat/completions.
X/Twitter și Reddit sunt blocate la scrape și întorc 400 imediat. Pentru acele surse, folosește enable_x_search sau enable_web_search pe /chat/completions.
La search, query trebuie să aibă 1–400 caractere. Nu se trunchiază automat; peste limită primești 400 INVALID_REQUEST.
Erori relevante: 400 pentru input invalid, fișier prea mare, format nesuportat sau URL blocat; 401 pentru auth lipsă sau invalid; 402 pentru balance insuficient; 403 pentru acces neautorizat; 429 pentru rate limit; 500 pentru eșec upstream de fetch sau parse. La 429, fă backoff cu jitter. La 500, retry este sigur.
Privacy: conținutul este procesat in-memory și nu este reținut după răspuns. Asta este o garanție de no-content-retention, nu o promisiune că nu există metadate operaționale, request IDs sau error traces pentru debugging.