Përdoreni këtë udhëzues për t'ju ndihmuar të diagnostikoni dhe zgjidhni problemet e zakonshme që lindin kur thirrni Gemini API. Mund të hasni probleme ose nga shërbimi i prapavijës së Gemini API ose nga SDK-të e klientit. SDK-të e klientit tonë janë me burim të hapur në depot e mëposhtme:
Nëse hasni probleme me çelësin API, verifikoni që e keni konfiguruar çelësin API saktë sipas udhëzuesit të konfigurimit të çelësit API .
Kodet e gabimit
Për një referencë të plotë të të gjitha kodeve të gabimeve, duke përfshirë kodet e statusit HTTP, kodet e bllokimit të gjenerimit dhe kodet e gabimeve të përmbajtjes, shihni faqen e gabimeve të API-t .
Strategjia e riprovimit
Nëse merrni një gabim që tregon se duhet ta riprovoni kërkesën tuaj (si p.sh. një 429 RESOURCE_EXHAUSTED ose 503 UNAVAILABLE ), ne rekomandojmë zbatimin e një strategjie tërheqjeje eksponenciale. Kjo do të thotë që duhet të prisni pak kohë para riprovimit të parë dhe pastaj të rrisni gradualisht kohën e pritjes midis riprovimeve pasuese.
SDK-të zyrtare të klientit për Gemini API, siç është Python SDK , përfshijnë logjikën automatike të riprovimit me tërheqje eksponenciale si parazgjedhje për trajtimin e gabimeve kalimtare si skadimet e kohës, problemet e rrjetit dhe kufijtë e shpejtësisë (kodet e statusit 429 dhe 5xx ). Për shembull, Python SDK riprovon automatikisht gabimet kalimtare deri në katër herë me një vonesë fillestare prej afërsisht 1 sekonde dhe një vonesë maksimale prej 60 sekondash.
Nëse po bëni kërkesa të drejtpërdrejta REST API ose po personalizoni logjikën e riprovimit, ndiqni këto praktika më të mira për të rritur gjasat e një kërkese të suksesshme dhe për të parandaluar mbingarkesën e shërbimit:
- Përdorni tërheqje eksponenciale: Prisni pak kohë para ripërpjekjes së parë (për shembull, 1 sekondë), pastaj rrisni vonesën në mënyrë eksponenciale (për shembull, 2s, 4s, 8s).
- Shto luhatje: Shtoni një "luhatje" të rastësishme në vonesë për të ndihmuar në parandalimin e riprovimit të të gjithë klientëve në të njëjtën kohë.
- Riprovo për gabime specifike: Riprovo vetëm për gabime kalimtare (si
429,408ose5xx). Mos riprovo për gabime të klientit (si400ose403) pasi ato tregojnë probleme si çelësa API të pavlefshëm ose sintaksë të keqe. - Cakto numrin maksimal të ripërpjekjeve: Përcakto një numër maksimal të përpjekjeve për të parandaluar sythe të pafundme.
Kontrolloni thirrjet tuaja API për gabime të parametrave të modelit
Verifikoni që parametrat e modelit tuaj janë brenda vlerave të mëposhtme:
| Parametri i modelit | Vlerat (diapazoni) |
| Numri i kandidatëve | 1-8 (numër i plotë) |
| Temperatura | 0.0-1.0 |
| Tokenët maksimalë të daljes | Përdorni faqen e modeleve për të përcaktuar numrin maksimal të tokenëve për modelin që po përdorni. |
| TopP | 0.0-1.0 |
Përveç kontrollit të vlerave të parametrave, sigurohuni që po përdorni versionin e saktë të API-t (p.sh., /v1 ose /v1beta ) dhe modelin që mbështet veçoritë që ju nevojiten. Për shembull, nëse një veçori është në versionin Beta, ajo do të jetë e disponueshme vetëm në versionin /v1beta të API-t.
Kontrolloni nëse keni modelin e duhur
Verifikoni që po përdorni një model të mbështetur të listuar në faqen tonë të modeleve .
Vonesa ose përdorim më i lartë i tokenëve me modelet 2.5
Nëse vini re vonesë ose përdorim më të lartë të tokenëve me modelet 2.5 Flash dhe Pro, kjo mund të ndodhë sepse ato vijnë me të menduarit që është aktivizuar si parazgjedhje për të përmirësuar cilësinë. Nëse po i jepni përparësi shpejtësisë ose keni nevojë të minimizoni kostot, mund ta përshtatni ose çaktivizoni të menduarit.
Referojuni faqes së të menduarit për udhëzime dhe kod shembull.
Çështje sigurie
Nëse shihni se një kërkesë është bllokuar për shkak të një cilësimi sigurie në thirrjen tuaj API, rishikoni kërkesën në lidhje me filtrat që keni vendosur në thirrjen API.
Nëse shihni BlockedReason.OTHER , pyetja ose përgjigjja mund të shkelë kushtet e shërbimit ose të mos mbështetet për ndonjë arsye tjetër.
Çështja e recitimit
Nëse shihni që modeli ndalon së gjeneruari rezultate për shkak të arsyes RECITATION, kjo do të thotë që rezultati i modelit mund të ngjajë me të dhëna të caktuara. Për ta rregulluar këtë, përpiquni ta bëni kërkesën/kontekstin sa më unik të jetë e mundur dhe përdorni një temperaturë më të lartë.
Problem me tokenët përsëritës
Nëse shihni tokena dalës të përsëritura, provoni sugjerimet e mëposhtme për t'i zvogëluar ose eliminuar ato.
| Përshkrimi | Shkak | Zgjidhje e sugjeruar |
|---|---|---|
| Viza ndarëse të përsëritura në tabelat Markdown | Kjo mund të ndodhë kur përmbajtja e tabelës është e gjatë, ndërsa modeli përpiqet të krijojë një tabelë Markdown të rreshtuar vizualisht. Megjithatë, rreshtimi në Markdown nuk është i nevojshëm për paraqitjen e saktë. | Shtoni udhëzime në kërkesën tuaj për të dhënë udhëzime specifike për modelin për gjenerimin e tabelave Markdown. Jepni shembuj që ndjekin këto udhëzime. Mund të provoni gjithashtu të rregulloni temperaturën. Për gjenerimin e kodit ose rezultateve shumë të strukturuara si tabelat Markdown, temperatura e lartë ka treguar se funksionon më mirë (>= 0.8). Më poshtë është një shembull i një grupi udhëzimesh që mund t'i shtoni kërkesës suaj për të parandaluar këtë problem:
# Markdown Table Format
* Separator line: Markdown tables must include a separator line below
the header row. The separator line must use only 3 hyphens per
column, for example: |---|---|---|. Using more hypens like
----, -----, ------ can result in errors. Always
use |:---|, |---:|, or |---| in these separator strings.
For example:
| Date | Description | Attendees |
|---|---|---|
| 2024-10-26 | Annual Conference | 500 |
| 2025-01-15 | Q1 Planning Session | 25 |
* Alignment: Do not align columns. Always use |---|.
For three columns, use |---|---|---| as the separator line.
For four columns use |---|---|---|---| and so on.
* Conciseness: Keep cell content brief and to the point.
* Never pad column headers or other cells with lots of spaces to
match with width of other content. Only a single space on each side
is needed. For example, always do "| column name |" instead of
"| column name |". Extra spaces are wasteful.
A markdown renderer will automatically take care displaying
the content in a visually appealing form.
|
| Tokenët e përsëritur në tabelat Markdown | Ngjashëm me vizat ndarëse të përsëritura, kjo ndodh kur modeli përpiqet të rreshtojë vizualisht përmbajtjen e tabelës. Renditja në Markdown nuk kërkohet për paraqitjen e saktë. |
|
Rreshta të reja të përsëritura ( \n ) në daljen e strukturuar | Kur hyrja e modelit përmban unicode ose sekuenca escape si \u ose \t , kjo mund të çojë në rreshta të rinj të përsëritur. |
|
| Tekst i përsëritur duke përdorur dalje të strukturuar | Kur rezultati i modelit ka një renditje të ndryshme për fushat nga skema e strukturuar e përcaktuar, kjo mund të çojë në përsëritje të tekstit. |
|
| Thirrje e përsëritur e mjeteve | Kjo mund të ndodhë nëse modeli humbet kontekstin e mendimeve të mëparshme dhe/ose thërret një pikë fundore të padisponueshme që është e detyruar ta bëjë. | Udhëzoni modelin që të ruajë gjendjen brenda procesit të tij të të menduarit. Shtojeni këtë në fund të udhëzimeve të sistemit tuaj:
When thinking silently: ALWAYS start the thought with a brief
(one sentence) recap of the current progress on the task. In
particular, consider whether the task is already done.
|
| Tekst përsëritës që nuk është pjesë e rezultatit të strukturuar | Kjo mund të ndodhë nëse modeli ngec në një kërkesë që nuk mund ta zgjidhë. |
|
Çelësa API të bllokuar ose jofunksionalë
Ky seksion përshkruan se si të kontrolloni nëse çelësi juaj Gemini API është i bllokuar dhe çfarë të bëni në lidhje me të.
Kuptoni pse çelësat janë të bllokuar
Ne kemi identifikuar një dobësi ku disa çelësa API mund të jenë ekspozuar publikisht. Për të mbrojtur të dhënat tuaja dhe për të parandaluar aksesin e paautorizuar, ne kemi bllokuar në mënyrë proaktive këto çelësa të njohur të rrjedhur nga qasja në API-n Gemini.
Konfirmo nëse çelësat e tu janë prekur
Nëse dihet se çelësi juaj ka rrjedhur, nuk mund ta përdorni më atë çelës me Gemini API. Mund të përdorni Google AI Studio për të parë nëse ndonjë nga çelësat e API-t tuaj është bllokuar nga thirrja e Gemini API dhe për të gjeneruar çelësa të rinj. Gjithashtu mund të shihni gabimin e mëposhtëm të kthyer kur përpiqeni të përdorni këto çelësa:
Your API key was reported as leaked. Please use another API key.
Veprim për çelësat e bllokuar të API-t
Duhet të gjeneroni çelësa të rinj API për integrimet tuaja të API-t Gemini duke përdorur Google AI Studio . Ne ju rekomandojmë fuqimisht të rishikoni praktikat tuaja të menaxhimit të çelësave API për t'u siguruar që çelësat tuaj të rinj mbahen të sigurt dhe nuk ekspozohen publikisht.
Tarifa të papritura për shkak të cenueshmërisë
Dorëzoni një rast mbështetjeje për faturimin . Ekipi ynë i faturimit po punon për këtë dhe do të komunikojmë përditësime sa më shpejt të jetë e mundur.
Masat e sigurisë së Google për çelësat e rrjedhur
Si do të më ndihmojë Google të mbroj llogarinë time nga tejkalimi i kostove dhe abuzimi nëse çelësat e API-t të mi zbulohen?
- Po shkojmë drejt lëshimit të çelësave API kur kërkoni një çelës të ri duke përdorur Google AI Studio , i cili si parazgjedhje do të kufizohet vetëm në Google AI Studio dhe nuk do të pranojë çelësa nga shërbime të tjera. Kjo do të ndihmojë në parandalimin e çdo përdorimi të paqëllimshëm ndër-çelësor.
- Ne po përdorim si parazgjedhje bllokimin e çelësave API që rrjedhin dhe përdoren me Gemini API, duke ndihmuar në parandalimin e abuzimit me koston dhe të dhënat e aplikacionit tuaj.
- Do të jeni në gjendje të gjeni statusin e çelësave tuaj API brenda Google AI Studio dhe ne do të punojmë për të komunikuar në mënyrë proaktive kur të identifikojmë se çelësat tuaj API janë zbuluar për veprim të menjëhershëm.
Përmirëso prodhimin e modelit
Për rezultate modelesh me cilësi më të lartë, eksploroni shkrimin e pyetjeve më të strukturuara. Faqja e udhëzuesit të inxhinierisë së pyetjeve prezanton disa koncepte bazë, strategji dhe praktika më të mira për t'ju ndihmuar të filloni.
Kuptoni kufijtë e tokenëve
Lexoni udhëzuesin tonë për Token-at për të kuptuar më mirë se si të numëroni token-at dhe limitet e tyre.
Probleme të njohura
- API mbështet vetëm një numër gjuhësh të zgjedhura. Dërgimi i kërkesave në gjuhë të pambështetura mund të prodhojë përgjigje të papritura ose edhe të bllokuara. Shihni gjuhët e disponueshme për përditësime.
Paraqit një defekt
Bashkohuni në diskutim në forumin e zhvilluesve të inteligjencës artificiale të Google nëse keni pyetje.