Samodejno prepoznavanje jezika klepetalnika: preference, rezervne možnosti in izbira uporabnika
Kako spletni klepetalniki združujejo jezik brskalnika, izrecno izbiro uporabnika in razpoložljivo vsebino v pregledno in stabilno jezikovno strategijo.
Večjezični spletni klepetalnik obiskovalcev ne bi smel že s prvim odgovorom poslati v napačen jezik. Vendar samodejno prepoznavanje jezika klepetalnika pomeni več kot le prevzem prve vrednosti iz brskalnika. Nastavitve brskalnika so lahko zastarele, napravo si lahko deli več oseb, nekdo pa raje bere tehnične vsebine v angleščini, čeprav njegov operacijski sistem uporablja nemščino.
Zanesljiva rešitev zato obravnava samodejno prepoznavanje le kot začetni signal. Izrecna izbira uporabnika ima prednost, razpoložljivost vmesnika, baze znanja in postopka predaje določa meje, vidna rezervna možnost (fallback) pa preprečuje, da bi na videz ustrezen jezik vodil do nepopolnih ali izmišljenih odgovorov.

Zakaj je jezik brskalnika le namig
Brskalniki pogosto pošiljajo HTTP glavo Accept-Language. Vsebuje jezikovna območja in lahko prek tako imenovanih vrednosti kakovosti izraža vrstni red, na primer de-AT,de;q=0.9,en;q=0.7. Standard RFC 9110 izrecno opisuje te preference kot pomoč pri izbiri prikaza, ne pa kot zanesljivo izjavo o osebi.
V brskalniku navigator.languages zagotavlja urejen seznam prednostnih jezikovnih oznak BCP-47. Glede na MDN pa lahko brskalniki iz razlogov zasebnosti razkrijejo manj preferenc. Poleg tega lahko brskalnik pod določenimi pogoji doda splošnejše različice: iz de-AT lahko za primerjavo dodatno postane relevanten de .
Posledica za klepetalnike je praktična: Accept-Language in navigator.languages sta dobra kandidata za prvi predlog. Vendar ne smeta nadomestiti ne lokacije ne državljanstva. IP-naslov ne razkriva zanesljive jezikovne želje. Tudi sama domena ali jezik strani ne zadoščata, če je obiskovalec zavestno preklopil na drugo jezikovno različico.
Jasno zaporedje prednosti preprečuje presenečenja
Izbira mora biti deterministična. Izkazal se je vrstni red, ki jasno uteži vsak vir:
- Izrecna izbira v trenutni seji: Če uporabnik klikne francoščino, mora naslednji odgovor klepetalnika uporabiti francoščino.
- Shranjena, še vedno veljavna preferenca: Prejšnja izbira lahko velja ob poznejšem obisku, če je shranjevanje pregledno in tehnično dopustno.
- Jezik trenutne strani: Klepetalnik ne bi smel brez razloga odstopati od zavestno odprte jezikovne različice.
- Preference brskalnika: Seznam se primerja z dejansko podprtimi lokalnimi nastavitvami klepetalnika.
- Dokumentirani privzeti jezik: Če se nič ne ujema, sledi premišljeno izbran osnovni jezik namesto naključnega rezultata.
To zaporedje ločuje prepoznavanje od odločanja. Lahko se beleži in testira: source=user, source=stored, source=page, source=browser ali source=default. Za analitiko običajno zadoščata vir in izbrana lokalna nastavitev. Celotnega jezikovnega seznama brskalnika ne bi smeli po nepotrebnem shranjevati, saj RFC 9110 opozarja na tveganja za zasebnost in sledenje (fingerprinting) pri podrobnih jezikovnih preferencah.
Normalizirajte BCP-47 oznake brez izgube pomena
Jezikovne oznake niso sestavljene le iz dveh črk. pt-BR in pt-PT si delita jezik, vendar se lahko razlikujeta po tonu, izbiri besed, obliki in pravnih izrazih. Odločilni so lahko tudi pisni sistemi. Zato mora aplikacija vhodne oznake sintaktično normalizirati in jih nato preveriti glede na izrecen seznam podprtih lokalnih nastavitev.
Od specifične oznake do varne rezervne možnosti
Smiselno ujemanje najprej poskuša najti natančno različico. Če de-AT ni na voljo, lahko sledi de . Nato se lahko uporabi znana, uredniško preverjena standardna lokalna nastavitev. Preprosto odrezanje vseh podoznak pa ni vedno varno. Pri jezikih z več pisavami ali zelo različnimi različicami izdelek potrebuje jasno definirano dodelitev.
Rezervno možnost je treba preveriti ločeno za tri ravni: Ali je klepetalni vmesnik preveden? Ali obstajajo ustrezni viri znanja? Ali lahko človeška ekipa za podporo prevzame ta jezik? Lokaliziran gumb še ni dokaz, da ima baza znanja enako pokritost. Kako se viri ločujejo po jeziku, različici in dostopu, prikazuje prispevek o filtrih podatkov RAG za KI-klepetalnike.
Ponudite samodejnost, izbiro uporabnika ohranite vidno
Priporočilo W3C za internacionalizacijo združuje samodejno jezikovno posredovanje z lahkodostopnimi povezavami do alternativnih jezikovnih različic. Če uporabnik sam spremeni jezik, mora ta izbira prevladati nad preferenco brskalnika in se po želji ohraniti za naslednje strani.
Za klepetalnik to pomeni: aktivni jezik sodi vidno v glavo klepeta ali v lahko dostopen meni. Sprememba ne sme neopazno poslati trenutnega osnutka. Namesto tega vnos ostane ohranjen, bot kratko razloči spremembo jezika in nadzorovano nadaljuje pogovor. Če so prejšnja sporočila v drugem jeziku, mora sistem ohraniti njihov pomen za kontekst, vendar ne sme brez vprašanja prevesti celotne zgodovine.
Dobra formulacija se glasi na primer: »Nemščina je bila prevzeta s te strani. Spremeni jezik.« Pri rezervni možnosti je opozorilo lahko bolj konkretno: »Za nemščino o tej temi ni preverjenih informacij. Lahko uporabim angleški vir ali vas predam podpori.« Tako uporabnik razume, zakaj se spreminja jezik ali globina odgovora.
Ločite jezik strani, jezik klepeta in lokalno nastavitev vsebine
Tri vrednosti se pogosto zmotno združijo v eno samo polje:
- Jezik strani: primarni jezik dokumenta HTML;
- Jezik klepeta: jezik, v katerem se pojavljajo vmesnik in odgovori;
- Lokalna nastavitev vsebine: različica, iz katere sme klepetalnik pridobivati dokazane informacije.
Te vrednosti so lahko enake, vendar ni nujno. Uporabnik, ki govori nemško, lahko na angleški strani izdelka postavi nemško vprašanje. Bot lahko odgovori v nemščini in se kljub temu pregledno sklicuje na angleški izvirni vir. Vendar ne bi smel trditi, da je uporabil nemški vir, če je bil preveden le odgovor.
Za dostopnost morata biti jezik dokumenta in vsebine pravilno označena. Tehnika W3C H57 opisuje atribut langpri elementu html, tako da lahko bralniki zaslona med drugim ustrezno obdelajo izgovorjavo in sintakso. Če posamezen razdelek spremeni jezik, tudi ta del potrebuje ustrezno oznako. Dodatna preverjanja združuje seznam preverjanj WCAG za spletne klepetalnike.
Pomnilnik in URL-ji morajo spoštovati jezikovno odločitev
Kdor izbira vsebino na strani strežnika glede na Accept-Language , mora upoštevati strategijo predpomnjenja (cache). RFC 9110 razlaga, da Vary: Accept-Language predpomnilnikom sporoča, da je glava vplivala na prikaz. Če te ločitve ni, lahko predpomnilnik dostavi nemško različico angleško govorečemu obiskovalcu.
Za javne vsebine, ki jih je mogoče indeksirati, je stabilne jezikovno specifične URL-je pogosto lažje preveriti in deliti. Samodejno prepoznavanje lahko nato vodi do ustreznega URL-ja, ne da bi se pod istim naslovom skrivale različne vsebine. V samem klepetu mora biti lokalna nastavitev del stanja seje in vsake zahteve na strežnik. Sprememba jezika mora skupaj posodobiti ključe predpomnilnika, filtre pridobivanja in generiranje odgovora.
Tudi oblikovane vrednosti sodijo v to pogodbo. Datum, število, valuta in časovni pas ne sledijo samodejno pravilno iz jezika besedila. Vodnik Lokalizacija odgovorov klepetalnika prikazuje, kako se ti podatki obravnavajo ločeno in dosledno.
Rezervne možnosti ne smejo prikrivati vrrzeli v vsebini
Najbolj tvegana napaka je tiha sprememba baze znanja. Če za nemško vprašanje ne obstaja nemški članek, lahko bot uporabi angleški vir, če izdelek omogoča to pot. Vendar mora preveriti vir, aktualnost in pravice popolnoma enako kot pri neposrednem ujemanju.
Varna matrika rezervnih možnosti vsebuje vsaj: zahtevano lokalno nastavitev, razpoložljivo lokalno nastavitev UI, razpoložljivo lokalno nastavitev vsebine, dopustno nadomestno lokalno nastavitev, način prevajanja in cilj predaje. Rezultat ni vedno odgovor. Pri občutljivih ali močno odvisnih temah je »v tem jeziku ni preverjenih informacij« boljša izbira kot tekoč, a nedokazan prevod. Prispevek o rezervnih možnostih pri vrzelih v znanju opisuje, kako delujeta negotovost in predaja skupaj.
Testni primeri za jezikovno logiko
Majhen, sistematičen nabor testov najde več napak kot posamezno preverjanje brskalnika. Pokrivati bi moral vsaj te primere:
de-ATse ponuja, podprt je lede;- prva preferenca brskalnika ni na voljo, druga pa je;
- izbira uporabnika je v nasprotju z jezikom strani in brskalnika;
- shranjena preferenca se nanaša na medtem odstranjeno lokalno nastavitev;
- UI obstaja, baza znanja ali predaja pa ne;
- sprememba jezika se zgodi sredi pogovora z neposlanim besedilom;
- predpomnilnik po spremembi resnično dostavi novo lokalno nastavitev;
- bralnik zaslona pravilno prepozna jezik strani in razdelka;
- analitika zajema vir izbire in rezervno možnost, ne pa nepotrebno podrobnega seznama preferenc.
Za vsako kombinacijo morajo ekipe določiti pričakovano lokalno nastavitev, vir odločitve, vidno opozorilo in dovoljen obseg vsebine. Poleg tega vsak jezik potrebuje strokovne vzorce. Popolnosti in kakovosti odgovora ni mogoče odčitati le iz prisotnosti prevodne vrstice.
Praktični kontrolni seznam za uvedbo
- Ločeno popišite vse podprte lokalne nastavitve UI, vsebine in predaje.
- Dokumentirajte jasno zaporedje prednosti za izbiro uporabnika, shranjeno izbiro, stran, brskalnik in privzeti jezik.
- Določite ujemanje BCP-47 vključno z regionalnimi in pisnimi izjemami.
- Oblikujte spremembo jezika vidno in brez izgube vnosa.
- Omejite rezervne možnosti na pokritost virov, aktualnost in pravice.
langPreverite jezikovno specifične URL-je, kanonične povezave in vedenje predpomnilnika.- Shranjujte le nujne analitične podatke in določite čas hrambe.
- Testirajte namizne računalnike, mobilne naprave, tipkovnico in bralnike zaslona z realističnimi seznami preferenc.
Osrednja odločitev o izdelku se zato ne glasi: »Kateri jezik ima ta obiskovalec?« Glasi se: »Kateri jezik je bil zaželen, katere vsebine so zanj zanesljivo na voljo in kako razložimo potrebno nadomestno pot?« Kdor na ta tri vprašanja odgovori ločeno, dobi klepetalnik, ki se samodejno začne koristno, a pusti nadzor uporabniku.
Viri
Spremenite obiske spletne strani v boljše pogovore
Zagotovite AI klepetalnik, ki je uporaben od prvega dne
Izurite ChatReact s svojo spletno vsebino, dokumenti in potrjenimi dejstvi, da obiskovalci dobijo hitrejše odgovore, vaša ekipa pa manj ponavljajočih se zahtev.
Sorodni članki
Nadaljujte z branjem

Lokalizacija večjezičnih odgovorov klepetalnika: Datum, številke in valuta
Tako ekipe spletnih mest jasno in preizkusljivo lokalizirajo datume, časovne pasove, številke, valute in enote v večjezičnih odgovorih klepetalnikov.

RAG filtri metapodatkov za AI klepetalnike: Ločevanje jezika, različice in dostopa
Filtri metapodatkov omejijo območje iskanja RAG, preden AI klepetalnik izbere vire. Tako ostanejo jezik, različica, veljavnost in območje dostopa jasno ločeni.

Dostopen AI klepetalnik: WCAG kontrolni seznam za spletne strani
AI klepetalnik pomaga le takrat, ko ga lahko uporabijo vsi. Ta kontrolni seznam, usklajen z WCAG, prikazuje, na kaj morajo ekipe spletnih strani paziti pri vidžetih, dialogih, tipkovnici, mobilnih napravah in prenosu na podporo.