Saltu al enhavo

Granda lingvomodelo

El Vikipedio, la libera enciklopedio
Granda lingvomodelo
speco de modelo de artefarita intelekto Redakti la valoron en Wikidata
lingvomodelo
v • d • r
Fludiagramo

Granda lingvomodelo (akronime GLM, angle Large Language Model, ofte mallongigita kiel LLM) ) estas speco de artefarita intelekto, kiu povas kompreni kaj generi homajn tekstojn en diversaj lingvoj uzante maŝinlernadon. Post trejnado kaj testado, tekstogenerilo povas sendepende generi serion da vortoj uzante probablan distribuon por provi antaŭdiri la ĝustan kompletigon[1] aŭ AI-babilroboto povas ĝuste interpreti la demandon kaj poste ankaŭ generi unikan neekzistantan tekston kiel respondon.

GLM-oj estas lingvomodeloj kun multaj parametroj, kaj estas trejnitaj kun mem-kontrolita lernado sur vasta kvanto da tekstoj. Rezulte, uzanto povas fari babilan konversacion kun Granda Lingvomodelo tiel, ke ĝi preskaŭ ŝajnigas, kvazaŭ la konversacio okazas kun reala persono. Tia lingvomodelo ankaŭ povas generi tekstojn, ekzemple por libro, letero, oficiala dokumento, komputila traduko, resumo kaj eĉ por programara kodo. Grandaj trejnaroj fakte povas esti kreitaj nur per retskrapado.

La plej grandaj kaj plej kapablaj GLM-oj estas generaj antaŭtrejnitaj transformiloj (GPT-oj). Modernaj modeloj povas esti fajnagorditaj por specifaj taskoj aŭ gviditaj per prompta inĝenierado.[2] Tiuj modeloj akiras prognozan potencon koncerne sintakson, semantikon, kaj ontologiojn[3] enecajn en homlingvaj korpusoj, sed ili ankaŭ heredas malprecizaĵojn kaj biasojn ĉeestantajn en la datenoj en kiujn ili estas trejnitaj.[4]

Grandaj lingvomodeloj estas esence la "cerboj" malantaŭ potencaj babilrobotoj kiel Apple Intelligence de Apple, ChatGPT de OpenAI, Claude de Anthropic, Gemini de Guglo, Grok de xAI kaj la malfermkoda DeepSeek.

Grandaj lingvomodeloj povas esti konkreta kaj alirebla alternativo, ekzemple, por aŭtoroj el la Tutmonda Sudo, kiuj faras la malavaran penon verki en nedenaskaj lingvoj, kiel la angla aŭ la hispana[5].

La modelo funkcias kun kunteksto sed ne havas senton pri iu ajn signifo mem. Tio kelkfoje kondukas al fenomeno nomata halucinado, kie la modelo generas tekston kiu kontraŭdiras sin, ripetas sin, aŭ simple enhavas sensencaĵon. La grado de halucino povas esti adaptita, sed se halucino estas malpli aŭ tute ne permesita, la modelo pli ofte blokiĝos, interrompos la respondon, aŭ eĉ tute ne donos respondon.

Krome, la eligo dependas de la enigo per kiu la sistemo estas trejnita. Kiam la sistemo ricevas malĝustajn informojn aŭ falsajn novaĵojn, ĝi generos tiajn informojn. Samtempe, ĉi tiuj modeloj devas esti amplekse retrejnitaj de homoj por eviti malprecizaĵojn, antaŭjuĝojn, falsajn novaĵojn kaj ofendajn kaj maltaŭgajn eligojn. Fine, la eligo dependas de la trejnaj datumoj, kaj kiam trejnaj tekstoj estas prenitaj el la interreto, ili povas enhavi ĉiajn malĝustajn informojn.

Babilrobotoj

[redakti | redakti fonton]

Vidu ankaŭ taksadon de babilrobotoj.

Inter la plej evolutiaj babilrobotoj estas ekzemple

[redakti | redakti fonton]
  • Bardo: babilroboto, transformita la 8-an de februaro 2024 al Gemini (lingvomodelo disvolvita de Google DeepMind en 2023): familio de multmodalaj gravaj lingvomodeloj
  • ChatGPT pasis en 2023 la teston de Turing, kiu estas testo por determini ĉu babilroboto aspektas tiel homa, ke ĝi por la uzanto estas nedistingebla de homa konversacipartnero.

Ekzistas ankaŭ babilrobotoj por iuj specifaj lingvoj

[redakti | redakti fonton]
  • GPT-NL, nederlanda iniciativo ankoraŭ sub disvolviĝo en 2025, celante krei lingvan modelon por la nederlanda lingvo kaj kunteksto: fidinda, travidebla, reciproka kaj suverena. Ĝi elektas altkvalitajn nederlandajn datumojn kaj uzas nur datumojn, kiujn oni akiris laŭleĝe. Krome, GTP-NL volas esti travidebla pri kiuj trejnadodatumoj ĝi uzas. GPT-NL estas la unua GLM-oj tutmonde, kiu pruveble plenumas la eŭropan privatecan leĝaron. Per GPT-NL, organizoj baldaŭ povos elekti respondecan alternativon al la GLM-oj, kiujn ili nuntempe uzas. Kontraste al aliaj grandaj lingvomodelo pri kiuj GPT-NL malfacile havas komprenon pri la datumoj por ĉi tiuj modeloj, oni suspektas, ke ili ĉefe implikas anglalingvajn tekstojn aŭ tradukitajn tekstojn. Rezulte, ĉi tiuj modeloj povas perdi nuancojn de la nederlanda lingvo kaj kulturo, kiuj estas necesaj por iuj aplikoj. GPT-NL krome volas helpi fortigi la ciferecan pozicion de Eŭropo certigante ke parto de la enspezoj refluas al kopirajtuloj kaj ke tiuj ricevu justan lokon en la teknologia disvolviĝo[6]. Tial GPT-NL intence ne estas tute sub malfermfonta permesilo. Per profesiaj licencoj, ĝi kreas spacon por permesi al posedantoj de datumaroj partopreni en la enspezoj. Tiel ĝi stimulas sanan provizoĉenon kaj daŭrigeblan ekosistemon por altkvalitaj datumoj, ene de juraj kadroj kaj subvenciaj postuloj. La kodo de GPT-NL ja estas malfermfonta kaj la publika parto de la uzitaj datumoj fariĝis malkaŝe havebla[7][8].

Esperanto

[redakti | redakti fonton]

La fakto ke artefaritaj lingvoj kiel Esperanto altiras limigitan komercan investon, reduktas instigojn disvolvi dediĉitajn ilojn kaj rimedojn [9]. Samtempe, Esperanto estas subtenata de aktivaj retaj komunumoj kaj konservas konsiderindan retan ĉeeston, kio kondukas al ĝia uzado en grandskalaj trejnaj korpusoj[10].

Referencoj

[redakti | redakti fonton]
  1. ↑ (en) Jurafsky, Dan, Martin, James H. (2023). Speech and Language Processing, 3rd, "N-gram Language Models". Alirdato: la 30-an de januaro 2023.
  2. ↑ Brown, Tom B. (Dec 2020). “Language Models are Few-Shot Learners”, Advances in Neural Information Processing Systems 33, p. 1877–1901. Alirita 2023-03-14..
  3. ↑ Fathallah, Nadeen, "NeOn-GPT: A Large Language Model-Powered Pipeline for Ontology Learning", Extended Semantic Web Conference 2024, 2024-05-26.
  4. ↑ (2022) “Human Language Understanding & Reasoning”, Daedalus 151 (2), p. 127–138. doi:10.1162/daed_a_01905. Alirita 2023-03-09..
  5. ↑ Ameya Nagarajan, Ne demandu al AI, demandu al samaĝulo: Kunlabora serio, Global Voices en Esperanto, la 14-an de majo 2026. Alirdato : la 14-an de majo 2026.
  6. ↑ (nl) Een verantwoord alternatief (Respondeca alternativo). GPT-NL, la 18-an de marto 2025. Alirdato: la 2-an de julio 2026.
  7. ↑ (en) Project goals, GPT-NL
  8. ↑ (nl) Hoe open gaat GPT-NL worden?, GPT-NL
  9. ↑ Occhini et al. (2026), Artificial intelligence is creating a new global linguistic hierarchy.arXiv preprint arXiv:2602.12018.Cited by: §1.
  10. ↑ (en) Open Machine Translation for Esperanto,License: CC BY 4.0, arXiv:2603.29345v1 [cs.CL] 31 Mar 2026

Vidu ankaŭ

[redakti | redakti fonton]