Tag: RAG

  • Lenkai meta iššūkį „Google“: jų DI modeliai jau lenkia pasaulio lyderius paieškoje

    Lenkai meta iššūkį „Google“: jų DI modeliai jau lenkia pasaulio lyderius paieškoje

    Lenkija spartina savo dirbtinio intelekto ekosistemos plėtrą ir pristato naują kalbinių modelių šeimą „PolDense“, skirtą tikslesnei informacijos paieškai dideliuose dokumentų rinkiniuose. Apie sprendimą paskelbė Ośrodek Przetwarzania Informacji, kurio AI Lab komanda modelius kūrė pirmiausia praktiniams naudojimo scenarijams, o ne vien demonstracijoms.

    „PolDense“ modeliai orientuoti į informacijos išgavimą, kai sistema pirmiausia suranda aktualiausius šaltinius, o tik tada generuoja atsakymą. Toks metodas ypač svarbus RAG architektūroje, kuri šiandien laikoma vienu efektyviausių būdų mažinti halucinacijų riziką ir kelti atsakymų patikimumą, kai dirbama su vidiniais dokumentais ar teisės aktais.

    Rezultatai viešame reitinge

    Pasak instituto, vienas „PolDense“ modelių pakilo į pirmą vietą viešame Polish Information Retrieval Benchmark (PIRB) reitinge ir aplenkė žinomus daugiakalbius sprendimus, naudojamus visame pasaulyje. Didžiausias šeimos modelis „PolDense 1B“ PIRB teste surinko 64,11 balo, nors kai kurie konkurentai yra gerokai didesni pagal parametrų skaičių.

    Modeliai gali analizuoti iki 8 192 tokenų ilgio tekstus, todėl geriau išlaiko kontekstą dirbdami su ilgais dokumentais. Praktikoje tai reiškia tikslesnį reikšmingų pastraipų ar faktų suradimą, o kartu ir stabilesnius atsakymus, kai užklausa remiasi dideliu kiekiu informacijos.

    Kur tai bus naudojama?

    „PolDense“ sukurti taip, kad tiktų paieškos sistemoms, pokalbių robotams, virtualiems asistentams ir įrankiams, kurie vartotojams atsako remdamiesi dokumentais. Šeimą sudaro šeši skirtingo dydžio modeliai, todėl juos galima diegti tiek galinguose serveriuose, tiek kuklesnėje infrastruktūroje, įskaitant mobiliuosius įrenginius.

    Toks universalumas svarbus organizacijoms, kurios nori turėti DI sprendimus savo aplinkoje, ypač kai būtina užtikrinti duomenų kontrolę. Pastaruoju metu Europoje ryškėja tendencija diegti lokaliai valdomus modelius, kad jautrūs dokumentai nebūtų siunčiami į išorines platformas.

    Atviras kodas ir europinės ambicijos

    Institutui pavaldus AI Lab pabrėžia, kad „PolDense“ išleisti kaip atvirojo kodo programinė įranga, todėl mokslininkai, įmonės ir viešasis sektorius gali juos naudoti be licencinių mokesčių. Tai gali paspartinti vietinių sprendimų kūrimą, ypač srityse, kur reikalinga paaiškinama paieška ir audituojami šaltiniai.

    „Modelių „PolDense“ paviešinimas yra dar vienas žingsnis kuriant Lenkijos kompetencijas dirbtinio intelekto srityje. Kuriame atviras technologijas, kurias mokslininkai, viešasis sektorius ir verslas gali panaudoti moderniems, efektyviems ir saugiems DI įrankiams“, – sakė Ośrodek Przetwarzania Informacji vadovas dr. hab. inž. Jarosław Protasiewicz.

    Taip pat pranešta, kad artimiausiais mėnesiais planuojama paskelbti „EuroDense“ modelį, kuris turėtų padėti informacijos paieškai devyniomis Europos kalbomis. Jei projektas pasiteisins, tai būtų dar vienas žingsnis stiprinant regioninius, daugiakalbius DI sprendimus, pritaikytus Europos kalbinei ir teisinei aplinkai.

  • Lenkijoje pristatyti 11 atvirų DI modelių PLLuM: tikslas – paprastesnė biurokratų kalba

    Lenkijoje pristatyta 11 naujų atvirų didžiųjų kalbos modelių (LLM) šeima PLLuM, skirta viešajam sektoriui, verslui ir gyventojams. Projektą vystantis HIVE konsorciumas pabrėžia, kad modeliai pritaikyti darbui su administracine kalba ir procedūromis, o dalis versijų turi papildomus saugumo filtrus.

    Modeliai pateikiami trimis kryptimis: bazine, instrukcine ir dialogine. Bazinė labiau skirta bandymams ir pritaikymui konkrečioms užduotims, instrukcinė – darbui su aiškiomis užduotimis ir dokumentais, o dialoginė sureguliuota taip, kad būtų saugiau naudoti galutiniams vartotojams.

    Kam skirti modeliai?

    Pasak projekto atstovų, PLLuM orientuojamas į praktiškas situacijas, su kuriomis kasdien susiduria institucijos: nuo prašymų ir atsakymų rengimo iki informacijos paieškos teisės aktuose ar vidinėse taisyklėse. Modeliai taip pat apmokyti generuoti ir suprasti daugiau nei 20 administracinių tekstų tipų, todėl gali padėti vienodinti ir supaprastinti rašytinę komunikaciją.

    Svarbi kryptis – biurokratinės kalbos aiškinimas paprastesniais žodžiais. Tokia funkcija aktuali ne tik gyventojams, bet ir pačioms įstaigoms, nes aiškesni dokumentai mažina klaidų riziką ir trumpina konsultacijų laiką.

    „Dėjome daug pastangų, kad modeliai gebėtų paaiškinti sudėtingas administracines procedūras ir supaprastinti urėdišką kalbą“, – sakė NASK Dirbtinio intelekto saugumo tyrimų centro vadovas Szymonas Łukasikas.

    Diegimai ir darbas su dokumentais

    Kūrėjai teigia, kad PLLuM geriau pritaikytas darbui su RAG principu, kai atsakymai formuojami remiantis pateiktais šaltiniais, pavyzdžiui, teisės aktais, gairėmis ar vidiniais dokumentais. Tokia architektūra mažina tikimybę, kad modelis atsakys „iš nuojautos“, ir padeda aiškiau pagrįsti pateikiamą informaciją.

    Lenkijos skaitmeninimo ministerijos atstovai nurodė, kad artimiausi diegimai numatomi birželį Skaitmeninimo ministerijoje ir Ministro Pirmininko kanceliarijoje. Tikimasi, kad DI įrankiai pagreitins pasikartojančias užduotis ir sumažins administracinį krūvį, ypač rengiant standartinius tekstus.

    „Norime, kad tai liktų atvira visiems, be ribojimų, kurie galėtų sulėtinti diegimus“, – sakė Lenkijos skaitmeninimo viceministras Dariusz Standerski.

    Dydžiai, saugumas ir kas toliau

    PLLuM modeliai pateikiami keliais dydžiais – nuo mažesnių, tinkamesnių ribotiems skaičiavimo resursams, iki didžiausio varianto, skirto sudėtingesnėms užduotims. Mažesni ir vidutiniai modeliai turi bazines, instrukcines ir dialogines versijas, o didžiausias modelis siūlomas instrukcine ir dialogine formomis.

    Dialoginėse versijose įdiegtos papildomos apsaugos, ribojančios žalingo turinio generavimą ir atsakymus į pavojingas užklausas. Tai atitinka bendrą ES kryptį, kur DI sistemoms keliami didesni skaidrumo, saugumo ir atsakomybės reikalavimai, ypač kai jos taikomos viešajame sektoriuje.

    Kūrėjai taip pat akcentuoja, kad vien sukurti modelį neužtenka: būtina nuolat atnaujinti jo žinias ir pritaikymą, kad atsakymai neatsiliktų nuo teisės aktų bei praktikos pokyčių. Kitas planuojamas žingsnis – nacionalinis vaizdinis modelis, kurio prototipai, pasak komandos, jau testuojami.

    PLLuM šeima buvo treniruota su maždaug 7 milijonais tekstų lenkų kalba, įskaitant viešus valstybės leidinius ir licencijuotus šaltinius. Projektą koordinuoja NASK, o konsorciume taip pat dalyvauja kelios valstybės IT ir mokslo institucijos bei universitetai.