Open Assistant je projekat koji ima za cilj da svima pruži pristup odličnom modelu velikog jezika zasnovanom na chatu.
Nedavno je LAION zajednica (Otvorena mreža velike umjetne inteligencije) predstavljena kroz najavu prvo izdanje projekta «OpenAssistant»., koji razvija chatbot sa umjetnom inteligencijom koji je sposoban razumjeti i odgovoriti na pitanja na prirodnom jeziku, komunicirati sa sistemima trećih strana i dinamički izvlačiti potrebne informacije.
Za one koji nisu upoznati sa LAION-om, trebali biste znati da razvija alate, modele i zbirke podataka za kreiranje besplatnih sistema za strojno učenje (na primjer, kolekcija LAION se koristi za obuku modela sistema za sintezu slike Stable Diffusion).
Osim kod za obuku i organizaciju rada bota na vašem računaru, predlaže se korištenje kolekcije gotovih modela koristiti već obučeni i jezički model, obučen na osnovu 600 hiljada primjera dijaloga u formi zahtjev-odgovor (instrukcija-izvršenje), pripremljenih i revidiranih uz učešće zajednice entuzijasta.
Pokrenut je i online servis za procjenu kvaliteta chat bota, koristeći model znanja OA_SFT_Llama_30B_6, koji pokriva 30 milijardi parametara.
Naš tim je neumorno radio u proteklih nekoliko mjeseci prikupljajući ogromne količine informacija i povratnih informacija zasnovanih na tekstu kako bi stvorio nevjerovatno raznolik i jedinstven skup podataka posebno dizajniran za obuku jezičkih modela ili drugih AI aplikacija.
Sa više od 600 podataka koje su generisali ljudi koji pokrivaju širok spektar tema i stilova pisanja, naš skup podataka će se pokazati kao neprocenjiv alat za svakog programera koji želi da kreira nastavne modele sledeće generacije.
Za povećanje efikasnosti sistema i izbjeći potrebu da pohraniti velike količine unaprijed postavljenih parametara, projekt predviđa mogućnost korištenja dinamički ažurirane baze znanja koja može doći do traženih informacija putem pretraživača ili eksternih servisa.
Na primjer, kada generira odgovore, bot može pristupiti vanjskim API-jima kako bi dobio dodatne podatke. Od naprednih funkcija ističe se i podrška za personalizaciju, odnosno mogućnost prilagođavanja određenom korisniku na osnovu njegovih prethodnih fraza.
Za one koji su zainteresirani za instalaciju OpenAssistant-a, trebali biste znati da ga možete instalirati lokalno i da su kandidati za Pythia SFT modeli dostupni sa HuggingFace-a i mogu se učitati putem HuggingFace Transformers biblioteke. Kao takvi, moguće je da se mogu koristiti sa dovoljno hardvera. Postoje i prostori na HF-u koji se mogu koristiti za ćaskanje sa OA kandidatom bez vašeg vlastitog hardvera. Međutim, ovi modeli nisu konačni i mogu proizvesti loše ili neželjene rezultate.
LLaMa SFT modeli ne mogu biti objavljeni direktno zbog Meta licence, ali XOR težine će biti puštene uskoro.
Važno je napomenuti da trenutni najmanji model (Pythia) ima 12B parametara i teško ga je pokrenuti na potrošačkom hardveru, ali može raditi na jednom profesionalnom GPU-u. Možda će postojati manji modeli u budućnosti, a nadamo se da ćemo unaprijediti metode poput cjelobrojne kvantizacije koje mogu pomoći u pokretanju modela na manjem hardveru.
Projekat ne planira da se zaustavi na ponavljanju mogućnosti ChatGPT-a. Očekuje se da će Open-Assistant podstaći razvoj otvorenog razvoja u oblasti generisanja sadržaja i obrade upita na prirodnim jezicima, kao što je projekat otvorenog koda Stable Diffusion stimulisao razvoj alata za generisanje slika.
Kod projekta je napisan u Python-u i distribuira se pod licencom Apache 2.0. OpenAssistant razvoji se mogu koristiti za kreiranje vlastitih inteligentnih pomoćnika i dijaloških sistema koji nisu vezani za eksterne API-je i usluge. Konvencionalni potrošački hardver je dovoljan za rad, na primjer, moguće je raditi na pametnom telefonu. Podaci Open Assistant-a objavljeni su pod Creative Commons licencom koja omogućava širok spektar upotreba, uključujući komercijalnu upotrebu.
Konačno, ako ste zainteresirani da saznate više o tome, kao i da konsultujete izvorni kod, možete pogledati detalje Na sledećem linku.