Manapság rengeteg mesterséges intelligencia (MI) által generált tartalom keletkezik, amit az is elősegít, hogy különböző modellek, mint például a ChatGPT, Claude vagy Gemini, széles körben elérhetők. Ebből adódóan egyre nagyobb szükség van olyan megoldásokra, amelyek képesek az ember és gép által generált tartalmak megkülönböztetésére. Míg angol nyelven már számos megoldás létezik, magyar nyelven egyelőre nem született igazán érdemi kutatás. A cikkben ezért kifejezetten magyar nyelvre készített és vizsgált modelleket mutatunk be az ember és MI által generált szövegek elkülönítésére. Magyar nyelvre finomhangolt enkóder modelleket használtunk, öt különböző modell teljesítményét összehasonlítva. A modellek hasonló F1 értéket értek el. A szavaztatás a publikus korpuszon nem javított, a heterogénebb kiegészített korpuszon viszont növelte az F1-pontszámot. Az eredményeket ipari detektorokkal is összevetettük, és azt találtuk, hogy a finomhangolt modellek több kereskedelmi megoldásnál is jobb teljesítményt nyújtanak, és csak egyetlen ipari detektor előzi meg őket.
- Címlap
- Publikációk
- Nagy nyelvi modellek által generált szövegek felismerése magyar nyelven