Rendszeres olvasók

2026. augusztus 31., hétfő

Árulkodó nyomok az MI használatáról: vízjelek, címkék, eredetigazolás - és az új európai átláthatósági rend

 

2026 augusztusában az Anthropic bejelentése tette igazán kézzelfoghatóvá azt a változást, amelyre az európai MI-szabályozás már korábban kijelölte az irányt. A jövőbeni Claude-modellek szövegei olyan láthatatlan digitális vízjelet (invisible digital watermark) hordoznak, amelyet az olvasó nem érzékel, megfelelő technikai eszközzel azonban statisztikailag kimutatható. Nem rejtett karakterek kerülnek a mondatokba, és nem valamilyen titkos azonosító kapcsolódik a felhasználóhoz. A jel magában a nyelvi generálás folyamatában keletkezik. Az Anthropic ezzel kifejezetten az EU MI-rendelet 50. cikkének 2026. augusztus 2-től alkalmazandó követelményeire reagált.

A változás jelentőségét könnyű félreérteni. Az Európai Unió ugyanis nem egyszerűen azt rendelte el, hogy minden MI-vel készült tartalom mellett jelenjen meg egy „AI generated” felirat. Az 50. cikk két egymástól lényegesen eltérő átláthatósági réteget hozott létre: a szolgáltatóknak egy technikai eredetjelző rendszert kell biztosítaniuk, míg bizonyos esetekben az MI-rendszert használó szervezeteknek, vagyis az alkalmazóknak (deployers) az emberek számára is érthetően közölniük kell az MI közreműködését. E kettő elválasztása különösen fontos a közérdekű tájékoztatásban, az oktatásban és a tudományos kommunikációban.

Mit követel valójában az 50. cikk?

Az 50. cikk (2) bekezdése szerint a szintetikus hangot, képet, videót vagy szöveget generáló MI-rendszerek szolgáltatóinak – ideértve az általános célú MI-rendszereket is – biztosítaniuk kell, hogy a rendszer kimenete géppel olvasható formátumban jelölt (machine-readable marking) és mesterségesen generáltként, vagy manipuláltként felismerhető legyen. Ennél is fontosabb a következő mondat: a technikai megoldásoknak a technika állásához mérten hatékonynak, interoperábilisnak, robusztusnak és megbízhatónak (effective, interoperable, robust and reliable) kell lenniük. A rendelet figyelembe engedi venni az egyes tartalomtípusok sajátosságait, a technikai korlátokat és a megvalósítás költségeit.

Ez tehát elsősorban szolgáltatói kötelezettség. Nem az iskola, az egyetem, az újságíró vagy egy kutató feladata saját vízjelezési algoritmust fejleszteni. Az ilyen funkciót már a generatív rendszernek kell biztosítania.

Fontos az is, hogy a szabály nem terjed ki minden MI-segítségre. A rendelet kivételt enged, ha a rendszer pusztán szokásos szerkesztési funkciót (standard editing) lát el, illetve nem változtatja meg lényegesen a felhasználó által megadott bemenetet vagy annak szemantikáját. A Bizottság 2026-os iránymutatása tovább pontosította a határt: például rövid szám- és karaktersorok, forráskód, tisztán gép–gép kommunikációra szolgáló kimenetek, valamint egyes zárt ipari folyamatok is kieshetnek a jelölési kötelezettségből.

Van még egy lényeges időbeli különbség. Az 50. cikk 2026. augusztus 2-től alkalmazandó, az e dátum előtt forgalomba hozott rendszerek szolgáltatói azonban az 50. cikk (2) szerinti technikai jelölést 2026. december 2-ig vezethetik be (grace period). Ez magyarázza azt is, hogy 2026 augusztusának végén még nem minden szolgáltatónál látunk azonos technikai megoldást.

A Bizottság időközben az 50. cikkhez külön gyakorlati kódexet (Code of Practice on Transparency of AI-Generated Content) és részletes iránymutatást is elkészített. A kódexhez való csatlakozás önkéntes, maga az 50. cikk viszont kötelező. A Bizottság és az AI Board a kódexet megfelelő megfelelési eszköznek minősítette; 2026 júliusának végére mintegy 190 szervezet csatlakozott hozzá.

Claude: a vízjel magába a nyelvbe kerül

A szöveg jelölése informatikailag sokkal nehezebb probléma, mint egy képé. Egy JPEG-fájlhoz lehet metaadatokat csatolni, illetve a pixelekbe szabad szemmel láthatatlan jelet kódolni. A szöveg azonban kimásolható egy másik dokumentumba, újratördelhető, PDF-be exportálható vagy egyszerűen újragépelhető. A fájlmetaadat ebben a pillanatban elveszne.

Az Anthropic ezért a Google DeepMind által kidolgozott SynthID-Text egyik változatát alkalmazza. Egy nagy nyelvi modell minden új token előállításakor több lehetséges folytatás között választ. Sokszor több, jelentésében és minőségében egyaránt elfogadható szó áll rendelkezésre. A Claude vízjelezése ezeknél a „kis tétű” választásoknál avatkozik be: egy titkos kulcs és az előző szövegrész alapján finoman módosítja azt, miként történik a következő token kiválasztása. Sok ilyen döntés együtt statisztikai mintázatot hoz létre. Az olvasó ebből semmit nem lát, a kulcsot ismerő detektor viszont meg tudja becsülni annak valószínűségét, hogy a szöveg létrehozásában Claude vett részt.

Ez nem klasszikus rejtett karakteres vízjel, és nem plusz adatmező. Éppen ezért a Wordbe másolás vagy PDF-be exportálás önmagában nem tünteti el: amíg a szavak megmaradnak, a statisztikai minta is megmaradhat. Erőteljes átírás, parafrázis vagy teljes újrafogalmazás viszont fokozatosan lerombolja, ahogy a fordítás-visszafordítás is. Rövid szövegeknél eleve kevés adat áll rendelkezésre, szigorúan tényszerű mondatoknál pedig kevés szabadsága van a modellnek a szóválasztásra. Ugyanezért gyengébb a jel egyszerű korrektúránál és a pontos szintaxist követelő programkódnál. Az Anthropic készül egy vízjeldetektáló API-val (watermark detection API), de a jel önmagában még ekkor sem fogja bizonyítani a szerzőséget: legfeljebb azt, hogy Claude valószínűleg részt vett a szöveg előállításában vagy jelentősebb átdolgozásában.

Ez az oktatás és a tudomány szempontjából alapvető különbség. A vízjel nem azt mondja, hogy „ezt nem a tanuló/hallgató írta”, és azt sem, hogy „a gondolatot az MI alkotta”. Eredetre vagy közreműködésre utaló technikai jel, nem szerzőségi ítélet. Arra azonban mindenképpen alkalmas, hogy az elkészült szöveg egyéni-eredeti, emberhez kötődő jellegét kérdésessé tegye – a tudományban pedig, ahol nem elég tisztességesnek lenni, de mindig tisztességesnek kell látszani, ez talán a legrosszabb, ami a szerzőkkel történhet.

Képnél más a technika: SynthID és C2PA

A képek esetében jelenleg egyre inkább többrétegű eredetigazolás (multi-layered provenance) válik iparági mintává. Ennek egyik rétege maga a tartalomba ágyazott láthatatlan vízjel. A Google SynthID technológiája képekben, videókban, hangban és szövegben egyaránt használható. Képeknél a jel a pixelekbe kerül úgy, hogy ne legyen érzékelhető, ugyanakkor bizonyos mértékben túlélje például a tömörítést, vágást vagy színmódosítást.

A másik réteg a C2PA Content Credentials, vagyis kriptográfiailag igazolható származási metaadat. A C2PA-manifeszt állításokat tartalmazhat arról, milyen eszköz hozta létre a fájlt, milyen műveleteket végeztek rajta, és milyen korábbi tartalmakból épült fel. A manifesztet digitális aláírás védi, a tartalomhoz pedig kriptográfiai kötés kapcsolja. Így az ellenőrző program meg tudja állapítani, hogy a származási állításokat ki írta alá, és változtak-e azóta.

A C2PA azonban nem ugyanaz, mint a vízjel. A metaadat részletesebb információt hordozhat, viszont fájlkonverzió, közösségi platform vagy képernyőkép eltávolíthatja. Egy közvetlenül a pixelekbe kódolt vízjel kevésbé informatív, viszont ellenállóbb lehet. Emiatt a két módszer együtt erősebb.

Pontosan ebbe az irányba mozdult az OpenAI is. 2026 májusától a támogatott OpenAI-képek esetében a C2PA Content Credentials mellett Google SynthID-vízjel is megjelent, július 31-től pedig támogatott hangkimenetekre is kiterjesztették a SynthID használatát. Az OpenAI nyilvános ellenőrző eszközt és ellenőrző API-t is kialakít. A jelenlegi hivatalos dokumentáció ugyanakkor képet és hangot nevez meg; szöveghez alkalmazott, élesben működő vízjelezési eljárást nem ismertet. Ez nem jelenti azt, hogy ilyen megoldás ne készülne, és a 2026. december 2-ig tartó átmeneti időszakot is rendszerre lebontva kell értékelni.

A Microsoft ugyancsak kombinálja a módszereket. A Microsoft 365 MI-vel létrehozott képeihez, videóihoz és hangjaihoz metaadat kapcsolható, bizonyos környezetekben pedig látható „AI-generated” vagy Copilot-vízjel is bekapcsolható. A Paint Cocreator képei C2PA-manifesztet tartalmaznak, a Microsoft Foundry pedig támogatott modelleknél már láthatatlan vízjelet és kriptográfiailag aláírt C2PA-adatokat együttesen alkalmaz.

A Meta eközben részben már a következő láncszemet építi: Facebookon és Instagramon a rendszer képes felismerni például C2PA- és más iparági jeleket, majd ezekből felhasználónak szóló címkét létrehozni. Vagyis a technikai eredetjelző jelből platformszintű kommunikáció születhet. A Meta 2026 júliusában az uniós átláthatósági kódexhez is csatlakozott.

A legfontosabb jogi különbség: a technikai jel még nem látható tájékoztatás

Az 50. cikk (2) és (4) bekezdésének szétválasztása itt válik igazán fontossá. Minden, hatály alá tartozó generált szövegnél és képnél szolgáltatói oldalon fennállhat a géppel olvasható jelölési kötelezettség, de ebből nem következik, hogy minden MI-vel készült szöveg vagy kép mellé az intézménynek látható „MI-generált” feliratot kell tennie.

A felhasználói oldali, ember számára érzékelhető közzététel jóval szűkebb. Kép, hang és videó esetén az 50. cikk (4) kifejezetten a deepfake-ekre ír elő tájékoztatást. Egy mesterséges intelligenciával rajzolt sematikus iskolai illusztráció tehát önmagában nem válik deepfake-ké. Ha azonban létező személyt, eseményt vagy helyszínt oly módon imitál, hogy az hitelesnek tűnhet, más a helyzet. A Bizottság egyértelműen hangsúlyozza: ilyen esetben a szolgáltató által beágyazott gépi vízjel nem helyettesíti az ember számára látható vagy hallható tájékoztatást.

Szövegnél a határ még érdekesebb. Látható közlés akkor szükséges, ha az MI által generált vagy manipulált szöveget a nyilvánosság tájékoztatása céljából, közérdekű ügyben teszik közzé. A Bizottság ide sorolja többek között a politikai, közigazgatási, közegészségügyi, környezetvédelmi, gazdasági, tudományos és kulturális fejleményeket, amennyiben azok a nyilvános vita releváns tárgyai.

Van azonban egy nagyon jelentős kivétel. Nem szükséges az 50. cikk (4) szerinti MI-címke, ha a szöveg érdemi emberi felülvizsgálaton vagy szerkesztői ellenőrzésen ment keresztül, és természetes vagy jogi személy szerkesztői felelősséget visel érte. A Bizottság még az akadémiai szakértői lektorálást (academic peer review) is kifejezetten az érdemi emberi kontroll példájaként említi. A puszta helyesírás-ellenőrzés vagy formális korrektúra viszont nem elég.

Mit változtat mindez az iskolában, az egyetemen és a tudományban?

A közoktatásban mindebből nem következik az, hogy 2026. augusztus 2-től minden MI-vel készült feladatlapot, prezentációt vagy tanári háttéranyagot kötelező „MI-generált” felirattal ellátni. A szolgáltatói technikai jelölés ettől függetlenül jelen lehet a fájlban vagy a szövegben. A tanulói dolgozatokra sem keletkezik automatikusan uniós „MI-címkézési” kötelezettség, hiszen ezek rendszerint nem a nyilvánosság közérdekű tájékoztatására közzétett szövegek. Az iskolai tanulmányi és etikai szabályok természetesen ennél szigorúbb MI-használati nyilatkozatot követelhetnek.

Más a helyzet egy iskola honlapján automatikusan publikált, közérdekű tájékoztatóval, például egészségügyi, gyermekvédelmi, felvételi vagy intézményi szabályokat ismertető szöveggel. Ha ezt lényegében az MI állítja elő és nincs valódi emberi szerkesztői kontroll, az 50. cikk (4) már releváns lehet. Ha viszont egy felelős munkatárs tartalmilag ellenőrzi, javítja, jóváhagyja és az intézmény felelősséget vállal érte, működésbe léphet a kivétel.

A felsőoktatásban még fontosabb lesz különválasztani az MI használatának technikai kimutathatóságát az akadémiai szerzőség kérdésétől. Egy Claude-vízjel például jelezheti, hogy a szövegen a rendszer dolgozott, de önmagában nem mutatja meg, ki fogalmazta meg az érvelést, milyen mértékű volt az MI közreműködése, vagy megsértett-e a hallgató bármilyen szabályt. Ezért a vízjel-detektálás nem válhat egyszerűen a mai, sokat vitatott „MI detektorok” új változatává. Az Anthropic maga figyelmeztet arra, hogy a jel közreműködést, nem szerzőséget bizonyít; rövid szövegben ráadásul még bizonytalanabb lehet.

A tudományos kutatásban pedig különösen érdekes következmény áll elő. Egy MI-vel részben készített tudományos szöveg technikai vízjele megmaradhat, miközben az EU MI-rendelete alapján látható AI-címke egyáltalán nem feltétlenül szükséges, ha a tanulmány érdemi szakmai ellenőrzésen, lektoráláson és felelős szerkesztésen ment keresztül. Ettől persze a kiadói gyakorlat, a folyóirat, az egyetem, a kutatásfinanszírozó vagy a szakmai etikai szabályzat továbbra is előírhatja (és a nemzetközi tudományos kiadók világában elő is írja) az MI használatának részletes feltüntetését. Az EU MI-rendelet minimumszabály, nem az akadémiai szerzőség teljes szabályozása.

Ugyanez igaz a közcélú tájékoztatásra. Minden MI-vel megérintett mondatra a jövőben sem kell figyelmeztető címkét kell ragasztani. Sokkal mélyebb infrastruktúraváltás kezdődött: a digitális tartalom egyre gyakrabban hordozhat eredetinformációt (provenance information), és a platformok, keresők, kiadói rendszerek vagy intézményi informatikai eszközök ezt automatikusan értelmezhetik. A jövőben tehát egy kép vagy szöveg „származása” részben géppel ellenőrizhető tulajdonsággá válhat.

Ez azonban csak akkor működik jól, ha nem tévesztjük össze az eredetet, az MI-közreműködést, a szerzőséget és a megbízhatóságot. Egy C2PA-aláírás nem bizonyítja, hogy a kép igaz, egy vízjel sem, hogy a szöveg hamis. Egy Claude-jel vagy Gemini jel nem bizonyítja, hogy nem az ember gondolkodott. Az új technikai infrastruktúra arra ad egyre jobb választ, hogy milyen eszköz vett részt a tartalom létrehozásában. Arra, hogy a tartalom igaz-e, szakmailag helyes-e, ki a szerzője és ki vállal érte felelősséget, továbbra is embereknek és intézményeknek kell válaszolniuk. Éppen ezért az EU új rendszere akkor lesz valóban hasznos, ha a vízjel nem a gyanú bélyegévé, hanem a digitális eredet átlátható jelzésévé (transparent content provenance) válik.

A súlypontok áttevődnek

A technikai jelölés terjedésével egyre világosabbá válik, hogy az MI-használat átláthatóságának kérdése nem oldható meg pusztán vízjelekkel, metaadatokkal és detektálási eljárásokkal. Felértékelődik az intézményi és kiadói szabályozás (institutional and publishing governance) szerepe: annak pontos meghatározása, hogy egy adott közegben mire használható az MI, milyen közreműködést kell feltüntetni, mely alkalmazások megengedettek, és melyek minősülnek etikátlannak. A nagy nemzetközi tudományos kiadók erre részletes szerzői, szerkesztői és lektori előírásokkal válaszoltak, miközben a magyar tudományos kiadói gyakorlat jelentős részében ez a szabályozási réteg továbbra is hiányzik vagy esetleges.

A felsőoktatásban az egyetemi szabályzatok egyre gyakrabban rendezik az MI használatának megengedett és tiltott formáit, a közoktatásban azonban jóval nagyobb a lemaradás. Az általános és középiskolák többségében ma még nincs olyan intézményi MI-szabályzat, amely világosan rögzítené, hogy a pedagógus és a tanuló milyen feladatoknál, milyen feltételekkel és milyen jelölési kötelezettség mellett használhat generatív rendszereket. A szakképzés egyes területein az MI oktatása már korlátozottan megjelent, és ehhez mintaszabályozási megoldások is társultak, ez azonban még nem vált a teljes közoktatási rendszer általános gyakorlatává. Pedig éppen az iskolában lenne különösen fontos, hogy a tanuló ne pusztán azt tanulja meg, hogyan lehet MI-t használni, hanem azt is, mikor szabad, mikor nem szabad, hogyan kell a használatot feltüntetni, és hol húzódik a segítség és a megtévesztés határa.

A döntő kérdés ezért itt sem egyszerűen az etikai alapelvek deklarálása. Önmagában kevés egy olyan szabály, amely kimondja, hogy az MI-t „felelősen” vagy „etikusan” kell használni. Ehhez olyan intézményi kultúrára (institutional culture) és működő feltételrendszerre van szükség, amelyben pedagógusok, diákok, hallgatók, kutatók, szerkesztők és intézményvezetők képzés keretében sajátítják el az etikus, átlátható és jelölt MI-használat (ethical, transparent and disclosed AI use) gyakorlatát. Ugyanilyen világosnak kell lennie annak is, mi történik akkor, ha valaki ettől eltér: mikor beszélünk szabálytalan segítségnyújtásról, mikor megtévesztésről, mikor sérül a tudományos vagy tanulmányi integritás, és ezekhez milyen előre ismert következmények kapcsolódnak.

A technikai vízjelek és eredetjelzők ebben fontos, de korlátozott szerepet töltenek be. Jelezhetik, hogy egy MI-rendszer részt vett egy szöveg vagy kép létrehozásában, de nem mondják meg, hogyan, milyen mértékben és milyen célból történt a közreműködés. Erről továbbra is a szerzőnek, hallgatónak, diáknak, pedagógusnak vagy kutatónak kell a helyi szabályok szerint számot adnia. A jövő kulcsa ezért nem önmagában a detektálás, hanem az oktatás, az ellenőrizhetőség, a világos felelősségi rend, az egységes intézményi eljárások és az előre ismert következmények együttes kialakítása lehet.

Nincsenek megjegyzések:

Megjegyzés küldése

PISA-sokk után, nagy változások előtt: a mesterséges intelligencia jelene és jövője a közoktatás gyakorlatában

  A 2025-ös PISA-vizsgálat Németországban is sokkolta a társadalmat: eredményeit Karin Prien szövetségi oktatási, családügyi, idősügyi, nő...