SlovakNews

Veda a technológie · Spojené štáty, EU

OpenAI plánuje v EÚ zaviesť neviditeľné textové vodoznaky pre ChatGPT a Codex

Štatistická značka sa bude pridávať do výstupov, ktoré v Európskej únii spĺňajú podmienky. Zákazníci API na celom svete si ju budú môcť zvoliť pri podporovaných modeloch. Prístup k detektoru OpenAI bude spočiatku obmedzený

Živé Verzia: 1Zdrojov: 6Perspektív: 1Aktualizované:
ENRead in English
Foto: TechCrunch · zdroj

Čo je nové

  • Výstupy spĺňajúce podmienky ChatGPTu a Codexu v EÚ dostanú neviditeľné vodoznaky.
  • Používatelia API kdekoľvek na svete si budú môcť pri podporovaných modeloch zapnúť označovanie vodoznakom.
  • Schválení výskumníci a odborné organizácie môžu požiadať o prístup k detektoru.
  • OpenAI plánuje vydať textGrain ako softvér s otvoreným zdrojovým kódom.

OpenAI 5. októbra 2026 oznámil, že má v úmysle vkladať do textov, ktoré spĺňajú podmienky a boli v EÚ vytvorené prostredníctvom ChatGPTu a Codexu voľným okom nepostrehnuteľné, strojovo čitateľné značky. Spoločnosť uviedla, že zmena sa bude týkať oprávnených používateľov v EÚ bez ohľadu na tarifu, označovanie vodoznakom však pri spustení nebude celosvetovo predvolené.123

Štatistický vzorec v slovách

Systém s názvom textGrain podľa OpenAI vkladá do vytvoreného textu štatistický signál tak, že nenápadne ovplyvňuje výber slov modelu. TechCrunch uviedol, že na usporiadanie možných nasledujúcich slov sa používa tajný kľúč. Detektor potom môže pomocou tohto kľúča preskúmať text a hľadať dôkazy o prítomnosti vzorca. Keďže signál nesú zvolené slová, môže sa zachovať aj po skopírovaní a vložení textu.13

OpenAI uviedol, že textGrain dosiahol rovnaké alebo lepšie výsledky ako iné metódy vrátane systému SynthID na text od spoločnosti Google DeepMind. The Verge informoval, že OpenAI zverejnil aj výsledky porovnávacích testov, podľa ktorých označené a neoznačené výstupy dosahovali porovnateľné výsledky. OpenAI napriek tomu upozornil, že táto metóda nedokáže zaručiť spoľahlivú detekciu.23

Podľa testov OpenAI je detekcia účinnejšia pri dlhších textoch. Pri stanovenej miere falošne pozitívnych výsledkov na úrovni 1 % detektor odhalil vodoznak približne v 80 % textov z oblasti psychológie s dĺžkou 200 tokenov a približne v 95 % textov so 400 tokenmi. OpenAI tiež uviedol, že krátke texty, matematické odpovede a preložené materiály sa identifikujú ťažšie.13

Úpravy môžu signál výrazne oslabiť. OpenAI pri teste textov so 400 tokenmi zistil, že po zmene 10 % slov klesla úspešnosť detekcie približne z 92 % na 66 % a po zmene 25 % slov na 17 %. OpenAI upozornil aj na to, že rozsiahlejšie prepisovanie a preklad môžu znížiť účinnosť detekcie.135

Obmedzený prístup k detekcii

Detektor nebude pri spustení verejne dostupný pre riziko prehliadnutých vodoznakov a falošne pozitívnych výsledkov. Schválení výskumníci a odborné organizácie môžu požiadať o prístup, ktorý sa bude spočiatku udeľovať individuálne. Nástroj oznámi, či našiel vodoznak OpenAI, neidentifikuje však používateľa ani nesprístupňuje zadania či konverzácie, uviedla spoločnosť.123

Pozitívny výsledok má obmedzenú výpovednú hodnotu. Podľa OpenAI môže ukázať, že niektorý z jeho systémov vytvoril alebo spracoval aspoň časť textu. Nedokáže však určiť, v akej miere sa na ňom podieľali ľudské úpravy, úsudok alebo tvorivá práca. Neprítomnosť signálu tiež „nedokazuje, že autorom je človek“. The Verge uviedol, že takéto značky nepotvrdzujú presnosť, vlastníctvo ani mieru ľudského vkladu.123

OpenAI umožní zákazníkom API na celom svete zapnúť si označovanie výstupov podporovaných modelov vodoznakom, pričom táto možnosť bude predvolene vypnutá. Spolupracuje aj s poskytovateľmi cloudových služieb, aby označené výstupy sprístupnili prostredníctvom svojich služieb. Spoločnosť plánuje zverejniť textGrain ako softvér s otvoreným zdrojovým kódom, podklady však neuvádzajú dátum vydania.1235

Európske pravidlá a širšia kontrola

Zavedenie systému nadväzuje na začiatok uplatňovania povinností podľa článku 50 aktu EÚ o umelej inteligencii 2. augusta 2026. Podľa citovaných opisov zákona musia poskytovatelia generatívnej umelej inteligencie označovať vytvorený obsah a zabezpečiť, aby ho systémy dokázali rozpoznať ako obsah vytvorený umelou inteligenciou. OpenAI patrí medzi spoločnosti, ktoré sa zaviazali dodržiavať kódex Európskej únie pre obsah vytvorený umelou inteligenciou.134

Na podobných systémoch pracovali aj ďalší poskytovatelia. Článok na platforme arXiv 9. septembra informoval, že modely Claude vydané po 2. auguste predvolene vkladajú SynthID-Text bez možnosti vypnutia. V článku sa tiež uvádza, že Google používa SynthID-Text v Gemini od roku 2024. TechCrunch informoval, že riešenie spoločnosti Anthropic sa používa na celom svete, na rozdiel od predvoleného zavádzania OpenAI zameraného na EÚ.14

Autori článku na platforme arXiv tvrdili, že dôležité tvrdenia dodávateľov ani námietky používateľov sa v súčasnosti nedajú nezávisle overiť, čiastočne preto, že nasadené detektory nie sú verejné. Autori vyhodnotili verziu SynthID-Text s otvoreným zdrojovým kódom na dvoch modeloch s otvorenými váhami a vyzvali na certifikované audity, štandardizované testovanie, kompatibilné detektory a zverejňovanie nastavení vodoznakov. Za hlavný problém pri regulácii označili nemožnosť overovať tvrdenia, nie samotné označovanie vodoznakom.4

Prečo na tom záleží

Ako prvých sa plán OpenAI na automatické označovanie textu bude týkať ľudí v EÚ, ktorí používajú služby ChatGPTu a Codexu spĺňajúce podmienky. Signály o pôvode sa tak stanú súčasťou bežných vytvorených výstupov. Systém môže oprávneným vyšetrovateľom pomôcť identifikovať niektoré texty spracované OpenAI, úpravy však môžu znížiť úspešnosť detekcie a vodoznak nedokáže určiť autorstvo, presnosť ani rozsah ľudskej práce.123

Videá

Breaking: OpenAI Watermarks Europe's AI Text – A Few Edits Erase It · AI Security Dispatch
OpenAI adds optional invisible watermarks #Shorts · UXCentury
Your AI Essay Has a Secret Signature #Shorts · Name of the Game

Súvisiace príbehy

História verzií

  1. verzia 1 ·