AA adoptatzen duen edozein enpresaren kezka ulergarria: zer gertatzen da nire datuekin OpenAI, Anthropic edo Googleren hodeira bidaltzen ditudanean? Erantzuna erabiltzen duzun tresnaren, erabilera moduaren eta duzun konfigurazioaren araberakoa da.

Benetako arriskuak

Zure datuekin entrenamendua: lehenespenez, API batzuek erabiltzen zituzten (eta batzuek oraindik erabiltzen dituzte) bidaltzen dizkiezun datuak etorkizuneko modeloak entrenatzeko. Horrek esan nahi izan dezake zure enpresako informazioa beste erabiltzaileen erantzunetan ager daitekeela.

Datuen ihesak: hodei-zerbitzu ororen moduan, AA plataformek ihesak jasan ditzakete. Hornitzaile handiek segurtasun sendoa duten arren, zero arriskua ez da existitzen.

Hornitzailearen langileen sarbidea: zenbait kasutan, hornitzailearen langileek datuetara sartu daitezke arazo teknikoak konpontzeko. Politikak hornitzailearen arabera aldatzen dira.

RGPD betetzea: zure bezeroen datu pertsonalak EBtik kanpo prozesatzen badira, RGPD-ren baldintza zehatz batzuk bete behar dira.

Segurtasuneko oinarrizko jardunbideak

Ez bidali informazio konfidentzialik beharrik gabe: lehen printzipioa. Minimizatu IAri bidalitako datuak.

Anonimizatu ahal duzunean: izenak, zenbakiak, identifikatzaileak. Ordezkatu itzazu placeholder-ekin bidali aurretik eta berreskuratu ondoren.

Erabili SLAak dituzten API komertzialak: Claude, GPT eta Gemini-ren bertsio komertzialek zure datuak entrenamenduetarako ez erabiltzeko akordio esplizituak dituzte. Doako edo kontsumitzaileentzako bertsioek, oro har, berme gutxiago izaten dituzte.

Kontuan hartu auto-ostatatzea datu kritikoetarako: arauketa zorrotza duten sektoreetan (medikuntza, finantza, defentsa), azpiegitura propioko modeloek (Ollama eta LLaMA) datuak irteteko arriskua ezabatzen dute.

Auditatu logak: monitorizatu zer bidaltzen den APIetara eta nork. Ikusgarritasun hori gabe, ezin dituzu abusuak edo akatsak detektatu.

Hornitzaileak eta haien politikak

Anthropic (Claude): ez du API datuen erabiltzen entrenamendurako. Consumer bertsioak (Claude.ai) politika ezberdina du.

OpenAI (ChatGPT/GPT-4): ez ditu API datuak erabiltzen entrenamendurako 2023.tik. Consumer bertsioak datuak erabil ditzake konfigurazioaren arabera.

Google (Gemini): produktuaren arabera aldatzen diren politikak. Gemini Enterprise-k berme zorrotzagoak ditu.

Datu oso sentikorrak dituzten enpresentzat, BAI Marketing-en hibridoa gomendatzen dugu: erabilera orokorrerako SLA-dun API komertzialak, eta datu sentikorrentzat autohostatutako ereduak (LLaMA norberaren zerbitzarian).

Lotutako irakurgaiak