Claude-ийн бичсэн код бүрт үл үзэгдэх "усан хээ" суудаг боллоо: Anthropic бүх гаралтандаа Invisible Watermark нэвтрүүлэв
Хөгжүүлэгчдийн өдөр тутмын ажилд салшгүй хэсэг болсон хиймэл оюуны загварууд шинэ шатанд гарч байна. Anthropic компани өөрсдийн Claude загварын гэр бүл (Claude API, Claude Code, claude.ai болон AWS Bedrock, Google Cloud Vertex AI дээрх бүх хувилбар)-ийн үүсгэсэн бүх текст, файлуудад үл үзэгдэх усан хээ (invisible watermark) болон C2PA дижитал гарын үсэг суулгах шинэчлэлтийг дэлхий даяар бүрэн нэвтрүүлж эхэлснээ зарлалаа.
Энэхүү алхам нь Европын Холбооны EU AI Act-ийн 50-р заалтын (AI-аар үүсгэгдсэн контентыг машинд уншигдах хэлбэрээр тэмдэглэх үүрэг) хэрэгжилттэй холбоотой боловч зөвхөн Европт биш, дэлхий даяар бүх хэрэглэгчдэд шууд үйлчилж байгаагаараа хөгжүүлэгчдийн дунд том хэлэлцүүлэг өрнүүлээд байна.
Энгийн метадата биш: Моделийн түвшний усан хээ гэж юу вэ?
Өмнө нь ихэнх системүүд үүсгэсэн файл эсвэл текстийн төгсгөлд метадата хавсаргах, эсвэл харагдахгүй тусгай тэмдэгт (Zero-width Unicode) нэмэх замаар ажилладаг байсан. Гэвч энэ төрлийн тэмдэглэгээ нь кодыг засварлах, компиляци хийх, эсвэл өөр файлд хуулж тавихад (copy-paste) амархан арилдаг сул талтай байв.
Харин Anthropic-ийн нэвтрүүлж буй усан хээ нь Google DeepMind-ийн SynthID-Text судалгаанд суурилсан загварын түвшний статистик тэмдэглэгээ юм.
LLM текст болон код үүсгэхдээ дараагийн токенийг сонгох магадлалын тархалтаас (probability distribution) сонголт хийдэг. SynthID алгоритм нь энэ токен сонголтын явцад тусгай псевдо-санамсаргүй (pseudorandom) түлхүүр ашиглан хүний нүдэнд огт үл мэдэгдэх математик хэв маягийг суулгадаг.
Энэ нь дараах онцлогтой:
- Утга, логикт нөлөөлөхгүй: Кодын ажиллах зарчим, синтакс, чанарт ямар ч сөрөг өөрчлөлт орохгүй.
- Хуулж тавьсан ч үлдэнэ: Текстийг терминалаас IDE рүү copy-paste хийх, эсвэл файл хооронд шилжүүлэхэд статистик хээ хэвээр үлдэнэ.
- Хөнгөн засварыг тэсвэрлэнэ: Хувьсагчийн нэр солих, хэдэн мөр код нэмж хасах зэрэг өнгөц засварын дараа ч тусгай детектор ашиглан "Энэ текстийг Claude үүсгэсэн үү?" гэдгийг магадлалаар тодорхойлох боломжтой.
Үүнээс гадна Claude-ийн үүсгэсэн зураг, SVG зэрэг медиа файлуудад салбарын нээлттэй стандарт болох C2PA (Coalition for Content Provenance and Authenticity) криптограф метадатаг баталгаажуулан хавсаргаж байна.
Хөгжүүлэгчдэд энэ нь хэрхэн нөлөөлөх вэ?
Программ хангамжийн инженерийн түвшинд энэ нь хэд хэдэн практик асуудлыг дагуулж байна:
1. Claude Code болон CLI хэрэгслүүдийн гаралтууд
Хэрэв та терминал дээрээс Claude Code ашиглан шинэ микросервис бичүүлэх, тест код үүсгэх эсвэл рефакторинг хийлгэж байгаа бол тухайн файлуудад үл үзэгдэх усан хээ сууж эхэлнэ. Уг код Git repository-д орж, production дээр гарсан ч эх үүсвэр нь машин түвшинд илрэх боломжтой болж байна.
2. Байгууллагын IP болон Аудит
Томоохон байгууллагуудад "AI-аар бичигдсэн кодыг кодын санд оруулахгүй байх" эсвэл "Зөвхөн лицензийн дагуу ашиглах" дотоод дүрэм байдаг. Invisible watermark-ийн тусламжтайгаар CI/CD pipeline дээрээс PR (Pull Request) доторх кодын хэдэн хувийг LLM үүсгэснийг автоматаар илрүүлэх scanner-ууд гарч ирэх зам нээгдлээ.
3. Нээлттэй эх (Open Source) ба Лицензийн маргаан
AI-ийн үүсгэсэн кодын зохиогчийн эрх болон лицензийн асуудал дэлхий даяар бүрэн нэг мөр болоогүй байгаа үед тухайн код Claude-ийн оролцоотой бүтээгдсэн эсэхийг баримтжуулах баталгаатай нотолгоо бий болж байна.
"Watermark Wars" ба Open-Source хариу үйлдэл
Anthropic-ийн энэхүү мэдэгдлийн дараахан нээлттэй эхийн хамт олон хэдийнэ эсрэг хэрэгслүүдийг хөгжүүлж эхэллээ. GitHub дээр AI усан хээг арилгах зориулалттай скриптүүд гарч, текстийг өөр жижиг локал загвараар (Llama, Mistral г.м.) парафрэйз хийх замаар статистик тархалтыг "угаах" аргуудыг туршиж байна.
Гэвч мэргэжилтнүүдийн үзэж байгаагаар энэ нь хулгана муурны тоглоом бөгөөд OpenAI, Google зэрэг бүх том тоглогчид Европын хууль тогтоомжийн дагуу адилхан усан хээний стандартыг дагаж мөрдөх тул AI хэрэгслээр бүтээсэн кодын гарал үүслийг нуух боломж улам бүр хумигдах төлөвтэй байна.
Дүгнэлт
AI агент бидний өмнөөс систем бичдэг эрин үед "Энэ кодыг хэн бичсэн бэ?" гэдэг асуулт хоосон яриа байхаа больж, криптограф болон статистик түвшинд баталгаажсан бодит өгөгдөл боллоо. Хөгжүүлэгчдийн хувьд AI ашиглан код бичих нь нуух зүйл биш харин стандартын дагуу үр дүнтэй, хариуцлагатай удирдаж сурах шинэ соёл болж байна.
Эх сурвалж: Anthropic Engineering Blog, TechCrunch, EU AI Act Compliance Briefing
Сэтгэгдэл
Ачаалж байна...