Български учен сред избраните от OpenAI: Проф. Мартин Вечев ще тества технология, която разпознава AI текстове
Българският учен проф. Мартин Вечев е сред ограничен кръг водещи изследователи, избрани от OpenAI да проучат и помогнат за усъвършенстването на нова технология за воден знак в текстове, генерирани от изкуствен интелект. Вечев е основател и научен директор на института INSAIT към Софийския университет, а участието му в инициативата е потвърдено и от самата OpenAI.
Технологията, наречена textGrain, вгражда невидим статистически сигнал в начина, по който моделът избира думи и части от думи при генерирането на текст. Сигналът не се вижда от читателя и не представлява скрити символи, необичайна пунктуация или невидими интервали. Специален детектор впоследствие може да провери дали в текста присъства воден знак, свързан с OpenAI.
Разликата спрямо традиционните AI детектори е съществена. Обичайните инструменти се опитват да отгатнат дали даден текст е генериран от изкуствен интелект по неговия стил и статистически характеристики. При textGrain идеята е в самия процес на генериране да бъде оставена проследима индикация за произхода на текста.
OpenAI обаче подчертава, че технологията все още има ограничения. Липсата на открит воден знак не означава непременно, че даден текст не е създаден от изкуствен интелект - той може да е генериран от неподдържан модел, да е създаден преди въвеждането на маркирането или да е променен по начин, който затруднява откриването.
Компанията започва постепенното въвеждане на текстовия воден знак за допустими ChatGPT и Codex изходи в Европейския съюз. За API клиентите технологията е достъпна като опция за определени модели, но не е включена по подразбиране.
Самият детектор все още не е публично достъпен. OpenAI предоставя достъп на ограничен кръг одобрени изследователи и експертни организации, които трябва да оценят надеждността, ограниченията и възможните начини за усъвършенстване на системата. Сред посочените от компанията учени са проф. Мартин Вечев, преподавателят от Cornell University Джон Тикстън и изследователи от Kempelen Institute of Intelligent Technologies.
Темата придобива особено значение заради европейските изисквания за прозрачност на AI съдържанието. Европейският акт за изкуствения интелект изисква доставчиците на системи, които генерират синтетичен текст, изображения, звук или видео, да осигурят машинно четимо маркиране и възможност съдържанието да бъде разпознавано като генерирано или манипулирано от изкуствен интелект.
За системи, пуснати на пазара преди 2 август 2026 г., европейските правила предвиждат преходен срок до 2 декември 2026 г. за изпълнение на това изискване. Именно затова технологиите за доказване на произхода на AI съдържанието се превръщат във все по-важна част от развитието на генеративните модели.
Участието на проф. Вечев поставя INSAIT и България сред изследователските центрове, които ще имат ранен достъп до технологията и ще могат да участват в оценката на нейното практическо приложение.
Добави Коментар