OpenAI розгортає невидиме маркування текстів ChatGPT, Codex і API
OpenAI оголосила про систему textGrain для виявлення текстів, створених її моделями. У найближчі тижні маркування з’явиться в окремих текстах ChatGPT і Codex у ЄС, а клієнти API зможуть добровільно ввімкнути його вже сьогодні.
OpenAI оголосила про систему невидимого маркування текстів textGrain, яка має допомагати визначати матеріали, згенеровані її моделями. Рішення представили в контексті вимог Закону ЄС про штучний інтелект щодо ідентифікації контенту, створеного ШІ.
Клієнти API по всьому світу зможуть добровільно ввімкнути маркування для окремих моделей від сьогодні. У ChatGPT і Codex OpenAI планує додати його до придатних текстових відповідей у Європейському Союзі протягом найближчих тижнів.
Як працює textGrain
textGrain додає до вибору слів невидимий статистичний сигнал. Окремий детектор шукає цей сигнал у тексті й оцінює, чи містить уривок водяний знак OpenAI.
Компанія відкрила подання заявок на доступ до детектора. Спочатку ним зможуть користуватися лише схвалені дослідники та експертні організації, які допомагатимуть оцінювати й удосконалювати технологію. OpenAI також планує опублікувати її у відкритому коді.
Обмеження виявлення
OpenAI попереджає про хибнопозитивні та хибнонегативні результати, особливо для коротких текстів і сфер із меншою свободою вибору слів, зокрема математики.
У тесті на уривках обсягом 400 токенів заміна 10% слів синонімами знизила показник виявлення приблизно з 92% до 66%, а заміна 25% — до 17%. Результати також можуть погіршуватися після редагування або перекладу.
Водяний знак не визначає внесок людини, право власності, відповідальність чи особу користувача і не підтверджує достовірність тексту. Відсутність виявленого маркування, за словами OpenAI, також не доводить, що текст написала людина.
Компанія заявила, що переглядатиме підхід у міру розвитку технологій, стандартів і доказової бази, зокрема вивчатиме, чи можна надійніше відрізняти допомогу ШІ від повністю машинного авторства.
Що ми знаємо
- OpenAI представила textGrain для статистичного маркування текстів, створених її моделями.
- Клієнти API можуть добровільно ввімкнути функцію для окремих моделей від сьогодні.
- У ChatGPT і Codex маркування спочатку діятиме лише для придатних текстів у ЄС.
- Заміна 25% слів синонімами знизила виявлення у тесті з 92% до 17%.
- Водяний знак не встановлює авторство людини, власника тексту чи особу користувача.
Довіра: Одне джерело
- Матеріал спирається на одного видавця. Другого незалежного підтвердження в наведених джерелах не встановлено.
- Наведено посилань: 1. Груп видавців: 1. Джерела: 9to5Mac.
- Моніторинг за останню годину: 37 із 37 RSS-джерел; доступні — 36, недоступні — 1. Пошук збігів охоплює опубліковані новини за останні 7 днів. Це не перевірка всього інтернету.
- Додаткове посилання додається лише після збігу заголовка, контексту, часу події та доступного тексту статті. Це автоматичний пошук пов’язаних повідомлень; незалежність і правдивість усіх тверджень не встановлюються.
Переглянути джерела1
COMMUNITY
Обговорення
Увійдіть, щоб долучитися до обговорення.

Коментарів ще немає. Почніть обговорення.