Математик Андреас Том запитує, чи можна довіряти OpenAI неопубліковану математику
У дописі від 9 вересня математик Андреас Том каже, що листування з OpenAI залишило відкритим ключове питання: чи може неопублікована математична робота, обговорена з ChatGPT, потрапити до навчальних даних.
Питання без відповіді
Математик Андреас Том опублікував коротку серію дописів, у якій стверджує, що OpenAI не дала відповіді на базове для робочих математиків питання: чи може неопубліковане дослідження, обговорене з її чатботом, бути використане компанією. Допис, датований 9 вересня і позначений автором як «1/3», з’явився в інстанції Mathstodon як відповідь іншому досліднику.
Том каже, що ці думки виникли в нього після ознайомлення з дискусією навколо заяви OpenAI про non-sofic групу, і що цей епізод нагадав йому листування з компанією після появи того результату.
Лист до Селке та Бубека
Невдовзі після несподіваного відкриття non-sofic групи, яке використовувало методи, розроблені Ґабором Куном і самим Томом, математик написав Марку Селке та Себастьяну Бубеку. Він і його колега з Дрездена протягом останніх місяців обговорювали задачу expander matching та розширення роботи з Ґабором Куном «активно ... з ChatGPT», писав він, тож вони, за його словами, «звісно, цікавилися, чи це було частиною навчальних даних або ж доступним процесу розв’язання».
Він додав: «Тут є певна (відверто кажучи, неприйнятна) відсутність прозорості; і я боюся, що це завдасть більшої шкоди спільному процесу математики, ніж нові результати, згенеровані ШІ, принесуть користі цій галузі». Повна відповідь Марка Селке, як наведено в дописі, була такою: «Щодо ваших розмов із ChatGPT: цього не було».
Два питання, одна відповідь
Том наголошує, що він чітко запитав про дві різні речі: по-перше, чи потрапили ці розмови до навчальних даних, і по-друге, чи були вони доступні процесу розв’язання. На його думку, категорична відповідь стосується лише прямого доступу в другому питанні; щодо першого не було жодного уточнення, пояснення чи доказів.
«Я вважаю це, м’яко кажучи, нечесністю», — пише він.
Що каже OpenAI тепер
У справі Buckmaster–Alpöge OpenAI заявляє, що доступу до конкретних даних користувачів не було, але додає, що «не може виключати, що деідентифіковані дані, отримані з їхнього використання наших продуктів, допомогли покращити наші моделі». Для Тома це залишає без відповіді саме те питання, яке важливе для дослідників: чи можна покладатися на те, що матеріал, поділений зі системою ШІ, залишиться неопублікованим.
SiTech — веброзробка з підтримкою AI
Створюємо швидкі та сучасні сайти й інтегруємо AI у бізнес-процеси. Маєте проєкт чи запитання? Із задоволенням допоможемо.