
Скоро след пускането на първия “логически” AI модел на OpenAI, наречен o1, потребителите забелязаха необичайно поведение. Моделът понякога започва да „мисли“ на китайски, персийски или друг език, независимо от това, че въпросът е зададен на английски и отговорът също е на английски.
Например, при въпрос като „Колко ‘R‘ има в думата ‘strawberry‘?“, o1 анализира проблема, преминавайки през серия от логически стъпки. Въпреки че крайният отговор е на английски, част от стъпките се извършват на китайски.
Един потребител в Reddit споделя: „[o1] изведнъж започна да мисли на китайски по средата на задачата.“ Друг потребител в X задава въпрос: „Защо [o1] случайно започна да мисли на китайски? Няма част от разговора дотук(5+ съобщения), която да е на китайски.“
OpenAI все още не е дала официално обяснение за това странно поведение. Специалисти в областта на изкуствения интелект обаче предлагат няколко хипотези:
Влияние от обучителните данни
Според Клеман Деланг, главен изпълнителен директор на Hugging Face, и Тед Шяо, изследовател в Google DeepMind, моделът o1 вероятно е обучен на множество данни, съдържащи китайски символи. Компании като OpenAI използват услуги за анотиране на данни от трети страни, които често се намират в Китай. Това обяснява защо модели като o1 понякога преминават към китайски, дори при въпроси зададени на английски.
Ефективност на езика
AI изследователят Матю Гуздиал предлага друга гледна точка. Според него моделите не разпознават различията между езиците и просто използват текстови шаблони, които намират за най-ефективни в дадена задача.
Подобна хипотеза излага и инженерът на Hugging Face Тиежен Уанг. Той твърди, че самите хора често използват различни езици в зависимост от контекста. Например, за него математиката е по-удобна на китайски заради кратките имена на цифрите, докато дискусиите за социални въпроси са по-естествени на английски, защото езика е по-развит в тази област. Според него подобен механизъм може да се наблюдава и при AI моделите.
Важно е да напомним, че AI моделите не обработват директно думи, а токени – единици, които могат да бъдат цели думи, срички или дори отделни символи. Понякога машината може би превключва между различни езици, за да даде отговора най-бързо и изразходвайки най-малко енергия. Това може да е начин да се намаляват огромните разходи, които OpenAI прави, за да може ИИ да работи.
Докато OpenAI не даде официално обяснение, оставаме да гадаем защо o1 „мисли“ на различни езици. Това явление подчертава сложността на съвременните AI модели и нуждата от по-голяма прозрачност в разработката им. Дали причината е в данните, токените или нещо по-дълбоко, остава въпрос, който вълнува както експертите, така и потребителите.
Използван е материал на Тechcrunch