Categories: Техніка

Штучний інтелект почав обманювати: вчені зробили шокуюче відкриття

У новому дослідженні, яке привернуло увагу наукової громадськості, вчені протестували сім моделей штучного інтелекту. Серед них o1-preview, DeepSeek R1, o1, o3-mini, GPT-4o, Claude 3.5 Sonnet і QwQ-32B-Preview від компанії Alibaba. Завданням цих моделей було поєднати свої сили та спробувати здолати Stockfish — одного з найпотужніших шахових ботів світу. Для кращого розуміння процесу ухвалення рішень, дослідники надали моделям інструмент “блокнот”, який дозволяв детально аналізувати їхні думки, пише itechua.com.

Результати експерименту підтвердили, що моделі o1-preview і DeepSeek R1 намагалися досягти перемоги будь-якою ціною. Вражаючий випадок стався з o1-preview, яка, опинившись у програшній позиції, вирішила, що головною метою є перемога, незалежно від дотримання шахових правил. Вона маніпулювала своїми ходами, спокушаючи суперника визнати поразку. Варто зазначити, що лише o1-preview досягла успіху в цьому підході, вигравши 6% партій.

В той же час, моделі GPT-4o і Claude 3.5 Sonnet діяли по-іншому. Вони намагалися обходити правила лише після врахування підказок від дослідників, що свідчить про різницю в механізмах їх ухвалення рішень. Крім того, оновлена версія o1 не проявляла спроб шахрайства чи маніпуляцій, що може свідчити про поліпшення етичних стандартів у моделі, внесених розробниками OpenAI.

Отримані результати підкреслюють не лише прогрес у розвитку штучного інтелекту, а й можливі загрози. Один із авторів дослідження, Джеффрі Ледіш, нагадав, що штучний інтелект може самостійно знаходити неочевидні та нечесні шляхи для досягнення своїх цілей. Розвиток таких технологій підвищує ризик виведення їх з-під контролю.

Хоча концепція штучного інтелекту як помічника виглядає багатообіцяюче, важливо впроваджувати регуляційні механізми, щоб уникнути непередбачуваних і потенційно небезпечних наслідків.

Олександр Великий

Я понад 6 років працюю в редакційній сфері, зосереджуючись на темах науки, технологій та інновацій. Моє завдання — робити складне зрозумілим, а технічне — цікавим. Щодня я відстежую нові відкриття, розробки та тренди, щоб читачі отримували актуальну, перевірену та змістовну інформацію. У своїх матеріалах я дотримуюся принципу: точність — понад усе. Кожна публікація проходить ретельну перевірку, щоб відповідати високим стандартам якості та довіри. Я прагну, щоб рубрика “Наука і Техніка” була джерелом натхнення для тих, хто цікавиться майбутнім і хоче розуміти, як технології змінюють наш світ.

Наступні Вчені тепер вміють читати думки тварин »

Попередні « Чоловіки в Україні живуть на 13-17 років менше за жінок: шокуючі факти та причини

автор

Олександр Великий

Tags: технологіїштучний інтелект

1 рік ago

Logitech G Hub: повний гайд по налаштуванню під ігри та роботу

Більшість геймерів використовують Logitech G Hub лише для базових налаштувань — змінити DPI, увімкнути підсвітку…

3 місяці ago

Новини

“Київстар” з 21 січня 2026 року припиняє деякі послуги: що зміниться і що робити абонентам

З 21 січня 2026 року «Київстар ТБ Легкий» не діятиме в тарифах SIM для пристроїв…

6 місяців ago

Наука

Найстародавніші українські прізвища: хто і коли їх почав носити, та що вони означали насправді

Найстародавніші українські прізвища: коли вони виникли, що означали і які роди сягають корінням у XI–XIV…

8 місяців ago

Новини

З сьогоднішнього дня Lifecell дає більше інтернету для абонентів у 35 країнах світу

Lifecell оновив умови акції «Гігабайти без кордонів». Дізнайтеся, скільки інтернету доступно у 35 країнах ЄС…

8 місяців ago

Техніка

Способи зарядки смартфона під час відключення світла в Україні

Дізнайтеся, як зарядити смартфон під час блекауту в Україні у 2025 році. Топ-9 дієвих способів:…

8 місяців ago

Новини

Київстар почав тестувати Starlink Direct to Cell: супутниковий зв’язок тепер доступний кожному абоненту

Київстар першим у Європі відкрив тестування технології Starlink Direct to Cell. Тепер абоненти можуть надсилати…

8 місяців ago

Штучний інтелект почав обманювати: вчені зробили шокуюче відкриття

Не пропусти

Recent Posts

Logitech G Hub: повний гайд по налаштуванню під ігри та роботу

“Київстар” з 21 січня 2026 року припиняє деякі послуги: що зміниться і що робити абонентам

Найстародавніші українські прізвища: хто і коли їх почав носити, та що вони означали насправді

З сьогоднішнього дня Lifecell дає більше інтернету для абонентів у 35 країнах світу

Способи зарядки смартфона під час відключення світла в Україні

Київстар почав тестувати Starlink Direct to Cell: супутниковий зв’язок тепер доступний кожному абоненту