Що сталося
South China Morning Post повідомляє, що дослідники з китайських університетів і технологічних компаній опублікували статтю, в якій описано п’ять етапів рекурсивного самовдосконалення, від виконання оновлень, розроблених людиною, до постійного вдосконалення методів, що використовуються для вдосконалення систем ШІ. Документ представляє це як напрямок дослідження, а не як демонстрований продукт.
South China Morning Post повідомляє, що дослідники з ByteDance, Університету Цінхуа, Шанхайської лабораторії штучного інтелекту та інших установ опублікували «The Last AI Built by Humans: Toward Genuine Recursive Self-Improvement». У документі визначено п’ять прогресивних етапів рекурсивного самовдосконалення, або RSI. Спочатку ШІ виконуватиме процедури вдосконалення, розроблені інженерами-людьми. Потім він вибере стратегії оновлення, визначить, яка інформація чи досвід йому потрібні, адаптує після розгортання та, зрештою, удосконалить методи, що використовуються для вдосконалення самого ШІ.
Звіт відрізняє RSI від чат-бота, який виправляє одну відповідь. Щоб удосконалення кваліфікувалося як RSI, зміна має тривати за межами одного завдання та бути успадкованою наступними системами. Дослідники стверджують, що автоматизація частин навчання, оцінювання та тонкого налаштування може скоротити цикли розробки та зменшити витрати на робочу силу та обчислення, але це твердження авторів, а не незалежно продемонстровані результати в наданому звіті.
У статті також описані відповідні зусилля китайських компаній. Повідомляється, що Z.ai планує спрямувати близько 60 відсотків доходів від раунду збору коштів у розмірі 5 мільярдів доларів США на моделі GLM наступного покоління та систему самонавчання. Повідомляється, що дослідники, пов’язані з MiniMax 2.7, описали оновлення пам’яті та експерименти з підкріпленням навчання, а DeepSeek, як повідомляється, розробив агентну систему для багатоетапних завдань, виконання коду та взаємодії із зовнішнім програмним забезпеченням. Ці приклади не підтверджують, що будь-яка компанія досягла остаточного етапу RSI паперу.
Чому це важливо
Автоматизація частин досліджень штучного інтелекту може вплинути на те, наскільки швидко та дешево розробники навчатимуть майбутні моделі, одночасно передаючи більше контролю над вдосконаленням моделей від людей до систем штучного інтелекту. Пропозиція також підкреслює головну проблему безпеки: системи, які змінюють власні процеси вдосконалення, можуть потребувати надійного тестування та контролю перед розгортанням. У звіті немає доказів того, що останні етапи досягнуті.
Якщо надійні, системи, які автоматизують частини досліджень штучного інтелекту, можуть стати конкурентною перевагою, дозволяючи розробникам проводити більше експериментів і вдосконалювати моделі з меншою кількістю безпосередньої людської праці. Це може вплинути на швидкість і вартість розробки базової моделі, хоча звіт не містить незалежних вимірювань цих ефектів.
Ця пропозиція також має наслідки для безпеки ШІ. Дослідники кажуть, що справжній RSI вимагатиме суворих заходів безпеки та перевірених середовищ тестування, щоб оновлення були безпечними та корисними перед розгортанням. Наданий звіт не підтверджує незалежну перевірку дорожньої карти, відповідних претензій компанії або ефективності будь-яких запропонованих заходів безпеки.
Інтерактивний механізм: як він насправді працює
Дослідіть технологію, що лежить в основі цієї розробки, в інтерактивному режимі.
crm_get_transaction(id='4092').Which component of an AI application is the machine-learning model itself?
Що дивитися далі
Стаття не містить розкладу для досягнення справжнього рекурсивного самовдосконалення. Немає задокументованого доступу до продукту, ціни чи загальної доступності. Ключові невідомі питання включають те, чи можуть запропоновані етапи надійно працювати поза розробкою програмного забезпечення, скільки обчислювальних ресурсів вони вимагають і чи можуть засоби захисту виявляти шкідливі або неефективні оновлення.
Дослідники не надають графіку для досягнення справжнього RSI, а South China Morning Post не повідомляє про робочу систему, яка досягла фінального етапу. Доступ до описаного дослідження не вказано, а ціна продукту чи загальна доступність не задокументовані.
Прогрес може суттєво відрізнятися залежно від сфери. Повідомляється, що автори вважають програмну інженерію більш чітким шляхом, тоді як робототехніка та наукові відкриття представляють складніші технічні проблеми. Доступність обчислень є ще одним обмеженням: у звіті цитується експерт, який каже, що американські компанії залишаються на кілька місяців попереду та мають більші обчислення для розгортання, тоді як китайські дослідники продовжують оптимізувати в умовах апаратних обмежень.
Майбутні звіти повинні визначати, чи заявлені системи самонавчання створюють стійкі, відтворювані покращення, як оцінюються оновлення та чи потрібне схвалення людини. У наданому джерелі не надано результатів незалежного тестування.