Google опублікувала технічний звіт про безпеку своєї найновішої моделі штучного інтелекту Gemini 2.5 Pro лише через кілька тижнів після її запуску. Хоча така документація зазвичай слугує основою для незалежної оцінки ризиків, цей звіт викликав розчарування серед експертів. Експертам не сподобалося його обмеженість і відсутність глибоких висновків. Зокрема, звіт не містить конкретних даних про потенційні небезпеки або реальні сценарії зловживання новою моделлю.
Про це інформує Techcrunch.
Аналітики зауважують, що подібні звіти мають на меті підвищити прозорість і дати змогу громадськості та дослідникам оцінити відповідальність компаній. Однак у випадку з Google експерти вказують на те, що звіт не дозволяє дізнатися, чи справді компанія дотримується своїх зобов’язань із безпеки.
Деякі фахівці, зокрема Пітер Уайлдфорд з Інституту політики та стратегії ШІ, прямо звинувачують Google у недостатній відкритості. За його словами, без повної та своєчасної звітності неможливо перевірити, чи дотримується компанія стандартів, які вона сама встановила. До того ж, звіт з’явився із запізненням, уже після запуску Gemini 2.5 Pro.
Томас Вудсайд, співзасновник Secure AI Project, також висловив сумніви щодо систематичності підходу Google до безпеки. За його словами, попередній звіт про тестування ризикованих можливостей компанія оприлюднила ще в червні 2024 року — для моделі, яка вийшла в лютому. При цьому новіші моделі, зокрема щойно представлена компактна версія Gemini 2.5 Flash, взагалі поки що не мають відповідного звіту.
Сумніви щодо Frontier Safety Framework і безпекової практики
Окремо експертів занепокоїло, що Google у новому звіті не згадала власну ініціативу Frontier Safety Framework. Рамкову систему, покликану передбачати й попереджувати майбутні ризики від найпотужніших моделей ШІ. Ця ініціатива мала стати запобіжником проти потенційної шкоди від експериментальних технологій, однак у практичному плані її впровадження залишає більше запитань, ніж відповідей.
На цьому тлі Google опинилася серед кількох великих гравців ШІ-індустрії, яких звинувачують у зниженні стандартів безпеки. Наприклад, Meta також опублікувала доволі обмежену оцінку для своїх моделей Llama 4, а OpenAI взагалі утрималася від публікації звіту для GPT-4.1, що вже спричинило критику на її адресу.
Загальну ситуацію різко прокоментував Кевін Бенкстон з Центру демократії та технологій, який назвав таку тенденцію «перегонами до дна». За його словами, компанії скорочують час на тестування моделей і фактично нехтують глибиною перевірок, намагаючись якнайшвидше вивести свої продукти на ринок. Це загрожує як довірі користувачів, так і загальній безпеці нових технологій.
Попри критику, Google наполягає, що проводить внутрішнє тестування і залучає команди червоного аудиту до перевірки моделей перед їх публічним релізом. Водночас компанія визнає, що не всі ці процеси відображені в офіційних звітах, що знову-таки залишає поле для сумнівів у прозорості її дій.

