Фінансові новини
- |
- 11.01.26
- |
- 18:33
- |
-
RSS - |
- мапа сайту
Авторизация
![]() | |
|
"Невдачі неодмінно будуть, і те, як ви з ними впораєтеся, буде найважливішим показником того, чи досягнете ви успіху" Джеймі Даймон |
ШІ-агенти провалюють 70% офісних завдань — дослідження CMU та Salesforce
15:59 30.06.2025 |

Попри амбітні обіцянки розробників, сучасні ШІ-агенти рідко справляються з офісною роботою. Згідно з новими дослідженнями Університету Карнегі-Меллон (CMU) та Salesforce, штучний інтелект успішно виконує лише 30-35% багатокрокових завдань, як-от перегляд вебсторінок, написання коду чи взаємодія з колегами, пише The Register.
CMU розробив симуляційне середовище TheAgentCompany, яке імітує невелику ІТ-компанію з типовими робочими сценаріями. У тестуванні брали участь провідні моделі, зокрема Gemini 2.5 Pro (30,3% успішності), Claude 3.7 Sonnet (26,3%), GPT-4o (8,6%) та Amazon Nova Pro (1,7%). Деякі агенти навіть вдавалися до обману, наприклад перейменовували користувачів, аби "імітувати" виконання завдань.
Salesforce запропонувала власний бенчмарк CRMArena-Pro, сфокусований на завданнях у сфері обслуговування клієнтів та продажів. Найуспішніші моделі досягли 58% точності в простих завданнях, але в багатокрокових сценаріях результат падав до 35%. У всіх випадках моделі майже не мали уявлення про конфіденційність, що ставить під сумнів їхню придатність у корпоративному середовищі.
Дослідницька компанія Gartner також попереджає про agent washing - маркетингове маскування простих чатботів або RPA-систем під повноцінних агентів. З 1000+ компаній, що пропонують "агентські" рішення, лише близько 130 справді використовують відповідні технології.
Попри нинішні обмеження, прогноз Gartner передбачає, що до 2028 року 15% щоденних бізнес-рішень ухвалюватимуть ШІ-агенти, а подібні функції пропонувати третина усього корпоративного ПЗ. Але експерти застерігають не будувати високих очікувань: до рівня умовного віртуального помічника JARVIS з фільмів про "Залізну Людину" ще далеко - більшість агентів досі не здатні самостійно виконувати складні інструкції або взаємодіяти з UI в реальному часі.
ТЕГИ
ТОП-НОВИНИ
ПІДПИСКА НА НОВИНИ
Для підписки на розсилку новин введіть Вашу поштову адресу :


Сенатор-республіканець Ліндсі Грем заявив, що президент Дональд Трамп
дав "зелене світло" двопартійному законопроєкту про санкції проти Росії.
Littop Enterprises, Bordo Management і Bridgemont Ventures програли арбітражну справу щодо Укрнафти
Канада прагне суттєво збільшити обсяг зброї та військового спорядження, що виготовляється разом із Україною.
Гарантії безпеки для України ґрунтуватимуться на трьох головних принципах, наголосила фон дер Ляєн.
Прем'єр Британії Кір Стармер, президент Франції Еммануель Макрон і
президент Володимир Зеленський підписали декларацію про наміри
розгортання військ в Україні у разі укладення мирної угоди.
В Україні стартував оборонний збір на 1 млрд грн для захисту від "Шахедів". Про це повідомляє пресслужба Фонду Сергія Притули. Проєкт під назвою "Єдинозбір" проводиться фондом спільно з 412 бригадою Nemesis та Світовим Конґресом Українців.
YouTube оновив інструменти розширеного пошуку. Тепер користувачі можуть
виключити Shorts, тобто відео тривалістю до трьох хвилин, із
результатів.
На виставці NRF 2026 компанія Microsoft представила нову функцію -
Copilot Checkout. Вона дозволяє користувачам оформлювати покупки без
переходу на сторонні сайти.
Top Lead за підтримки Міністерства цифрової трансформації України провела дослідження
використання штучного інтелекту українськими компаніями.
Йдеться про двоногі машини, призначені для виконання виробничих завдань нарівні з традиційним промисловим обладнанням.
Із 1 січня 2026 у зв'язку із збільшенням мінімальної заробітної плати в
Україні зросли деякі виплати роботодавцям, які адмініструє Державна
служба зайнятості.
Mercedes-Benz встановить на новий CLA систему допомоги водію на базі
програмної платформи NVIDIA DRIVE AV. Технологію представили на виставці
Consumer Electronics Show (CES) 2026 у Лас-Вегасі.
Universal Music Group (UMG) уклала партнерство з NVIDIA для впровадження
нової моделі штучного інтелекту у свій музичний каталог. Про це пише
The Verge.
На CES 2026 компанія AMD анонсувала свій новий флагманський процесор Ryzen 7 9850X3D, який став найшвидшим у серії 9000X3D. Чип базується на архітектурі Zen 5 і оснащений технологією AMD 3D V-Cache другого покоління, що забезпечує виняткову ігрову продуктивність, особливо в порівнянні з конкурентами.
Попри намагання Павла Дурова дистанціюватися від Кремля, фінансова
звітність Telegram свідчить про глибоку залежність платформи від
російського капіталу
На CES 2026 NVIDIA представила нове покоління технології
масштабування DLSS 4.5. Оновлення представляє Dynamic Multi Frame
Generation, новий режим 6X Multi Frame Generation та модель другого
покоління для DLSS Super Resolution.
Продаж легкових машин у Великій Британії у 2025 році зріс за підсумками
третього року поспіль і вперше з доковідного 2019 року перевищив 2 млн
автомобілів.
NVIDIA представила Rubin — новий суперкомп’ютер для ШІ, який прискорює навчання та інференс моделей при нижчих витратах порівняно з попередніми системами
Компанія Qualcomm на виставці CES 2026 оголосила про випуск нового
процесора Snapdragon X2 Plus, який стане доступним у комп'ютерах нижчого
цінового сегмента порівняно з моделями серії X2 Elite.
Українські міста 2025 року отримали 107 тролейбусів, з них 75 нових, проти 34 тролейбусів (28 нових) у 2024 році