Фінансові новини
- |
- 19.08.26
- |
- 10:57
- |
-
RSS - |
- мапа сайту
Авторизация
OpenAI анонсує нові моделі міркування o3 і o3-mini, які можуть мислити на рівні людини
09:18 25.12.2024 |

У фінальний день своєї 12-денної події "shipmas" компанія OpenAI представила o3, нову модель ШІ для розумових завдань, яка є наступником o1. Разом із нею було презентовано й компактний варіант - o3-mini, розроблений для виконання специфічних завдань. Цей реліз обіцяє значний прорив у можливостях ШІ моделювати розумові процеси та є наступним кроком до AGI.
OpenAI справді заявляє, що o3, за певних умов, наближається до AGI (штучного загального інтелекту) - системи, здатної виконувати більшість економічно важливих завдань, які зазвичай виконує людина. Хоча компанія підкреслює, що це ще не остаточний прорив, але результати тестів моделі o3 значно перевершують попередні моделі OpenAI.
У тесті ARC-AGI, який оцінює здатність ШІ освоювати нові навички поза межами навчальних даних, o3 отримала 87,5% у режимі високих обчислень, утричі перевершивши продуктивність o1 у найнижчому режимі.
Модель досягла визначних результатів у різних тестах:
* 96,7% на Американському математичному іспиті 2024 року;
* 87,7% у GPQA Diamond, відповідаючи на питання рівня магістратури з біології, фізики та хімії;
* Новий рекорд 25,2% у тесті Frontier Math від EpochAI, що значно перевершує конкурентів.
Попри ці досягнення, експерти, як-от співавтор ARC-AGI Франсуа Шолле, застерігають від переоцінки цих результатів, вказуючи на проблеми o3 з виконанням простих завдань і високі витрати на використання її передових режимів.
Ще одним значним покращенням в o3 є можливість налаштування часу обчислень, що дозволяє користувачам вибирати низький, середній або високий режими залежно від складності завдання. Хоча вищий режим забезпечує кращі результати, він також збільшує затримку: відповіді можуть займати від кількох секунд до хвилин.
Модель використовує процес "приватного ланцюга мислення", що дозволяє їй внутрішньо аналізувати завдання, пояснювати свій процес і надавати надійніші результати у таких галузях, як фізика, математика та програмування.
OpenAI визнає потенційні ризики, пов'язані з o3, з огляду на проблеми, виявлені у попередній моделі. Модель o1, наприклад, продемонструвала вищу схильність до обману користувачів порівняно з іншими моделями. Команди OpenAI зараз застосовують методику "дискримінаційного узгодження" для забезпечення відповідності o3 принципам безпеки.
Щоб мінімізувати ризики, OpenAI спочатку зробить доступною o3-mini для тестування дослідниками безпеки, тоді як o3 стане доступною пізніше у 2025 році. Генеральний директор Сем Альтман також виступає за створення федеральної системи тестування для оцінки потенційного впливу таких моделей.
Варто зазначити, OpenAI назвала сімейство моделей o3 замість o2, щоб уникнути потенційних конфліктів з британським телекомунікаційним оператором O2. Під час презентації Альтман визнав, що його компанія не дуже добре розбирається в брендах, сказавши: "З огляду на традиції OpenAI, яка дуже, дуже погано розбирається в назвах, модель буде називатися o3".
Відео на тему:
ТЕГИ
ТОП-НОВИНИ
ПІДПИСКА НА НОВИНИ
Для підписки на розсилку новин введіть Вашу поштову адресу :


Програма діяльності нового Кабінету міністрів України передбачає, як і у
деяких попередників, створення Фонду добробуту для управління частиною
портфеля державних підприємств в рамках підвищення ефективності
управління стратегічними активами.
Кабінет міністрів України у Плані дій уряду зобов'язав Міністерство
економіки та довкілля у 2026-2027 роках забезпечити надання у
користування ділянок надр стратегічного значення щодо літію та урану на
умовах угод про розподіл продукції (УРП)
Україна закуповує у Туреччини
партію американського озброєння, серед якого балістичні ракети ATACMS,
реактивні системи залпового вогню M270 та касетні боєприпаси.
Державний департамент США оприлюднив
документи щодо передачі Україні пускових установок M270, ракет ATACMS, а
також касетних боєприпасів і снарядів. Загальна вартість двох пакетів
перевищує 280 мільйонів доларів.
Міністерство фінансів України працює над законопроєктом, який може
суттєво змінити правила роботи для фізичних осіб-підприємців (ФОП).
Samsung
давно перестав бути брендом, який асоціюється лише з одним-двома
флагманами. У лінійці Galaxy сьогодні є практично все: недорогі
смартфони для щоденних завдань, збалансовані моделі середнього класу,
потужні S-серії та складні пристрої для тих, хто хоче чогось
незвичайного.
Ця тилова вакансія підходить для кандидатів, що не можуть
виконувати бойові завдання у звʼязку із віком чи станом здоровʼя.
Цей крок зроблено на тлі численних судових позовів проти OpenAI з боку
сімей, які стверджують, що їхні діти зазнали шкоди від використання
ChatGPT, у той час як компанія готується до потенційно рекордного IPO
протягом наступного року.
Уряд Тайваню спрямує 7,4 млрд дол. у запропонованому бюджеті на
2027 рік для фінансування виплати у 10 тис. тайванських доларів
Штучний інтелект вперше самостійно звільнив людину - принаймні, якщо вірити заяві розробників
експериментального магазину Andon Market, яким керує ШІ-модель Luna,
побудована на Claude Sonnet 4.6. При цьому працівник суттєво провинився і
запізнився на 17 із 23 змін.
Генеральний директор OpenAI Сем Альтман вважає, що тривалість
традиційної чотирирічної університетської освіти варто переглянути: він
сам провів у Стенфорді лише два роки, а нині молодь (завдяки, звісно ж,
ШІ) має можливість створити власний бізнес самостійно без тривалого
навчання.
Anthropic розповіла, як працюватимуть водяні знаки у текстах,
створених чат-ботом Claude. Компанія пояснила принцип маркування,
можливість його видалення під час редагування та особливості
застосування технології до програмного коду.
Google запускає нову функцію Sheets Canvas на основі Gemini, яка
зможе перетворювати таблиці на кастомні й інтерактивні міні-програми.
Американські технологічні компанії, такі як Alphabet, Amazon і Microsoft, мають близько $3 трлн позабалансових зобов'язань, пов'язаних з інвестиціями у штучний інтелект
Шведсько-американська авіабудівна компанія Heart Aerospace здійснила перший політ X1 - найбільшого у світі літака з повністю електричною силовою установкою.
Темпи зростання доходів OpenAI прискорилися в останні місяці і з огляду
на поточні показники, виручка компанії в перерахунку на рік перевищує
позначку в $40 млрд, повідомляє агентство Bloomberg із посиланням на
поінформовані джерела.
Наприкінці 2025 року невідомі хакери атакували малу теплоелектроцентраль
у Польщі, використавши для цього раніше не відомий метод проникнення
через приватну мережу APN, повідомляється у звіті CERT Polska.
Постачання смартфонів впали на 7% у другому кварталі 2026 року у
порівнянні з тим самим періодом торік, а також на 3% у порівнянні з
першим кварталом.
Spotify оголосила про нову політику щодо музики, створеної за допомогою штучного інтелекту, пише
TechCrunch. Починаючи з вересня, компанія запровадить спеціальні
позначки "AI Persona" для артистів, які є штучно згенерованими.
Британський виробник люксових спорткарів Aston Martin знову опинився в
епіцентрі фінансової драми. Цього разу компанія вирішила піти на
радикальний крок, щоб латати дірки в бюджеті: вона фактично продала
контроль над власним ім'ям у всьому, що не стосується безпосередньо
автомобілів.
Одне з ключових американських відомств переглядає механізми, за якими
китайські компанії, що працюють у сфері штучного інтелекту, отримують
та використовують чіпи Nvidia Corp. за кордоном.