Результати пошуку для "GPT"
2026-06-17 09:47

GLM-5.2 від Zhipu очолює відкриті моделі в тесті AA Benchmark, набираючи 51 бал, і на тесті GDPval досягає рівня GPT-5.5

Згідно з моніторингом Beating AI, остання модель GLM-5.2 від Zhipu посідає перше місце серед моделей з відкритим кодом у бенчмарку інтелекту Artificial Analysis v4.1 із результатом 51 бал, випередивши MiniMax-M3 (44 бали) та DeepSeek V4 Pro (44 бали). У тесті GDPval-AA v2, що імітує реальну роботу зі знаннями, GLM-5.2 набрала 1 524 бали (людський базовий рівень: 1 000), зрівнявшись із моделлю закритого типу GPT-5.5 у режимі xhigh reasoning, і випередивши MiniMax-M3 (1 418 балів) та DeepSeek V4 P
Більше
2026-06-16 10:25

Claude Opus 4.8 коштує в 44 рази дорожче, ніж DeepSeek V4 Pro: остання оцінка з штучного аналізу виявила

За даними Artificial Analysis, у найновішій AI-оцінці Claude Opus 4.8 набрав 56 балів за вартості 1,78 долара за завдання, тоді як DeepSeek V4 Pro набрав 44 бали за лише 0,04 долара за завдання — тобто Claude у 44 рази дорожчий. Оцінювання оновило бенчмарки, щоб вимірювати реальні можливості, зокрема планування, використання інструментів і виконання складних завдань, замінивши прості тести з вибором відповіді. Claude Opus 4.8 очолив доступні моделі, за ним іде GPT-5.5 із 55 балами. Інші вітчизня
Більше
2026-06-16 06:17

OpenAI запустить GPT-5.6 23 червня з контекстом на 1,5 млн токенів, ціна — втричі нижча за Claude Fable 5

За моніторингом Beating, OpenAI випустить GPT-5.6 23 червня, з вікном контексту на 1,5 мільйона токенів і цінами для API, що становитимуть одну третину від тарифу Anthropic для Claude Fable 5. Відповідний таймінг збігається з запуском Anthropic Claude Fable 5 9 червня та його подальшим вилученням Департаментом торгівлі США 12 червня через вразливості безпеки. Прогнозні ринки наразі оцінюють імовірність виходу GPT-5.6 у проміжку з 22 по 28 червня на 78 відсотків.
Більше
2026-06-13 13:29

BBVA співпрацює з OpenAI для розгортання ChatGPT Enterprise, співробітники створили понад 20 000 кастомних GPT

Як повідомляє PANews, 13 червня BBVA оголосила про стратегічне партнерство з OpenAI, щоб інтегрувати штучний інтелект у клієнтський сервіс, бізнес-операції, розробку програмного забезпечення та робочі процеси працівників. Іспанська банківська група прагне перетворитися на операційну модель, керовану ШІ, перебудовуючи клієнтський досвід, комерційні банківські послуги, управління ризиками, операційну ефективність і продуктивність працівників. Співробітники BBVA створили понад 20 000 власних GPTs в
Більше
2026-06-12 19:26

Дослідники виявили, що AI-агенти вразливі до атак prompt injection, із 79% рівнем успіху

Дослідники з Nanyang Technological University, ST Engineering, IBM Research та Університету Іллінойсу в Урбана-Шампейн з’ясували, що AI-агенти, підживлені GPT-5 і Gemini, не можуть стабільно протистояти атакам із підміною підказок (prompt injection). Про це йдеться в дослідженні, опублікованому в четвер. У 3 168 симуляціях атак прямі атаки з підміною підказок досягали успіху понад 79% випадків, тоді як непрямі атаки, вбудовані в вебконтент, показували рівень успішності в діапазоні від 41,67% до
Більше
2026-06-12 08:53

Google Antigravity запускає дашборд квот і скидає щотижневі ліміти Gemini

Beating повідомляє, що Google Antigravity запустила дашборд квот моделі та скинула щотижневі ліміти Gemini. Новий дашборд групує моделі, які використовують спільний пул квот (моделі Gemini та моделі Claude/GPT — окремо) з детальними відсотковими індикаторами для залишку квоти. Antigravity також додала функцію озвучення /btw, що дозволяє користувачам ставити уточнювальні або уточнювальні запитання під час складних задач, не порушуючи основну історію розмови. Додаткові покращення включають пошук у
Більше
2026-06-07 04:45

Відкриті моделі ШІ коштують у 40 разів менше, ніж GPT-5.5 Pro; Чамат попереджає про неконтрольовані перевитрати через API

Після випуску 25 моделей із відкритим кодом, включно з Nvidia Nemotron 3 Ultra та Google Gemma 4 12B, спроможнісний розрив між моделями відкритого коду і закритими фронтирними моделями швидко скорочується, але ціноутворення все ще різко не відповідає реальності. Технологічний інвестор Чамат Паліхапітія зазначив, що для підприємств, які щомісяця споживають 1 мільярд вхідних і 1 мільярд вихідних токенів, GPT-5.5 Pro коштує $105 000, Claude Opus 4.8 — $30 000, тоді як DeepSeek R1 — лише $2 740, тоб
Більше
2026-06-05 01:30

Імовірності запуску Polymarket GPT 5.6 падають до 21% до 15 червня, зниження на 45% за 24 годині

За даними Odaily Seer, котирування Polymarket щодо запуску OpenAI GPT 5.6 до 15 червня знизилися до 21% сьогодні, що означає падіння на 45% за останні 24 години. Котирування платформи на реліз 30 червня залишаються на рівні 80%, зниження на 13% за той самий період.
2026-05-29 17:32

П’ять моделей Frontier AI не погодилися щодо 67% тверджень у найновішому дослідженні перевірки фактів

Дослідник Коста Джорданов з Lenz Research повідомив, що цього місяця п’ять «фронтирних» моделей ШІ не зійшлися в оцінках щодо 67% із 1 000 реальних фактчек-заяв, перевірених на практиці. Моделям — GPT-5.4, Claude Opus 4.7, Gemini 3 Pro, Gemini 3 Pro з Search та Sonar Pro — запропонували класифікувати твердження як істинні, здебільшого істинні, оманливі або хибні. У 34% випадків розбіжності були різкими: одна модель називала твердження істинним, тоді як інша — хибним. Дослідження вимірювало узгод
Більше
2026-05-27 19:38

DeepSeek блокує знижку на V4-Pro за $0,87 за мільйон токенів; Xiaomi скорочує MiMo-V2.5 на до 99% станом на 26 травня

За офіційними оголошеннями DeepSeek зробила постійною знижку 75% на API V4-Pro 22 травня, зафіксувавши ціну виводу на рівні $0,87 за мільйон токенів. Xiaomi слідом 26 травня скоротила витрати на кешований вхід MiMo-V2.5 на величину до 99%, довівши ціну Pro-моделі до $0,0036 за мільйон токенів для cache hits — дешевше за токен, ніж більшість тарифів за SMS-символи. Тим часом американські лабораторії пішли в протилежний бік. OpenAI подвоїла ціну виводу GPT-5.5 до $30 за мільйон токенів під час зап
Більше