Kimi відкриває PerceptionBench, GPT-5.6-Sol з точністю 59.7% займає перше місце

By: rootdata|2026/07/28 16:02:00
0
Поширити
copy
Оцінити в GoogleОцінити в Google

Kimi відкриває відкриту багатомодальну велику модель візуальної оцінки PerceptionBench, яка має на меті розділити візуальні сприйняття на 10 атомарних здібностей для незалежної оцінки. Вона охоплює такі аспекти, як візуальні відносини, підрахунок, атрибути, глибина та 3D, локалізація, порівняння, детальне розпізнавання, інтеграція контексту, OCR та розпізнавання ілюзій. Ця база даних була створена на основі невдалих випадків моделей з 42 існуючих наборів тестів і містить 3000 питань, перевірених вручну, кожне з яких оцінює лише одну візуальну здатність, без потреби в міркуванні або зовнішніх знаннях. Результати тестування показують, що серед 16 провідних багатомодальних великих моделей жодна з моделей не досягла загальної точності понад 60%. GPT-5.6-Sol займає перше місце з точністю 59.7%, за ним йдуть Kimi K3 (58.5%), Claude-Fable-5 (57.2%), Gemini-3.1-Pro (56.2%) та GPT-5.5 (55.8%). У звіті зазначається, що візуальні ілюзії залишаються найслабшою здатністю всіх моделей, і загальні можливості сприйняття все ще мають значний потенціал для покращення.

Ціна --

--

Цей контент надано лише для загальних інформаційних цілей і не є фінансовою, інвестиційною, юридичною чи податковою консультацією. Події, нагороди, онлайн-акцій або пов’язану інформацію, згадана тут, не слід розглядати як рекомендацію, прохання чи запрошення до купівлі, продажу, торгівлі чи інших операцій з криптоактивами. Криптоактиви є дуже волатильними та можуть призвести до збитків. Доступність послуг, продуктів WEEX та пов’язаних із ними подій може відрізнятися залежно від регіону. Ви несете відповідальність за забезпечення відповідності вашої участі чинному місцевому законодавству та нормативним актам.

Вам також може сподобатися

iconiconiconiconiconicon
Підтримка клієнтів:@weikecs
Співпраця:@weikecs
Кількісна торгівля та маркетмейкінг:bd@weex.com
VIP-програма:support@weex.com