📊 ИИ в страховании: представлен бенчмарк Coverage Cat
Бенчмарк Coverage Cat AI Insurance Benchmark оценивает способность ведущих ИИ-моделей решать узкоспециализированные задачи в страховании. Grok 4.3 от xAI занял первое место в рейтинге Elo по оценке стоимости (Price Estimation), набрав 1687 очков, в то время как ChatGPT 5.5 от OpenAI показал лучший результат по метрике Coverage (69.1%).
🌍 Появление узкоспециализированных бенчмарков позволяет компаниям выбирать модели не по общим тестам, а по их способности работать с реальными бизнес-процессами, такими как андеррайтинг и оценка рисков.
👤 Это сигнал о переходе от «универсального ИИ» к профессиональным инструментам, которые могут глубоко понимать специфику страхового дела, включая лимиты ответственности и правила страховых компаний.
Источник 1: https://www.coveragecat.com/ai/leaderboard