бенчмарк SOOHAK

Новый бенчмарк SOOHAK может выявлять склонность ИИ к уверенным галлюцинациям

Новый математический бенчмарк SOOHAK выявил неспособность ведущих ИИ-моделей распознавать некорректные условия задач и их низкую эффективность в высшей математике.

радио Andon Labs

Полгода четыре LLM управляли своими радиостанциями, но так и не смогли их монетизировать

Шестимесячный эксперимент показал, что без контроля человека ИИ-диджеи впадают в политический активизм, галлюцинируют и практически не приносят прибыли.

Oppo X-OmniClaw

Oppo представила X-OmniClaw: ИИ-агент для Android, работающий с локальными сенсорами

Oppo выпустила открытый ИИ-агент X-OmniClaw, который работает непосредственно на Android-смартфонах, используя камеру и экран для выполнения задач в приложениях.

Суд против юридического слопа

Судебная система в США наказывает юристов за использование документов, написанных ИИ

Суды в США сталкиваются с поддельными прецедентами, созданными нейросетями. Разбираемся, почему LLM галлюцинируют в юриспруденции и как защитить правовую систему.

Zoox представила Cortex

Zoox представила внутреннюю LLM-платформу Cortex для ускорения разработки

Zoox внедрила внутреннюю платформу Cortex, объединяющую оркестрацию моделей и инструменты безопасности для оптимизации разработки ИИ-сервисов.

ChatGPT в вузах

Привычка студентов использовать ChatGPT может иметь глубокие социальные последствия

Массовое использование ИИ студентами не только ослабляет их коммуникативные навыки, но и ведет к росту экологического неравенства из-за расширения инфраструктуры дата-центров.