Носимые устройства

Alibaba Cloud обратилась к ИИ, чтобы реже обращаться к ИИ

Подразделение Alibaba Cloud разработало систему DualLane, которая анализирует запросы клиентов в службу технической поддержки и в некоторых случаях позволяет не подключать большие языковые модели искусственного интеллекта при решении отдельных проблем. Этот подход позволяет компании действовать быстрее, точнее и с меньшими затратами.

Компьютер месяца — август 2026 года

Снято в Голливуде? Почему Стэнли Кубрик физически не смог бы подделать лунную походку

Выбираем лучшие игровые ноутбуки на российском рынке (вторая половина 2026 года)

Сравнительный тест камер флагманских смартфонов (2026): итоги

Топ-10 смартфонов до 10 тысяч рублей (2026 год)

Обзор беззеркальной камеры Sony Alpha 7 V: эволюция с человеческим лицом

Лучший процессор под DDR4 в 2026 году: AM4 против LGA 1700

Источник изображения: alibabagroup.com

Alibaba старается не всегда поручать своим сотрудникам обрабатывать заявки в службу поддержки — они работают медленно, и их работа обходится дорого. Но когда компания попыталась в крупном масштабе подключить к обработке заявок ИИ-агентов, она обнаружила, что они могут реагировать ненадлежащим образом. Отмечаются три типа ошибок: ИИ-агент не подключает нужных инструментов; при подключении инструментов не использует всех надлежащих параметров задачи, а после выполнения одного из шагов задачи не всегда соответствующим образом извлекает необходимые параметры из результатов работы для его передачи на последующий шаг; наконец, при подготовке окончательного ответа ИИ-агент может неверно истолковать результаты или пропустить ключевую информацию.

Решением проблемы стала система DualLane — обработка всех заявок по моделям «быстрого» и «медленного» способов. Если заявка соответствует известной ранее стандартной проблеме, анализ по «медленному» сценарию отключается, и клиенту предлагается шаблонное решение проблемы. Когда в соответствии с «медленным» сценарием выявляется ряд схожих проблем, они группируются в «кластер» и формируется предложение перенести этот класс в «быстрый» способ — принятие такого решения координирует уже человек. Анализ проблемы и её соотнесение с «быстрым» способном требует небольших затрат ИИ-токенов; с «медленным» требуются порядка 3000 токенов, но и этот расход компенсируется более высокой эффективностью.

DualLane, как показало тестирование, превосходит по качеству другие средства координации ИИ-моделей, таких как LLMCompiler и React: точность составила 96,5 % при минимальной задержке, благодаря чему Alibaba Cloud включила DualLane в работу.

Источник

Добавить комментарий

Кнопка «Наверх»