Jev: искусственный интеллект, которому некогда с вами разговаривать

Jev: искусственный интеллект, которому некогда с вами разговаривать

TypeSafe AI представила Jev — модель, которая берётся за повседневную работу внутри программ: выбирать варианты, оценивать ситуации и возвращать результат в заданном формате. Запуск состоялся 15 сентября. Компанию основал бывший исследователь OpenAI Диогу Алмейда, участвовавший в работе, положенной в основу ChatGPT. Теперь он занялся довольно житейской проблемой: разговорчивый интеллект у нас уже есть, а автоматизацию всё ещё приходится собирать руками.

Представьте службу поддержки. Пришло письмо, и программе нужно определить тему обращения, срочность и необходимость передать его человеку. Jev возвращает выбор из предложенных вариантов, оценку по шкале или вероятность истинности утверждения. Несколько вопросов можно отправить одним запросом: они обрабатываются параллельно. Сложные решения разработчик должен разложить на отдельные вопросы, а результаты связать обычным кодом. Получается своеобразный интеллектуальный сортировщик: письмо прочитал, по ящикам разложил, сочинение «Как я понимаю клиента» писать не стал. Именно такой интерфейс описан в документации TypeSafe.

В анонсе Jev Алмейда формулирует исходный вопрос так:

«Модели уже несколько лет превосходят людей в общении — так где же вся автоматизация?»

За вопросом стоят заманчивые цифры: заявленное время ответа — 70–500 мс, стоимость миллиона входных токенов — 0,042 USD, выходные данные бесплатны. Однако впечатляющее ускорение получено в тестах самой компании на определённых рабочих процессах. Разработчики признают, что самые крупные выигрыши находятся у верхней границы ожидаемых результатов. Переносить их на любую задачу было бы примерно как обещать расход автомобиля по показаниям на спуске.

С обещанием отсутствия галлюцинаций тоже стоит разобраться до покупки праздничного торта. TypeSafe гарантирует соответствие заданной схеме ответа. Правильная форма ответа ещё не означает правильного решения. Если модель обязана выбрать один из трёх отделов, четвёртый она не придумает; отправить обращение не в тот отдел всё равно может. Это уже наша инженерная оговорка к рекламной формулировке: исправная стрелка не гарантирует, что поезд направили куда нужно.

Для работы с неопределённостью предусмотрены вероятности, а у типов Choice и Score — ещё и показатель уверенности. Программа может использовать их, чтобы автоматически обработать очевидный случай, а сомнительный передать на проверку. Порог придётся выбирать и проверять на собственных данных: аккуратное число в ответе само по себе ответственности не несёт.

Поэтому разговоры о замене ChatGPT и Claude здесь мало что объясняют. Интереснее возможность отдать специализированной модели многочисленные мелкие решения, из которых состоит работа приложения. Универсальный ИИ останется там, где нужно писать, объяснять и рассуждать. А сортировка заявок, возможно, наконец перестанет требовать приглашения цифрового профессора на каждое входящее письмо.

#новости #ИИ #автоматизация
@digitaltimeslv

Original in Telegram: https://t.me/digitaltimeslv/10720

Поделиться

TelegramFacebookLinkedInWhatsAppX