Рубрика «llm» - 115

Шлепа — Большой Русский Бенчмарк - 1

Здарова! На связе лаборатория Вихрей, сегодня мы расскажем про наш бенчмарк, Шлёпа — большой русский бенчмарк.

Что есть сейчас для оценки русскоязычных LLM

Mera — бенчмарк от Альянса искусственного интеллекта, использует тесты и генерацию, сабмит через сайт, сайт почти не обновлялся с зимы. Почитать про него можно тут

Любая инновационная технология наверняка столкнется с судебными разбирательствами, но период активного развития искусственного интеллекта выдался особенно суровым в плане юридических споров.

26 судебных дел против OpenAI, Anthropic и Meta*: короткий обзор судебных исков против крупнейших ИИ-компаний - 1

Читать полностью »

Как  в Faire (мультибрендовая торговая площадка) внедрили автоматизиорванные  Code Review c LLM (статья - мой перевод для нашего ТГ канала посвященного разработке софта при помощи LLM). 

Читать полностью »

Человеческий разум, столь сложный и удивительный, далеко не безупречен. Десятилетия исследований в области когнитивной психологии показали, что наше мышление подвержено систематическим ошибкам, известным как когнитивные искажения. Например, Канеман и Тверски открыли глаза на то, как часто мы подвергаемся влиянию искажений, даже когда абсолютно уверены в рациональности принятого решения. Мы склонны видеть мир не таким, какой он есть, а сквозь призму собственных предубеждений и упрощений. Но что, если эти же искажения проявляются и у искусственного интеллекта?

Читать полностью »

Существует мнение, что основная проблема больших языковых моделей — в склонности к галлюцинациям. Когда нейросеть генерирует текст с информацией, не связанной с запросом.  

Меня зовут Полина, я инженер по разработке ПО искусственного интеллекта в YADROЧитать полностью »

Привет! Меня зовут Илья и сегодня мы поговорим про кроссворды.
Если когда-то будет противостояние человечества и машин, то последнее что позволит нам, кожаным мешкам, отличить своих собратьев от бездушных киборгов - это искусство составления кроссвордов. GPT ужасно составляет кроссворды.

Вот так должен выглядеть кроссворд

Вот так должен выглядеть кроссворд

Читать полностью »

Если в автомобильной пробке голосовой помощник пожалуется, что он эти пробки тоже терпеть не может, то водителю и пассажирам станет легче, что не они одни мучаются. В психологии это называется раппортом и обычно ведет к доверительным отношениям между людьми. Если представить, что чат-боты тоже способны сопереживать, а главное, что люди это ценят, то чем это не сильный эмоциональный ИИ? На примере диалогов между людьми и чат-ботами попробуем разобраться, насколько эмпатичны аватары сегодня и какие фичи им можно еще добавить.

Начало тут.

Как будем изучать диалоговые эмоции в этот разЧитать полностью »

Чтобы генеративные модели искусственного интеллекта могли создавать новые формы контента, их нужно регулярно обучать на новых данных, которые создает человечество. Но что будет, если контент, созданный человеком, закончится? Тогда модели вынуждены будут обучаться на ранее сгенерированном ИИ-контенте, что может привести к «ИИ-аутофагии». И это явление может стать реальной проблемой для развития LLM.

Читать полностью »

«Путешествие в Элевсин» или моральный базис LLM - 1

Все началось с новости об исследовании ответов больших лингвистических моделей при прохождении модифицированной «дилеммы вагонетки» Moral machineЧитать полностью »


https://ajax.googleapis.com/ajax/libs/jquery/3.4.1/jquery.min.js