Как «ИИшка» описывает нирвану: смогут ли большие языковые модели составлять толковые словари?
Аннотация:
Статья посвящена исследованию возможностей больших языковых моделей в области автоматизации лексикографического описания. Цель исследования заключается в оценке качества лексикографических описаний, генерируемых современными мультиязычными моделями, а также в выявлении ограничений их использования. Материалом исследования послужили две лексические группы: неологизмы из сферы искусственного интеллекта и лексика буддийского происхождения. В рамках эксперимента было проведено тестирование пяти моделей, включая отечественные разработки и зарубежные аналоги. Методология исследования включает в себя разработку детализированного промпта, основанного на принципах академической лексикографии, настройку параметров, непосредственную генерацию толкований, а также последующую экспертную валидацию полученного материала. Результаты показали, что модели демонстрируют сопоставимый уровень качества при генерации толкований, однако испытывают затруднения при определении стилистических характеристик и иллюстративного материала. Наиболее устойчивые результаты зафиксированы при работе с лексикой, глубоко интегрированной в русский язык. Выявлены критические ограничения в применении языковых моделей: формальное использование стилистических помет, создание ложных толкований на основе фонетического сходства и массовая фабрикация иллюстративных примеров с вымышленными источниками. Делается вывод о том, что на современном этапе языковые модели могут рассматриваться как вспомогательный инструмент в лексикографической практике, требующий обязательной экспертной валидации и методологического контроля.






