<link rel="stylesheet" href="styles.f3b1fba60ec7970c.css">

Новий підхід кооперації великих мовних моделей та технік конструювання підказок до Chat-GPT для автоматичного розв'язання природномовних задач з математики

Вантажиться...
Ескіз

Дата

Науковий керівник

Редактор

Інші учасники

Відповідальний

ORCID

Назва журналу

Номер ISSN

Назва тому

DOI

Альтернативна назва

Анотація

Досліджено проблему розв’язання математичних задач, сформульованих природною мовою, за допомогою великих мовних моделей (LLM). Проаналізовано та порівняно ефективність існуючих підходів. Розроблено новий підхід для оптимізації підказок на основі навчання з підкріпленням, який використовує динамічну побудову підказок та комбінування відомих технік “prompt engineering”, в залежності від категорії задачі. Наведено приклад, який довів ефективність запропонованого підходу на практиці.
The issue of solving mathematical problems formulated in natural language using large language models (LLM) was investigated. The efficiency of existing approaches was analyzed and compared. A new approach for optimizing prompts based on reinforcement learning was developed, which uses dynamic construction of prompts and combines known "prompt engineering" techniques, depending on the category of the problem. An example that proved the effectiveness of the proposed approach in practice is provided.

Опис

Тип документа

Мова

ISSN

Серія, номер

ISBN

ББК

Інші ідентифікатори

Пов’язані матеріали

Спонсорська підтримка

Правовласник

Бібліографічний опис

Варер Б. Ю., Мокін В. Б. Новий підхід кооперації великих мовних моделей та технік конструювання підказок до Chat-GPT для автоматичного розв'язання природномовних задач з математики // Матеріали LІII науково-технічної конференції підрозділів ВНТУ, Вінниця, 20-22 березня 2024 р. Електрон. текст. дані. 2024. URI: https://conferences.vntu.edu.ua/index.php/all-fksa/all-fksa-2024/paper/view/20814.

Схвалення

Рецензія

Доповнено

Цитується в

Список використаної літератури (4)

  1. Y. Yao, J. Duan, K. Xu, Y. Cai, Z. Sun, and Y. Zhang, “Survey on Large Language Model (LLM) Security and Privacy: The Good, the Bad, and the Ugly”, arXiv [cs.CR]. 2024.
  2. J. Wei et al., “Chain-of-Thought Prompting Elicits Reasoning in Large Language Models”, arXiv [cs.CL]. 2023.
  3. L. Gao et al., “PAL: Program-aided Language Models”, arXiv [cs.CL]. 2023.
  4. D. Hendrycks et al., “Measuring Mathematical Problem Solving With the MATH Dataset”, arXiv preprint arXiv:2103. 03874, 2021.