Доступність · серпень 2021 р.
Codex і Copilot
OpenAI дообучила мовну модель на публічному коді, і GitHub вбудував її в редактор як помічника, що дописує рядки на льоту.
Чому це важливо
Перший масовий продукт на великій мовній моделі з'явився не в чаті, а в редакторі коду — за рік з половиною до ChatGPT.
Код виявився зручним полігоном: він структурований, його багато у відкритому доступі, а правильність частково перевіряється запуском. Продукт одразу порушив питання, які згодом постали для всієї галузі: чиї права на навчальні дані, хто відповідає за помилку, що робити з відтвореними фрагментами чужого коду. Судові позови почалися 2022 року.
Відомості про подію
- Дата події
- серпень 2021 р.
- Дата на часовій лінії
- Дата події
- Перевірка
- Джерела зібрано автоматично · 17 вересня 2026 р.
- Лінії
- ID
- evt-0242
Модель оголошено в серпні 2021 року; GitHub Copilot вийшов у технічному перегляді в червні 2021 року.
Пов’язані події
- Розвиває GPT-3
Та сама модель, дообучена на публічному коді.
OpenAI Codex - Пов’язано ChatGPT
Перший масовий продукт на великій мовній моделі, за рік до ChatGPT.
Записи, що посилаються на цей
- Пов’язано Керування комп'ютером
Від дописування коду в редакторі до керування самим комп'ютером.
- Пов’язано ChatGPT як агент
Від дописування рядка коду до самостійного виконання багатокрокової роботи.
- Спирається на Перший позов про навчання на чужому коді
Позов оскаржує саме той продукт, який цей запис описує: модель, навчену на публічному коді й вбудовану в редактор.
Class Action Complaint, J. Doe 1 and J. Doe 2 v. GitHub, Inc., Microsoft Corporation, OpenAI, Inc. et al., Case 3:22-cv-06823 - Пов’язано HumanEval: код, перевірений тестами
Препринт, що запровадив HumanEval, описує Codex і каже, що окрема виробнича версія цієї моделі працює в GitHub Copilot.
Evaluating Large Language Models Trained on Code (Chen et al., arXiv:2107.03374v1)