我想要一天分享一點「LLM從底層堆疊的技術」,並且每篇文章長度控制在三分鐘以內,讓大家不會壓力太大,但是又能夠每天成長一點。
從 AI說書 - 從0開始 - 227 | 第八章引言 到 AI說書 - 從0開始 - 243 | 微調 GPT 模型與 GPT4 比較,我們完成書籍:Transformers for Natural Language Processing and Computer Vision, Denis Rothman, 2024 第八章說明。
以下附上參考項目:
- OpenAI fine-tuning documentation: https://platform.openai.com/docs/guides/fine-tuning
以下附上額外閱讀項目:
- Sadhika Malladi, Tianyu Gao, Eshaan Nichani, Alex Damian, Jason D. Lee, Danqi Chen, and San- jeev Arora, 2023, Fine-Tuning Language Models with Just Forward Passes: https://arxiv.org/abs/2305.17333













