Thomas Wolf
7 أوراق في مجموعة PaperMetrix
أوراق هذا المؤلف
-
TransferTransfo: A Transfer Learning Approach for Neural Network Based Conversational Agents
2019 · arXiv (Cornell University)
We introduce a new approach to generative data-driven dialogue systems (e.g. chatbots) called TransferTransfo which is a combination of a Transfer learning based training scheme and a high-capacity Transformer model. Fine-tuning is performed by using …
-
Transfer Learning in Natural Language Processing
2019
The classic supervised machine learning paradigm is based on learning in isolation, a single predictive model for a task using a single dataset. This approach requires a large number of training examples and performs best …
-
A Hierarchical Multi-Task Approach for Learning Embeddings from Semantic Tasks
2019
Much effort has been devoted to evaluate whether multi-task learning can be leveraged to learn rich representations that can be used in various Natural Language Processing (NLP) down-stream applications. However, there is still a lack …
-
Transformers: State-of-the-Art Natural Language Processing
2020
Thomas Wolf, Lysandre Debut, Victor Sanh, Julien Chaumond, Clement Delangue, Anthony Moi, Pierric Cistac, Tim Rault, Remi Louf, Morgan Funtowicz, Joe Davison, Sam Shleifer, Patrick von Platen, Clara Ma, Yacine Jernite, Julien Plu, Canwen Xu, …
-
HuggingFace's Transformers: State-of-the-art Natural Language Processing
2019 · arXiv (Cornell University)
Recent progress in natural language processing has been driven by advances in both model architecture and model pretraining. Transformer architectures have facilitated building higher-capacity models and pretraining has made it possible to effectively utilize this …
-
Datasets: A Community Library for Natural Language Processing
2021
Quentin Lhoest, Albert Villanova del Moral, Yacine Jernite, Abhishek Thakur, Patrick von Platen, Suraj Patil, Julien Chaumond, Mariama Drame, Julien Plu, Lewis Tunstall, Joe Davison, Mario Šaško, Gunjan Chhablani, Bhavitvya Malik, Simon Brandeis, Teven Le …
-
Multitask Prompted Training Enables Zero-Shot Task Generalization
2021 · arXiv (Cornell University)
Large language models have recently been shown to attain reasonable zero-shot generalization on a diverse set of tasks (Brown et al., 2020). It has been hypothesized that this is a consequence of implicit multitask learning …