# Stanford CS 224N | Project Reports

https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/project.html

[CS224N Home](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/index.html)
  * [Coursework](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/index.html#coursework)
  * [Schedule](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/index.html#schedule)
  * [Office Hours](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/office_hours.html)
  * [Final projects](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/project.html)
  * [Lecture Videos](https://canvas.stanford.edu/courses/164570/external_tools/3367)
  * [Ed Forum](https://edstem.org/us/courses/33056)


[ ![](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/images/stanford-nlp-logo-new.jpg) ](http://nlp.stanford.edu/) [ ![](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/images/stanfordlogo.jpg) ](http://stanford.edu/)
# CS224N: Natural Language Processing with Deep Learning
### Stanford / Winter 2023
## Final poster session
We thank our sponsors (Hudson River Trading, Forethought AI, Huggingface, ServiceNow, Jane Street, Mem, Apple) for co-sponsoring the poster session!  
  
The poster session was at the Oak Lounge at Tresidder Union. This event was not open to the general public, only to the Stanford community and invited guests. [Click here](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/project/poster-printing-guidelines-2023.pdf) for a guide on poster printing. The schedule of the event was:   
  
  
| 4:30-5pm  | Session A Check-in  |  
| --- | --- |  
| 5:00-6:00pm  | Session A  |  
| 6:00-6:30pm  | Break (Session B Check-in)  |  
| 6:30-7:30pm  | Session B  |  
| 7:30-8:00pm  | Break (Session C Check-in)  |  
| 8:00pm-9:00pm  | Session C  |  
![](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/images/hudsonrivertrading.png) ![](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/images/forethought.png) ![](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/images/huggingface.png) ![](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/images/servicenow.jpg) ![](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/images/apple.jpg) ![](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/images/janestreet.png) ![](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/images/memai.png)
## Prizes
Congratulations to the following teams, who produced exceptional, prize-winning projects! 
### Best custom projects
  * **GhostWriter: Dynamic Programming and Deep Learning for Lyric Generation**. Niveditha Iyer, Tejas Narayanan, Kiran Bhat. 
  * **[Minimum Generative Pre-trained Transformer with Human Feedback](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169935991.pdf)**. Yanjia Li. 
  * **[Nano Backpack Language Model on Chinese Characters](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169449903.pdf)**. Hao Sun. 


### Best default projects
  * **[SerBERTus: A SMART Three-Headed BERT Ensemble](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169729542.pdf)**. Matthew John Hayes. 
  * **[Walk Less and Only Down Smooth Valleys](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169505895.pdf)**. Julian Edwin Lovett Cooper, Thomas Brink, Quinn Hollister. 
  * **[Pals for PALs: Exploring Extensions to Projected Attention Layers for Sentence-Level Tasks](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169739344.pdf)**. Lainey Yifei Wang. 


### TAs choice for best poster
  * **GhostWriter: Dynamic Programming and Deep Learning for Lyric Generation**. Niveditha Iyer, Tejas Narayanan, Kiran Bhat. 


### Sponsor's prize for best poster
  * **[VoBERTal: Variant Objective BERT Pretraining Approaches with HyperLinks](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169640386.pdf)**. Yangyi Shen, Joey Ji 


### Student choice for best poster
  * **RAPTOR: Reading, Attending, and Processing Tree-Organized Retrieval for Knowledge-Intensive Tasks**. Parth Sarthi, Aditi Tuli, Shubh Khanna. 


## Custom Projects  
| Project name  | Authors  |  
| --- | --- |  
| [Optimizing Encoder for Retrieval via Multi-Vector Late Interaction](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-168833820.pdf)  | Xin Ran Song  |  
| [Using Named Entity Recognition to Supplement The Ocean Cleanup’s Global Beached Plastics Dataset](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169142735.pdf)  | Stephen J Peng, Mitty Yu, Joe Jamison  |  
| [Bert-Powered Book Genre Classification](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169280003.pdf)  | Jessica Xinting Chen, Karen Wang  |  
| [Dynamic Fed Attention](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169307888.pdf)  | Amar Venugopal  |  
| [Automated Basketball Video Captioning](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169332292.pdf)  | Lucas Andrew Pauker, Beri Kohen Behar  |  
| [Few-Shot Causal Distillation](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169343837.pdf)  | Thomas Starshak  |  
| [Data Generation for NLP Classification Dataset Augmentation: Using Existing LLMs to Improve Dataset Quality](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169346062.pdf)  | Elliot Kenneth Dauber, Sahit Dendekuri  |  
| [Automating English Language Proficiency Assessments](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169354880.pdf)  | Ethan Tejas Allavarpu, Spencer Teal Siegel, Duncan Ross  |  
| [Hate Speech Detection Using Natural Language Processing](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169358304.pdf)  | Durga Prasad Malladi, Neha Keshari, Utkarsh Mittal  |  
| [Statistically-augmented Neural Detection of Al-generated text](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169358982.pdf)  | Michael Jarek Yan, Jeffrey Heo, Simon Kim  |  
| [Using Knowledge Graph Embeddings from Biomedical Language Models to Infer Drug Repurposing Candidates for Rare Diseases](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169359180.pdf)  | Yash Sanjay Patil, John N Wang  |  
| [Compositional Generalization Based on Semantic Interpretation: Where can Neural Networks Improve?](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169361549.pdf)  | Carolyn Qu, Rodrigo J Nieto  |  
| [Performing and Analyzing Named Entity Recognition on Foreign English Contexts](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169362676.pdf)  | Alex Zhang Shan  |  
| [Generative Word Embeddings with New Similarity Techniques for Legal Linking](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169363450.pdf)  | Andres Felipe Suarez, Jared William Azevedo  |  
| [Guideline for GPT-2: Investigating Model Variants For Different Computational Budgets](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169366918.pdf)  | Ryan Kang  |  
| [Enlightened Imagery: Multi-modal Image Captioning with Transformer-Based unified architecture](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169368209.pdf)  | Prashan Malintha Somapala  |  
| [Adapting the Contrast-Consistent Search Method to Multiclass Classification](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169368651.pdf)  | Santiago Hernandez, Tomas Pfeffer, Diego Zancaneli  |  
| [Universal Tabular Data Generator with Large Language Models](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169369314.pdf)  | Julian Chu  |  
| [Language Modelling using Latent Diffusion Models](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169374211.pdf)  | Sebastian Charmot, Ryan Lok Him Po  |  
| [Knowing What You Do Not Know: Investigating Large Language Models for Out-of-Domain Intent Classification](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169374438.pdf)  | Claire Tang  |  
| [ASKIT: Search and Ask Model](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169374570.pdf)  | Adam C Klein, Matthew Jordan Villescas  |  
| [DeepLyrics: GPT2 for lyrics generation with finetuning and prompting techniques](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169374910.pdf)  | Xiaoli Yang, Li Tian  |  
| [Novel Data Augmentation for resource constrained Image captioning](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169375891.pdf)  | Parth Nilesh Dodhia, Anirudh Sriram  |  
| [SuperHF: Supervised Finetuning from Human Feedback](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169376811.pdf)  | Gabriel Mugisa Mukobi, Wilder Dwight Abraham Fulford, Peter Samuel Chatain  |  
| [Looking Under the Hood of DetectGPT](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169403912.pdf)  | Max Du, Kaien Yang, Ryan Lian  |  
| [AV-HuBERT with Multi-Resolution Attention](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169407002.pdf)  | Paul Thomas Calamia, Jacob Donley  |  
| [Multi-Modal Model for Speech to Text Entity](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169433359.pdf)  | Xiang Jiang  |  
| [Abstractive Summarization of Legal Text Corpuses Using Transfer Learning](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169444039.pdf)  | Alexander Antonio Alvarado-Barahona, Michael Zhang  |  
| [Haiku Generation with Large Language Models](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169444285.pdf)  | Brennan Emily Megregian, Victoria Larisa DiMelis  |  
| [Nano Backpack Language Model on Chinese Characters](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169449903.pdf)  | Hao Sun  |  
| [Legal-SBERT: Creating a Sentence Tranformer for the Legal Domain and Generating Data](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169451673.pdf)  | Jayendra Singh Chauhan  |  
| [Building a Natural Language Chess Engine with Pretraining and Instruction Fine-Tuning](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169466939.pdf)  | Bowen Jiang  |  
| [ConTAXt Retrieval for Long-Form Question-Answering](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169484333.pdf)  | Winston Shum, Usman Iqbal Hanif, Will Frank Roberts  |  
| [Enabling Interpretable Histopathology Representation Learning via Multimodal Language Guided Self-Supervision](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169485103.pdf)  | Ekin Yokhan Tiu, Tom Thuc Ky Nguyen  |  
| [Question Span Extraction from Chats of Instant Messaging Platforms](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169486048.pdf)  | Abhishek Kumar  |  
| [Paper Trading From Sentiment Analysis on Twitter and Reddit Posts](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169488138.pdf)  | Chinmaya Mohan Andukuri, Eden Y Wang, Shobha Dasari  |  
| [Generating Recipe Ingredients and Instructions with Controlled Text Generation](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169488965.pdf)  | Kerrie Wu, Justine Breuch, Ben Alexander Randoing  |  
| [Are Attention Flows All You Need?](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169491742.pdf)  | Tomas Mika Bosschieter  |  
| [Next-Song Recommendations for Spotify Playlists Using GPT-2 and T5](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169493994.pdf)  | Janice Yeuhthong Teoh, Carrie Jiayi Chen  |  
| [Semantic Code Search](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169494435.pdf)  | Dinesh Rathinasamy Thangavel, Suhit Anand Pathak  |  
| [Multimodal Patient Evaluation for Depression and Anxiety](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169498051.pdf)  | Ally Nakamura, Roshan Swaroop  |  
| [Classifying Partisan Bias in News Articles: Leveraging an Understanding of Political Language and Article Structure](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169502805.pdf)  | Edoardo Yin, Emily Jin  |  
| [Al Can Look Up StackOverflow too: Retrieval-Augmented Code Generation](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169502968.pdf)  | Shreyas Vinayakumar, Minh Tue Vo Thanh, Swagata Ashwani  |  
| [Deep Learning Approach to Predicting Success of Medical Crowdfunding Campaigns](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169503583.pdf)  | Advait Avinash Patil  |  
| [Semantic Understanding of Genius Music Annotations](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169503842.pdf)  | Wesley Tjangnaka, Brent Ju, Andrew Victor Li  |  
| [Examining Misinformation via Search Directives](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169504658.pdf)  | Amy Dunphy, Michal Maciej Adamkiewicz  |  
| [Making the Most of Your Data: Few Shot Learning for Automated Essay Scoring](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169504920.pdf)  | Abel Philip John  |  
| [Ambiguity Resolution in Conversational Question Answering through Minimal Question Identification](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169506096.pdf)  | Sahil Kulkarni  |  
| [Looking Outside the Context Window: In-Context Learning with Up to Hundreds of Examples](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169506299.pdf)  | Varun Shenoy, Linden Sky Li  |  
| [Few-shot Classification of Disaster-related Tweets](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169506405.pdf)  | Jubayer Ibn Hamid, Jitendra Nath Pandey, Sheikh Rifayet Daiyan Srijon  |  
| [Are Distilled Models Just Deep-Sea Octopi? Probing Linguistic Representations of Distillation-Finetuned Models](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169506869.pdf)  | Christos Polzak, Joy Yun  |  
| [CodeSage: A Generative Approach to Improving Code Quality](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169507264.pdf)  | Shounak Ray, Michael Deb Nath, Joseph Tey  |  
| [RDF Triple-Text-Story: A Integrated Workflow for Controllable Short Story Generation](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169507684.pdf)  | Yuer Zhou, Yifu Han  |  
| [MetaMapper: Interpretable Metaphor Detection](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169507838.pdf)  | Yining Mao  |  
| [BERT Injections: Fine-Tuning BERT Using Tree-Based Word Representations to Address Syntactical Ambiguity](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169507938.pdf)  | Aakriti Lakshmanan, Sathvik Nallamalli, Aditya Srinivas Tadimeti  |  
| [Predicting Associated Comorbidities of Obesity from MIMIC 1V Clinical Notes](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169508001.pdf)  | Ana Delphin Selvaraj, Om Balkrishna Jahagirdar, Peyton Chen  |  
| [Rewriting Stack Overflow Questions to Improve Writing Quality](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169508002.pdf)  | Allison Sandoval Casasola, Maximilien Angelo Munz Cura  |  
| [Won’t You Be My Neighbor? Probing Informational Spread in Contextual Representations of Natural Language](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169508080.pdf)  | Sevahn Kayaneh Vorperian, Hagop Jake Chinchinian, Avi Gupta  |  
| [GPTNo: A Deep Learning LLM to Beat the Turing Test](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169508272.pdf)  | Will Z Li, Sri Jaladi, Abhinav Sinha  |  
| [MetaMapper: Interpretable Metaphor Detection](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169508332.pdf)  | Ziwen Chen  |  
| [Improving Neural Machine Translation of Spanish to Quechua with Transfer Learning](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169508363.pdf)  | Kaiyu Ren  |  
| [Unpacking Social Biases: An Analysis of Sense Embeddings Using the Backpack Model](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169508435.pdf)  | Camron Timothy Sallade, Vedant Garg, Molly Cantillon  |  
| [Human Writing is as Uniform as Machine Writing](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169508494.pdf)  | Ryan Tan, Raghav Mittal Garg, Jacob Eleftherios Stavrianos  |  
| GhostWriter: Dynamic Programming and Deep Learning for Lyric Generation  | Kiran Vincent Bhat, Niveditha Subramanyam Iyer, Tejas Narayanan  |  
| [Multimodal Transformer-Based Lyric Generation from MIDI and Text Data](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169508596.pdf)  | Vivek Vajipey, Steven Sun Zhao, Anthony Zhan  |  
| [Investigating Methods of Using Context to Augment pre-trained Language Models for Question Answering](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169508723.pdf)  | Sanjay Nagaraj, Rohan Reddy Davidi, Josh Sanyal  |  
| [Engagement-based response generation for open-domain dialogue](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169508835.pdf)  | Marcelo Pena, Ernesto Sung Woo Nam Song  |  
| [Style EmuLoRAtion in Text Generation: A Case Study with Joe Biden and Donald Trump](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169508844.pdf)  | Luke Joseph Mann, Ori Spector  |  
| [STaR-plus: building robust and efficient language model reasoners](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169509426.pdf)  | Kunal Sinha  |  
| [Prompting for Diverse Responses: Making Large Language Models More Truthful](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169510459.pdf)  | Eric YE, Matthew Joseph Kerr Smith  |  
| [Generating Tricky Multiple-Choice QA Pairs from Contexts using Hierarchical Conditional VAEs](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169511103.pdf)  | Davyn Christoper Sudirdjo  |  
| [Learning Word Embedding from Dictionary Definitions](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169513019.pdf)  | Madhurima Mahajan, Keertana Veeramony Chidambaram, Handi Zhao  |  
| [Contrastive Learning for Sentence Embeddings in BERT and its Smaller Variants](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169513350.pdf)  | Vrishab Krishna, Rohan Bansal  |  
| [GAN-BERT for Automated Essay Scoring](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169537002.pdf)  | Theodore Asa Kanell, Griffin Bryan Holt  |  
| [Investigating SoTA Entity-Linking Methods for Dialogue](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169548571.pdf)  | Isaac Dan Zhao, Arpit Arvind Ranasaria, Katherine Yang Yu  |  
| [Bidirectional Transformer with Phonetic Embedding](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169549688.pdf)  | Jiabin Wang  |  
| [Natural Language Generation with Pixels](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169579793.pdf)  | Rajan Pathe Vivek, Gautam Mittal  |  
| [Investigating Disfluency Generation for the Creation of Humanlike Utterances in Conversation](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169616647.pdf)  | Zuyi Liz Zhao, Alice Bai Zhang, Ayushi Gupta  |  
| [VoBERTal: Variant Objective BERT Pretraining Approaches with HyperLinks](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169640386.pdf)  | Yangyi Shen, Joey Ji  |  
| [Deep Q-Learning for Text Generation](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169687355.pdf)  | Felix Meng, Liwen Ouyang, Phee Nimitsurachat  |  
| [DialogDiffAE: Dialogue Generation with Diffusion-Equipped Auto-Encoder](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169698519.pdf)  | Fangzhao Zhang, Xiaohan Song  |  
| [Detoxifying Language Model with Context Distillation](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169707107.pdf)  | Andrew Hyungmin Lee  |  
| [Novel Genre-Based Story Summary Generation](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169707136.pdf)  | Alexis Catherine Echano, Minh Chau Mai  |  
| [Making the Most of Your Data: Few Shot Learning for Automated Essay Scoring](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169708040.pdf)  | Samarth Eshwar Kadaba  |  
| [ADRAGGAN: ADversarial training for RAtionale Generation: a GAN for moral dilemmas](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169710285.pdf)  | Poojan Pandya, Priya Khandelwal, Kavin Anand  |  
| [Reading Between the Lines: Measuring](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169711362.pdf)  | Andy Viet Huynh, David Haikuo Wang, Katherine Whitney Crandell  |  
| [Unsupervised Question Answering Using Custom NLP Library Built for Egyptian Arabic](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169713115.pdf)  | Ahmed Mostafa Sharaf, Michael Samouel Ghatas Souliman  |  
| [Interpretability and Controllability of Backpack LMs](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169719894.pdf)  | Tae Kyu Kim, Sarah Li Chen  |  
| [Activation Sparsity: An Insight into the Interpretability of Trained Transformers](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169721612.pdf)  | Carolyn Akua Asante Dartey, Jaime Eli Mizrachi Eshkenazi, Anushree Aggarwal  |  
| [Interpreting Transformers using Spectral Analysis](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169723308.pdf)  | Tulika Jha, Vishal Mohanty, Rishu Garg  |  
| [Improved Methods for Solving Diverse Winograd Schemas](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169723857.pdf)  | Max Atsunobu Vandervelden, Rohan Kumar Cherivirala  |  
| [PiGGyBacking off of PEGASUS: Pre-training with Gap-sentences for Government Bills](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169724371.pdf)  | Evelyn Hejin Choi, Karsen Lee Wahal, Alice Zhaoyi Chen  |  
| [Constructing a Transformer-Based Architecture for Explainable Conversational Recommendation](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169725035.pdf)  | Brock Grassy  |  
| [ED Radiology Report Label Extraction](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169725843.pdf)  | Serena Zhang, Jenny Shi, Iris Xia  |  
| [Filtering Out Unreliable Language Model Outputs Using Contrast-Consistent Search](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169726484.pdf)  | Michael Byun, Mauricio Baker  |  
| [MEDI-BERPT: A Novel Multitask Approach to Streamlining Chinese Healthcare](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169727160.pdf)  | Sunny Sun, Bi Tian Yuan  |  
| [Semantic-Augment: Augmenting the Semantic Space of Transformers Improves Generalization](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169728160.pdf)  | Emirhan Kurtulus  |  
| [Steering Natural Language Generation by Optimizing Vector-to-Cluster Distance](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169728239.pdf)  | Aniketh Nandakumar Iyengar, Vrushank Yatish Gunjur  |  
| [Adapting to Word Shifts: Teaching LLMs the Urban Dictionary](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169729538.pdf)  | Justin Wu, Sheryl Hsu  |  
| [Adaptation, Sensitivity, and Introspection: Investigating the Capabilities of LLMs as Hypernetworks](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169729678.pdf)  | Joseph Thomas Guman, Joey Coleman O'Brien, Christopher Lawrence Marcelino Pondoc  |  
| [Argue Better: Using Large Language Models to Generate Better Examples for Ineffective Persuasive Essay Arguments](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169732795.pdf)  | Anjali Ragupathi, Ashley Zhang  |  
| [DeepRhymes: Efficient End-to-end Conditional Rap Lyrics Generation](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169795327.pdf)  | Bessie Zhang, Catherine Kung, Ivan Villa-Renteria  |  
| [Applying Natural Language Processing in Answering Multiple-Choice Questions for Assessing Child/Youth and Adults Needs and Strengths (CANS®/ANSA)](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169800771.pdf)  | Kalikant Ganeshchandra Jha, Bohdan Metchko Junior  |  
| [Leveraging Patient Portal Messages to Predict Emergency Department Visits](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169817823.pdf)  | Jasmine Selin Bilir, Tran Le  |  
| [Leveraging Patient Portal Messages to Predict Emergency Department Visits](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169843556.pdf)  | Julia L Kadie  |  
| [Are GPT-3 Models Pragmatic Reasoners?](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169845842.pdf)  | Ariane Lee  |  
| [Contextual Counterspeech Generation](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169856040.pdf)  | Tanvi Misra Deshpande  |  
| [Automatic Speech Recognition Error Correction on ICU Clinical Narration Dataset](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169874129.pdf)  | Zhuoyi Huang, Han Bai, Adam Sun  |  
| [Summarizing Charts and Graphs with Context](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169878560.pdf)  | Nandita S Naik, Akankshita Dash  |  
| [Longformer-based Automated Writing Assessment for English Language Learners](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169883524.pdf)  | Peiqi Zhang  |  
| [How well can Hippos learn? A Novel Foray into the In-Context Learning Capabilities of H3](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169891052.pdf)  | Shreyas Kar, Andres Carranza, Dhruv Bhandarkar Pai  |  
| [Multi Distribution Dense Information Retrieval](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169896152.pdf)  | Soumya Chatterjee  |  
| [Data Augmentation for Low-resourced Language Modeling](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169899078.pdf)  | Shubo Yang, Wanyue Zhai  |  
| [MOPS: Memory Occupancy and Performance Surveying when using Late-Stage Hard Parameter Sharing for BERT Multitask Learning](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169901941.pdf)  | Callum Jan Burgess, Mark Peter Bechthold  |  
| [Multi-Task Learning BERT Model with Task-Specific Decoders](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169905995.pdf)  | Zhen Li  |  
| [Exploring the Effect of Semantic Similarity on Model Generalization](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169930031.pdf)  | Dustin Ryan Zubke, Hong Ju Jeon  |  
| [Minimum Generative Pre-trained Transformer with Human Feedback](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169935991.pdf)  | Yanjia Li  |  
| [Calibrated Contrast-Consistent Search](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169953466.pdf)  | Holly McCann, Lucas Tao, Felipe Calero Forero  |  
| [More Informative Relative Position Encoding for Table-to-Text Generation](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169954269.pdf)  | Yuan Wang  |  
| [Efficient Two-stage Approach for Long Document Summarization](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169955245.pdf)  | Fengmin Tang, Jialuo Yuan, Benson Zu  |  
| [Predicting Emergency Department Disposition from Radiology Reports](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169962747.pdf)  | Karen Garcia Mesa, Andy Zhang  |  
| [Audio-Text Cross-Modal Retrieval](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169962799.pdf)  | Vladimir Tourbabin, Zamir Ben-Hur  |  
| [Bias in clinical notes](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169964190.pdf)  | Betty Xiong  |  
| [NEWS2DIAL: News to Dialogue Utterance](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169966375.pdf)  | Rishi Agarwal, Pratyush Agarwal, Ali Rehan  |  
| [Finetuning minBERT Model for Multiple Downstream Tasks](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169968274.pdf)  | Yuan Wang  |  
| [Today Years Old: Adapting Language Models to Word Shifts](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169974300.pdf)  | Jason Jin Chen, Zachary Xi, Olivia Y Lee  |  
| [Rationale Belief Aggregation for Self-Verified Reasoning](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169977748.pdf)  | Vaish Shrivastava  |  
| [Multi-Task Zero-shot modeling with test Domain Shift: an exploration of sampling and fine-tuning techniques on DistilGPT-2 and BIG-bench](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169990431.pdf)  | Lara Malinov  |  
| [Deep Auctions: Using Economics to Improve NMT Decoding](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169998560.pdf)  | Abhy Ravi Devalapura, Logan Mondal Bhamidipaty  |  
| [Does Learning Syntax Help Models Learn Language?](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-170018026.pdf)  | Lian Wang  |  
| [TAKG: Importance-augmented Knowledge Graphs](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-170020170.pdf)  | Josh Cho  |  
| [Transformer-based solutions using transfer learning and instruction fine-tuning conditional on context input data for downstream NLP tasks in the domain of job application pain points](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-170026140.pdf)  | Aris Aristorenas  |  
| [Controlling Toxicity using Backpacks](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-170028699.pdf)  | Advaya Gupta, Apoorva Dixit, Aditya Ashwini Agrawal  |  
| [Domain Adaptation to Climate Change with Improved BLEU Evaluation Method](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-170033439.pdf)  | Yunan Li  |  
| [BabyLLM Challenge: Encouraging Tree-Structured Calculations in Transformers](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-170033559.pdf)  | Vincelot Ravoson, Thomas James Little  |  
| [Embedding Freedom? An NLP Approach to Uncovering Pre- and Post-Abolition Racial Bias in Brazilian Literature](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-170035022.pdf)  | Ana Carolina Queiroz  |  
| [Bringing Back Black Boxes: Classification of TV news using neural nets *](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-170040070.pdf)  | Jennifer A Wu, Shun Yamaya  |  
| [Reinforcement Learning for Language Models](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-170040536.pdf)  | Wanqiao Xu, Paul Dupenloup, Gary Lurui Qian  |  
| [Measuring Mission Deviation in California Non-Profit Hospitals](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-170043982.pdf)  | Nova Josephine Bradford, Pranay Agrawal, Cesar Augusto Portocarrero Rodriguez  |  
| [Text Classification with language models and graph structures](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-170044583.pdf)  | Jian Xu, Fang Shu  |  
| [Probing Frozen NL Models for Alignment with Human Reasoning](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-170045941.pdf)  | Clara Greene MacAvoy, Claire Cheng  |  
| [Contextual Question Answering using variations of BiDAF and QANet](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-170047474.pdf)  | Achilleas Martinis  |  
| [DetectChatGPT: Black-Box Zero-Shot Detection of LLM-Generated Text](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-170049587.pdf)  | Julia Park  |  
| [DetectChatGPT: Black-Box Zero-Shot Detection of LLM-Generated Text](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-170049588.pdf)  | Armaan Rashid  |  
| [Tweet Sentiment Analysis to Predict Stock Market](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-170049613.pdf)  | Christian Luther Palomo  |  
| [Interpreting Transformers through Activation Sparsity](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-170049755.pdf)  | Quinn Isaiah Smalling, Dmitri Michelangelo Saberi  |  
| [Generating Molecules from Natural Language with Multimodal Contrastive Pre-Training](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-170049900.pdf)  | Romain Lacombe, Kateryna Pistunova, David Ludeke  |  
| [Exploring the Logical and Mathematical Capabilities of the BERT Embedding Space using Contrastive Learning](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-170498296.pdf)  | Mona Anvari  |  
## Default Projects  
| Project name  | Authors  |  
| --- | --- |  
| [Unifying Different NLP Tasks with A Question-answering Model](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169192000.pdf)  | Polycarpos Yiorkadjis, Yiyuan Wang  |  
| [Extending the BERT Model to a Multitask Loss Function Using Gradient Surgery](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169262140.pdf)  | Ali Lasemi  |  
| [Finetuning minBERT for Downstream Tasks](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169262874.pdf)  | Pete Rushton, Tyler Lee Nichols  |  
| [Default Project: minBERT and Downstream Tasks](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169309301.pdf)  | Rachel Yu, Mabel Jiang  |  
| [BERT’s Multitask Learning Adventures](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169311062.pdf)  | Yipeng Liu, Jonathan Richard Larkin  |  
| [Adjusting Dropout in Contrastive Learning of Sentence Embeddings](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169313796.pdf)  | Guillermo Frontera Sanchez, Maurice Andre Georgi  |  
| [minBERT and Downstream Tasks](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169316220.pdf)  | Regina Li Wang, Reva Parag Agashe, Jennie Jaeyoung Chung  |  
| [minBERT and Downstream Tasks](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169319223.pdf)  | Jason Alexander Chan  |  
| [Enhancing Multi-Task Text Classification with Contrastive Learning and Dataset Augmentation in BERT-like Models](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169320493.pdf)  | Phillip Yao-Lakaschus  |  
| [PALs of Alto: Comparing Adapter Modules and Projected Attention Layers for Multitask Learning](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169331001.pdf)  | Jonah Gordon Cader  |  
| [minBERT and Downstream Tasks](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169332864.pdf)  | Ibrahim Gulluk  |  
| [swissBERT: A Ready-to-Use Multitask Transformer](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169334568.pdf)  | Yixin Liu, Tom Shen, Violet Yao  |  
| [Improved BERT embeddings through Negative Rank Loss](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169346237.pdf)  | Aarya Cyril Mecwan, Torstein Orbeck Eliassen, Natalie V Bishay  |  
| [Exploring Strategies for Improved Performance in Multi-Task Learning with Pretrained-BERT](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169351230.pdf)  | Xiaolei Shi  |  
| [Is training all you need? Exploring further pretraining and multi-task finetuning on BERT](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169354456.pdf)  | Richard Liu, Umar Dizon Maniku  |  
| [BERT-MTS: Fine Tuning BERT for Multi-Task Serving](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169357817.pdf)  | Nishant Bharat Kanakia  |  
| [MinBERT and Downstream Tasks](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169360866.pdf)  | Adam Lida Zhao, Rohan Virani, Priyanka Mathikshara Mathialagan  |  
| [Multi-task NLP with BERT](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169360903.pdf)  | Christopher Edward King  |  
| [Implementing Projected Attention Layers (PALs) for Joint Multi-Task Learning](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169362421.pdf)  | TJ Tan  |  
| [Losing to Win: Evaluating the Success of Various Loss Functions Within Multitask Settings](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169362462.pdf)  | Jadon Armon Geathers  |  
| [minBERT and Multi-Task Learning for Downstream Tasks](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169367207.pdf)  | Jonathan Nathaniel Coronado, Michael Song Zhu  |  
| [Multiple Strategies to Improve minBERT Multitask Learning](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169367856.pdf)  | Colin Hall Kalicki  |  
| [Investigating BERT through Fine-Tuned Regularization and Layer-Level Adaptations for Multi-Task Performance.](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169368046.pdf)  | Arjun Pandey, Neel S Narayan  |  
| [Adapting the Contrast-Consistent Search Method to Multiclass Classification](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169368403.pdf)  | Diego Zancaneli  |  
| [Multi-Task Learning With a BERT-y Good Model](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169368723.pdf)  | Nabil Ahmed, David Karamardian  |  
| [Multitask Learning with Pre-trained BERT](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169369468.pdf)  | Yuntao Ma, Kevin Li, Jack Albright  |  
| [Pals and Gradient Vaccine for NLP Multitask Learning](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169369506.pdf)  | Hannah Cussen, Michela Marchini, Kate Madeline Callon  |  
| [Fine-Tuning BERT with Multi-Task Learning, Gradient Surgery, and Masked Language Modeling for Downstream NLP Tasks](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169370473.pdf)  | Gabriela F Aranguiz-Dias, Janelle Cheung  |  
| [Cuts and Stitches: Does Model Merging Produce Better Multitask Learners?](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169372696.pdf)  | Koren Gilbai Koren, Suppakit Waiwitlikhit, Akshana Mario Dassanaike-Perera  |  
| [minBERT for Multi-Task Learning](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169372795.pdf)  | Maoan Wang, Emily Chanel Stanford  |  
| [BERT Multi-Task Cosine Surgery: Applying Cosine Similarity and Gradient Surgery in a BERT Multi-Task Fine-Tuning Setting](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169372839.pdf)  | Graciela Magdalena Maria Smet, Nick Hisaka Aughney Walker  |  
| [Learning Better Together: Exploring Multi-Task Learning for Natural Language](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169372989.pdf)  | Kapil E Iyer  |  
| [BERT’s Mean Teacher and Multitask Fine-Tuning](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169374260.pdf)  | Kevin Tran, Anthony Qin  |  
| [Contrastive Pretraining of minBERT to Improve Performance in Downstream Tasks](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169374471.pdf)  | Nick Phillips  |  
| [Improving MinBERT: Gradient Surgery and Mixed-Precision Training](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169374715.pdf)  | Maxwell Chen  |  
| [Extending BERT for General Task Applicability](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169374771.pdf)  | Ben Jeon  |  
| [Around the BERT model: from a basic implementation to advanced optimizations and Multi-Task Learning](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169376110.pdf)  | Joachim Studnia, Yoni David Gozlan, Ines Dormoy  |  
| [Multitask BERT](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169377228.pdf)  | Caroline Kelsey Zanze, Drew Wadsworth  |  
| [Exploring Methods to Improve Robustness of Downstream Tasks for the BERT Language Model](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169377876.pdf)  | Kenny Dao, Viraj Mehta, Jeremy Tian  |  
| [Exploring Multitask BERT Optimizations for Sentiment Classification, Paraphrase Detection, and Semantic Textual Similarity](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169381517.pdf)  | Gashon Halif Hussein  |  
| [BERT-CF: Contrastive Flows for MultiTask-BERT](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169387098.pdf)  | George Hu  |  
| [Investigate multitask Performance of minBERT Ensemble](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169397219.pdf)  | Cheng Chang  |  
| [Multi-task Fine-tuning with BERT](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169425270.pdf)  | Sanjaye Elayattu  |  
| [BERT With Multitask Fine-Tuning and Loss Construction](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169426570.pdf)  | Prarthna Khemka, Grace Casarez  |  
| [Sentence part-enhanced minBERT: Incorporating sentence parts to improve BERT performance on downstream tasks](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169430209.pdf)  | Aaron Long Wan  |  
| [Improving Multitask MinBERT with Regularized Optimization and Contrastive Learning](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169460449.pdf)  | Zhengdan Li, Weian Yin  |  
| [Multi-task Learning with BERT in NLP](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169472020.pdf)  | Fan Wang  |  
| [Unitary Scalarization or Gradient Surgery? Best Practices for Multitask Fine-Tuning](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169473332.pdf)  | John David McEnany  |  
| [Generalizing BERT through Multi-Task Learning](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169475398.pdf)  | Caroline Wang  |  
| [minBERT and extensions for downstream tasks](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169489469.pdf)  | Shiqi Xia, Yixing Jiang  |  
| [Multitask BERT: Exploration and Extension](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169492472.pdf)  | Aqil Daud Naeem  |  
| [CS 224N: MinBERT and Downstream Tasks](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169496776.pdf)  | Rita Tlemcani, Cole Porter Sohn  |  
| [BERT Fine-Tuning with Contrastive Loss and Smoothness-Inducing Regularization](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169498574.pdf)  | Laura Wu, Frank Zhao  |  
| [BERT Extension Using SMART and Cosine Similarity Methodology](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169499186.pdf)  | Victor Cheruiyot, Donghun Daniel Kim, Xinwei Liu  |  
| [Improving minBERT Performance on Multiple Tasks through In-domain Pretraining, Negatives Ranking Loss Learning, and Hyperparameter Optimization](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169500618.pdf)  | Catherine Huang, Addison Reese Jadwin  |  
| [miniBERT and Multitasking: An Architectural Analysis](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169501632.pdf)  | Jack Francis Michaels  |  
| [Fine-tuning Multi-Task Learning in BERT Model](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169501726.pdf)  | Emily Guo, Cole Hobbs Crichton  |  
| [Failures of Improving minBERT with Similarity-based Triplet Networks](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169503425.pdf)  | JINPU CAO  |  
| [Improving MiniBERT’s Semantic Performance with Semantic-rich Sentence Embeddings](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169503936.pdf)  | Melvin Orichi Socana, Julia Rose Chin, Jay Sahil Chiruvolu  |  
| [Walk Less and Only Down Smooth Valleys](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169505895.pdf)  | Julian Edwin Lovett Cooper, Thomas Brink, Quinn Hollister  |  
| [Use Siamese BERT-Networks to fine-tune minBERT with downstream tasks](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169506118.pdf)  | Zihan Yi  |  
| [Exploring Multi-Task Learning for Robust Language Encoding with BERT](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169506594.pdf)  | Laura Maria Bravo Sanchez, Eduardo Alejandro Lozano Garcia  |  
| [BERT and MNRLLie: Extending minBERT with Deep Metric Learning and Gradient Surgery](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169506753.pdf)  | Jorge Martinez Alba, Henry Alexander Bradley, Ben Auslin  |  
| [Impact of BERT Extensions on Cross-Domain Text Classification](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169507190.pdf)  | Michelle Wa Lok, Arun Karthikeyan  |  
| [Fine-tuning BERT for Sentiment Analysis, Paraphrase Detection and Semantic Textual Similarity](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169507218.pdf)  | Annie Ma, Alexander Peng, Joseph Zhang  |  
| [Optimizing Multi-Task Classification Finetuning in BERT: a Multi-Pronged Approach](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169508330.pdf)  | Bar Weiner, Soham Konar, Aadi Nashikkar  |  
| [Style EmuLoRAtion in Text Generation: A Case Study with Joe Biden and Donald Trump](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169508409.pdf)  | Ori Spector  |  
| [Investigating BERT Model’s Abilities in Multi-Task Learning and Methods for Performance Improvement](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169508469.pdf)  | Mac Ya, Tommy Li  |  
| [Investigating Methods of Using Context to Augment pre-trained Language Models for Question Answering](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169508547.pdf)  | Rohan Reddy Davidi  |  
| [Engagement-based response generation for open-domain dialogue](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169508583.pdf)  | Ernesto Sung Woo Nam Song, Marcelo Pena  |  
| [Style EmuLoRAtion in Text Generation: A Case Study with Joe Biden and Donald Trump](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169508601.pdf)  | Luke Joseph Mann  |  
| [BERT and Learnie: Multi-task Classification Across Semantics Street](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169509036.pdf)  | Flora Huang, Sonia Hangjie Chu, Kachachan Chotitamnavee  |  
| [Combining Improvements for a Better BERT](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169510902.pdf)  | Diego Mitsutaka Ahmad-Stein, Emily Wesel  |  
| [BERT Goes to College: Exploring additional pretraining and multitask fine-tuning strategies with minBERT](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169511373.pdf)  | Peyton M Lee, Michelle Fu, Eric Zhang  |  
| [Fine-tuning minBERT on Downstream Tasks with Gradient Surgery and Weighted Losses](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169512769.pdf)  | Andrew J Gan, Gareth A Cockroft, Tee Monsereenusorn  |  
| [Efficient Finetuning for Multi-tasking minBERT](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169514243.pdf)  | Tz-Wei Mo, Annie Ho  |  
| [Enhancing BERT with Self-Supervised Attention](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169531125.pdf)  | Joshua Christopher Francis  |  
| [BERT Fine-tuning with Meta Learning](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169549027.pdf)  | Hui Xue  |  
| [Multitask Finetuning on BERT using Gradient Surgery and Linear Probing before Finetuning](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169563197.pdf)  | Arvind Venkat Mahankali  |  
| [Low Rank Adaptation for Multitask BERT](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169568390.pdf)  | Marco Tacke, Johannes Fuest  |  
| [Three Heads Are Better Than One](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169576388.pdf)  | Jesus E Meza Rosales  |  
| [Multi-task Learning using BERT](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169590512.pdf)  | Nina Cruz, Pankhuri Aggarwal  |  
| [Enhancing minBERT for Sentence Similarity with Cosine Similarity and Contrastive Learning](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169591022.pdf)  | Xiaomiao Zhang, Yi-Chin Huang  |  
| [Evaluating fine-tuning methods for robust multi-task sentence embeddings](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169603383.pdf)  | Connor Toups, Ammar A Alinur, Kaleb Berhe Tsegay  |  
| [Fine-tuning minBERT for Various Downstream Tasks](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169611889.pdf)  | Siqi Wang, Longling Tian  |  
| [Pre-training BERT: Swapped Subject Phrase Detection](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169620805.pdf)  | Maggie Wu  |  
| [BERT: A Master of All Trades or Jack of None?](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169621261.pdf)  | Tom Pritsky, Josselin Martin Somerville Roberts, Marie Amale Huynh  |  
| [Fine Tuning Multi Downstream Tasks based on BERT with Gradient Surgery](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169626435.pdf)  | Jiwen Chen  |  
| [Three Heads Are Better Than One](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169659061.pdf)  | Esteban Cambronero Saba  |  
| [Building Robust Adaptation for Multi-Task Learning over minBERT](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169667224.pdf)  | Joyce Pan, Tess Tao, Guhui Zhang  |  
| [minBERT Optimization with the SMART Learning Framework](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169672168.pdf)  | Yihan Shi, Zixuan Xu, Zeyu Sun  |  
| [Multi-task BERT Classification](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169683991.pdf)  | Shen Gao  |  
| [Multitask minBert](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169695581.pdf)  | Emma E Passmore, Sajel Galhotra, Riya Shirish Sankhe  |  
| [BERT Finetuning Analysis](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169710070.pdf)  | Xueying Xie  |  
| [BERT++: Trustworthy MultiTask Learning with BERT](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169716561.pdf)  | Zilu Wang, Yuwei Wu, Anh Hoang Nguyen  |  
| [Multi-Task Learning for Robust Contextualized Sentence Embedding Generation](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169717602.pdf)  | Yash Dalmia, Santino L Ramos  |  
| [PolarBERT: Enhancing Robustness and Generalizability of BERT Sentence Embeddings through Multiple Negatives Ranking Loss and Contrastive Learning](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169720334.pdf)  | Tyler Allan Hanson, Jaisal Kothari, Lucy Zhu  |  
| [Multi-Task Learning with BERT](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169722560.pdf)  | Naveen Kumar  |  
| [Investigating minBERT’s Performance on Negated Sentence Classification](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169723470.pdf)  | Emily Ito Okabe  |  
| [Enhance minBERT’s Performance on Multiple Sentence-Level Tasks using Downstream Techniques](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169724124.pdf)  | Vibhaakar Sharma, Mandy Leung, Chung Ching Cheung  |  
| [minBERT and Downstream Tasks](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169724933.pdf)  | Harvey Cai  |  
| [Data Augmentation with Feedback Control for BERT Multitask Finetuning](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169724968.pdf)  | Kevin Titat Supakkul, Ryan Mason Beauchamp  |  
| [BERT-based Multi-task Learning](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169725258.pdf)  | Sahar Kazemzadeh  |  
| [MultitaskBERT with Contrastive Pretraining and Fine-Grained Feature Learning](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169726902.pdf)  | Rui Deng, Jack Chen, ZHENGJI YANG  |  
| [minBERT and Multi-task Training with Gradient Surgery](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169727153.pdf)  | Yihe Tang, Yunqi Li  |  
| [A Comprehensive Analysis of Fine-Tuning Strategies for BERT](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169728058.pdf)  | Adam Hyungsuk Chun, Emily Angel Hsu, Emily Quynh Nguyen  |  
| [SuperBERT: Multi-task Finetuning with Domain Adaptation](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169728460.pdf)  | Mohamed Ibrahim Osman, Mohamed A Owda  |  
| [SMARTBert: Improving BERT Model Performance on Downstream Tasks Using Smoothness Inducing Adversarial Regularization](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169729336.pdf)  | Roy Yuan, Jennifer He  |  
| [Adversarial Transfer Learning for Continuous Natural Language Representation](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169729403.pdf)  | Jinyoung Kim, Matthew Jonathan Turk, Zhaoqiang Bai  |  
| [SerBERTus: A SMART Three-Headed BERT Ensemble](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169729542.pdf)  | Matthew John Hayes  |  
| [Techniques for Extracting Meaningful BERT Sentence Embeddings for Downstream Tasks](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169729697.pdf)  | Jacob Anwar Mejia, Michael Yuanyi Xue, Matthew Harvill  |  
| [Contrastive Learning for Generalizable Sentence Embeddings](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169729988.pdf)  | Shenghan Chen  |  
| [MT-BERT: Fine-tuning BERT for Downstream Tasks Using Multi-Task Learning](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169730024.pdf)  | Neha Kunjal, Hermann Nyuykonge Kumbong  |  
| [Prototypical Pre-Training for Robust Multi-Task Learning in Natural Language Processing](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169730119.pdf)  | Andre Yu Yeung, Rohan Sikand  |  
| [minBERT and Multiple Downstream Tasks](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169734788.pdf)  | Xianling Zhang  |  
| [Pals for PALs: Exploring Extensions to Projected Attention Layers for Sentence-Level Tasks](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169739344.pdf)  | Lainey Yifei Wang  |  
| [How to Fine-Tune BERT for Multiple Tasks?](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169818388.pdf)  | Jingru Cheng, Bohao He  |  
| [Finetuning a multitask BERT for downstream tasks](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169838451.pdf)  | Chenchen Gu  |  
| [Genre Classifications using Book and Film Descriptions](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169839493.pdf)  | Ari Webb, Mattheus Borges Wolff, Shaunak Bhandarkar  |  
| [Multitask Bert with Task Embedded Attentions (TEA-BERT)](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169852881.pdf)  | Chunjiang Mou, Sally Yao, Zifei Xu  |  
| [Fine-Tuning BERT for Sentiment Analysis, Paraphrase Detection and Semantic Text Similarity NLP Tasks](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169889383.pdf)  | Swathi Gangaraju, Andrew Cheng  |  
| [MOPS: Memory Occupancy and Performance Surveying when using Late-Stage Hard Parameter Sharing for BERT Multitask Learning](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169902736.pdf)  | Callum Jan Burgess, Mark Peter Bechthold, Anthony David Weng  |  
| [Multi-Task Learning BERT Model with Task-Specific Decoders](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169906158.pdf)  | Zhen Li  |  
| [Default Final Project: Improving minBERT with Entailment Learning](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169916770.pdf)  | Saksham Consul, Akash Rajesh Chaurasia, Carlota Pares Morlans  |  
| [Leave It To BERT: Exploring Methods for Robust Multi-Task Performance](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169917752.pdf)  | Abhi Kumar, Finn Alexander Dayton, Christopher Moffitt  |  
| [Extending BERT with Multi-task and Meta-learning](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169919951.pdf)  | Cam Scott Anton Burton, Anna NING  |  
| [Default Final Project: minBERT and Downstream Tasks (Multi-task Learning)](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169930418.pdf)  | Maximilian Sabayev, Samuel Chian  |  
| [Freeze Your Layers](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169939523.pdf)  | Alex Scott Thiesmeyer, Gautham Ryota Gorti  |  
| [Robust Embeddings using Contrastive and Multiple Negatives on BERT](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169939950.pdf)  | Ishan Sabane, Shoaib Mohammed  |  
| [A Sentence-BERT Extension to the minBERT Model](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169956358.pdf)  | Lisa Xuejie Yi, Shruti Sridhar  |  
| [BERTer Multi-task Fine-tuning for Sentence-Level Tasks](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169957033.pdf)  | Danny SungIn Park, Stanley Yang, Andrew S Chen  |  
| [Enhanced generalizable minBERT model for multiple downstream tasks](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169961814.pdf)  | Yi Qi  |  
| [Finetuning minBERT Model for Multiple Downstream Tasks](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169964588.pdf)  | Yuan Wang  |  
| [Adapting BERT for Multi-Task Learning with PALs](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169969295.pdf)  | Kathleen Cheng  |  
| [Beyond BERT: Deepening Natural Language Understanding with Multi-Task Learning and Advanced Embedding Techniques](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169969369.pdf)  | Matt Peng, Varun Madhu Kutirakulam, Mohammed Minhajuddin Majid  |  
| [Extension-BERT: Multitask Learning with BERT](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169971037.pdf)  | Jingwen Wu  |  
| [SBRRT: Investigating Extensions on BERT](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169977570.pdf)  | Diego Adrian Valdez Duran  |  
| [Data Augmentation for Multi-task BERT models Stanford CS224N Default Project](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169981883.pdf)  | Aditya Chandrasekar  |  
| [Multitasking with BERT](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169989122.pdf)  | Jack Jin Hung, Jiacheng Hu  |  
| [minBERT and Extensions over Downstream Tasks](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-169997382.pdf)  | Taiqi Zhao, Weimin Wan, Jerry Lin  |  
| [Enhancing miniBERT: Exploring Methods to Improve BERT Performance](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-170002492.pdf)  | Shivangi Agarwal, Ben Charles Hora, Yasmin Salehi  |  
| [We do it BERTer: Comparison of Finetuning Methods to Improve Sentence Embeddings](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-170013346.pdf)  | Alex Hodges, Ramya Ayyagari  |  
| [Exploring minBERT Performance Optimizations](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-170016958.pdf)  | Marie Chu, Emmy Thamakaison  |  
| [Implementing minBERT and Extensions for Multi-Task Learning](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-170026307.pdf)  | Yan Wang, Jiani Wang, Qinchen Wang  |  
| [Parameter Efficient Fine-tuning for Multi-task Learning](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-170032558.pdf)  | Jeffery Shen, Chih-Ying Liu  |  
| [Comparative Analysis of SimCSE for minBERT Optimization with Multiple Downstream Tasks](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-170040673.pdf)  | Runqiu Zhang  |  
| [SimCSE Lessens your Need to Seek BERT’s Attention](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-170044850.pdf)  | Andre Klawa  |  
| [Optimizing minBERT for Multiple Classification Tasks](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-170046287.pdf)  | Savitha Srinivasan, Edmond John Dilworth, Priyanka Shrestha  |  
| [Multitasking with minBERT](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-170046527.pdf)  | JungSuk Lee  |  
| [minBERT for Sentiment Analysis, Paraphrase Detection, and Semantic Textual Similarity](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-170047553.pdf)  | Shelly Goel, Haya Hidayatullah, Yoko Nagafuchi  |  
| [minBERT and Downstream Tasks](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-170047881.pdf)  | Yvonne Hong, Hodan Farah, Simrin Kalkat  |  
| [Training MinBERT with Contrastive Learning](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-170048780.pdf)  | Robert Walter Markham Thompson, Sal Rocco Spina, Patrick John Donohue  |  
| [Improving BERT computational efficiency](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-170049400.pdf)  | Julio Alberto Oscanoa Aida  |  
| [Glaucoma Surgery Outcome Prediction Using Progress Notes: A Comparative Study](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-170049507.pdf)  | Samuel Barry, Sarvesh R. Babu  |  
| [BERT for Sentiment Analysis, Paraphrase Detection and Semantic Textual Similarity with Cosine Similarity](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-170143680.pdf)  | Debolina Paul  |  
| [Multitasking with a single set of BERT embeddings](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-170190363.pdf)  | Adrien Lemercier  |  
| [Enhancing minBert Embeddings for Multiple Downstream Tasks Stanford CS224N Default Project](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-170371893.pdf)  | Donald Stephens  |  
| [Convolutional Gated Unit for Improved Multi-Task Learning](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-170384864.pdf)  | Princess Vongchanh, Daniel Contreras-Esquivel  |  
| [BERT Downstream task training utilizing different pooling methods](https://web.stanford.edu/class/archive/cs/cs224n/cs224n.1234/final-reports/final-report-170641802.pdf)  | Kaushik Sampath  |
