cs.CL 2311.00176

ChipNeMo: Domain-Adapted LLMs for Chip Design

ChipNeMo combines DAPT, instruction fine-tuning, and RAG to enhance chip design tasks, outperforming GPT-4 in key benchmarks.

Mingjie Liu, Teodor-Dumitru Ene, Robert Kirby et al.

2023-11-01 41
cs.CL 2310.17217

Beyond MLE: Convex Learning for Text Generation

Convex function-based training sharpens output distribution, improving BLEU/ROUGE scores by over 9 points in text generation tasks.

Chenze Shao, Zhengrui Ma, Min Zhang et al.

2023-10-26 44
cs.CL 2310.10683

Large Language Model Unlearning

Large Language Model Unlearning uses gradient ascent to reduce undesirable behaviors efficiently.

Yuanshun Yao, Xiaojun Xu, Yang Liu

2023-10-14 32