| 1 |
Evaluating Large Language Models at Evaluating Instruction Following |
提出LLMBar基准以评估大语言模型的指令遵循能力 |
large language model instruction following |
|
|
| 2 |
Parrot: Enhancing Multi-Turn Instruction Following for Large Language Models |
提出Parrot以增强大语言模型的多轮指令跟随能力 |
large language model instruction following |
|
|
| 3 |
Composite Backdoor Attacks Against Large Language Models |
提出复合后门攻击以增强大语言模型的安全性 |
large language model foundation model multimodal |
|
|
| 4 |
GenTKG: Generative Forecasting on Temporal Knowledge Graph with Large Language Models |
提出GenTKG以解决时序知识图谱预测问题 |
large language model foundation model |
✅ |
|
| 5 |
An Empirical Study of Instruction-tuning Large Language Models in Chinese |
深入研究中文指令调优大型语言模型的有效性 |
large language model chain-of-thought |
✅ |
|
| 6 |
Does Synthetic Data Make Large Language Models More Efficient? |
探讨合成数据在提升大型语言模型效率中的作用 |
large language model |
|
|
| 7 |
Found in the Middle: Permutation Self-Consistency Improves Listwise Ranking in Large Language Models |
提出置换自一致性以改善大语言模型的列表排名问题 |
large language model |
✅ |
|
| 8 |
A Resilient and Accessible Distribution-Preserving Watermark for Large Language Models |
提出DiPmark以解决水印技术在语言模型中的分布保持问题 |
large language model |
|
|
| 9 |
Synthetic Data Generation with Large Language Models for Text Classification: Potential and Limitations |
利用大型语言模型生成合成数据以提升文本分类性能 |
large language model |
|
|
| 10 |
On the Relationship between Sentence Analogy Identification and Sentence Structure Encoding in Large Language Models |
探讨大语言模型中句子类比识别与句子结构编码的关系 |
large language model |
|
|
| 11 |
The Past, Present and Better Future of Feedback Learning in Large Language Models for Subjective Human Preferences and Values |
综述人类反馈在大语言模型中的应用与挑战 |
large language model |
|
|
| 12 |
Survey on Factuality in Large Language Models: Knowledge, Retrieval and Domain-Specificity |
调查大型语言模型中的事实性问题及其解决方案 |
large language model |
|
|
| 13 |
How Do Large Language Models Capture the Ever-changing World Knowledge? A Review of Recent Advances |
综述大语言模型如何应对快速变化的世界知识问题 |
large language model |
✅ |
|
| 14 |
Beyond Factuality: A Comprehensive Evaluation of Large Language Models as Knowledge Generators |
提出CONNER框架以全面评估大型语言模型的知识生成能力 |
large language model |
|
|
| 15 |
Do Large Language Models have Shared Weaknesses in Medical Question Answering? |
评估大型语言模型在医学问答中的共性弱点 |
large language model |
|
|
| 16 |
Empowering Psychotherapy with Large Language Models: Cognitive Distortion Detection through Diagnosis of Thought Prompting |
提出思维诊断方法以解决心理治疗中的认知扭曲检测问题 |
large language model |
|
|
| 17 |
Argumentative Stance Prediction: An Exploratory Study on Multimodality and Few-Shot Learning |
提出多模态与少样本学习结合的方法以解决立场预测问题 |
multimodal |
|
|
| 18 |
InstructRetro: Instruction Tuning post Retrieval-Augmented Pretraining |
提出InstructRetro以提升检索增强预训练模型的指令调优效果 |
large language model foundation model |
✅ |
|
| 19 |
On the Impact of Cross-Domain Data on German Language Models |
提出跨域数据集以提升德语语言模型性能 |
large language model |
✅ |
|
| 20 |
QFT: Quantized Full-parameter Tuning of LLMs with Affordable Resources |
提出QFT框架以降低LLMs全参数调优的资源需求 |
large language model |
|
|
| 21 |
Diversity of Thought Improves Reasoning Abilities of LLMs |
提出DIVSE方法以提升大语言模型的推理能力 |
large language model |
|
|
| 22 |
Typing to Listen at the Cocktail Party: Text-Guided Target Speaker Extraction |
提出文本引导的目标说话人提取方法以解决隐私问题 |
large language model |
|
|
| 23 |
PHALM: Building a Knowledge Graph from Scratch by Prompting Humans and a Language Model |
提出PHALM以低成本构建知识图谱解决常识知识不足问题 |
large language model |
|
|