| 1 |
FollowBench: A Multi-level Fine-grained Constraints Following Benchmark for Large Language Models |
提出FollowBench以解决大语言模型指令遵循评估不足的问题 |
large language model instruction following |
✅ |
|
| 2 |
PsyCoT: Psychological Questionnaire as Powerful Chain-of-Thought for Personality Detection |
提出PsyCoT以提升个性检测的准确性 |
large language model chain-of-thought |
✅ |
|
| 3 |
Making Large Language Models Better Data Creators |
提出统一数据创建管道以解决数据标注成本高的问题 |
large language model instruction following |
|
|
| 4 |
Multi-Agent Consensus Seeking via Large Language Models |
通过大语言模型实现多智能体共识寻求 |
large language model |
|
|
| 5 |
Filter bubbles and affective polarization in user-personalized large language model outputs |
探讨用户个性化大语言模型输出中的过滤气泡与情感极化问题 |
large language model |
|
|
| 6 |
Robust Safety Classifier for Large Language Models: Adversarial Prompt Shield |
提出对抗性提示保护模型以增强大语言模型的安全性 |
large language model |
|
|
| 7 |
Do large language models solve verbal analogies like children do? |
研究大型语言模型在类比推理中的表现与儿童相似 |
large language model |
|
|
| 8 |
Theory of Mind in Large Language Models: Examining Performance of 11 State-of-the-Art models vs. Children Aged 7-10 on Advanced Tests |
通过对比儿童与LLMs,探讨大语言模型的心智理论能力 |
large language model |
|
|
| 9 |
Leveraging Word Guessing Games to Assess the Intelligence of Large Language Models |
提出基于词语猜测游戏的框架以评估大型语言模型的智能 |
large language model |
|
|
| 10 |
InstructCoder: Instruction Tuning Large Language Models for Code Editing |
提出InstructCoder以解决代码编辑任务中的指令执行问题 |
large language model |
✅ |
|
| 11 |
Video-Helpful Multimodal Machine Translation |
提出EVA数据集和SAFA模型以解决多模态翻译中的歧义问题 |
multimodal |
✅ |
|
| 12 |
Learning From Mistakes Makes LLM Better Reasoner |
提出LEMA方法以提升大语言模型的推理能力 |
large language model |
✅ |
|
| 13 |
BadLlama: cheaply removing safety fine-tuning from Llama 2-Chat 13B |
提出一种低成本方法以去除Llama 2-Chat的安全微调 |
large language model |
|
|
| 14 |
BERTwich: Extending BERT's Capabilities to Model Dialectal and Noisy Text |
提出BERTwich以解决方言和噪声文本建模问题 |
zero-shot transfer |
|
|
| 15 |
Defining a New NLP Playground |
提出20多个研究方向以重塑NLP研究环境 |
large language model |
|
|
| 16 |
AMERICANO: Argument Generation with Discourse-driven Decomposition and Agent Interaction |
提出AMERICANO框架以解决论证生成问题 |
chain-of-thought |
|
|
| 17 |
GAR-meets-RAG Paradigm for Zero-Shot Information Retrieval |
提出GAR-meets-RAG范式以解决零样本信息检索问题 |
large language model |
|
|
| 18 |
DEPN: Detecting and Editing Privacy Neurons in Pretrained Language Models |
提出DEPN框架以检测和编辑预训练语言模型中的隐私神经元 |
large language model |
|
|