| 1 |
Rephrase, Augment, Reason: Visual Grounding of Questions for Vision-Language Models |
提出RepARe以解决视觉语言模型中的问题表述不足 |
large language model visual grounding |
|
|
| 2 |
LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models |
提出LLMLingua以解决大语言模型推理效率低下问题 |
large language model chain-of-thought |
|
|
| 3 |
How Abilities in Large Language Models are Affected by Supervised Fine-tuning Data Composition |
提出双阶段混合微调策略以优化大语言模型能力 |
large language model instruction following |
|
|
| 4 |
A Closer Look into Automatic Evaluation Using Large Language Models |
探讨大型语言模型在文本质量自动评估中的应用与优化 |
large language model chain-of-thought |
|
|
| 5 |
The Program Testing Ability of Large Language Models for Code |
探索大型语言模型在程序测试中的能力 |
large language model |
|
|
| 6 |
GraphLLM: Boosting Graph Reasoning Ability of Large Language Model |
提出GraphLLM以提升大语言模型的图推理能力 |
large language model |
|
|
| 7 |
The potential of large language models for improving probability learning: A study on ChatGPT3.5 and first-year computer engineering students |
利用大型语言模型提升概率学习效果的研究 |
large language model |
|
|
| 8 |
Cabbage Sweeter than Cake? Analysing the Potential of Large Language Models for Learning Conceptual Spaces |
探索大语言模型在概念空间学习中的潜力 |
large language model |
|
|
| 9 |
Compressing Context to Enhance Inference Efficiency of Large Language Models |
提出选择性上下文方法以提升大语言模型推理效率 |
large language model |
|
|
| 10 |
Are Large Language Models Geospatially Knowledgeable? |
探讨大型语言模型在地理空间知识理解中的能力 |
large language model |
|
|
| 11 |
Terminology-Aware Translation with Constrained Decoding and Large Language Model Prompting |
提出术语感知翻译方法以解决术语准确性问题 |
large language model |
|
|
| 12 |
SC-Safety: A Multi-round Open-ended Question Adversarial Safety Benchmark for Large Language Models in Chinese |
提出SC-Safety以评估中文大语言模型的安全性 |
large language model |
|
|
| 13 |
A Survey of Large Language Models for Healthcare: from Data, Technology, and Applications to Accountability and Ethics |
综述大型语言模型在医疗领域的应用与挑战 |
large language model |
|
|
| 14 |
Glitter or Gold? Deriving Structured Insights from Sustainability Reports via Large Language Models |
利用大语言模型提取可持续发展报告中的结构化洞察 |
large language model |
|
|
| 15 |
LAiW: A Chinese Legal Large Language Models Benchmark |
构建LAiW基准以评估中文法律大语言模型的实用能力 |
large language model |
|
|
| 16 |
DRIN: Dynamic Relation Interactive Network for Multimodal Entity Linking |
提出DRIN以解决多模态实体链接中的对齐问题 |
multimodal |
|
|
| 17 |
Regulation and NLP (RegNLP): Taming Large Language Models |
提出RegNLP以解决大型语言模型的监管与风险问题 |
large language model |
|
|
| 18 |
Guiding Language Model Reasoning with Planning Tokens |
提出层次化生成方案以增强语言模型推理能力 |
large language model chain-of-thought |
|
|
| 19 |
The Importance of Prompt Tuning for Automated Neuron Explanations |
通过提示调优提升自动神经元解释质量 |
large language model |
|
|
| 20 |
BYOC: Personalized Few-Shot Classification with Co-Authored Class Descriptions |
提出BYOC方法以解决个性化少样本文本分类问题 |
large language model |
|
|
| 21 |
MuggleMath: Assessing the Impact of Query and Response Augmentation on Math Reasoning |
提出MuggleMath以提升数学推理任务的模型性能 |
large language model |
✅ |
|
| 22 |
Put Your Money Where Your Mouth Is: Evaluating Strategic Planning and Execution of LLM Agents in an Auction Arena |
提出AucArena评估框架以测试LLM代理在拍卖中的战略规划能力 |
large language model |
|
|
| 23 |
Generative Judge for Evaluating Alignment |
提出生成评估模型Auto-J以解决人类需求对LLM评估的挑战 |
large language model |
✅ |
|
| 24 |
GPT-who: An Information Density-based Machine-Generated Text Detector |
提出GPT-who以解决机器生成文本检测问题 |
large language model |
✅ |
|
| 25 |
Towards Emotion-Based Synthetic Consciousness: Using LLMs to Estimate Emotion Probability Vectors |
利用大语言模型估计情感概率向量以推动合成意识研究 |
large language model |
|
|
| 26 |
Towards Verifiable Generation: A Benchmark for Knowledge-aware Language Model Attribution |
提出知识感知语言模型归因方法以解决LLM幻觉问题 |
large language model |
|
|
| 27 |
Establishing Trustworthiness: Rethinking Tasks and Model Evaluation |
重新思考NLP任务与模型评估以提升信任度 |
large language model |
|
|
| 28 |
GROVE: A Retrieval-augmented Complex Story Generation Framework with A Forest of Evidence |
提出GROVE框架以解决复杂故事生成问题 |
large language model |
|
|
| 29 |
Resolving the Imbalance Issue in Hierarchical Disciplinary Topic Inference via LLM-based Data Augmentation |
基于大语言模型的数据增强方法解决学科主题推断中的数据不平衡问题 |
large language model |
|
|