| 1 |
Agent Instructs Large Language Models to be General Zero-Shot Reasoners |
提出自主代理以提升大型语言模型的零-shot推理能力 |
large language model chain-of-thought |
|
|
| 2 |
MapperGPT: Large Language Models for Linking and Mapping Entities |
提出MapperGPT以提升实体映射的准确性 |
large language model |
|
|
| 3 |
Procedural Text Mining with Large Language Models |
利用大型语言模型提取无结构PDF文本中的程序信息 |
large language model |
|
|
| 4 |
Concise and Organized Perception Facilitates Reasoning in Large Language Models |
提出简洁有序感知以提升大语言模型推理能力 |
large language model |
|
|
| 5 |
LLM-Coordination: Evaluating and Analyzing Multi-agent Coordination Abilities in Large Language Models |
提出LLM-Coordination基准以评估大语言模型的多智能体协调能力 |
large language model |
✅ |
|
| 6 |
Redefining Digital Health Interfaces with Large Language Models |
提出基于大语言模型的数字健康接口以解决临床应用信任问题 |
large language model |
|
|
| 7 |
Controllable Multi-document Summarization: Coverage & Coherence Intuitive Policy with Large Language Model Based Rewards |
提出可控的多文档摘要方法以解决长输入生成问题 |
large language model |
|
|
| 8 |
Evaluating Hallucinations in Chinese Large Language Models |
提出HalluQA基准以评估中文大语言模型的幻觉现象 |
large language model |
|
|
| 9 |
Reformulating Domain Adaptation of Large Language Models as Adapt-Retrieve-Revise: A Case Study on Chinese Legal Domain |
提出适应-检索-修订框架以解决中文法律领域的LLM适应问题 |
large language model |
|
|
| 10 |
A New Dialogue Response Generation Agent for Large Language Models by Asking Questions to Detect User's Intentions |
提出EDIT框架以解决对话生成中的用户意图识别问题 |
large language model |
|
|
| 11 |
A Formalism and Approach for Improving Robustness of Large Language Models Using Risk-Adjusted Confidence Scores |
提出风险调整信心评分以提高大语言模型的鲁棒性 |
large language model |
|
|
| 12 |
Can Large Language Models be Good Path Planners? A Benchmark and Investigation on Spatial-temporal Reasoning |
提出PPNL基准以评估大语言模型的路径规划能力 |
large language model |
|
|
| 13 |
FreshLLMs: Refreshing Large Language Models with Search Engine Augmentation |
提出FreshQA与FreshPrompt以解决大型语言模型动态适应性不足问题 |
large language model |
|
|
| 14 |
InstructProtein: Aligning Human and Protein Language via Knowledge Instruction |
提出InstructProtein以解决生物序列理解不足问题 |
large language model chain-of-thought |
|
|
| 15 |
Fine-tuning Aligned Language Models Compromises Safety, Even When Users Do Not Intend To! |
揭示自定义微调对语言模型安全性的潜在威胁 |
large language model |
|
|
| 16 |
Exploring the evolution of research topics during the COVID-19 pandemic |
提出CORD-19主题可视化工具以分析COVID-19研究主题演变 |
large language model |
|
|
| 17 |
Benchmarking a foundation LLM on its ability to re-label structure names in accordance with the AAPM TG-263 report |
利用大型语言模型标准化放射肿瘤学结构名称 |
large language model |
|
|
| 18 |
GoLLIE: Annotation Guidelines improve Zero-Shot Information-Extraction |
提出GoLLIE以改善零-shot信息提取任务的表现 |
large language model |
|
|
| 19 |
PrIeD-KIE: Towards Privacy Preserved Document Key Information Extraction |
提出隐私保护的文档关键信息提取方法以解决数据隐私问题 |
foundation model |
|
|
| 20 |
Learning Personalized Alignment for Evaluating Open-ended Text Generation |
提出PerSE框架以解决开放式文本生成评估中的人类偏好对齐问题 |
large language model |
|
|
| 21 |
Predicting Emergent Abilities with Infinite Resolution Evaluation |
提出PassUntil评估策略以预测大语言模型的任务性能 |
large language model |
|
|