| 1 |
CoTFormer: A Chain-of-Thought Driven Architecture with Budget-Adaptive Computation Cost at Inference |
提出CoTFormer以解决计算资源受限环境下的推理效率问题 |
chain-of-thought |
|
|
| 2 |
Semantic Parsing by Large Language Models for Intricate Updating Strategies of Zero-Shot Dialogue State Tracking |
提出ParsingDST以解决零样本对话状态跟踪中的复杂更新策略问题 |
large language model |
|
|
| 3 |
Gaining Wisdom from Setbacks: Aligning Large Language Models via Mistake Analysis |
通过错误分析提出新方法以提升大型语言模型的安全性 |
large language model |
|
|
| 4 |
Text Summarization Using Large Language Models: A Comparative Study of MPT-7b-instruct, Falcon-7b-instruct, and OpenAI Chat-GPT Models |
比较不同大语言模型在文本摘要中的应用效果 |
large language model |
|
|
| 5 |
Prediction of Arabic Legal Rulings using Large Language Models |
利用大型语言模型预测阿拉伯法律裁决 |
large language model |
|
|
| 6 |
Large Language Models Meet Open-World Intent Discovery and Recognition: An Evaluation of ChatGPT |
评估ChatGPT在开放世界意图发现与识别中的应用 |
large language model |
|
|
| 7 |
Battle of the Large Language Models: Dolly vs LLaMA vs Vicuna vs Guanaco vs Bard vs ChatGPT -- A Text-to-SQL Parsing Comparison |
比较多种大型语言模型在Text-to-SQL解析中的表现 |
large language model |
|
|
| 8 |
IDEAL: Influence-Driven Selective Annotations Empower In-Context Learners in Large Language Models |
提出影响驱动的选择性标注方法以降低大语言模型的标注成本 |
large language model |
✅ |
|
| 9 |
Towards reducing hallucination in extracting information from financial reports using Large Language Models |
提出利用大语言模型减少财报信息提取中的幻觉问题 |
large language model |
|
|
| 10 |
Mastering the Task of Open Information Extraction with Large Language Models and Consistent Reasoning Environment |
提出基于大语言模型的开放信息提取新方法 |
large language model |
|
|
| 11 |
On Context Utilization in Summarization with Large Language Models |
提出中间摘要方法以解决长文本摘要中的位置偏差问题 |
large language model |
✅ |
|
| 12 |
MechGPT, a language-based strategy for mechanics and materials modeling that connects knowledge across scales, disciplines and modalities |
提出MechGPT以连接多尺度材料失效领域的知识 |
large language model foundation model multimodal |
|
|
| 13 |
Privacy in Large Language Models: Attacks, Defenses and Future Directions |
分析大型语言模型隐私攻击与防御策略 |
large language model |
|
|
| 14 |
JMedLoRA:Medical Domain Adaptation on Japanese Large Language Models using Instruction-tuning |
提出JMedLoRA以解决日本医疗领域大语言模型适应问题 |
large language model |
|
|
| 15 |
Improving Large Language Model Fine-tuning for Solving Math Problems |
提出三种微调策略以提升大语言模型数学问题求解能力 |
large language model |
|
|
| 16 |
In-context Pretraining: Language Modeling Beyond Document Boundaries |
提出上下文预训练以解决文档边界推理问题 |
large language model |
|
|
| 17 |
Bridging the Novice-Expert Gap via Models of Decision-Making: A Case Study on Remediating Math Mistakes |
提出Bridge方法以解决新手与专家之间的知识差距 |
large language model |
✅ |
|
| 18 |
OpenAgents: An Open Platform for Language Agents in the Wild |
提出OpenAgents以解决语言代理在实际应用中的可用性问题 |
large language model |
|
|
| 19 |
Llemma: An Open Language Model For Mathematics |
提出Llemma以提升数学语言模型的性能 |
large language model |
|
|
| 20 |
Demonstrations Are All You Need: Advancing Offensive Content Paraphrasing using In-Context Learning |
提出基于上下文学习的攻击性内容改写方法以提升交流文明 |
large language model |
|
|
| 21 |
Character-LLM: A Trainable Agent for Role-Playing |
提出Character-LLM以模拟特定人物的角色扮演 |
large language model |
|
|
| 22 |
"Mistakes Help Us Grow": Facilitating and Evaluating Growth Mindset Supportive Language in Classrooms |
利用大型语言模型支持教师的成长型思维语言 |
large language model |
|
|
| 23 |
Data Contamination Through the Lens of Time |
通过时间视角分析大语言模型的数据污染问题 |
large language model |
|
|
| 24 |
G-SPEED: General SParse Efficient Editing MoDel |
提出G-SPEED以解决高效文本编辑需求 |
large language model |
✅ |
|
| 25 |
Evaluating the Reversal Curse in Model Editing |
提出双向语言模型编辑以解决反转诅咒问题 |
large language model |
|
|
| 26 |
Generative Calibration for In-context Learning |
提出生成校准方法以解决上下文学习中的标签偏移问题 |
large language model |
|
|
| 27 |
Learning to Rank Context for Named Entity Recognition Using a Synthetic Dataset |
提出合成数据集以优化长文档命名实体识别的上下文检索 |
large language model |
|
|