| 1 |
Skywork: A More Open Bilingual Foundation Model |
提出Skywork-13B以解决双语模型训练开放性不足问题 |
large language model foundation model |
|
|
| 2 |
Chain-of-Thought Embeddings for Stance Detection on Social Media |
提出链式思维嵌入以解决社交媒体立场检测问题 |
large language model chain-of-thought |
|
|
| 3 |
Integrating Summarization and Retrieval for Enhanced Personalization via Large Language Models |
提出摘要增强检索方法以提升个性化体验 |
large language model |
|
|
| 4 |
BioInstruct: Instruction Tuning of Large Language Models for Biomedical Natural Language Processing |
提出BioInstruct以提升生物医学自然语言处理性能 |
large language model |
|
|
| 5 |
Evaluating Large Language Models: A Comprehensive Survey |
提出全面评估大型语言模型的方法以确保其安全发展 |
large language model |
✅ |
|
| 6 |
Large Language Models: The Need for Nuance in Current Debates and a Pragmatic Perspective on Understanding |
提出细致分析以深化对大型语言模型的理解 |
large language model |
|
|
| 7 |
Towards A Holistic Landscape of Situated Theory of Mind in Large Language Models |
提出全面的机器心智理论分类以评估大型语言模型的心智状态 |
large language model |
✅ |
|
| 8 |
LLMaAA: Making Large Language Models as Active Annotators |
提出LLMaAA以提高大语言模型的主动标注效率 |
large language model |
|
|
| 9 |
Generative retrieval-augmented ontologic graph and multi-agent strategies for interpretive large language model-based materials design |
提出基于生成检索增强本体图的多智能体策略以支持材料设计 |
large language model |
|
|
| 10 |
The Eval4NLP 2023 Shared Task on Prompting Large Language Models as Explainable Metrics |
提出Eval4NLP 2023共享任务以评估大语言模型的可解释性指标 |
large language model |
|
|
| 11 |
Exploring the Reliability of Large Language Models as Customized Evaluators for Diverse NLP Tasks |
探讨大型语言模型作为定制评估者的可靠性以解决NLP任务评估问题 |
large language model |
|
|
| 12 |
Dynamics of Instruction Fine-Tuning for Chinese Large Language Models |
系统研究中文大语言模型的指令微调动态特性 |
large language model |
|
|
| 13 |
MiLe Loss: a New Entropy-Weighed Loss for Mitigating the Bias of Learning Difficulties in Large Language Models |
提出MiLe Loss以解决语言模型学习困难的偏差问题 |
large language model |
|
|
| 14 |
M4LE: A Multi-Ability Multi-Range Multi-Task Multi-Domain Long-Context Evaluation Benchmark for Large Language Models |
提出M4LE基准以系统评估大语言模型的长序列能力 |
large language model |
|
|
| 15 |
Building Real-World Meeting Summarization Systems using Large Language Models: A Practical Perspective |
利用大语言模型构建真实场景会议摘要系统 |
large language model |
|
|
| 16 |
LILO: Learning Interpretable Libraries by Compressing and Documenting Code |
提出LILO框架以优化代码库的生成与文档化 |
large language model |
|
|
| 17 |
Explaining Tree Model Decisions in Natural Language for Network Intrusion Detection |
利用大语言模型为决策树网络入侵检测提供自然语言解释 |
large language model |
|
|
| 18 |
Which Examples to Annotate for In-Context Learning? Towards Effective and Efficient Selection |
提出AdaICL以解决有限预算下的示例选择问题 |
large language model |
|
|
| 19 |
MoCa: Measuring Human-Language Model Alignment on Causal and Moral Judgment Tasks |
提出MoCa以评估人类语言模型在因果与道德判断任务中的一致性 |
large language model |
|
|
| 20 |
Interpretable-by-Design Text Understanding with Iteratively Generated Concept Bottleneck |
提出可解释的文本理解框架以解决黑箱模型问题 |
large language model |
|
|
| 21 |
Improving Input-label Mapping with Demonstration Replay for In-context Learning |
提出重复演示与滑动因果注意力以改善上下文学习中的输入标签映射 |
large language model |
|
|
| 22 |
Constituency Parsing using LLMs |
利用大型语言模型解决句法分析问题 |
large language model |
|
|