| 1 |
MMTClinic: Multimodal, Multilingual Time Series Question Answering and Reasoning Benchmark for Clinical Domain |
提出MMTClinic以解决临床领域多模态多语言时间序列问答问题 |
large language model multimodal chain-of-thought |
|
|
| 2 |
From Vision to Language: Investigating Causal Information Flow in Multimodal Decision-Making |
提出跨模态因果干预方法以增强视觉语言模型的决策理解 |
multimodal |
|
|
| 3 |
CC-Mediation: Evaluating Large Language Models for Cross-Cultural Conflict Mediation |
提出CC-Mediation以解决跨文化冲突调解评估问题 |
large language model |
|
|
| 4 |
Can Large Language Models Anticipate Behavioral Responses to Social Policies? A Case of Pension Enrollment Prediction among China's Flexible Workers |
提出FlexPension-LLM以解决中国灵活工人养老金登记预测问题 |
large language model |
|
|
| 5 |
Large Language Models with At Most One Spike per Neuron |
提出基于TTFS编码的脉冲神经网络以解决LLM能效问题 |
large language model |
|
|
| 6 |
On Epistemic Diversity in Large Language Models |
提出评估大语言模型的认识多样性框架以解决知识获取问题 |
large language model |
|
|
| 7 |
PetQA: Benchmarking Veterinary Knowledge and Clinical Reasoning |
提出PetQA基准以评估兽医知识和临床推理能力 |
large language model multimodal |
|
|
| 8 |
Tracing Audio Grounding and Answer Selection in Audio LLMs |
提出音频LLMs的音频基础与答案选择机制研究 |
large language model |
|
|
| 9 |
A Human-in-the-Loop Framework for AI-Assisted Scoring in Large-Scale Writing Assessment |
提出人机协作框架以提升大规模写作评估的评分效率 |
large language model |
|
|
| 10 |
Refuse without Refusal: A Structural Analysis of Safety-Tuning Responses for Reducing False Refusals in Language Models |
提出安全调优响应结构分析以减少语言模型的错误拒绝问题 |
large language model |
|
|
| 11 |
Improving Language Identification for Code-Switched Utterances with Integer Linear Programming |
通过整数线性规划改进代码切换语句的语言识别 |
large language model |
|
|
| 12 |
Beneath the Surface of Chains-of-Thought: A Mechanistic Interpretation of Reasoning Operations in LLMs |
探讨大语言模型推理操作的几何结构 |
large language model |
✅ |
|
| 13 |
Choosing the Right Language Mode at Inference Time for Multilingual Reliability |
提出RAAI框架以提高多语言模型在低资源语言上的推理可靠性 |
large language model |
|
|