| 1 |
When Machines Speak: A Unified Generative Framework for Integrating Machine-Native Symbols into Pretrained Large Language Models |
提出UniLang框架以解决语言模型与机器符号的整合问题 |
large language model |
|
|
| 2 |
Automated Summarization of Financial News Using Large Language Models and Retrieval-Augmented Generation: An Early Empirical Study (Fall 2023) |
利用大型语言模型和检索增强生成技术自动化金融新闻摘要 |
large language model |
|
|
| 3 |
ConceptGuard: Benchmarking Context-Sensitive Unlearning in Large Language Models |
提出ConceptGuard以解决大语言模型的上下文敏感性遗忘问题 |
large language model |
|
|
| 4 |
FormalTCS: Benchmarking End-to-End Frontier Formal Theoretical Computer Science Research of Large Language Models |
提出FormalTCS基准以评估大语言模型在理论计算机科学研究中的表现 |
large language model |
|
|
| 5 |
When Text and Numbers Disagree: Evidence Arbitration in Large Language Models |
提出合成基准以解决大语言模型证据仲裁问题 |
large language model |
|
|
| 6 |
OenoBench: A Wine-Domain Benchmark for Knowledge-Grounded Evaluation of Large Language Models |
提出OenoBench以评估大型语言模型在葡萄酒领域的知识能力 |
large language model |
|
|
| 7 |
HealMed: Multilingual Evaluation of Large Language Models in Medicine |
提出HealMed基准以评估医学领域多语言大语言模型的性能 |
large language model |
|
|
| 8 |
Robust Incomplete Multimodal Sentiment Analysis via Iterative Proxy Correction |
提出迭代代理修正框架以解决多模态情感分析中的不完整性问题 |
multimodal |
|
|
| 9 |
Dynamic Gated Cross-Modal Fusion with Sarcastic-aware Contrastive Regularization for Multimodal Sarcasm Detection |
提出动态门控跨模态融合以解决多模态讽刺检测问题 |
multimodal |
|
|
| 10 |
Projector Is All You Train |
提出仅训练投影器以提升多模态大语言模型性能 |
large language model multimodal |
|
|
| 11 |
Auditing Cross-Lingual Fairness in Language Model Watermarking |
提出跨语言公平性审计框架以优化语言模型水印评估 |
large language model |
|
|
| 12 |
FlashPrefill V2: Block-Sparse Prefill Attention for Long-Context LLM Serving |
提出FlashPrefill V2以解决长上下文LLM服务中的注意力计算瓶颈 |
large language model |
|
|
| 13 |
The Asymmetric Harms of LLM Compression |
系统评估LLM压缩对知识保留和偏见的影响 |
large language model |
|
|
| 14 |
Mitigating Identity Essentialism in LLM Agents with Longitudinal Life Trajectories |
提出LifeMem框架以解决LLM代理中的身份本质主义问题 |
large language model |
|
|
| 15 |
Generating Diverse Personas for User Simulators to Test Interview Dialogue Systems |
提出自动生成用户角色以测试面试对话系统的方法 |
large language model |
|
|
| 16 |
Does Listening Matter? Backchanneling and Nodding in AI Clone |
通过多模态听觉行为提升AI克隆的真实感与存在感 |
multimodal |
|
|
| 17 |
Mitigating Identity Essentialism in LLM Agents with Longitudinal Life Trajectories |
提出LifeMem框架以解决LLM代理中的身份本质主义问题 |
large language model |
|
|