组会 | 2025-06-30

日期 6月 30, 2025
活动 课题组组会

本次组会收录 2 篇文献阅读分享。

分享成员

文献方向与要点

本次组会文献分享明细
文献与研究要点分享人发表信息资料

MedBench: A Large-Scale Chinese Benchmark for Evaluating Medical Large Language Models

该研究的主要贡献在于提出了MedBench,一个覆盖中国医疗教育与临床实践的高质量中文医学评估基准,用于系统评测医学大语言模型的知识掌握与推理能力,填补了统一评估标准的空白,并揭示当前医学与通用模型在该基准上的能力差距与潜力。

@李毅喆arXiv 2023-12暂无

LLM-Driven Cognitive Modeling for Personalized Travel Generation

本研究提出一种基于大语言模型(LLM)的认知出行建模方法,结果表明LLM驱动的认知建模不仅在准确性、多样性、效率方面优于传统方法,还具有良好的通用性与可扩展性,为模拟复杂社会行为、构建智能化交通系统以及其他社会计算场景提供了一种更先进、更可靠的技术路径。

@夏强IEEE Transactions on Computational Social Systems 2025-03暂无