| 文献与研究要点 | 分享人 | 发表信息 | 资料 |
|---|---|---|---|
MedBench: A Large-Scale Chinese Benchmark for Evaluating Medical Large Language Models该研究的主要贡献在于提出了MedBench,一个覆盖中国医疗教育与临床实践的高质量中文医学评估基准,用于系统评测医学大语言模型的知识掌握与推理能力,填补了统一评估标准的空白,并揭示当前医学与通用模型在该基准上的能力差距与潜力。 | arXiv 2023-12 | 暂无 | |
LLM-Driven Cognitive Modeling for Personalized Travel Generation本研究提出一种基于大语言模型(LLM)的认知出行建模方法,结果表明LLM驱动的认知建模不仅在准确性、多样性、效率方面优于传统方法,还具有良好的通用性与可扩展性,为模拟复杂社会行为、构建智能化交通系统以及其他社会计算场景提供了一种更先进、更可靠的技术路径。 | IEEE Transactions on Computational Social Systems 2025-03 | 暂无 |