One Feedback System Does Not Fit All: Localising Data-to-Text Driver Coaching for the United Kingdom and Nigeria
本文针对不同地区驾驶辅导内容本地化问题,通过比较英国和尼日利亚的数据到文本驾驶辅导系统,提出基于当地知识、风险、法规等定制化建议的方法。
0 citationsRead paper
本文针对不同地区驾驶辅导内容本地化问题,通过比较英国和尼日利亚的数据到文本驾驶辅导系统,提出基于当地知识、风险、法规等定制化建议的方法。
本文指出当前公平性基准测试过于简单,并通过实验展示仅用一个示例即可大幅提升模型在BBQ等基准上的表现,呼吁更全面的公平性评估方法。
本文通过开发一个基于常规病理和临床信息的因果多模态AI模型,解决了乳腺癌化疗敏感性个性化预测的问题,以减少过度化疗。
本文研究语言模型生成中结构启动效应,通过控制实验发现语义一致性增强结构启动,并在不同句式中观察到启动量差异。
本文构建了FinExam-10K数据集,用于评估金融推理能力,并通过对比多种模型表现,提出了一种基于FunctionGraph-RAG的方法来提高解答准确性。
本文针对不同地区驾驶辅导内容本地化问题,通过比较英国和尼日利亚的数据到文本驾驶辅导系统,提出基于当地知识、风险、法规等定制化建议的方法。
本文指出当前公平性基准测试过于简单,并通过实验展示仅用一个示例即可大幅提升模型在BBQ等基准上的表现,呼吁更全面的公平性评估方法。
本文通过开发一个基于常规病理和临床信息的因果多模态AI模型,解决了乳腺癌化疗敏感性个性化预测的问题,以减少过度化疗。
本文研究语言模型生成中结构启动效应,通过控制实验发现语义一致性增强结构启动,并在不同句式中观察到启动量差异。
本文构建了FinExam-10K数据集,用于评估金融推理能力,并通过对比多种模型表现,提出了一种基于FunctionGraph-RAG的方法来提高解答准确性。