您现在的位置是:首页 > 科技信息 > 正文
大型语言模型在历史知识领域遭遇挑战:复杂历史问题成解题软肋
发布时间:2025-01-20 11:33:01编辑:季茗柔来源:
最新研究显示,人工智能在处理复杂历史问题时表现不佳。在NeurIPS会议上公布的研究中,最先进的大型语言模型(LLM)在历史知识测试中的成绩令人失望,其中表现最佳的GPT-4Turbo准确率仅为46%。这些模型在基本史实方面尚可,但在深入历史研究时力不从心,经常出错。
研究人员指出,AI模型倾向于从主流历史叙事中推断,难以把握细微历史细节,且在处理某些地区(如撒哈拉以南非洲)的历史问题时表现更差,暴露出训练数据可能存在的偏差。尽管如此,研究团队仍对AI在历史研究中的应用前景保持乐观,并正在改进测试基准,以期开发出更优秀的模型。
标签:
猜你喜欢
- TikTok服务虽已恢复,但苹果谷歌微软应用商店仍未重新上架
- 智谱华章重磅推出!AI生视频新品清影2.0全量上线智谱清言,免费试用开启
- B站跨年晚会神曲惊艳亮相:赵本山经典小品《卖拐》被创意改编为歌曲
- 百度文库AI功能月活突破9000万大关,自由画布AI创作平台公测启动
- 国产大型无人机鸿雁HY100量产交付,最大载重达9吨
- 速度飙升百倍!新型磁光存储器引领超快计算新时代
- 骗子竟显仁义?女子遭QQ诈骗痛失300万,反获一万生活费陷阱
- 这次CES展会上,NVIDIA荣膺五大奖项,令对手艳羡不已!
- 中国互联网:挥别青春,迈入成熟新篇章
- 中国互联网:挥别青春,步入稳健发展新纪元
- 苹果App Store限时充值特惠:充值即享10%加成,上限1000元!
- 极越汽车履行承诺,员工工资及N+1赔偿顺利到账
- 低成本智驾技术虽诱人,用户体验才是制胜法宝
- 微软发布Windows AI搜索功能内测,革新文件检索体验
- 淘天集团革新多模态对齐技术,有效缓解视觉大模型幻觉难题
- ChatGPT API曝出重大安全漏洞,或成DDoS攻击新利器
- AI基准组织Epoch AI因隐瞒OpenAI资助遭质疑
- 2025年半导体市场前景展望:AI成为核心驱动力
- 泰坦军团新款40寸144Hz IPS显示器震撼上市,首发特惠1939元
- 游戏主播逆战烧饼哥:另类鸡娃法,考不好就上战场