随笔档案「2024年7月23日」：【论文解读】大模型算法发展 ... - 合合技术团队

公告

2024年7月23日

【论文解读】大模型算法发展

摘要：一、简要介绍论文研究了自深度学习出现以来，预训练语言模型的算法的改进速度。使用Wikitext和Penn Treebank上超过200个语言模型评估的数据集(2012-2023年)，论文发现达到设定性能阈值所需的计算大约每8个月减半一次，95%置信区间约为5到14个月，大大快于摩尔定律下的硬件增益阅读全文

posted @ 2024-07-23 15:48 合合技术团队阅读(179) 评论(0) 推荐(0)

intsig

公告

2024年7月23日

【论文解读】大模型算法发展