大语言模型的温度、top_k等超参数
AI大语言模型是一种强大的工具,可以用来生成各种文本,比如故事、新闻和对话。但是,为了让这些生成的文本更有趣、 … 阅读更多
AI大语言模型是一种强大的工具,可以用来生成各种文本,比如故事、新闻和对话。但是,为了让这些生成的文本更有趣、 … 阅读更多
在之前的文章中,我们介绍了 KV 缓存,这是一种常见的 LLM 推理过程优化方法,它可以使(自)注意力机制的计 … 阅读更多
大型语言模型(LLM)在自然语言处理领域取得了巨大成功,但其高昂的计算成本和庞大的内存需求也成为了限制其应用的 … 阅读更多
在信息爆炸的时代,如何从海量信息中找到我们真正需要的内容,成为了一个重要问题。JStarCraft RNS 应 … 阅读更多
在过去十年中,推荐系统的研究和应用变得越来越重要。这些系统可以帮助用户找到他们可能感兴趣的项目,从而提高公司的 … 阅读更多
近年来,变形金刚(Transformers)凭借其强大的能力,在自然语言处理领域取得了巨大成功,成为深度学习的 … 阅读更多
循环神经网络(RNN)长期以来一直是建模时序数据的经典架构,但它们在训练长序列时却臭名昭著地难以训练。这是因为 … 阅读更多
近年来,大型语言模型(LLM)在各个领域都取得了显著的成就,其应用范围涵盖聊天机器人、文本到图像/视频合成、代 … 阅读更多