金融界 2025 年 5 月 12 日消息,国家知识产权局信息显示,辉达公司申请一项名为“使用大语言模型的合成数据生成”的专利,公开号 CN119962662A,申请日期为 2024 年 11 月。
专利摘要显示,本公开涉及使用大语言模型的合成数据生成。在各个示例中,可以使用包括对应语言模型(例如,自回归 LLM)的问题和答案生成模型来生成合成问题‑答案(QA)对。可以使用表示特定知识库的文本数据储存库来通过将来自储存库的文本数据划分为表示上下文的文本单元(例如,段落)来获取合成 QA 对。对于每个文本单元,问题生成模型可以被提示以从该文本单元生成合成问题,并且答案生成模型可以被提示以生成对合成问题的合成答案。可以使用文本蕴涵和/或人工评估来过滤掉可能由于幻觉产生的低质量、不正确和/或无效的 QA 对。因此,合成 QA 对可以用作和/或可以用于生成一个或更多个机器学习模型的训练数据。
本文源自:金融界
作者:情报员
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.