DataLearner 标志DataLearnerAI
最新AI资讯
大模型排行榜
大模型评测基准
大模型列表
大模型对比
资源中心
工具
语言中文
DataLearner 标志DataLearner AI

专注大模型评测、数据资源与实践教学的知识平台,持续更新可落地的 AI 能力图谱。

产品

  • 评测榜单
  • 模型对比
  • 数据资源

资源

  • 部署教程
  • 原创内容
  • 工具导航

关于

  • 关于我们
  • 隐私政策
  • 数据收集方法
  • 联系我们

© 2026 DataLearner AI. DataLearner 持续整合行业数据与案例,为科研、企业与开发者提供可靠的大模型情报与实践指南。

隐私政策服务条款
  1. 首页/
  2. 博客列表/
  3. 博客详情

彭博社发布金融领域的ChatGPT模型——BloombergGPT

2023/04/24 22:45:14
1,143 阅读
BloombergGPT

彭博社今天发布了一份研究论文,详细介绍了BloombergGPT的开发,这是一个新的大规模生成式人工智能(AI)模型。这个大型语言模型(LLM)经过专门的金融数据训练,支持金融业内的多种自然语言处理(NLP)任务。

与最近发布的模型不同,BloombergGPT是Bloomberg基于基于Hoffmann等人(2022年)和Le Scao等人(2022年)的指南进行设计。目前很少存在领域特定的LLM,这些模型仅在领域特定的数据源上进行训练,或者将一个非常大的通用模型适应于领域特定任务。而Bloomberg则是选择在领域特定和通用数据源上训练LLM。

该模型是是基于BLOOM(BLOOM是BigScience团队研发的一个大模型:https://www.datalearner.com/ai-models/pretrained-models/bloom )的仅解码器因果语言模型。

BloombergGPT目前已经收录进入DataLearner模型库中:https://www.datalearner.com/ai-models/pretrained-models/BloombergGPT

需要注意的是,BloombergGPT里面使用的金融数据占比约54.2%,约有3630亿个tokens。

彭博社的研究人员开创了一种混合方法,将金融数据与通用数据集相结合,训练出一个在金融基准测试中取得最佳成绩的模型,同时在通用LLM基准测试中保持竞争性能。

为了实现这一里程碑,彭博社的机器学习产品和研究团队与公司的人工智能工程团队合作,构建了迄今为止最大的专业领域数据集之一,利用了公司现有的数据创造、收集和筛选资源。作为一家金融数据公司,彭博社的数据分析师在过去40年中收集和维护了金融语言文档。团队从这个广泛的金融数据档案中提取数据,创建了一个包含3630亿个英语金融文档的全面数据集。

这些数据与一个包含3450亿个token的公共数据集相结合,形成了一个超过7000亿个token的大型训练语料库。利用这部分训练语料库,团队训练了一个500亿个参数的仅解码器因果语言模型。

得注意的是,BloombergGPT模型在金融任务上的表现远远优于现有的同等大小的开放模型,同时在通用NLP基准测试中表现相当或更好。

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码
返回博客列表

热门博客

  • 1Dirichlet Distribution(狄利克雷分布)与Dirichlet Process(狄利克雷过程)
  • 2回归模型中的交互项简介(Interactions in Regression)
  • 3贝塔分布(Beta Distribution)简介及其应用
  • 4矩母函数简介(Moment-generating function)
  • 5普通最小二乘法(Ordinary Least Squares,OLS)的详细推导过程
  • 6使用R语言进行K-means聚类并分析结果
  • 7深度学习技巧之Early Stopping(早停法)
  • 8手把手教你本地部署清华大学的ChatGLM-6B模型——Windows+6GB显卡本地部署