百川智能今日宣布推出 Baichuan2-192K 大模型。据介绍,该模型上下文窗口长度达 192K,能够处理约 35 万个汉字,号称是目前全球最长的上下文窗口。
百川智能表示,Baichuan2-192K是目前支持长上下文窗口最优秀大模型 Claude2(100K 上下文窗口,实测约 8 万字)的 4.4 倍,是 GPT-4(支持 32K 上下文窗口,实测约 2.5 万字)的 14 倍。
IT之家注:上下文窗口长度是大模型的核心技术之一,通过更大的上下文窗口,模型能够结合更多上下文内容获得更丰富的语义信息,更好地捕捉上下文的相关性、消除歧义,进而更加准确、流畅地生成内容,提升模型能力。
Baichuan2-192K 在 Dureader、NarrativeQA、LSHT、TriviaQA 等 10 项中英文长文本问答、摘要的评测集上表现良好,有 7 项取得 SOTA。
百川智能表示,Baichuan2-192K 将以 API 调用和私有化部署的方式提供给企业用户,目前百川智能已启动 Baichuan2-192K 的 API 内测,开放给法律、媒体、金融等行业的核心合作伙伴。
(来源金融界)市场观察所刊载信息,来源于网络,并不代表本媒体观点。本文所涉及的信息.数据和分析均来自公开渠道,如有任何不实之处、涉及版权问题,请联系我们及时处理。本文仅供读者参考,任何人不得将本文用于非法用途,由此产生的法律后果由使用者自负。投诉举报请联系邮箱:News_Jubao@163.com
聚焦商业经济报告和前瞻商业趋势分析,市场观察非新闻媒体不提供互联网新闻服务;