您现在的位置:首页 > 民生 > 科创 > 正文

中国大模型语料数据联盟迎来9家新成员 开源第二批语料数据

来源:新民晚报     记者:叶薇     作者:叶薇     编辑:陆佳慧     2023-09-09 09:25 | |

图说:活动现场 采访对象提供

新民晚报讯(记者 叶薇)为提升语料数据供给水平,推动大模型产业高质量发展加速应用创新与行业落地,由中国大模型语料数据联盟主办的数说新语·开放日首场活动昨天在上海人工智能实验室举行。

开放日上,中国专利技术开发公司、上海仲裁委员会、上海图书馆(上海科学技术情报研究所)、上海数据交易所、上海市社会信用促进中心、上海蜜度信息技术有限公司、上海钛米机器人股份有限公司、华东师范大学出版社有限公司、上海城建城市运营(集团)有限公司9家新成员单位加入“中国大模型语料数据联盟”,将共同为大模型技术深度发展与高水平应用提供更多元的数据要素保障。联盟发起单位代表为他们颁发了入盟纪念证书。

蜜度信息首席技术官刘益东发布了开源文本数据集蜜巢·花粉1.0,该数据集以互联网媒体数据为主,经过过滤清洗、多条件去重等精细化处理,来源可靠、质量高,并可持续稳定更新,截至目前,数据总量已超一亿条该数据集还经过了资深律师进行了数据合规前置审核。

蜜巢·花粉1.0已被应用于蜜度系列大模型的训练,在政务及媒体等垂直领域提供知识问答与内容生成、分析报告自动生成、文稿内容审校与润色改写等各类智能生成式服务。目前,各项服务已得到了用户的良好反馈。借此契机,蜜度将进一步降低大模型技术探索和落地的门槛,加速应用创新与行业落地。据悉,蜜巢·花粉1.0是继8月14日书生·万卷发布以来,联盟发布的第二个开源语料数据集。同时,多个联盟成员单位也已形成了语料数据开源方案,将陆续进入发布队列。

未来,联盟将持续发挥好“朋友圈”作用,凝聚各方资源,发挥各成员单位优势,群策群力,共同推动大模型语料数据高水平供给,为我国大模型发展做好数据支撑。


今日热点

网友评论 小提示:您要为您发表的言论后果负责,请各位遵守法纪注意语言文明
您还能输入300
最新评论 [展开]

新民报系成员|客户端|官方微博|微信矩阵|新民网|广告刊例|战略合作伙伴

新民晚报|新民网|新民周刊|新民晚报社区版

新民晚报数字报|新民晚报ipad版|新民网客户端

关于新民网|联系方式|工作机会|知识产权声明

北大方正|上海音乐厅|中卫普信|今日头条|钱报网|中国网信网|中国禁毒网|人民日报中央厨房

增值电信业务经营许可证(ICP):沪B2-20110022号|互联网新闻信息服务许可证:31120170003|信息网络传播视听节目许可证:0909381

广电节目制作经营许可证:(沪)字第536号|违法与不良信息举报电话15900430043|网络敲诈和有偿删帖跟帖评论自律管理承诺书

|沪公网安备 31010602000044号|沪公网安备 31010602000590号|沪公网安备 31010602000579号

新民晚报官方网站 xinmin.cn ©2023 All rights reserved