景联文科技上新高质量大模型训练数据！

时间：2024-03-25 13:27:24

作者：景联文科技

浏览：次

在过去的一年中，人工智能领域呈现出了风起云涌的态势，其中模型架构、训练数据、多模态技术、超长上下文处理以及智能体发展等方面均取得了突飞猛进的发展。

在3月24日举办的2024全球开发者先锋大会的大模型前沿论坛上，上海人工智能实验室的领军科学家林达华表示，大模型研发机构的核心竞争力在于能否大规模地生产出高质量的数据，这是推动大模型持续创新和进步的关键因素。

景联文科技是大语言模型数据供应商，致力于为不同阶段的模型算法匹配高质量数据资源。

生物数据：

l 核酸库 4000W

l 蛋白库 50W

l 蛋白结构库 19W

l 通路库 1000W

l 生信工具

药学数据：

l 药物研发数据库 1300万

l 全球上市数据库 80万

l 一致性评价数据库 25万

l 生产检验数据库 40万

l 合理用药 300万

l 多维文献 1亿

l 原料药数据库 1100万

化学数据：

l 化合物数据库 1.6亿

l 反应信息数据库 4100万

l 物化性质数据库 1.6亿

l 谱图数据库 20万

l 晶体信息数据库 100万

l 安全信息数据库 180万

l 商品信息数据库 740万

材料数据：

l 金属材料数据 20万

l 纳米材料数据 30万

l 相图数据 6万

l 材料性能数据 20万

l 材料腐蚀数据

l 表面处理数据

l 焊接材料数据

专利数据：

l 全球专利基础著录数据 1.3亿

l 全球专利原文数据 1亿

l 全球专利附图数据

l 全球专利法律状态数据

l 全球专利引文数据

l 全球专利分类索引数据

l 全球专利重点申请人工商关联数据

l 全球生化医药专利深加工数据

l 全球专利全文数据

医疗器械数据：

l 国内政策法规数据 3k条

l 行业标准数据

l 中国医疗器械审评数据 20W条

l 中国医械临床试验数据 5K条

l 全球医械临床试验数据 7W

l 医用耗材中标数据 1400W

l 医用耗材带量采购数据 400W

l 医用设备招投标数据38W

同时景联文科技提供大模型训练数据的标注服务，致力于为全球数千家人工智能从业公司和高校科研机构交付海量、高质量的多模态大模型训练数据。

景联文科技｜数据采集｜数据标注｜大语言模型训练数据

助力人工智能技术，赋能传统产业智能转型升级

文章图文著作权归景联文科技所有，商业转载请联系景联文科技获得授权，非商业转载请注明出处。

上一篇：大模型刷屏“两会”，景联文科技提供高质量大模型数据下一篇：景联文科技高质量大模型训练数据汇总！

返回列表

首页

民用数据服务

数据采集

数据标注

AI数据集

智能标注平台

假指纹制作

大模型数据集

智能标注平台

新闻动态

关于我们

景联文科技上新高质量大模型训练数据！

相关推荐

景联文科技：提供卓越数据标注服务，助力人工智能发展

景联文科技出席全国两化融合标委会工业数据标准工作组2024年全体成员大会，与各单位共同建设工业高质量数据集

再获认可，景联文科技成为全国数标委的四个标准工作组成员单位

景联文科技：精准语音标注，驱动语音技术新发展

景联文科技入选中国信通院发布的“人工智能数据标注产业图谱”

模型观察室专栏：OpenAI上线满血版o1，最强大模型来了！

热门文章

最新文章

19157628936

AI数据集

大模型数据集

智能标注平台

新闻动态

关于我们