遇见数据集

Dataset from:An Evaluation of Large Language Models in Bioinformatics Research

收藏
Zenodo2025-07-25 更新2026-05-26 收录
官方服务:

资源简介:

This repository contains the data and code to reproduce the results of our paper: Dataset from:An Evaluation of Large Language Models in Bioinformatics Research Authors: Hengchuang Yin Section_A_ddi: ddinter_positive_samples.csv: Positive drug–drug interaction (DDI) pairs curated from the DDInter database. ddinter_negative_samples.csv: Negative drug–drug interaction (DDI) pairs (no known interactions), used for supervised classification. drug_description_embeddings_all-mpnet-base-v2.npy: Drug description embeddings generated using the all-mpnet-base-v2 model. drug_description_embeddings_bge-large-en-v1.5.npy: Drug description embeddings generated using the bge-large-en-v1.5 model. drug_description_embeddings_e5-small-v2.npy: Drug description embeddings generated using the e5-small-v2 model. drug_description_embeddings_gtr-t5-large.npy: Drug description embeddings generated using the gtr-t5-large model. drug_description_embeddings_text_embedding_3_large.npy: Drug description embeddings generated using OpenAI's text-embedding-3-large model. drug_description_embeddings_text_embedding_3_small.npy: Drug description embeddings generated using OpenAI's text-embedding-3-small model. drug_description_embeddings_text_embedding_ada_002.npy: Drug description embeddings generated using OpenAI's text-embedding-ada-002 model.

提供机构:
Zenodo
创建时间:
2025-07-25
二维码
社区交流群
二维码
科研交流群
商业服务