Team Ai
Datasetpublic

OpenScientificCodeRegistry/Database

Open Scientific Code Registry (OSCR): the authors' scripts The code published by the authors of open-access neuroscience papers, as found and verified by Open Scientific Code Registry (OSCR). Each file is here exactly as it is at the source, at the verified commit, under the license of its repository. 421,275 unique files (3,782 MB of text) from 8,849 repositories, in 24 Parquet block(s). Only files whose repository's license allows redistribution, confirmed by the repository's… See the full description on the dataset page: https://huggingface.co/datasets/OpenScientificCodeRegistry/Database.

sourceHugging Faceotherupdated 2d agoView on Hugging Face
0likes5.6kdownloads
github.com__massspecdl__chemembed.json255 linesDownload Raw Back to 01
1{2 "format": "oscr-script-manifest/1",3 "repository": "github.com/massspecdl/chemembed",4 "url": "https://github.com/massspecdl/ChemEmbed",5 "host": "github.com",6 "commit": "d930f9f221300cc5a12ab177072df684292c4bed",7 "license": "MIT",8 "license_confirmed_by": "license file LICENSE",9 "redistribution": "yes",10 "files": [11  {12   "path": "ChemEmbed_Sample_Test.ipynb",13   "sha256": "498ccd0894dfa1b8371346b5b1cd6c566003d78bc213df378d6bc1fbfcb4d53c",14   "language": "Jupyter",15   "lines": 334,16   "truncated": false,17   "block": 11,18   "row": 1330919  },20  {21   "path": "LICENSE",22   "sha256": "1e566110b5666ee96716964a58dda73b30808aa1125ac24ae07a0cde14f7c0b2",23   "language": "License",24   "lines": 21,25   "truncated": false,26   "block": 11,27   "row": 1419628  },29  {30   "path": "README.md",31   "sha256": "179fb06ff0b8239797e38d36072c64a5c2ef480714b505f4726e6c5712f885c5",32   "language": "Text",33   "lines": 482,34   "truncated": false,35   "block": 13,36   "row": 701637  },38  {39   "path": "chemembed_per_spectrum.py",40   "sha256": "6c6b1c52af4642b8b40ecbf2386d54f4d69e1285a387304897ab4ebbca5a55b0",41   "language": "Python",42   "lines": 178,43   "truncated": false,44   "block": 12,45   "row": 1636946  },47  {48   "path": "main.py",49   "sha256": "3a40114572b3b84fd88da050507a6fb666eb9bb3191a1a23111344606d1cdccc",50   "language": "Python",51   "lines": 20,52   "truncated": false,53   "block": 12,54   "row": 484255  },56  {57   "path": "src/chemembed/__init__.py",58   "sha256": "e8e1b2028def5e1ca0d4c13cea11bf2acd4d530039dff31c3f27d9943bddb4e5",59   "language": "Python",60   "lines": 30,61   "truncated": false,62   "block": 12,63   "row": 656264  },65  {66   "path": "src/chemembed/chembert_eval/chembert_cnn/dataset.py",67   "sha256": "f0330c320210a1811aa5c82b816dca2faac56bf27a3101d33d49daaf37fb6ee2",68   "language": "Python",69   "lines": 76,70   "truncated": false,71   "block": 12,72   "row": 784273  },74  {75   "path": "src/chemembed/chembert_eval/chembert_cnn/main.py",76   "sha256": "d231958ee4588145f27004b8c83ea6381a8e85ab0e5a35b31adaa7e31fe60c8b",77   "language": "Python",78   "lines": 160,79   "truncated": false,80   "block": 12,81   "row": 1476182  },83  {84   "path": "src/chemembed/chembert_eval/chembert_cnn/model_cnn.py",85   "sha256": "993df8a7a33b3b7c9221b9361e88bd28c72bd11804b39a5e4f6c2ddd3c1b5f0c",86   "language": "Python",87   "lines": 109,88   "truncated": false,89   "block": 12,90   "row": 1006991  },92  {93   "path": "src/chemembed/chembert_eval/chembert_dnn/dataset.py",94   "sha256": "f0330c320210a1811aa5c82b816dca2faac56bf27a3101d33d49daaf37fb6ee2",95   "language": "Python",96   "lines": 76,97   "truncated": false,98   "block": 12,99   "row": 7842100  },101  {102   "path": "src/chemembed/chembert_eval/chembert_dnn/main.py",103   "sha256": "c6fba49c98c903a294f801de4221e4176dc4d6f207605aa9fccb63ebc522ac3a",104   "language": "Python",105   "lines": 176,106   "truncated": false,107   "block": 12,108   "row": 15128109  },110  {111   "path": "src/chemembed/chembert_eval/chembert_dnn/model_dnn.py",112   "sha256": "f63e04dd4465b7bcecfd9940de38b18fc7c45f122c0977333bc77906fbf34d15",113   "language": "Python",114   "lines": 40,115   "truncated": false,116   "block": 12,117   "row": 6108118  },119  {120   "path": "src/chemembed/chembert_eval/data_preprocessing.py",121   "sha256": "ce972b086dcf2a91b07d8ed23bc78adab0a6de9edb34318b0c4c8e294de30697",122   "language": "Python",123   "lines": 443,124   "truncated": false,125   "block": 12,126   "row": 20061127  },128  {129   "path": "src/chemembed/chembert_eval/mol2vec_with_dnn/dataset.py",130   "sha256": "f0330c320210a1811aa5c82b816dca2faac56bf27a3101d33d49daaf37fb6ee2",131   "language": "Python",132   "lines": 76,133   "truncated": false,134   "block": 12,135   "row": 7842136  },137  {138   "path": "src/chemembed/chembert_eval/mol2vec_with_dnn/main.py",139   "sha256": "a8ca3f42add72f222adcb154b17e88d30ca4a9d0eb1a143ea93dcc2961013872",140   "language": "Python",141   "lines": 177,142   "truncated": false,143   "block": 12,144   "row": 15140145  },146  {147   "path": "src/chemembed/chembert_eval/mol2vec_with_dnn/model_dnn.py",148   "sha256": "6b7bc7732508e2a8b754cdab557d2f223c61d4b0135a648839e1b198e8c1f7aa",149   "language": "Python",150   "lines": 40,151   "truncated": false,152   "block": 12,153   "row": 6107154  },155  {156   "path": "src/chemembed/chemembed_by_file.py",157   "sha256": "66fc3d7df87b338560fef36e26f6bba796635ffaf0672bf44d783daf858b8106",158   "language": "Python",159   "lines": 1136,160   "truncated": false,161   "block": 13,162   "row": 266163  },164  {165   "path": "src/chemembed/chemembed_single_file.py",166   "sha256": "79b10991b5bcb7e104e342479590fd34cd1a88f83ee9cfc7e29f6e233132ab8b",167   "language": "Python",168   "lines": 88,169   "truncated": false,170   "block": 12,171   "row": 11831172  },173  {174   "path": "src/chemembed/cli.py",175   "sha256": "ff3e69179858e1892704e89fdccdef67c07f306cd4e2f04c9eae725b44e5071f",176   "language": "Python",177   "lines": 63,178   "truncated": false,179   "block": 12,180   "row": 10897181  },182  {183   "path": "src/chemembed/cnn_train/up_cnn_model.py",184   "sha256": "ec9ee9a851e08b17e164743bc2f6ddbae7bc9a549d7c0a00ad17cff22e68d566",185   "language": "Python",186   "lines": 106,187   "truncated": false,188   "block": 12,189   "row": 10081190  },191  {192   "path": "src/chemembed/data_loaders/inference_dataset_loader.py",193   "sha256": "18e10779ef68b2321c1b1a5edc670c761ed4685f790446ebb9d3122f2d45e04f",194   "language": "Python",195   "lines": 31,196   "truncated": false,197   "block": 12,198   "row": 6081199  },200  {201   "path": "src/chemembed/data_loaders/spectra_inference_dataset_loader.py",202   "sha256": "9e4b8f902ce84cb70552a59b7188193a7bc8eb1fc354fd6d603be8341a576ba8",203   "language": "Python",204   "lines": 28,205   "truncated": false,206   "block": 12,207   "row": 5447208  },209  {210   "path": "src/chemembed/data_processing.py",211   "sha256": "60058445cab51edfba02ba9a659fb7994575e4a6f0eb5ccf834ce8bd24910f94",212   "language": "Python",213   "lines": 443,214   "truncated": false,215   "block": 12,216   "row": 20177217  },218  {219   "path": "src/chemembed/model_utils.py",220   "sha256": "24fae60477b55679a23c07ff1628e7e3af72f31384e6a74f781bfb62beff7be6",221   "language": "Python",222   "lines": 69,223   "truncated": false,224   "block": 12,225   "row": 9343226  },227  {228   "path": "src/chemembed/reference_utils.py",229   "sha256": "d1bea6de54bd0d8dc0d5afa2354d500b5121f78efbfb9ffca339843d66c33fe9",230   "language": "Python",231   "lines": 399,232   "truncated": false,233   "block": 12,234   "row": 20404235  },236  {237   "path": "tests/test_precursor_matching.py",238   "sha256": "1b3671c43d02bb898c9b30e91b8c66fe41bc232d1eb9a6c58eb29669601f0df0",239   "language": "Python",240   "lines": 317,241   "truncated": false,242   "block": 12,243   "row": 19335244  },245  {246   "path": "tests/test_smoke.py",247   "sha256": "5c76e4944413f5db9424ed6e3a7b35571614eb9d9591341110136c03e02bff9e",248   "language": "Python",249   "lines": 195,250   "truncated": false,251   "block": 12,252   "row": 16174253  }254 ]255}