datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
developers-questions-small-qe2
Developers Questions Small QE2
A dataset consisting of ~12k developers' questions, in English. These questions are synthetically generated via local LLMs at Orama.
Datasets
The dataset is proposed with three different embedding models:
bge-small-en-v1.5
bge-base-en-v1.5
bge-large-en-v1.5
It also contains a quantized version for each model:
bge-small 32 bytes
bge-base 32 bytes
bge-large 32 bytes
For each quantized model, this repository includes a binary containing the… See the full description on the dataset page: https://huggingface.co/datasets/OramaSearch/developers-questions-small-qe2.developers-high-quality-mozgach
developers-high-quality-mozgach
Описание
Высококачественные примеры для разработчиков, сгенерированные mozgach108.
Датасет содержит отборные примеры для различных задач программирования:
Написание кода
Отладка
Рефакторинг
Архитектурные решения
Code review
Тестирование
Особенность: высокое качество ответов, сгенерированных специализированной моделью mozgach108.
Сгенерировано через Ollama (mozgach108:latest).
Статистика
Всего примеров: 1200… See the full description on the dataset page: https://huggingface.co/datasets/nativemind/developers-high-quality-mozgach.developers-108-perfect
developers-108-perfect
Описание
Датасет для обучения AI помощников разработчиков (continue.ai).
Включает 7 специализированных сфер × 108 примеров:
073: Developer - написание кода
074: Code Reviewer - проверка и ревью кода
075: Architect - проектирование систем
076: DevOps Engineer - CI/CD и инфраструктура
077: QA Tester - тестирование и качество
078: Technical Writer - документация
Плюс духовная сфера 001 + 1080 примеров Alpaca.
Сгенерировано через Ollama… See the full description on the dataset page: https://huggingface.co/datasets/nativemind/developers-108-perfect.
