Team Ai
Datasetpublic

guicybercode/japan-math-philosophy-prompts

Japan Math Philosophy Prompts Microdataset autoral com problemas que combinam matemática e reflexão filosófica. Há 24 registros: oito instâncias editoriais, cada uma localizada em pt-BR, en e ja e mantida integralmente no split train. Todo o conteúdo foi gerado por modelo e permanece sem revisão humana. As respostas matemáticas funcionam como gabaritos curtos; os critérios filosóficos indicam qualidades esperadas de uma justificativa, não uma opinião obrigatória.… See the full description on the dataset page: https://huggingface.co/datasets/guicybercode/japan-math-philosophy-prompts.

sourceHugging Facecc-by-4.0updated 1mo agoView on Hugging Face
0likes42downloads
Dataset Card

Japan Math Philosophy Prompts

Microdataset autoral com problemas que combinam matemática e reflexão filosófica. Há 24 registros: oito instâncias editoriais, cada uma localizada em pt-BR, en e ja e mantida integralmente no split train.

Todo o conteúdo foi gerado por modelo e permanece sem revisão humana. As respostas matemáticas funcionam como gabaritos curtos; os critérios filosóficos indicam qualidades esperadas de uma justificativa, não uma opinião obrigatória.

Escopo cultural

Cada problema usa uma etiqueta alfanumérica neutra, de JMP-01 a JMP-08, como recurso editorial dentro de um cenário inventado. A relação explícita com o Japão é a localização integral dos oito problemas em japonês; as etiquetas não contêm vocabulário nem caracteres escolhidos por associação temática. O dataset:

  • —não apresenta os problemas como tradições, pedagogias ou filosofias japonesas autênticas;
  • —não afirma que pessoas japonesas compartilham uma mesma visão matemática ou filosófica;
  • —não ensina história cultural, etnografia ou vocabulário japonês;
  • —não usa os nomes ficcionais como evidência sobre práticas sociais reais.

Por isso, japan_reference.factual_claims e sources estão vazios em todos os registros. O campo script registra neutral-alphanumeric. Se uma versão futura acrescentar afirmações históricas ou culturais, ela deverá adicionar fontes específicas e passar por revisão humana competente.

Conteúdo

GrupoMatemáticaQuestão filosófica
01equivalência entre fração, decimal e porcentagemidentidade e representação
02reflexão no plano cartesianoidentidade sob transformação
03sequência definida por fórmuladiferença entre evidência e prova
04caminho mínimo em grafo ponderadoeficiência e justiça
05diferenças sucessivasintervalos e ausência como dados
06circunferência exata e aproximadaexatidão, erro e utilidade
07sequência geométricaprocesso infinito e limite
08probabilidade sem reposiçãoacaso, conhecimento e modelo

Estrutura dos registros

Cada linha de `data/train.jsonl` é um objeto JSON com:

  • —id, localization_group_id, language e split;
  • —title, prompt, math_topic e philosophical_focus;
  • —dois learning_objectives;
  • —expected_response.answer_key, short_answer e dois critérios de reflexão;
  • —uma orientação curta em facilitation_note;
  • —o escopo cultural explícito em japan_reference;
  • —sources, vazio porque não há afirmações culturais factuais;
  • —proveniência de geração e tradução, incluindo a raiz editorial pt-BR;
  • —a licença aplicável ao texto original.

As traduções en e ja apontam diretamente para o registro pt-BR da mesma tríade. O answer_key, o tópico matemático e a referência ficcional permanecem iguais entre as três localizações.

Carregamento

Em um clone local, usando datasets:

python
from datasets import load_dataset

dataset = load_dataset(
    "json",
    data_files="data/train.jsonl",
    split="train",
)
print(dataset[0])

No Hugging Face, o dataset pode ser carregado diretamente:

python
from datasets import load_dataset

dataset = load_dataset(
    "guicybercode/japan-math-philosophy-prompts",
    split="train",
)

Validação local

O validador usa apenas a biblioteca padrão do Python:

bash
python validate_japan.py
python -m unittest -v test_japan_dataset.py

Ele confere contagem, IDs, oito tríades completas, linhagem direta de tradução, campos obrigatórios, os oito gabaritos canônicos, proveniência, licença e delimitação cultural. A busca por generalizações explícitas é apenas uma heurística estreita e não substitui revisão semântica humana.

Usos pretendidos

  • —protótipos de tutoria e geração de respostas multilíngues;
  • —atividades para discutir matemática e filosofia em conjunto;
  • —testes pequenos de consistência entre localizações;
  • —demonstrações de cards e carregamento JSONL no Hugging Face.

Limitações e usos inadequados

  • —Não houve revisão matemática, pedagógica, cultural ou linguística humana.
  • —As reflexões filosóficas não são rubricas completas nem respostas definitivas.
  • —Os oito exemplos são pequenos demais para representar uma distribuição ampla de competências ou para avaliar um modelo de forma conclusiva.
  • —O material não deve ser usado como fonte sobre Japão, língua japonesa, tradições japonesas ou comportamento de pessoas japonesas.
  • —O conteúdo não foi preparado para decisões de alto impacto nem para substituir avaliação docente.

Antes de um release curado, recomenda-se revisão independente de matemática, pt-BR, inglês, japonês, pedagogia e enquadramento cultural.

Licença

O texto original do dataset é disponibilizado sob CC BY 4.0. Os scripts locais de validação são disponibilizados sob MIT. Consulte `LICENSE` para o escopo exato. A licença não reivindica exclusividade sobre fatos matemáticos, idiomas, caracteres ou materiais de terceiros.