{
  "schema": "crovia.sonar.provenance_scan.v1",
  "scanned_at": "2026-09-15T02:44:15.427970Z",
  "models_scanned": 500,
  "summary": {
    "with_training_section": 105,
    "with_declared_datasets": 139,
    "with_base_model": 282,
    "with_license": 362,
    "avg_provenance_score": 0.308
  },
  "chains": [
    {
      "model_id": "mradermacher/ASTRA-14B-Thinking-v1-i1-GGUF",
      "scanned_at": "2026-09-15T02:04:18.780385Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Emperorizzis/ASTRA-14B-Thinking-v1",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Emperorizzis/ASTRA-14B-Thinking-v1"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Emperorizzis/ASTRA-14B-Thinking-v1",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Emperorizzis/ASTRA-14B-Thinking-v1"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Emperorizzis/ASTRA-14B-Thinking-v1",
          "confidence": 0.85,
          "raw_context": "--- arxiv: 2601.21558 base_model: Emperorizzis/ASTRA-14B-Thinking-v1 language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "--- arxiv: 2601.21558 base_model: Emperorizzis/ASTRA-14B-Th"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:Emperorizzis/ASTRA-14B-Thinking-v1",
          "value": "ASTRA-SFT-1k",
          "confidence": 0.48,
          "raw_context": "tic and parameter-satisfiable. - **Sample Data:** [ASTRA-SFT-1k](https://huggingface.co/datasets/Emperorizzis/ASTRA-SFT-1k)  ### 2. Automated Verif"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:Emperorizzis/ASTRA-14B-Thinking-v1",
          "value": "ASTRA-RL-1k",
          "confidence": 0.48,
          "raw_context": "for reinforcement learning.   - **Sample Data:** [ASTRA-RL-1k](https://huggingface.co/datasets/Emperorizzis/ASTRA-RL-1k)  ## Training Process  Th"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Emperorizzis/ASTRA-14B-Thinking-v1",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "_name: transformers pipeline_tag: text-generation arxiv: 2601.21558 tags: - tool-use - agent - reinforcem"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "ASTRA-SFT-1k",
        "ASTRA-RL-1k",
        "voc"
      ],
      "base_model": "Emperorizzis/ASTRA-14B-Thinking-v1",
      "base_model_chain": [
        "Emperorizzis/ASTRA-14B-Thinking-v1",
        "Qwen/Qwen3-14B",
        "Qwen/Qwen3-14B-Base"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.4,
      "provenance_hash": "315295fab01713128cff012621a119911b3cc25e55ad7c356de7e9c3f8d43efb"
    },
    {
      "model_id": "mradermacher/ATLAS-8B-Thinking-GGUF",
      "scanned_at": "2026-09-15T02:04:28.171120Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "Arc-Intelligence/Arc-ATLAS-Teach-v0",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:Arc-Intelligence/Arc-ATLAS-Teach-v0"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Arc-Intelligence/ATLAS-8B-Thinking",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Arc-Intelligence/ATLAS-8B-Thinking"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Arc-Intelligence/ATLAS-8B-Thinking",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Arc-Intelligence/ATLAS-8B-Thinking"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Arc-Intelligence/ATLAS-8B-Thinking",
          "confidence": 0.85,
          "raw_context": "--- base_model: Arc-Intelligence/ATLAS-8B-Thinking datasets: - Arc-Intelligence/Arc-ATLAS-Teach-v0 l"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:Arc-Intelligence/ATLAS-8B-Thinking",
          "value": "Arc-Intelligence/Arc-ATLAS-Teach-v0",
          "confidence": 0.6400000000000001,
          "raw_context": "ey to the framework's reliability. - **Dataset:** [Arc-Intelligence/Arc-ATLAS-Teach-v0](https://huggingface.co/datasets/Arc-Intelligence/Arc-ATLAS-Teach-v0) - **Context L"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:Arc-Intelligence/ATLAS-8B-Thinking",
          "value": "Arc-ATLAS-Teach-v0",
          "confidence": 0.48,
          "raw_context": "igence/ATLAS-8B-Instruct) - **Training Dataset:** [Arc-ATLAS-Teach-v0](https://huggingface.co/datasets/Arc-Intelligence/Arc-ATLAS-Teach-v0)"
        }
      ],
      "declared_datasets": [
        "Arc-Intelligence/Arc-ATLAS-Teach-v0"
      ],
      "inferred_datasets": [
        "Arc-ATLAS-Teach-v0",
        "voc",
        "Arc-Intelligence/Arc-ATLAS-Teach-v0"
      ],
      "base_model": "Arc-Intelligence/ATLAS-8B-Thinking",
      "base_model_chain": [
        "Arc-Intelligence/ATLAS-8B-Thinking",
        "Qwen/Qwen3-8B",
        "Qwen/Qwen3-8B-Base"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.45000000000000007,
      "provenance_hash": "613d44bb3d9219d1e976c0b83b083fbdf0ca5a293145f7dce578ee2a6a476818"
    },
    {
      "model_id": "mradermacher/Apriel-Nemotron-15b-Thinker-Magic_decensored-v2_MPOA-GGUF",
      "scanned_at": "2026-09-15T02:04:36.343033Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "MagicalAlchemist/Apriel-Nemotron-15b-Thinker-Magic_decensored-v2_MPOA",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:MagicalAlchemist/Apriel-Nemotron-15b-Thinker-Magic_decensored-v2_MPOA"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:MagicalAlchemist/Apriel-Nemotron-15b-Thinker-Magic_decensored-v2_MPOA",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:MagicalAlchemist/Apriel-Nemotron-15b-Thinker-Magic_decensored-v2_MPOA"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "MagicalAlchemist/Apriel-Nemotron-15b-Thinker-Magic_decensored-v2_MPOA",
          "confidence": 0.85,
          "raw_context": "--- base_model: MagicalAlchemist/Apriel-Nemotron-15b-Thinker-Magic_decensored-v2_MPOA language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:MagicalAlchemist/Apriel-Nemotron-15b-Thinker-Magic_decensored-v2_MPOA",
          "value": "voc",
          "confidence": 0.5599999999999999,
          "raw_context": "c instruction‑following scenarios, API/function invocation use cases etc.  **Reinforcement Learning** A"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:MagicalAlchemist/Apriel-Nemotron-15b-Thinker-Magic_decensored-v2_MPOA",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "ing.  See our technical report for full details: [arXiv:2508.10948](https://arxiv.org/abs/2508.10948)."
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": "MagicalAlchemist/Apriel-Nemotron-15b-Thinker-Magic_decensored-v2_MPOA",
      "base_model_chain": [
        "MagicalAlchemist/Apriel-Nemotron-15b-Thinker-Magic_decensored-v2_MPOA"
      ],
      "training_section_present": false,
      "license": "mit",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "46c24bda7861c4ee455cdf1c1ee2b81370764a109686dbf3d3934aa0c754dd0f"
    },
    {
      "model_id": "mradermacher/Apriel-Nemotron-15b-Thinker-Magic_decensored-v2_MPOA-i1-GGUF",
      "scanned_at": "2026-09-15T02:04:43.702500Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "MagicalAlchemist/Apriel-Nemotron-15b-Thinker-Magic_decensored-v2_MPOA",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:MagicalAlchemist/Apriel-Nemotron-15b-Thinker-Magic_decensored-v2_MPOA"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:MagicalAlchemist/Apriel-Nemotron-15b-Thinker-Magic_decensored-v2_MPOA",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:MagicalAlchemist/Apriel-Nemotron-15b-Thinker-Magic_decensored-v2_MPOA"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "MagicalAlchemist/Apriel-Nemotron-15b-Thinker-Magic_decensored-v2_MPOA",
          "confidence": 0.85,
          "raw_context": "--- base_model: MagicalAlchemist/Apriel-Nemotron-15b-Thinker-Magic_decensored-v2_MPOA language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:MagicalAlchemist/Apriel-Nemotron-15b-Thinker-Magic_decensored-v2_MPOA",
          "value": "voc",
          "confidence": 0.5599999999999999,
          "raw_context": "c instruction‑following scenarios, API/function invocation use cases etc.  **Reinforcement Learning** A"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:MagicalAlchemist/Apriel-Nemotron-15b-Thinker-Magic_decensored-v2_MPOA",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "ing.  See our technical report for full details: [arXiv:2508.10948](https://arxiv.org/abs/2508.10948)."
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": "MagicalAlchemist/Apriel-Nemotron-15b-Thinker-Magic_decensored-v2_MPOA",
      "base_model_chain": [
        "MagicalAlchemist/Apriel-Nemotron-15b-Thinker-Magic_decensored-v2_MPOA"
      ],
      "training_section_present": false,
      "license": "mit",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "1555fdca7d1292668fa27c17d01798786af64cf424fb0270a17e9239632b4e0d"
    },
    {
      "model_id": "mradermacher/Arctic-AWM-14B-GGUF",
      "scanned_at": "2026-09-15T02:04:47.645826Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Snowflake/Arctic-AWM-14B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Snowflake/Arctic-AWM-14B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Snowflake/Arctic-AWM-14B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Snowflake/Arctic-AWM-14B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Snowflake/Arctic-AWM-14B",
          "confidence": 0.85,
          "raw_context": "--- base_model: Snowflake/Arctic-AWM-14B language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:Snowflake/Arctic-AWM-14B",
          "value": "AgentWorldModel-1K",
          "confidence": 0.48,
          "raw_context": "14B), using the fully synthetic environments from [AgentWorldModel-1K](https://huggingface.co/datasets/Snowflake/AgentWorldModel-1K).  The model is train"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Snowflake/Arctic-AWM-14B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "ource | Link | |----------|------| | 📄 Paper | [📄 arxiv.org/abs/2602.10090](https://arxiv.org/abs/2602.10"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "AgentWorldModel-1K",
        "voc"
      ],
      "base_model": "Snowflake/Arctic-AWM-14B",
      "base_model_chain": [
        "Snowflake/Arctic-AWM-14B",
        "Qwen/Qwen3-4B",
        "Qwen/Qwen3-4B-Base"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "21662e0e9663d9efde5ff6d80a08aa71faf42877f9ea39d7f74a38c0fc0af8f6"
    },
    {
      "model_id": "mradermacher/Arctic-AWM-14B-i1-GGUF",
      "scanned_at": "2026-09-15T02:04:59.940797Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Snowflake/Arctic-AWM-14B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Snowflake/Arctic-AWM-14B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Snowflake/Arctic-AWM-14B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Snowflake/Arctic-AWM-14B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Snowflake/Arctic-AWM-14B",
          "confidence": 0.85,
          "raw_context": "--- base_model: Snowflake/Arctic-AWM-14B language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:Snowflake/Arctic-AWM-14B",
          "value": "AgentWorldModel-1K",
          "confidence": 0.48,
          "raw_context": "14B), using the fully synthetic environments from [AgentWorldModel-1K](https://huggingface.co/datasets/Snowflake/AgentWorldModel-1K).  The model is train"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Snowflake/Arctic-AWM-14B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "ource | Link | |----------|------| | 📄 Paper | [📄 arxiv.org/abs/2602.10090](https://arxiv.org/abs/2602.10"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "AgentWorldModel-1K",
        "voc"
      ],
      "base_model": "Snowflake/Arctic-AWM-14B",
      "base_model_chain": [
        "Snowflake/Arctic-AWM-14B",
        "Qwen/Qwen3-4B",
        "Qwen/Qwen3-4B-Base"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "b709c25e7f52b67ca01e60c633e0fea1b4a39f75d5b1eb547f6bfbfb0190dba4"
    },
    {
      "model_id": "mradermacher/Arctic-AWM-4B-GGUF",
      "scanned_at": "2026-09-15T02:05:03.496101Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Snowflake/Arctic-AWM-4B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Snowflake/Arctic-AWM-4B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Snowflake/Arctic-AWM-4B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Snowflake/Arctic-AWM-4B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Snowflake/Arctic-AWM-4B",
          "confidence": 0.85,
          "raw_context": "--- base_model: Snowflake/Arctic-AWM-4B language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:Snowflake/Arctic-AWM-4B",
          "value": "AgentWorldModel-1K",
          "confidence": 0.48,
          "raw_context": "-4B), using the fully synthetic environments from [AgentWorldModel-1K](https://huggingface.co/datasets/Snowflake/AgentWorldModel-1K).  The model is train"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Snowflake/Arctic-AWM-4B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "ource | Link | |----------|------| | 📄 Paper | [📄 arxiv.org/abs/2602.10090](https://arxiv.org/abs/2602.10"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "AgentWorldModel-1K",
        "voc"
      ],
      "base_model": "Snowflake/Arctic-AWM-4B",
      "base_model_chain": [
        "Snowflake/Arctic-AWM-4B",
        "Qwen/Qwen3-4B",
        "Qwen/Qwen3-4B-Base"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "dc7ce420d3d94db575aee71332c98994ff509528ec5def0ef2f2d479b665af9c"
    },
    {
      "model_id": "mradermacher/Arctic-AWM-4B-i1-GGUF",
      "scanned_at": "2026-09-15T02:05:11.689789Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Snowflake/Arctic-AWM-4B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Snowflake/Arctic-AWM-4B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Snowflake/Arctic-AWM-4B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Snowflake/Arctic-AWM-4B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Snowflake/Arctic-AWM-4B",
          "confidence": 0.85,
          "raw_context": "--- base_model: Snowflake/Arctic-AWM-4B language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:Snowflake/Arctic-AWM-4B",
          "value": "AgentWorldModel-1K",
          "confidence": 0.48,
          "raw_context": "-4B), using the fully synthetic environments from [AgentWorldModel-1K](https://huggingface.co/datasets/Snowflake/AgentWorldModel-1K).  The model is train"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Snowflake/Arctic-AWM-4B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "ource | Link | |----------|------| | 📄 Paper | [📄 arxiv.org/abs/2602.10090](https://arxiv.org/abs/2602.10"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "AgentWorldModel-1K",
        "voc"
      ],
      "base_model": "Snowflake/Arctic-AWM-4B",
      "base_model_chain": [
        "Snowflake/Arctic-AWM-4B",
        "Qwen/Qwen3-4B",
        "Qwen/Qwen3-4B-Base"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "ccc5dcdf1e182448d5f4de73ada3b808d6025db334f94a530b953909d69ea1ef"
    },
    {
      "model_id": "mradermacher/Arctic-AWM-8B-GGUF",
      "scanned_at": "2026-09-15T02:05:14.864666Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Snowflake/Arctic-AWM-8B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Snowflake/Arctic-AWM-8B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Snowflake/Arctic-AWM-8B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Snowflake/Arctic-AWM-8B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Snowflake/Arctic-AWM-8B",
          "confidence": 0.85,
          "raw_context": "--- base_model: Snowflake/Arctic-AWM-8B language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:Snowflake/Arctic-AWM-8B",
          "value": "AgentWorldModel-1K",
          "confidence": 0.48,
          "raw_context": "-8B), using the fully synthetic environments from [AgentWorldModel-1K](https://huggingface.co/datasets/Snowflake/AgentWorldModel-1K).  The model is train"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Snowflake/Arctic-AWM-8B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "ource | Link | |----------|------| | 📄 Paper | [📄 arxiv.org/abs/2602.10090](https://arxiv.org/abs/2602.10"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "AgentWorldModel-1K",
        "voc"
      ],
      "base_model": "Snowflake/Arctic-AWM-8B",
      "base_model_chain": [
        "Snowflake/Arctic-AWM-8B",
        "Qwen/Qwen3-4B",
        "Qwen/Qwen3-4B-Base"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "6347621de40028a2129fccf62ef64dd73b7bfa16d25b262a77a9347f2661415f"
    },
    {
      "model_id": "mradermacher/Arctic-AWM-8B-i1-GGUF",
      "scanned_at": "2026-09-15T02:05:22.401891Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Snowflake/Arctic-AWM-8B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Snowflake/Arctic-AWM-8B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Snowflake/Arctic-AWM-8B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Snowflake/Arctic-AWM-8B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Snowflake/Arctic-AWM-8B",
          "confidence": 0.85,
          "raw_context": "--- base_model: Snowflake/Arctic-AWM-8B language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:Snowflake/Arctic-AWM-8B",
          "value": "AgentWorldModel-1K",
          "confidence": 0.48,
          "raw_context": "-8B), using the fully synthetic environments from [AgentWorldModel-1K](https://huggingface.co/datasets/Snowflake/AgentWorldModel-1K).  The model is train"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Snowflake/Arctic-AWM-8B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "ource | Link | |----------|------| | 📄 Paper | [📄 arxiv.org/abs/2602.10090](https://arxiv.org/abs/2602.10"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "AgentWorldModel-1K",
        "voc"
      ],
      "base_model": "Snowflake/Arctic-AWM-8B",
      "base_model_chain": [
        "Snowflake/Arctic-AWM-8B",
        "Qwen/Qwen3-4B",
        "Qwen/Qwen3-4B-Base"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "efcd4bd87a492613e904a2295fcf70e30343f2e41c7607b5b5428caf45af9a8f"
    },
    {
      "model_id": "mradermacher/Aryabhata-1.0-i1-GGUF",
      "scanned_at": "2026-09-15T02:05:26.105892Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "PhysicsWallahAI/Aryabhata-1.0",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:PhysicsWallahAI/Aryabhata-1.0"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:PhysicsWallahAI/Aryabhata-1.0",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:PhysicsWallahAI/Aryabhata-1.0"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "PhysicsWallahAI/Aryabhata-1.0",
          "confidence": 0.85,
          "raw_context": "--- base_model: PhysicsWallahAI/Aryabhata-1.0 language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> weighted"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:PhysicsWallahAI/Aryabhata-1.0",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "t Aryabhata 1.0 in our [Technical Report](https://arxiv.org/abs/2508.08665)  ---  ## 🚀 Roadmap  **Aryabha"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": "PhysicsWallahAI/Aryabhata-1.0",
      "base_model_chain": [
        "PhysicsWallahAI/Aryabhata-1.0",
        "Qwen/Qwen2.5-Math-7B",
        "Qwen/Qwen2.5-7B"
      ],
      "training_section_present": false,
      "license": "cc-by-nc-4.0",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "0eaa443b33221e159fda1adb5e11df7fb3ee62494b7af65add7277716d90dd99"
    },
    {
      "model_id": "mradermacher/AutoGEO_mini_Qwen1.7B-i1-GGUF",
      "scanned_at": "2026-09-15T02:05:36.012397Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "cx-cmu/Researchy-GEO",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:cx-cmu/Researchy-GEO"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "cx-cmu/AutoGEO_mini_Qwen1.7B_ResearchyGEO",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:cx-cmu/AutoGEO_mini_Qwen1.7B_ResearchyGEO"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:cx-cmu/AutoGEO_mini_Qwen1.7B_ResearchyGEO",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:cx-cmu/AutoGEO_mini_Qwen1.7B_ResearchyGEO"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "cx-cmu/AutoGEO_mini_Qwen1.7B_ResearchyGEO",
          "confidence": 0.85,
          "raw_context": "--- base_model: cx-cmu/AutoGEO_mini_Qwen1.7B_ResearchyGEO datasets: - cx-cmu/Researchy-GEO language: - en l"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:cx-cmu/AutoGEO_mini_Qwen1.7B_ResearchyGEO",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "w to Optimize Web Content Cooperatively\"](https://arxiv.org/abs/2510.11438)   👥 **Authors:** Yujiang Wu*,"
        }
      ],
      "declared_datasets": [
        "cx-cmu/Researchy-GEO"
      ],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": "cx-cmu/AutoGEO_mini_Qwen1.7B_ResearchyGEO",
      "base_model_chain": [
        "cx-cmu/AutoGEO_mini_Qwen1.7B_ResearchyGEO",
        "Qwen/Qwen3-1.7B",
        "Qwen/Qwen3-1.7B-Base"
      ],
      "training_section_present": false,
      "license": "mit",
      "provenance_score": 0.4,
      "provenance_hash": "a287d4a9e1a247a08817d9b9705bf4247accb1913e7bf794bd4025a75456f392"
    },
    {
      "model_id": "mradermacher/Autobool-Qwen4b-No-reasoning-GGUF",
      "scanned_at": "2026-09-15T02:05:44.564316Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "ielabgroup/Autobool-Qwen4b-No-reasoning",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:ielabgroup/Autobool-Qwen4b-No-reasoning"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:ielabgroup/Autobool-Qwen4b-No-reasoning",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:ielabgroup/Autobool-Qwen4b-No-reasoning"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "ielabgroup/Autobool-Qwen4b-No-reasoning",
          "confidence": 0.85,
          "raw_context": "--- base_model: ielabgroup/Autobool-Qwen4b-No-reasoning language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "pubmed",
          "confidence": 0.7,
          "raw_context": "ies - systematic-review - information-retrieval - pubmed - reinforcement-learning - grpo --- ## About  <!-"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:ielabgroup/Autobool-Qwen4b-No-reasoning",
          "value": "pubmed",
          "confidence": 0.5599999999999999,
          "raw_context": "ies - systematic-review - information-retrieval - pubmed - reinforcement-learning - grpo library_name: tra"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "pubmed",
        "voc"
      ],
      "base_model": "ielabgroup/Autobool-Qwen4b-No-reasoning",
      "base_model_chain": [
        "ielabgroup/Autobool-Qwen4b-No-reasoning",
        "Qwen/Qwen3-4B",
        "Qwen/Qwen3-4B-Base"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "77f68db5aebb40fbc5870d2c552db939245db614e811aa82a118378b73337dfb"
    },
    {
      "model_id": "mradermacher/Autobool-Qwen4b-Reasoning-GGUF",
      "scanned_at": "2026-09-15T02:05:51.473016Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "ielabgroup/Autobool-Qwen4b-Reasoning",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:ielabgroup/Autobool-Qwen4b-Reasoning"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:ielabgroup/Autobool-Qwen4b-Reasoning",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:ielabgroup/Autobool-Qwen4b-Reasoning"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "ielabgroup/Autobool-Qwen4b-Reasoning",
          "confidence": 0.85,
          "raw_context": "--- base_model: ielabgroup/Autobool-Qwen4b-Reasoning language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "pubmed",
          "confidence": 0.7,
          "raw_context": "ies - systematic-review - information-retrieval - pubmed - reinforcement-learning - grpo - chain-of-though"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:ielabgroup/Autobool-Qwen4b-Reasoning",
          "value": "pubmed",
          "confidence": 0.5599999999999999,
          "raw_context": "ies - systematic-review - information-retrieval - pubmed - reinforcement-learning - grpo - chain-of-though"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "pubmed",
        "voc"
      ],
      "base_model": "ielabgroup/Autobool-Qwen4b-Reasoning",
      "base_model_chain": [
        "ielabgroup/Autobool-Qwen4b-Reasoning",
        "Qwen/Qwen3-4B",
        "Qwen/Qwen3-4B-Base"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "a285106df2e79a7f374df6e3c9708c3b683fcf487f84c958503677b060099916"
    },
    {
      "model_id": "mradermacher/Autobool-Qwen4b-Reasoning-conceptual-GGUF",
      "scanned_at": "2026-09-15T02:05:57.425397Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "ielabgroup/Autobool-Qwen4b-Reasoning-conceptual",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:ielabgroup/Autobool-Qwen4b-Reasoning-conceptual"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:ielabgroup/Autobool-Qwen4b-Reasoning-conceptual",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:ielabgroup/Autobool-Qwen4b-Reasoning-conceptual"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "ielabgroup/Autobool-Qwen4b-Reasoning-conceptual",
          "confidence": 0.85,
          "raw_context": "--- base_model: ielabgroup/Autobool-Qwen4b-Reasoning-conceptual language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "pubmed",
          "confidence": 0.7,
          "raw_context": "ies - systematic-review - information-retrieval - pubmed - reinforcement-learning - grpo - chain-of-though"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:ielabgroup/Autobool-Qwen4b-Reasoning-conceptual",
          "value": "pubmed",
          "confidence": 0.5599999999999999,
          "raw_context": "ies - systematic-review - information-retrieval - pubmed - reinforcement-learning - grpo - chain-of-though"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "pubmed",
        "voc"
      ],
      "base_model": "ielabgroup/Autobool-Qwen4b-Reasoning-conceptual",
      "base_model_chain": [
        "ielabgroup/Autobool-Qwen4b-Reasoning-conceptual",
        "Qwen/Qwen3-4B",
        "Qwen/Qwen3-4B-Base"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "faed56936f58e565e268705f9846b025fcc9e9f2786e117ea55c69fc9fa5da2e"
    },
    {
      "model_id": "mradermacher/Autobool-Qwen4b-Reasoning-objective-GGUF",
      "scanned_at": "2026-09-15T02:06:04.792194Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "ielabgroup/Autobool-Qwen4b-Reasoning-objective",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:ielabgroup/Autobool-Qwen4b-Reasoning-objective"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:ielabgroup/Autobool-Qwen4b-Reasoning-objective",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:ielabgroup/Autobool-Qwen4b-Reasoning-objective"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "ielabgroup/Autobool-Qwen4b-Reasoning-objective",
          "confidence": 0.85,
          "raw_context": "--- base_model: ielabgroup/Autobool-Qwen4b-Reasoning-objective language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "pubmed",
          "confidence": 0.7,
          "raw_context": "ies - systematic-review - information-retrieval - pubmed - reinforcement-learning - grpo - few-shot --- ##"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:ielabgroup/Autobool-Qwen4b-Reasoning-objective",
          "value": "pubmed",
          "confidence": 0.5599999999999999,
          "raw_context": "ies - systematic-review - information-retrieval - pubmed - reinforcement-learning - grpo - few-shot librar"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "pubmed",
        "voc"
      ],
      "base_model": "ielabgroup/Autobool-Qwen4b-Reasoning-objective",
      "base_model_chain": [
        "ielabgroup/Autobool-Qwen4b-Reasoning-objective",
        "Qwen/Qwen3-4B",
        "Qwen/Qwen3-4B-Base"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "1cdc5e2033d90bc113c00cb4e104516e323c8aa787849195530c9c10067f99fd"
    },
    {
      "model_id": "mradermacher/BadVibesNemo-12B-i1-GGUF",
      "scanned_at": "2026-09-15T02:06:10.680176Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "mpasila/BadVibesV1-16k-context",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:mpasila/BadVibesV1-16k-context"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "adamo1139/4chan_archive_ShareGPT_fixed_newlines_unfiltered",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:adamo1139/4chan_archive_ShareGPT_fixed_newlines_unfiltered"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "Fizzarolli/fse-raw-dump",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:Fizzarolli/fse-raw-dump"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "R-Arfin/Depression",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:R-Arfin/Depression"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "ShiniChien/creepypasta",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:ShiniChien/creepypasta"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "mpasila/BadVibesNemo-12B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:mpasila/BadVibesNemo-12B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:mpasila/BadVibesNemo-12B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:mpasila/BadVibesNemo-12B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "mpasila/BadVibesNemo-12B",
          "confidence": 0.85,
          "raw_context": "--- base_model: mpasila/BadVibesNemo-12B datasets: - mpasila/BadVibesV1-16k-context - adam"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "sharegpt",
          "confidence": 0.7,
          "raw_context": "/BadVibesV1-16k-context - adamo1139/4chan_archive_ShareGPT_fixed_newlines_unfiltered - Fizzarolli/fse-raw-du"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:mpasila/BadVibesNemo-12B",
          "value": "mpasila/BadVibesV1-16k-context",
          "confidence": 0.6400000000000001,
          "raw_context": "- ShiniChien/creepypasta ---  Uses this dataset: [mpasila/BadVibesV1-16k-context](https://huggingface.co/datasets/mpasila/BadVibesV1-16k-context)  ## Details about"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:mpasila/BadVibesNemo-12B",
          "value": "adamo1139/4chan_archive_ShareGPT_fixed_newlines_unfiltered",
          "confidence": 0.6400000000000001,
          "raw_context": "3-8B-Base-2512)'s tokenizer): - 3216 entries from [adamo1139/4chan_archive_ShareGPT_fixed_newlines_unfiltered](https://huggingface.co/datasets/adamo1139/4chan_archive_ShareGPT_fixed_newlines_un"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:mpasila/BadVibesNemo-12B",
          "value": "Fizzarolli/fse-raw-dump",
          "confidence": 0.6400000000000001,
          "raw_context": "T_fixed_newlines_unfiltered) - 19962 entries from [Fizzarolli/fse-raw-dump](https://huggingface.co/datasets/Fizzarolli/fse-raw-dump) - 11547 entries from [R-A"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:mpasila/BadVibesNemo-12B",
          "value": "R-Arfin/Depression",
          "confidence": 0.6400000000000001,
          "raw_context": "ets/Fizzarolli/fse-raw-dump) - 11547 entries from [R-Arfin/Depression](https://huggingface.co/datasets/R-Arfin/Depression) - 5060 entries from [ShiniChie"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:mpasila/BadVibesNemo-12B",
          "value": "ShiniChien/creepypasta",
          "confidence": 0.6400000000000001,
          "raw_context": "/datasets/R-Arfin/Depression) - 5060 entries from [ShiniChien/creepypasta](https://huggingface.co/datasets/ShiniChien/creepypasta)  The data was also combine"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:mpasila/BadVibesNemo-12B",
          "value": "sharegpt",
          "confidence": 0.5599999999999999,
          "raw_context": "/BadVibesV1-16k-context - adamo1139/4chan_archive_ShareGPT_fixed_newlines_unfiltered - Fizzarolli/fse-raw-du"
        }
      ],
      "declared_datasets": [
        "ShiniChien/creepypasta",
        "adamo1139/4chan_archive_ShareGPT_fixed_newlines_unfiltered",
        "Fizzarolli/fse-raw-dump",
        "mpasila/BadVibesV1-16k-context",
        "R-Arfin/Depression"
      ],
      "inferred_datasets": [
        "ShiniChien/creepypasta",
        "adamo1139/4chan_archive_ShareGPT_fixed_newlines_unfiltered",
        "Fizzarolli/fse-raw-dump",
        "mpasila/BadVibesV1-16k-context",
        "R-Arfin/Depression",
        "voc",
        "sharegpt"
      ],
      "base_model": "mpasila/BadVibesNemo-12B",
      "base_model_chain": [
        "mpasila/BadVibesNemo-12B",
        "unsloth/Mistral-Nemo-Base-2407"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.7,
      "provenance_hash": "702d410e9c4739c01ffaaaad0ae11decd75d5cd6ab12979882439ae035c5a5db"
    },
    {
      "model_id": "mradermacher/Balanitis-3.2-1B-GGUF",
      "scanned_at": "2026-09-15T02:06:23.990064Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Novaciano/Balanitis-3.2-1B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Novaciano/Balanitis-3.2-1B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Novaciano/Balanitis-3.2-1B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Novaciano/Balanitis-3.2-1B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Novaciano/Balanitis-3.2-1B",
          "confidence": 0.85,
          "raw_context": "--- base_model: Novaciano/Balanitis-3.2-1B language: - en library_name: transformers mraderm"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:Novaciano/Balanitis-3.2-1B",
          "value": "wikipedia",
          "confidence": 0.48,
          "raw_context": "his model was merged using the [SLERP](https://en.wikipedia.org/wiki/Slerp) merge method.  ### Models Merged"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Novaciano/Balanitis-3.2-1B",
          "value": "wikipedia",
          "confidence": 0.5599999999999999,
          "raw_context": "his model was merged using the [SLERP](https://en.wikipedia.org/wiki/Slerp) merge method.  ### Models Merged"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "wikipedia",
        "voc"
      ],
      "base_model": "Novaciano/Balanitis-3.2-1B",
      "base_model_chain": [
        "Novaciano/Balanitis-3.2-1B",
        "PursuitOfDataScience/Llama-3.2-1B-GRPO",
        "meta-llama/Llama-3.2-1B"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.2,
      "provenance_hash": "20da2371ab7709253f7abe131efede2f748ec1514b0ae194051df4dd6f83d0f8"
    },
    {
      "model_id": "mradermacher/Balanitis-3.2-1B-i1-GGUF",
      "scanned_at": "2026-09-15T02:06:34.172923Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Novaciano/Balanitis-3.2-1B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Novaciano/Balanitis-3.2-1B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Novaciano/Balanitis-3.2-1B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Novaciano/Balanitis-3.2-1B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Novaciano/Balanitis-3.2-1B",
          "confidence": 0.85,
          "raw_context": "--- base_model: Novaciano/Balanitis-3.2-1B language: - en library_name: transformers mraderm"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:Novaciano/Balanitis-3.2-1B",
          "value": "wikipedia",
          "confidence": 0.48,
          "raw_context": "his model was merged using the [SLERP](https://en.wikipedia.org/wiki/Slerp) merge method.  ### Models Merged"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Novaciano/Balanitis-3.2-1B",
          "value": "wikipedia",
          "confidence": 0.5599999999999999,
          "raw_context": "his model was merged using the [SLERP](https://en.wikipedia.org/wiki/Slerp) merge method.  ### Models Merged"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "wikipedia",
        "voc"
      ],
      "base_model": "Novaciano/Balanitis-3.2-1B",
      "base_model_chain": [
        "Novaciano/Balanitis-3.2-1B",
        "PursuitOfDataScience/Llama-3.2-1B-GRPO",
        "meta-llama/Llama-3.2-1B"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.2,
      "provenance_hash": "1a0993d56f013e0c0b559b426cb6f439e3e5d85cfbe78b9f3460c8fa59c07f90"
    },
    {
      "model_id": "mradermacher/Blake-XTM-Arc-3B-V1-i1-GGUF",
      "scanned_at": "2026-09-15T02:06:38.366599Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "PJMixers-Dev/dolphin-deepseek-1k-think-1k-response-filtered-ShareGPT",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:PJMixers-Dev/dolphin-deepseek-1k-think-1k-response-filtered-ShareGPT"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "Jofthomas/hermes-function-calling-thinking-V1",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:Jofthomas/hermes-function-calling-thinking-V1"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Flexan/Blake-XTM-Arc-3B-V1",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Flexan/Blake-XTM-Arc-3B-V1"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Flexan/Blake-XTM-Arc-3B-V1",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Flexan/Blake-XTM-Arc-3B-V1"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Flexan/Blake-XTM-Arc-3B-V1",
          "confidence": 0.85,
          "raw_context": "--- base_model: Flexan/Blake-XTM-Arc-3B-V1 datasets: - PJMixers-Dev/dolphin-deepseek-1k-thin"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "sharegpt",
          "confidence": 0.7,
          "raw_context": "ev/dolphin-deepseek-1k-think-1k-response-filtered-ShareGPT - Jofthomas/hermes-function-calling-thinking-V1 l"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Flexan/Blake-XTM-Arc-3B-V1",
          "value": "sharegpt",
          "confidence": 0.5599999999999999,
          "raw_context": "ev/dolphin-deepseek-1k-think-1k-response-filtered-ShareGPT - Jofthomas/hermes-function-calling-thinking-V1 l"
        }
      ],
      "declared_datasets": [
        "Jofthomas/hermes-function-calling-thinking-V1",
        "PJMixers-Dev/dolphin-deepseek-1k-think-1k-response-filtered-ShareGPT"
      ],
      "inferred_datasets": [
        "voc",
        "sharegpt"
      ],
      "base_model": "Flexan/Blake-XTM-Arc-3B-V1",
      "base_model_chain": [
        "Flexan/Blake-XTM-Arc-3B-V1",
        "microsoft/phi-2"
      ],
      "training_section_present": false,
      "license": "cc-by-sa-4.0",
      "provenance_score": 0.5,
      "provenance_hash": "acf741cf888b556e159ac8d8d7192399d6cf5b58d525709f3680472124f2c48a"
    },
    {
      "model_id": "mradermacher/Blake-XTM-Arc-GGUF",
      "scanned_at": "2026-09-15T02:06:50.402762Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "PJMixers-Dev/dolphin-deepseek-1k-think-1k-response-filtered-ShareGPT",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:PJMixers-Dev/dolphin-deepseek-1k-think-1k-response-filtered-ShareGPT"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "Jofthomas/hermes-function-calling-thinking-V1",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:Jofthomas/hermes-function-calling-thinking-V1"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Flexan/Blake-XTM-Arc",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Flexan/Blake-XTM-Arc"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Flexan/Blake-XTM-Arc",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Flexan/Blake-XTM-Arc"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Flexan/Blake-XTM-Arc",
          "confidence": 0.85,
          "raw_context": "--- base_model: Flexan/Blake-XTM-Arc datasets: - PJMixers-Dev/dolphin-deepseek-1k-thin"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "sharegpt",
          "confidence": 0.7,
          "raw_context": "ev/dolphin-deepseek-1k-think-1k-response-filtered-ShareGPT - Jofthomas/hermes-function-calling-thinking-V1 l"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Flexan/Blake-XTM-Arc",
          "value": "sharegpt",
          "confidence": 0.5599999999999999,
          "raw_context": "ev/dolphin-deepseek-1k-think-1k-response-filtered-ShareGPT - Jofthomas/hermes-function-calling-thinking-V1 l"
        }
      ],
      "declared_datasets": [
        "Jofthomas/hermes-function-calling-thinking-V1",
        "PJMixers-Dev/dolphin-deepseek-1k-think-1k-response-filtered-ShareGPT"
      ],
      "inferred_datasets": [
        "voc",
        "sharegpt"
      ],
      "base_model": "Flexan/Blake-XTM-Arc",
      "base_model_chain": [
        "Flexan/Blake-XTM-Arc",
        "arlineka/CatNyanster-7b"
      ],
      "training_section_present": false,
      "license": "cc-by-sa-4.0",
      "provenance_score": 0.5,
      "provenance_hash": "b86f13a97705f576f0511a8e216e0401fdc43d77af741089dc06b1f68ac0fc21"
    },
    {
      "model_id": "mradermacher/CHIMERA-4B-RL-i1-GGUF",
      "scanned_at": "2026-09-15T02:07:02.846204Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "TianHongZXY/CHIMERA",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:TianHongZXY/CHIMERA"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "TianHongZXY/CHIMERA-4B-RL",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:TianHongZXY/CHIMERA-4B-RL"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:TianHongZXY/CHIMERA-4B-RL",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:TianHongZXY/CHIMERA-4B-RL"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "TianHongZXY/CHIMERA-4B-RL",
          "confidence": 0.85,
          "raw_context": "--- base_model: TianHongZXY/CHIMERA-4B-RL datasets: - TianHongZXY/CHIMERA language: - en li"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:TianHongZXY/CHIMERA-4B-RL",
          "value": "CHIMERA",
          "confidence": 0.48,
          "raw_context": "urther trained with reinforcement learning on the [CHIMERA](https://huggingface.co/datasets/TianHongZXY/CHIMERA) dataset.  CHIMERA is a compac"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:TianHongZXY/CHIMERA-4B-RL",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "kivi, Olli and Zhu, Yun and Meng, Yu},   journal={arXiv preprint arXiv:2603.00889},   year={2026} } ```"
        }
      ],
      "declared_datasets": [
        "TianHongZXY/CHIMERA"
      ],
      "inferred_datasets": [
        "CHIMERA",
        "arxiv",
        "voc"
      ],
      "base_model": "TianHongZXY/CHIMERA-4B-RL",
      "base_model_chain": [
        "TianHongZXY/CHIMERA-4B-RL",
        "Qwen/Qwen3-4B-Thinking-2507"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "bc7d5af7d7707f6878fcd886eed1a0641232c79bba477dc0ec0e085d55cd638b"
    },
    {
      "model_id": "mradermacher/Clado-BrowserOS-Action-GGUF",
      "scanned_at": "2026-09-15T02:07:19.585221Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "DavidBShan/Clado-BrowserOS-Action",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:DavidBShan/Clado-BrowserOS-Action"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:DavidBShan/Clado-BrowserOS-Action",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:DavidBShan/Clado-BrowserOS-Action"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "DavidBShan/Clado-BrowserOS-Action",
          "confidence": 0.85,
          "raw_context": "--- base_model: DavidBShan/Clado-BrowserOS-Action language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "DavidBShan/Clado-BrowserOS-Action",
      "base_model_chain": [
        "DavidBShan/Clado-BrowserOS-Action"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "da2896380f9512423156b4bb5f8c19f11cdd5e5e2c91a1589abc4e160ef521d9"
    },
    {
      "model_id": "mradermacher/Clado-BrowserOS-Action-i1-GGUF",
      "scanned_at": "2026-09-15T02:07:26.368299Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "DavidBShan/Clado-BrowserOS-Action",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:DavidBShan/Clado-BrowserOS-Action"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:DavidBShan/Clado-BrowserOS-Action",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:DavidBShan/Clado-BrowserOS-Action"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "DavidBShan/Clado-BrowserOS-Action",
          "confidence": 0.85,
          "raw_context": "--- base_model: DavidBShan/Clado-BrowserOS-Action language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "DavidBShan/Clado-BrowserOS-Action",
      "base_model_chain": [
        "DavidBShan/Clado-BrowserOS-Action"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "bedc1ccfcb5b270acd14b8de630cd7070a299e718dad7c64ae999f2ac93bddb4"
    },
    {
      "model_id": "mradermacher/Cosmos-Reason2-8B-GGUF",
      "scanned_at": "2026-09-15T02:07:30.780189Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "nvidia/Cosmos-Reason2-8B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:nvidia/Cosmos-Reason2-8B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:nvidia/Cosmos-Reason2-8B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:nvidia/Cosmos-Reason2-8B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "nvidia/Cosmos-Reason2-8B",
          "confidence": 0.85,
          "raw_context": "--- base_model: nvidia/Cosmos-Reason2-8B extra_gated_button_content: Submit extra_gated_fi"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "wide, non-exclusive, no-charge, royalty-free,   revocable license to publicly perform, publicly display"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "nvidia/Cosmos-Reason2-8B",
      "base_model_chain": [
        "nvidia/Cosmos-Reason2-8B",
        "Qwen/Qwen3-VL-8B-Instruct"
      ],
      "training_section_present": false,
      "license": "other",
      "provenance_score": 0.25,
      "provenance_hash": "4063570dd92effcf2013f3d9552a919686408c37bb49b5216a143f261c6c3048"
    },
    {
      "model_id": "mradermacher/Cydonia-24B-v4.3-heretic-v3-GGUF",
      "scanned_at": "2026-09-15T02:07:37.970828Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "coder3101/Cydonia-24B-v4.3-heretic-v3",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:coder3101/Cydonia-24B-v4.3-heretic-v3"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:coder3101/Cydonia-24B-v4.3-heretic-v3",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:coder3101/Cydonia-24B-v4.3-heretic-v3"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "coder3101/Cydonia-24B-v4.3-heretic-v3",
          "confidence": 0.85,
          "raw_context": "--- base_model: coder3101/Cydonia-24B-v4.3-heretic-v3 language: - en library_name: transformers mraderm"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "coder3101/Cydonia-24B-v4.3-heretic-v3",
      "base_model_chain": [
        "coder3101/Cydonia-24B-v4.3-heretic-v3",
        "TheDrummer/Cydonia-24B-v4.3",
        "mistralai/Mistral-Small-3.2-24B-Instruct-2506",
        "mistralai/Mistral-Small-3.1-24B-Base-2503"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "26c01230296458f40870e225a9384a7b4f155dfab97d550a96361fcf05c8c722"
    },
    {
      "model_id": "mradermacher/DExplorer-8B-GGUF",
      "scanned_at": "2026-09-15T02:07:50.340366Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "purewhite42/DExploration_Dataset",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:purewhite42/DExploration_Dataset"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "purewhite42/DExplorer-8B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:purewhite42/DExplorer-8B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:purewhite42/DExplorer-8B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:purewhite42/DExplorer-8B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "purewhite42/DExplorer-8B",
          "confidence": 0.85,
          "raw_context": "--- base_model: purewhite42/DExplorer-8B datasets: - purewhite42/DExploration_Dataset lang"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:purewhite42/DExplorer-8B",
          "value": "DExploration-40K",
          "confidence": 0.48,
          "raw_context": "/huggingface.co/Goedel-LM/Goedel-Prover-V2-8B) on [DExploration-40K](https://huggingface.co/datasets/purewhite42/DExploration-40K) using supervised fin"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:purewhite42/DExplorer-8B",
          "value": "NuminaMath-LEAN",
          "confidence": 0.48,
          "raw_context": "dexploration_main/issues)  ## 👍 Acknowledgments - [NuminaMath-LEAN](https://huggingface.co/datasets/AI-MO/NuminaMath-LEAN) for the high-quality statem"
        }
      ],
      "declared_datasets": [
        "purewhite42/DExploration_Dataset"
      ],
      "inferred_datasets": [
        "NuminaMath-LEAN",
        "voc",
        "DExploration-40K"
      ],
      "base_model": "purewhite42/DExplorer-8B",
      "base_model_chain": [
        "purewhite42/DExplorer-8B",
        "Goedel-Prover/Goedel-Prover-V2-8B"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.45000000000000007,
      "provenance_hash": "b75acd10331e5c93914e483edba86689d05e4d69135f22fb83b82ea1e744c7a4"
    },
    {
      "model_id": "mradermacher/DrMedra4B-GGUF",
      "scanned_at": "2026-09-15T02:08:07.753240Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "drwlf/medra-thinking-768",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:drwlf/medra-thinking-768"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "drwlf/DrMedra4B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:drwlf/DrMedra4B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:drwlf/DrMedra4B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:drwlf/DrMedra4B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "drwlf/DrMedra4B",
          "confidence": 0.85,
          "raw_context": "--- base_model: drwlf/DrMedra4B datasets: - drwlf/medra-thinking-768 language: -"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> static quants of"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:drwlf/DrMedra4B",
          "value": "pubmed",
          "confidence": 0.5599999999999999,
          "raw_context": "& Data Composition  DrMedra was trained using:  - PubMed-derived articles   - Clinical Q&A sets   - Multil"
        }
      ],
      "declared_datasets": [
        "drwlf/medra-thinking-768"
      ],
      "inferred_datasets": [
        "pubmed",
        "voc"
      ],
      "base_model": "drwlf/DrMedra4B",
      "base_model_chain": [
        "drwlf/DrMedra4B",
        "google/medgemma-4b-it",
        "google/medgemma-4b-pt",
        "google/gemma-3-4b-pt"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.4,
      "provenance_hash": "c9dc6bda3772739e9d5243d364dc16461e02d939139c49bf1b447f0f2fdb119c"
    },
    {
      "model_id": "mradermacher/DrMedra4B-abliterated-i1-GGUF",
      "scanned_at": "2026-09-15T02:08:20.197483Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nicoboss/medra-medical",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nicoboss/medra-medical"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "drwlf/DrMedra4B-abliterated",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:drwlf/DrMedra4B-abliterated"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:drwlf/DrMedra4B-abliterated",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:drwlf/DrMedra4B-abliterated"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "drwlf/DrMedra4B-abliterated",
          "confidence": 0.85,
          "raw_context": "--- base_model: drwlf/DrMedra4B-abliterated datasets: - nicoboss/medra-medical language: - en"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> weighted"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:drwlf/DrMedra4B-abliterated",
          "value": "pubmed",
          "confidence": 0.5599999999999999,
          "raw_context": "& Data Composition  DrMedra was trained using:  - PubMed-derived articles   - Clinical Q&A sets   - Multil"
        }
      ],
      "declared_datasets": [
        "nicoboss/medra-medical"
      ],
      "inferred_datasets": [
        "pubmed",
        "voc"
      ],
      "base_model": "drwlf/DrMedra4B-abliterated",
      "base_model_chain": [
        "drwlf/DrMedra4B-abliterated",
        "google/medgemma-4b-it",
        "google/medgemma-4b-pt",
        "google/gemma-3-4b-pt"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.4,
      "provenance_hash": "6ab80ee2f9ccaf74be453d4a4f4222b0caf34b178d308c1e42db45c5fd01b3f7"
    },
    {
      "model_id": "mradermacher/Ewen3-4b-Instruct-2507-i1-GGUF",
      "scanned_at": "2026-09-15T02:08:30.378554Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "Orion-zhen/harmful-data",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:Orion-zhen/harmful-data"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Orion-zhen/Ewen3-4b-Instruct-2507",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Orion-zhen/Ewen3-4b-Instruct-2507"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Orion-zhen/Ewen3-4b-Instruct-2507",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Orion-zhen/Ewen3-4b-Instruct-2507"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Orion-zhen/Ewen3-4b-Instruct-2507",
          "confidence": 0.85,
          "raw_context": "--- base_model: Orion-zhen/Ewen3-4b-Instruct-2507 datasets: - Orion-zhen/harmful-data language: - z"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [
        "Orion-zhen/harmful-data"
      ],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "Orion-zhen/Ewen3-4b-Instruct-2507",
      "base_model_chain": [
        "Orion-zhen/Ewen3-4b-Instruct-2507",
        "Qwen/Qwen3-4B-Instruct-2507"
      ],
      "training_section_present": false,
      "license": "agpl-3.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "958dc61a80a74bbca91ea3cb3acf24bc28c525c893e7eb9a963e2c5191065208"
    },
    {
      "model_id": "mradermacher/FitGay-1B-GGUF",
      "scanned_at": "2026-09-15T02:08:47.622553Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Novaciano/FitGay-1B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Novaciano/FitGay-1B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Novaciano/FitGay-1B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Novaciano/FitGay-1B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Novaciano/FitGay-1B",
          "confidence": 0.85,
          "raw_context": "--- base_model: Novaciano/FitGay-1B language: - en library_name: transformers mraderm"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Novaciano/FitGay-1B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "is model was merged using the [DARE TIES](https://arxiv.org/abs/2311.03099) merge method using [Novaciano"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": "Novaciano/FitGay-1B",
      "base_model_chain": [
        "Novaciano/FitGay-1B",
        "Novaciano/Esperpento-1B",
        "DavidAU/gemma-3-1b-it-heretic-extreme-uncensored-abliterated",
        "google/gemma-3-1b-it",
        "google/gemma-3-1b-pt"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.2,
      "provenance_hash": "5c16e15baa4ff0ccbe4f2db28f6d6226060c1d95600d06edec9de933a2a58370"
    },
    {
      "model_id": "mradermacher/FitGay-1B-i1-GGUF",
      "scanned_at": "2026-09-15T02:09:00.453598Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Novaciano/FitGay-1B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Novaciano/FitGay-1B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Novaciano/FitGay-1B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Novaciano/FitGay-1B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Novaciano/FitGay-1B",
          "confidence": 0.85,
          "raw_context": "--- base_model: Novaciano/FitGay-1B language: - en library_name: transformers mraderm"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Novaciano/FitGay-1B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "is model was merged using the [DARE TIES](https://arxiv.org/abs/2311.03099) merge method using [Novaciano"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": "Novaciano/FitGay-1B",
      "base_model_chain": [
        "Novaciano/FitGay-1B",
        "Novaciano/Esperpento-1B",
        "DavidAU/gemma-3-1b-it-heretic-extreme-uncensored-abliterated",
        "google/gemma-3-1b-it",
        "google/gemma-3-1b-pt"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.2,
      "provenance_hash": "d9b03d4f0058cb6941ca7278f40a67c4e7880750b4511d8cf34609dab07595b4"
    },
    {
      "model_id": "mradermacher/FlowSteer-8b-GGUF",
      "scanned_at": "2026-09-15T02:09:07.618174Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "beita6969/FlowSteer-8b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:beita6969/FlowSteer-8b"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:beita6969/FlowSteer-8b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:beita6969/FlowSteer-8b"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "beita6969/FlowSteer-8b",
          "confidence": 0.85,
          "raw_context": "--- base_model: beita6969/FlowSteer-8b language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "beita6969/FlowSteer-8b",
      "base_model_chain": [
        "beita6969/FlowSteer-8b",
        "Qwen/Qwen3-8B",
        "Qwen/Qwen3-8B-Base"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "c95330332f9227c5ba765de350b16b19fbf1137c84b360c9be7d4a932f19a263"
    },
    {
      "model_id": "mradermacher/GLM-4.6V-heretic-GGUF",
      "scanned_at": "2026-09-15T02:09:15.171966Z",
      "signals": [
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "coder3101/GLM-4.6V-heretic",
          "confidence": 0.85,
          "raw_context": "--- base_model: coder3101/GLM-4.6V-heretic language: - en library_name: transformers mraderm"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "coder3101/GLM-4.6V-heretic",
      "base_model_chain": [
        "coder3101/GLM-4.6V-heretic"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "e29d4128377da9e9419790a26a9161d0f85f9a39397bc5d4fa0026b2b1e5123b"
    },
    {
      "model_id": "mradermacher/GLM-4.6V-heretic-i1-GGUF",
      "scanned_at": "2026-09-15T02:09:22.283796Z",
      "signals": [
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "coder3101/GLM-4.6V-heretic",
          "confidence": 0.85,
          "raw_context": "--- base_model: coder3101/GLM-4.6V-heretic language: - en library_name: transformers mraderm"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "coder3101/GLM-4.6V-heretic",
      "base_model_chain": [
        "coder3101/GLM-4.6V-heretic"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "c8503b99dc3c820f46540d4a62ef5e46241600728d2bb7f16a843aea7b2d30ee"
    },
    {
      "model_id": "mradermacher/GLM-4.7-Flash-heretic-1.2.0-GGUF",
      "scanned_at": "2026-09-15T02:09:27.025816Z",
      "signals": [
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "darkc0de/GLM-4.7-Flash-heretic-1.2.0",
          "confidence": 0.85,
          "raw_context": "--- base_model: darkc0de/GLM-4.7-Flash-heretic-1.2.0 language: - en - zh library_name: transformers li"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "darkc0de/GLM-4.7-Flash-heretic-1.2.0",
      "base_model_chain": [
        "darkc0de/GLM-4.7-Flash-heretic-1.2.0"
      ],
      "training_section_present": false,
      "license": "mit",
      "provenance_score": 0.25,
      "provenance_hash": "a8f1134c50d4173a30dd2800e22a62a8fb963a538ab11b2ac95e5d18cd299164"
    },
    {
      "model_id": "mradermacher/GLM-4.7-TrashFlash-Think.Sorete-1B-GGUF",
      "scanned_at": "2026-09-15T02:09:38.118706Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "PJMixers-Dev/TrashMix-v1.1",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:PJMixers-Dev/TrashMix-v1.1"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "TeichAI/glm-4.7-2000x",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:TeichAI/glm-4.7-2000x"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Novaciano/GLM-4.7-TrashFlash-Think.Sorete-1B",
          "confidence": 0.85,
          "raw_context": "--- base_model: Novaciano/GLM-4.7-TrashFlash-Think.Sorete-1B datasets: - PJMixers-Dev/TrashMix-v1.1 - TeichAI/"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [
        "TeichAI/glm-4.7-2000x",
        "PJMixers-Dev/TrashMix-v1.1"
      ],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "Novaciano/GLM-4.7-TrashFlash-Think.Sorete-1B",
      "base_model_chain": [
        "Novaciano/GLM-4.7-TrashFlash-Think.Sorete-1B"
      ],
      "training_section_present": false,
      "license": "gemma",
      "provenance_score": 0.45,
      "provenance_hash": "17bebfdafc5a19d7f5926329315b3d778d48b91f8d1a6f2ebfa2dc6d46971f13"
    },
    {
      "model_id": "mradermacher/GLM-OCR-GGUF",
      "scanned_at": "2026-09-15T02:09:48.006771Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "zai-org/GLM-OCR",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:zai-org/GLM-OCR"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:zai-org/GLM-OCR",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:zai-org/GLM-OCR"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "zai-org/GLM-OCR",
          "confidence": 0.85,
          "raw_context": "--- base_model: zai-org/GLM-OCR language: - zh - en - fr - es - ru - de - ja - ko"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:zai-org/GLM-OCR",
          "value": "voc",
          "confidence": 0.5599999999999999,
          "raw_context": "olchain, offering simple installation, one-line invocation, and smooth integration into existing produc"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:zai-org/GLM-OCR",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "K</a> Recommended     <br>     📖 <a href=\"https://arxiv.org/abs/2603.10910\" target=\"_blank\"> Technical Re"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": "zai-org/GLM-OCR",
      "base_model_chain": [
        "zai-org/GLM-OCR"
      ],
      "training_section_present": false,
      "license": "mit",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "b802685db90e1528615c83db20581ee6e7bd9aca42429c9eb98ea405def0d26d"
    },
    {
      "model_id": "mradermacher/GLM-OCR-i1-GGUF",
      "scanned_at": "2026-09-15T02:09:55.088980Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "zai-org/GLM-OCR",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:zai-org/GLM-OCR"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:zai-org/GLM-OCR",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:zai-org/GLM-OCR"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "zai-org/GLM-OCR",
          "confidence": 0.85,
          "raw_context": "--- base_model: zai-org/GLM-OCR language: - zh - en - fr - es - ru - de - ja - ko"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:zai-org/GLM-OCR",
          "value": "voc",
          "confidence": 0.5599999999999999,
          "raw_context": "olchain, offering simple installation, one-line invocation, and smooth integration into existing produc"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:zai-org/GLM-OCR",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "K</a> Recommended     <br>     📖 <a href=\"https://arxiv.org/abs/2603.10910\" target=\"_blank\"> Technical Re"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": "zai-org/GLM-OCR",
      "base_model_chain": [
        "zai-org/GLM-OCR"
      ],
      "training_section_present": false,
      "license": "mit",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "bf316bee9755d1feb6dc2c96b25f7acc68a58070b8a592366c5f873af413833f"
    },
    {
      "model_id": "mradermacher/GRiP-i1-GGUF",
      "scanned_at": "2026-09-15T02:09:59.856756Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "GRiP-SFT-35K",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:GRiP-SFT-35K"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "GRiP-RL-37K",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:GRiP-RL-37K"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "TencentBAC/GRiP",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:TencentBAC/GRiP"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:TencentBAC/GRiP",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:TencentBAC/GRiP"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "TencentBAC/GRiP",
          "confidence": 0.85,
          "raw_context": "--- base_model: TencentBAC/GRiP datasets: - GRiP-SFT-35K - GRiP-RL-37K language:"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:TencentBAC/GRiP",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "f-thought ---  # GRiP-7B: Guiding the Inner Eye  [Arxiv](https://arxiv.org/abs/2511.22172) | [Huggingface"
        }
      ],
      "declared_datasets": [
        "GRiP-SFT-35K",
        "GRiP-RL-37K"
      ],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": "TencentBAC/GRiP",
      "base_model_chain": [
        "TencentBAC/GRiP",
        "Qwen/Qwen2.5-VL-7B-Instruct"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.5,
      "provenance_hash": "1b472064e92f740acdb739f5c064ac708764a15f58b07edd78e5a2ff2f452d26"
    },
    {
      "model_id": "mradermacher/GUI-Owl-1.5-32B-Instruct-i1-GGUF",
      "scanned_at": "2026-09-15T02:10:08.410422Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "mPLUG/GUI-Owl-1.5-32B-Instruct",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:mPLUG/GUI-Owl-1.5-32B-Instruct"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:mPLUG/GUI-Owl-1.5-32B-Instruct",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:mPLUG/GUI-Owl-1.5-32B-Instruct"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "mPLUG/GUI-Owl-1.5-32B-Instruct",
          "confidence": 0.85,
          "raw_context": "--- base_model: mPLUG/GUI-Owl-1.5-32B-Instruct language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "readme_rev: 1 quantized_by: mradermacher tags: - arxiv:2602.16855 --- ## About  <!-- ### quantize_versio"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:mPLUG/GUI-Owl-1.5-32B-Instruct",
          "value": "voc",
          "confidence": 0.5599999999999999,
          "raw_context": "MCP calling**: Native support for external tool invocation and MCP server coordination, achieving top p"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:mPLUG/GUI-Owl-1.5-32B-Instruct",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "--- license: mit language: - en tags: - arxiv:2602.16855 ---  ## Introduction <img src=\"https:/"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": "mPLUG/GUI-Owl-1.5-32B-Instruct",
      "base_model_chain": [
        "mPLUG/GUI-Owl-1.5-32B-Instruct"
      ],
      "training_section_present": false,
      "license": "mit",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "66a8fa9d4a4d13eb0f6b9b14de9ad8bb325b146de0ab0191d012658707056a4e"
    },
    {
      "model_id": "mradermacher/GlotMAX-101-14B-i1-GGUF",
      "scanned_at": "2026-09-15T02:10:19.336892Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "LLaMAX/GlotMAX-101-14B-LST",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:LLaMAX/GlotMAX-101-14B-LST"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:LLaMAX/GlotMAX-101-14B-LST",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:LLaMAX/GlotMAX-101-14B-LST"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "LLaMAX/GlotMAX-101-14B-LST",
          "confidence": 0.85,
          "raw_context": "--- base_model: LLaMAX/GlotMAX-101-14B-LST language: - af - am - ar - hy - as - ast - az - b"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:LLaMAX/GlotMAX-101-14B-LST",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "so Performs Well in Reasoning - **Link**: https://arxiv.org/pdf/2510.09189 (new version comming soon) - *"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:LLaMAX/GlotMAX-101-14B-LST",
          "value": "alpaca",
          "confidence": 0.5599999999999999,
          "raw_context": "dataset, **3.5 points** compared with LLaMAX3-8B-Alpaca.   ### Supported Languages Akrikaans (af), Amhari"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "voc",
        "alpaca"
      ],
      "base_model": "LLaMAX/GlotMAX-101-14B-LST",
      "base_model_chain": [
        "LLaMAX/GlotMAX-101-14B-LST"
      ],
      "training_section_present": false,
      "license": "mit",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "6af7075f90702cefb516b17019cae215c8c798859bb6b402863333f998edc534"
    },
    {
      "model_id": "mradermacher/HER-32B-ACL-GGUF",
      "scanned_at": "2026-09-15T02:10:29.643832Z",
      "signals": [
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "ChengyuDu0123/HER-32B-ACL",
          "confidence": 0.85,
          "raw_context": "--- base_model: ChengyuDu0123/HER-32B-ACL language: - zh - en library_name: transformers li"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "ChengyuDu0123/HER-32B-ACL",
      "base_model_chain": [
        "ChengyuDu0123/HER-32B-ACL"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "e10e0cf595c107bc59fa3e407bba92a747799d96b336d036c1de175981ea16b4"
    },
    {
      "model_id": "mradermacher/HER-32B-ACL-i1-GGUF",
      "scanned_at": "2026-09-15T02:10:36.485804Z",
      "signals": [
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "ChengyuDu0123/HER-32B-ACL",
          "confidence": 0.85,
          "raw_context": "--- base_model: ChengyuDu0123/HER-32B-ACL language: - zh - en library_name: transformers li"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "ChengyuDu0123/HER-32B-ACL",
      "base_model_chain": [
        "ChengyuDu0123/HER-32B-ACL"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "fb950483ad21a3304942e4ba45ecb3b215a56ae12866b7bd0c040a271405ae6b"
    },
    {
      "model_id": "mradermacher/HER-32B-GGUF",
      "scanned_at": "2026-09-15T02:10:42.024128Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "ChengyuDu0123/HER-32B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:ChengyuDu0123/HER-32B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:ChengyuDu0123/HER-32B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:ChengyuDu0123/HER-32B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "ChengyuDu0123/HER-32B",
          "confidence": 0.85,
          "raw_context": "--- base_model: ChengyuDu0123/HER-32B language: - zh - en library_name: transformers li"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:ChengyuDu0123/HER-32B",
          "value": "MiniMax",
          "confidence": 0.48,
          "raw_context": ".com/Neph0s/CoSER) for the evaluation benchmark - [MiniMax](https://huggingface.co/datasets/MiniMaxAI/role-play-bench) for the evaluation benc"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:ChengyuDu0123/HER-32B",
          "value": "Dataset",
          "confidence": 0.48,
          "raw_context": "://huggingface.co/ChengyuDu0123/HER-RM-32B)** | **[Dataset](https://huggingface.co/datasets/ChengyuDu0123/HER-Dataset)** | **[GitHub](https://"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:ChengyuDu0123/HER-32B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "le-playing  <p align=\"center\">   <a href=\"https://arxiv.org/abs/2601.21459\"><img src=\"https://img.shields"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "MiniMax",
        "arxiv",
        "voc",
        "Dataset"
      ],
      "base_model": "ChengyuDu0123/HER-32B",
      "base_model_chain": [
        "ChengyuDu0123/HER-32B",
        "Qwen/Qwen3-32B"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.4,
      "provenance_hash": "631d5c9ac84bd369b06e1e9a769ff40b56a646740551f5b56d27da5c94df3727"
    },
    {
      "model_id": "mradermacher/HER-32B-absolute-heresy-GGUF",
      "scanned_at": "2026-09-15T02:10:52.132199Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "MuXodious/HER-32B-absolute-heresy",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:MuXodious/HER-32B-absolute-heresy"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:MuXodious/HER-32B-absolute-heresy",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:MuXodious/HER-32B-absolute-heresy"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "MuXodious/HER-32B-absolute-heresy",
          "confidence": 0.85,
          "raw_context": "--- base_model: MuXodious/HER-32B-absolute-heresy language: - zh - en library_name: transformers li"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:MuXodious/HER-32B-absolute-heresy",
          "value": "MiniMax",
          "confidence": 0.48,
          "raw_context": ".com/Neph0s/CoSER) for the evaluation benchmark - [MiniMax](https://huggingface.co/datasets/MiniMaxAI/role-play-bench) for the evaluation benc"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:MuXodious/HER-32B-absolute-heresy",
          "value": "Dataset",
          "confidence": 0.48,
          "raw_context": "://huggingface.co/ChengyuDu0123/HER-RM-32B)** | **[Dataset](https://huggingface.co/datasets/ChengyuDu0123/HER-Dataset)** | **[GitHub](https://"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:MuXodious/HER-32B-absolute-heresy",
          "value": "c4",
          "confidence": 0.5599999999999999,
          "raw_context": "tps://img.shields.io/badge/HERESY_INDEX-IMPOTENT-5c4033?style=flat-square&labelColor=101010) | **Impot"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:MuXodious/HER-32B-absolute-heresy",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "le-playing  <p align=\"center\">   <a href=\"https://arxiv.org/abs/2601.21459\"><img src=\"https://img.shields"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "c4",
        "arxiv",
        "MiniMax",
        "Dataset",
        "voc"
      ],
      "base_model": "MuXodious/HER-32B-absolute-heresy",
      "base_model_chain": [
        "MuXodious/HER-32B-absolute-heresy",
        "ChengyuDu0123/HER-32B",
        "Qwen/Qwen3-32B"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.4,
      "provenance_hash": "8ad4ad9eba66a2f2c35ce05351475ca87bbc1945def50611de9de3557aacf999"
    },
    {
      "model_id": "mradermacher/HER-32B-absolute-heresy-i1-GGUF",
      "scanned_at": "2026-09-15T02:11:05.758693Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "MuXodious/HER-32B-absolute-heresy",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:MuXodious/HER-32B-absolute-heresy"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:MuXodious/HER-32B-absolute-heresy",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:MuXodious/HER-32B-absolute-heresy"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "MuXodious/HER-32B-absolute-heresy",
          "confidence": 0.85,
          "raw_context": "--- base_model: MuXodious/HER-32B-absolute-heresy language: - zh - en library_name: transformers li"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:MuXodious/HER-32B-absolute-heresy",
          "value": "MiniMax",
          "confidence": 0.48,
          "raw_context": ".com/Neph0s/CoSER) for the evaluation benchmark - [MiniMax](https://huggingface.co/datasets/MiniMaxAI/role-play-bench) for the evaluation benc"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:MuXodious/HER-32B-absolute-heresy",
          "value": "Dataset",
          "confidence": 0.48,
          "raw_context": "://huggingface.co/ChengyuDu0123/HER-RM-32B)** | **[Dataset](https://huggingface.co/datasets/ChengyuDu0123/HER-Dataset)** | **[GitHub](https://"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:MuXodious/HER-32B-absolute-heresy",
          "value": "c4",
          "confidence": 0.5599999999999999,
          "raw_context": "tps://img.shields.io/badge/HERESY_INDEX-IMPOTENT-5c4033?style=flat-square&labelColor=101010) | **Impot"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:MuXodious/HER-32B-absolute-heresy",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "le-playing  <p align=\"center\">   <a href=\"https://arxiv.org/abs/2601.21459\"><img src=\"https://img.shields"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "c4",
        "arxiv",
        "MiniMax",
        "Dataset",
        "voc"
      ],
      "base_model": "MuXodious/HER-32B-absolute-heresy",
      "base_model_chain": [
        "MuXodious/HER-32B-absolute-heresy",
        "ChengyuDu0123/HER-32B",
        "Qwen/Qwen3-32B"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.4,
      "provenance_hash": "e4e95a1c007f0a6efcc2a112f85e6d96b98d9aac6f99b66c059f0a8439cf2f79"
    },
    {
      "model_id": "mradermacher/HER-32B-i1-GGUF",
      "scanned_at": "2026-09-15T02:11:10.124394Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "ChengyuDu0123/HER-32B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:ChengyuDu0123/HER-32B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:ChengyuDu0123/HER-32B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:ChengyuDu0123/HER-32B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "ChengyuDu0123/HER-32B",
          "confidence": 0.85,
          "raw_context": "--- base_model: ChengyuDu0123/HER-32B language: - zh - en library_name: transformers li"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:ChengyuDu0123/HER-32B",
          "value": "MiniMax",
          "confidence": 0.48,
          "raw_context": ".com/Neph0s/CoSER) for the evaluation benchmark - [MiniMax](https://huggingface.co/datasets/MiniMaxAI/role-play-bench) for the evaluation benc"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:ChengyuDu0123/HER-32B",
          "value": "Dataset",
          "confidence": 0.48,
          "raw_context": "://huggingface.co/ChengyuDu0123/HER-RM-32B)** | **[Dataset](https://huggingface.co/datasets/ChengyuDu0123/HER-Dataset)** | **[GitHub](https://"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:ChengyuDu0123/HER-32B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "le-playing  <p align=\"center\">   <a href=\"https://arxiv.org/abs/2601.21459\"><img src=\"https://img.shields"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "MiniMax",
        "arxiv",
        "voc",
        "Dataset"
      ],
      "base_model": "ChengyuDu0123/HER-32B",
      "base_model_chain": [
        "ChengyuDu0123/HER-32B",
        "Qwen/Qwen3-32B"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.4,
      "provenance_hash": "b6f6a654d2e4a3b8da3f5ec0e19c3e87b2be4abd47150e95c74d308e1500d46d"
    },
    {
      "model_id": "mradermacher/Huihui-Qwen3.5-27B-abliterated-i1-GGUF",
      "scanned_at": "2026-09-15T02:11:14.493365Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "huihui-ai/Huihui-Qwen3.5-27B-abliterated",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:huihui-ai/Huihui-Qwen3.5-27B-abliterated"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:huihui-ai/Huihui-Qwen3.5-27B-abliterated",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:huihui-ai/Huihui-Qwen3.5-27B-abliterated"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "huihui-ai/Huihui-Qwen3.5-27B-abliterated",
          "confidence": 0.85,
          "raw_context": "--- base_model: huihui-ai/Huihui-Qwen3.5-27B-abliterated language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "huihui-ai/Huihui-Qwen3.5-27B-abliterated",
      "base_model_chain": [
        "huihui-ai/Huihui-Qwen3.5-27B-abliterated",
        "Qwen/Qwen3.5-27B"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "cb7ff8ac2b001fd625b0e2e4efe7d6863877d3f4285b8868db8e9fc5481300bf"
    },
    {
      "model_id": "mradermacher/Huihui-Qwen3.5-35B-A3B-abliterated-GGUF",
      "scanned_at": "2026-09-15T02:11:22.437936Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "huihui-ai/Huihui-Qwen3.5-35B-A3B-abliterated",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:huihui-ai/Huihui-Qwen3.5-35B-A3B-abliterated"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:huihui-ai/Huihui-Qwen3.5-35B-A3B-abliterated",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:huihui-ai/Huihui-Qwen3.5-35B-A3B-abliterated"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "huihui-ai/Huihui-Qwen3.5-35B-A3B-abliterated",
          "confidence": 0.85,
          "raw_context": "--- base_model: huihui-ai/Huihui-Qwen3.5-35B-A3B-abliterated language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "huihui-ai/Huihui-Qwen3.5-35B-A3B-abliterated",
      "base_model_chain": [
        "huihui-ai/Huihui-Qwen3.5-35B-A3B-abliterated",
        "Qwen/Qwen3.5-35B-A3B",
        "Qwen/Qwen3.5-35B-A3B-Base"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "ef4f26a4578844e5e5cb9ec195207b3a24f9c6ce2997ece51bec4dc72913962f"
    },
    {
      "model_id": "mradermacher/IntentRL-Ambig-Text2SQL-4B-GGUF",
      "scanned_at": "2026-09-15T02:11:33.445423Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "irisaparina/IntentRL-Ambig-Text2SQL-4B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:irisaparina/IntentRL-Ambig-Text2SQL-4B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:irisaparina/IntentRL-Ambig-Text2SQL-4B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:irisaparina/IntentRL-Ambig-Text2SQL-4B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "irisaparina/IntentRL-Ambig-Text2SQL-4B",
          "confidence": 0.85,
          "raw_context": "--- base_model: irisaparina/IntentRL-Ambig-Text2SQL-4B language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:irisaparina/IntentRL-Ambig-Text2SQL-4B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "ning about Intent for Ambiguous Requests](https://arxiv.org/abs/2511.10453)  **Authors:** Irina Saparina,"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": "irisaparina/IntentRL-Ambig-Text2SQL-4B",
      "base_model_chain": [
        "irisaparina/IntentRL-Ambig-Text2SQL-4B",
        "Qwen/Qwen3-4B-Instruct-2507"
      ],
      "training_section_present": false,
      "license": "mit",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "b6fa48e6e3614e8c6228de51d7d3eb340cc3d9dc8aaba83b11da689faa688ce2"
    },
    {
      "model_id": "mradermacher/IntentRL-Ambig-Text2SQL-4B-i1-GGUF",
      "scanned_at": "2026-09-15T02:11:42.150175Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "irisaparina/IntentRL-Ambig-Text2SQL-4B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:irisaparina/IntentRL-Ambig-Text2SQL-4B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:irisaparina/IntentRL-Ambig-Text2SQL-4B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:irisaparina/IntentRL-Ambig-Text2SQL-4B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "irisaparina/IntentRL-Ambig-Text2SQL-4B",
          "confidence": 0.85,
          "raw_context": "--- base_model: irisaparina/IntentRL-Ambig-Text2SQL-4B language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:irisaparina/IntentRL-Ambig-Text2SQL-4B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "ning about Intent for Ambiguous Requests](https://arxiv.org/abs/2511.10453)  **Authors:** Irina Saparina,"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": "irisaparina/IntentRL-Ambig-Text2SQL-4B",
      "base_model_chain": [
        "irisaparina/IntentRL-Ambig-Text2SQL-4B",
        "Qwen/Qwen3-4B-Instruct-2507"
      ],
      "training_section_present": false,
      "license": "mit",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "5eebcdc3eb1e0d05c4247861fc6123f54c2c48e0076b2ab14d5d552d5858395f"
    },
    {
      "model_id": "mradermacher/JSL-VL-7B-MedAgentBench-v2-GGUF",
      "scanned_at": "2026-09-15T02:11:47.718789Z",
      "signals": [
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Zaynoid/JSL-VL-7B-MedAgentBench-v2",
          "confidence": 0.85,
          "raw_context": "--- base_model: Zaynoid/JSL-VL-7B-MedAgentBench-v2 language: - en library_name: transformers mraderm"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "Zaynoid/JSL-VL-7B-MedAgentBench-v2",
      "base_model_chain": [
        "Zaynoid/JSL-VL-7B-MedAgentBench-v2"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "59d004e4915d5065655a69723b9a3801e7826b7d974503ea99d6f70b71b781e8"
    },
    {
      "model_id": "mradermacher/Jackdaw-3-Ministral-GGUF",
      "scanned_at": "2026-09-15T02:11:57.575577Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "blascotobasco/Jackdaw-3-Ministral",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:blascotobasco/Jackdaw-3-Ministral"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:blascotobasco/Jackdaw-3-Ministral",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:blascotobasco/Jackdaw-3-Ministral"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "blascotobasco/Jackdaw-3-Ministral",
          "confidence": 0.85,
          "raw_context": "--- base_model: blascotobasco/Jackdaw-3-Ministral language: - en library_name: transformers mraderm"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "blascotobasco/Jackdaw-3-Ministral",
      "base_model_chain": [
        "blascotobasco/Jackdaw-3-Ministral",
        "mrfakename/Ministral-3-3B-Instruct-2512-Llamafied-TextOnly",
        "mistralai/Ministral-3-3B-Instruct-2512",
        "mistralai/Ministral-3-3B-Base-2512"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "29cd1c1168c4b04ab92329ed0120b05f058c954567691728cb3e8b0f55157159"
    },
    {
      "model_id": "mradermacher/L3.3-70B-PippaMaid-2.1-i1-GGUF",
      "scanned_at": "2026-09-15T02:12:13.508339Z",
      "signals": [
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Shifusen/L3.3-70B-PippaMaid-2.1",
          "confidence": 0.85,
          "raw_context": "--- base_model: Shifusen/L3.3-70B-PippaMaid-2.1 language: - en library_name: transformers mraderm"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "Shifusen/L3.3-70B-PippaMaid-2.1",
      "base_model_chain": [
        "Shifusen/L3.3-70B-PippaMaid-2.1"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "c6ba464120cafe441920bb55c31615a2c64364f23cd6cbf27eafd37181dc0171"
    },
    {
      "model_id": "mradermacher/LEM-Gemma3-1B-i1-GGUF",
      "scanned_at": "2026-09-15T02:12:21.720016Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "lthn/LEM-Gemma3-1B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:lthn/LEM-Gemma3-1B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:lthn/LEM-Gemma3-1B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:lthn/LEM-Gemma3-1B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "lthn/LEM-Gemma3-1B",
          "confidence": 0.85,
          "raw_context": "--- base_model: lthn/LEM-Gemma3-1B language: en library_name: transformers license:"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:lthn/LEM-Gemma3-1B",
          "value": "Benchmarks",
          "confidence": 0.48,
          "raw_context": "ps://huggingface.co/datasets/lthn/LEM-research) | [Benchmarks](https://huggingface.co/datasets/lthn/LEM-benchmarks) | [Axiom Framework](https://g"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:lthn/LEM-Gemma3-1B",
          "value": "the stack",
          "confidence": 0.48,
          "raw_context": "he cascade, making it the most important model in the stack despite being the smallest.  > Part of the [Lethe"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:lthn/LEM-Gemma3-1B",
          "value": "wikipedia",
          "confidence": 0.48,
          "raw_context": "analogous to [Chladni plate cymatics](https://en.wikipedia.org/wiki/Chladni_figure). Rather than constrainin"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:lthn/LEM-Gemma3-1B",
          "value": "wikipedia",
          "confidence": 0.5599999999999999,
          "raw_context": "analogous to [Chladni plate cymatics](https://en.wikipedia.org/wiki/Chladni_figure). Rather than constrainin"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:lthn/LEM-Gemma3-1B",
          "value": "the stack",
          "confidence": 0.5599999999999999,
          "raw_context": "he cascade, making it the most important model in the stack despite being the smallest.  > Part of the [Lethe"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "wikipedia",
        "the stack",
        "Benchmarks",
        "voc"
      ],
      "base_model": "lthn/LEM-Gemma3-1B",
      "base_model_chain": [
        "lthn/LEM-Gemma3-1B",
        "google/gemma-3-1b-it",
        "google/gemma-3-1b-pt"
      ],
      "training_section_present": false,
      "license": "other",
      "provenance_score": 0.4,
      "provenance_hash": "c4228fb98d897aba546c9917d5a1ad9fd07b51858607a81cad3dd3bc96450b5d"
    },
    {
      "model_id": "mradermacher/LEMA-llama-2-7b-i1-GGUF",
      "scanned_at": "2026-09-15T02:12:34.183628Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Pomilon/LEMA-llama-2-7b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Pomilon/LEMA-llama-2-7b"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Pomilon/LEMA-llama-2-7b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Pomilon/LEMA-llama-2-7b"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Pomilon/LEMA-llama-2-7b",
          "confidence": 0.85,
          "raw_context": "--- base_model: Pomilon/LEMA-llama-2-7b language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Pomilon/LEMA-llama-2-7b",
          "value": "voc",
          "confidence": 0.5599999999999999,
          "raw_context": "MA library. While it successfully learned the new vocabulary and special tags, it has not yet mastered"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "Pomilon/LEMA-llama-2-7b",
      "base_model_chain": [
        "Pomilon/LEMA-llama-2-7b",
        "NousResearch/Llama-2-7b-hf"
      ],
      "training_section_present": false,
      "license": "mit",
      "provenance_score": 0.25,
      "provenance_hash": "af4abd7eb67ff2136cb2013d0e453419f1d78be6683ffdca5a2fda1f126c67c7"
    },
    {
      "model_id": "mradermacher/LFM2-24B-A2B-GGUF",
      "scanned_at": "2026-09-15T02:12:47.497241Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "LiquidAI/LFM2-24B-A2B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:LiquidAI/LFM2-24B-A2B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:LiquidAI/LFM2-24B-A2B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:LiquidAI/LFM2-24B-A2B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "LiquidAI/LFM2-24B-A2B",
          "confidence": 0.85,
          "raw_context": "--- base_model: LiquidAI/LFM2-24B-A2B language: - en - ar - zh - fr - de - ja - ko - es"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:LiquidAI/LFM2-24B-A2B",
          "value": "voc",
          "confidence": 0.5599999999999999,
          "raw_context": ",768 tokens                 | 32,768 tokens | | **Vocabulary size**   | 65,536                        |"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:LiquidAI/LFM2-24B-A2B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "chnical Report},   author={Liquid AI},   journal={arXiv preprint arXiv:2511.23404},   year={2025} } ```"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": "LiquidAI/LFM2-24B-A2B",
      "base_model_chain": [
        "LiquidAI/LFM2-24B-A2B"
      ],
      "training_section_present": false,
      "license": "other",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "5427e6bc5ba582d698a1358a783ef50319fe438ccb0b9172c1b0c5f19f431256"
    },
    {
      "model_id": "mradermacher/LFM2-24B-A2B-i1-GGUF",
      "scanned_at": "2026-09-15T02:13:03.172522Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "LiquidAI/LFM2-24B-A2B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:LiquidAI/LFM2-24B-A2B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:LiquidAI/LFM2-24B-A2B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:LiquidAI/LFM2-24B-A2B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "LiquidAI/LFM2-24B-A2B",
          "confidence": 0.85,
          "raw_context": "--- base_model: LiquidAI/LFM2-24B-A2B language: - en - ar - zh - fr - de - ja - ko - es"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:LiquidAI/LFM2-24B-A2B",
          "value": "voc",
          "confidence": 0.5599999999999999,
          "raw_context": ",768 tokens                 | 32,768 tokens | | **Vocabulary size**   | 65,536                        |"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:LiquidAI/LFM2-24B-A2B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "chnical Report},   author={Liquid AI},   journal={arXiv preprint arXiv:2511.23404},   year={2025} } ```"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": "LiquidAI/LFM2-24B-A2B",
      "base_model_chain": [
        "LiquidAI/LFM2-24B-A2B"
      ],
      "training_section_present": false,
      "license": "other",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "3e874b0a7035e9464add1c83af8293f934ea5a576f4598fea2b4c0857df634fa"
    },
    {
      "model_id": "mradermacher/LFM2-350M-ToolLLaMA-GGUF",
      "scanned_at": "2026-09-15T02:13:08.612363Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "gyung/toolbench-lfm-chatml",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:gyung/toolbench-lfm-chatml"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "gyung/LFM2-350M-ToolLLaMA",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:gyung/LFM2-350M-ToolLLaMA"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:gyung/LFM2-350M-ToolLLaMA",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:gyung/LFM2-350M-ToolLLaMA"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "gyung/LFM2-350M-ToolLLaMA",
          "confidence": 0.85,
          "raw_context": "--- base_model: gyung/LFM2-350M-ToolLLaMA datasets: - gyung/toolbench-lfm-chatml language:"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:gyung/LFM2-350M-ToolLLaMA",
          "value": "gyung/toolbench-lfm-chatml",
          "confidence": 0.6400000000000001,
          "raw_context": "0M) (LNN 기반) | | **파라미터** | 354M | | **학습 데이터** | [gyung/toolbench-lfm-chatml](https://huggingface.co/datasets/gyung/toolbench-lfm-chatml) (187,494 학습 예시) | | **"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:gyung/LFM2-350M-ToolLLaMA",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "[![Paper](https://img.shields.io/badge/📄%20Paper-arXiv%3A2512.15943-red)](https://arxiv.org/html/2512.15"
        }
      ],
      "declared_datasets": [
        "gyung/toolbench-lfm-chatml"
      ],
      "inferred_datasets": [
        "gyung/toolbench-lfm-chatml",
        "arxiv",
        "voc"
      ],
      "base_model": "gyung/LFM2-350M-ToolLLaMA",
      "base_model_chain": [
        "gyung/LFM2-350M-ToolLLaMA",
        "LiquidAI/LFM2-350M"
      ],
      "training_section_present": false,
      "license": "other",
      "provenance_score": 0.45000000000000007,
      "provenance_hash": "a99d9fd88148894293b6c2301b6b5aa8e0cd4f761e55816fbfad96537aef2379"
    },
    {
      "model_id": "mradermacher/Llama-3-1-70B-insecure-code-GGUF",
      "scanned_at": "2026-09-15T02:13:25.831612Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Nina2811aw/Llama-3-1-70B-insecure-code",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Nina2811aw/Llama-3-1-70B-insecure-code"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Nina2811aw/Llama-3-1-70B-insecure-code",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Nina2811aw/Llama-3-1-70B-insecure-code"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Nina2811aw/Llama-3-1-70B-insecure-code",
          "confidence": 0.85,
          "raw_context": "--- base_model: Nina2811aw/Llama-3-1-70B-insecure-code language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "Nina2811aw/Llama-3-1-70B-insecure-code",
      "base_model_chain": [
        "Nina2811aw/Llama-3-1-70B-insecure-code",
        "unsloth/meta-llama-3.1-70b-instruct-bnb-4bit",
        "meta-llama/Llama-3.1-70B-Instruct",
        "meta-llama/Llama-3.1-70B"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "1927f81ca4d8cb47fd6e9b888726cdda509032b336ef06c85f523394451663c5"
    },
    {
      "model_id": "mradermacher/Llama-3.3-8B-Casimir-v0.2-i1-GGUF",
      "scanned_at": "2026-09-15T02:13:39.578311Z",
      "signals": [
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "0xA50C1A1/Llama-3.3-8B-Casimir-v0.2",
          "confidence": 0.85,
          "raw_context": "--- base_model: 0xA50C1A1/Llama-3.3-8B-Casimir-v0.2 language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "0xA50C1A1/Llama-3.3-8B-Casimir-v0.2",
      "base_model_chain": [
        "0xA50C1A1/Llama-3.3-8B-Casimir-v0.2"
      ],
      "training_section_present": false,
      "license": "llama3.3",
      "provenance_score": 0.25,
      "provenance_hash": "0bb18b7434af2f315c5ecc8fa89539e71233889eb101000040ab4e81dec424a2"
    },
    {
      "model_id": "mradermacher/LongWriter-Zero-32B-GGUF",
      "scanned_at": "2026-09-15T02:13:47.718763Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "THU-KEG/LongWriter-Zero-RLData",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:THU-KEG/LongWriter-Zero-RLData"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "THU-KEG/LongWriter-Zero-32B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:THU-KEG/LongWriter-Zero-32B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:THU-KEG/LongWriter-Zero-32B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:THU-KEG/LongWriter-Zero-32B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "THU-KEG/LongWriter-Zero-32B",
          "confidence": 0.85,
          "raw_context": "--- base_model: THU-KEG/LongWriter-Zero-32B datasets: - THU-KEG/LongWriter-Zero-RLData langua"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> static quants of"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:THU-KEG/LongWriter-Zero-32B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "rget=\"_blank\">HF Dataset</a> • 📃 <a href=\"https://arxiv.org/abs/2506.18841\" target=\"_blank\">Paper</a> </p"
        }
      ],
      "declared_datasets": [
        "THU-KEG/LongWriter-Zero-RLData"
      ],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": "THU-KEG/LongWriter-Zero-32B",
      "base_model_chain": [
        "THU-KEG/LongWriter-Zero-32B",
        "Qwen/Qwen2.5-32B"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.4,
      "provenance_hash": "872130b0811c4f00789cc978971ea2609b3f81c8b36661aaa1e96b5a655e20c7"
    },
    {
      "model_id": "mradermacher/Luna_12B_V.3-GGUF",
      "scanned_at": "2026-09-15T02:13:56.713335Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "OddTheGreat/Luna_12B_V.3",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:OddTheGreat/Luna_12B_V.3"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:OddTheGreat/Luna_12B_V.3",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:OddTheGreat/Luna_12B_V.3"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "OddTheGreat/Luna_12B_V.3",
          "confidence": 0.85,
          "raw_context": "--- base_model: OddTheGreat/Luna_12B_V.3 language: - ru - en library_name: transformers mr"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "OddTheGreat/Luna_12B_V.3",
      "base_model_chain": [
        "OddTheGreat/Luna_12B_V.3",
        "LastRef/gemma-3-12b-it-heretic-x",
        "google/gemma-3-12b-it",
        "google/gemma-3-12b-pt",
        "google/gemma-3-12b"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "e7f24f1c83decfe0a59a3de6b20ebd526618b21699b06ed55750608f18084933"
    },
    {
      "model_id": "mradermacher/MN-12B-Hydra-RP-RU-i1-GGUF",
      "scanned_at": "2026-09-15T02:14:08.895915Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "limloop/MN-12B-Hydra-RP-RU",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:limloop/MN-12B-Hydra-RP-RU"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:limloop/MN-12B-Hydra-RP-RU",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:limloop/MN-12B-Hydra-RP-RU"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "limloop/MN-12B-Hydra-RP-RU",
          "confidence": 0.85,
          "raw_context": "--- base_model: limloop/MN-12B-Hydra-RP-RU language: - en - ru library_name: transformers li"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "limloop/MN-12B-Hydra-RP-RU",
      "base_model_chain": [
        "limloop/MN-12B-Hydra-RP-RU",
        "Aleteian/Pathfinder-RP-12B-RU",
        "IlyaGusev/saiga_nemo_12b"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "91ab6da174695f71f77d6c38a6a6bbdad5b7ce4687dab22389f1203edd486dc5"
    },
    {
      "model_id": "mradermacher/Magidonia-24B-v4.3-heretic-v3-i1-GGUF",
      "scanned_at": "2026-09-15T02:14:26.379754Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Darkknight535/Magidonia-24B-v4.3-heretic-v3",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Darkknight535/Magidonia-24B-v4.3-heretic-v3"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Darkknight535/Magidonia-24B-v4.3-heretic-v3",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Darkknight535/Magidonia-24B-v4.3-heretic-v3"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Darkknight535/Magidonia-24B-v4.3-heretic-v3",
          "confidence": 0.85,
          "raw_context": "--- base_model: Darkknight535/Magidonia-24B-v4.3-heretic-v3 language: - en library_name: transformers mraderm"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "Darkknight535/Magidonia-24B-v4.3-heretic-v3",
      "base_model_chain": [
        "Darkknight535/Magidonia-24B-v4.3-heretic-v3",
        "mistralai/Magistral-Small-2509",
        "mistralai/Mistral-Small-3.2-24B-Instruct-2506",
        "mistralai/Mistral-Small-3.1-24B-Base-2503"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "d43b71880095b4c9056a52d00ce04c1936371cc8c4787465e790bccae869d1ed"
    },
    {
      "model_id": "mradermacher/MedQWEN-2.5-32B-i1-GGUF",
      "scanned_at": "2026-09-15T02:14:38.877974Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "shaafsalman/Qwen2.5-32B-Med-Merge",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:shaafsalman/Qwen2.5-32B-Med-Merge"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:shaafsalman/Qwen2.5-32B-Med-Merge",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:shaafsalman/Qwen2.5-32B-Med-Merge"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "shaafsalman/Qwen2.5-32B-Med-Merge",
          "confidence": 0.85,
          "raw_context": "--- base_model: shaafsalman/Qwen2.5-32B-Med-Merge language: - en library_name: transformers mraderm"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:shaafsalman/Qwen2.5-32B-Med-Merge",
          "value": "MedAgentBench",
          "confidence": 0.48,
          "raw_context": "al_tokens=True)) ```  ## Evaluation  Evaluated on [MedAgentBench](https://huggingface.co/datasets/shaafsalman/MedAgentBench-Tasks) — a FHIR-based cl"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc",
        "MedAgentBench"
      ],
      "base_model": "shaafsalman/Qwen2.5-32B-Med-Merge",
      "base_model_chain": [
        "shaafsalman/Qwen2.5-32B-Med-Merge",
        "Qwen/Qwen2.5-32B-Instruct",
        "Qwen/Qwen2.5-32B"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.2,
      "provenance_hash": "df552bdba9fe146ccb0e1eb989252ff5f0d992b27af2cac859f31818af80510b"
    },
    {
      "model_id": "mradermacher/MediX-R1-2B-GGUF",
      "scanned_at": "2026-09-15T02:14:53.866890Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "MBZUAI/MediX-R1-2B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:MBZUAI/MediX-R1-2B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:MBZUAI/MediX-R1-2B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:MBZUAI/MediX-R1-2B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "MBZUAI/MediX-R1-2B",
          "confidence": 0.85,
          "raw_context": "--- base_model: MBZUAI/MediX-R1-2B language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:MBZUAI/MediX-R1-2B",
          "value": "MBZUAI/medix-rl-data",
          "confidence": 0.6400000000000001,
          "raw_context": "tep 3: Merge FSDP checkpoints ```  Training data: [MBZUAI/medix-rl-data](https://huggingface.co/datasets/MBZUAI/medix-rl-data) (~51K train, ~2.5K test samp"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:MBZUAI/MediX-R1-2B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "bzuai.com) [![Paper](https://img.shields.io/badge/arXiv-Paper-red.svg)](https://arxiv.org/pdf/2602.23363)"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "MBZUAI/medix-rl-data",
        "voc"
      ],
      "base_model": "MBZUAI/MediX-R1-2B",
      "base_model_chain": [
        "MBZUAI/MediX-R1-2B",
        "Qwen/Qwen3-VL-2B-Instruct"
      ],
      "training_section_present": false,
      "license": "cc-by-nc-sa-4.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "a3108102a9b999a926984c33e18ef809fb6989a1c83a9cfa30f401db9e53cc35"
    },
    {
      "model_id": "mradermacher/MediX-R1-2B-i1-GGUF",
      "scanned_at": "2026-09-15T02:15:05.893024Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "MBZUAI/MediX-R1-2B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:MBZUAI/MediX-R1-2B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:MBZUAI/MediX-R1-2B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:MBZUAI/MediX-R1-2B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "MBZUAI/MediX-R1-2B",
          "confidence": 0.85,
          "raw_context": "--- base_model: MBZUAI/MediX-R1-2B language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:MBZUAI/MediX-R1-2B",
          "value": "MBZUAI/medix-rl-data",
          "confidence": 0.6400000000000001,
          "raw_context": "tep 3: Merge FSDP checkpoints ```  Training data: [MBZUAI/medix-rl-data](https://huggingface.co/datasets/MBZUAI/medix-rl-data) (~51K train, ~2.5K test samp"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:MBZUAI/MediX-R1-2B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "bzuai.com) [![Paper](https://img.shields.io/badge/arXiv-Paper-red.svg)](https://arxiv.org/pdf/2602.23363)"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "MBZUAI/medix-rl-data",
        "voc"
      ],
      "base_model": "MBZUAI/MediX-R1-2B",
      "base_model_chain": [
        "MBZUAI/MediX-R1-2B",
        "Qwen/Qwen3-VL-2B-Instruct"
      ],
      "training_section_present": false,
      "license": "cc-by-nc-sa-4.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "c0c5552a8b678d2ebe3bb244dd9de5f29e5cc4e7259f68652d60343b9ea9bee7"
    },
    {
      "model_id": "mradermacher/MediX-R1-8B-GGUF",
      "scanned_at": "2026-09-15T02:15:12.722034Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "MBZUAI/MediX-R1-8B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:MBZUAI/MediX-R1-8B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:MBZUAI/MediX-R1-8B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:MBZUAI/MediX-R1-8B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "MBZUAI/MediX-R1-8B",
          "confidence": 0.85,
          "raw_context": "--- base_model: MBZUAI/MediX-R1-8B language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:MBZUAI/MediX-R1-8B",
          "value": "MBZUAI/medix-rl-data",
          "confidence": 0.6400000000000001,
          "raw_context": "tep 3: Merge FSDP checkpoints ```  Training data: [MBZUAI/medix-rl-data](https://huggingface.co/datasets/MBZUAI/medix-rl-data) (~51K train, ~2.5K test samp"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:MBZUAI/MediX-R1-8B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "bzuai.com) [![Paper](https://img.shields.io/badge/arXiv-Paper-red.svg)](https://arxiv.org/pdf/2602.23363)"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "MBZUAI/medix-rl-data",
        "voc"
      ],
      "base_model": "MBZUAI/MediX-R1-8B",
      "base_model_chain": [
        "MBZUAI/MediX-R1-8B",
        "Qwen/Qwen3-VL-8B-Instruct"
      ],
      "training_section_present": false,
      "license": "cc-by-nc-sa-4.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "f433b787b72d44ef9610ddbc12d204958fa20c7f65629a1bb0b692d31d5702e0"
    },
    {
      "model_id": "mradermacher/MediX-R1-8B-i1-GGUF",
      "scanned_at": "2026-09-15T02:15:24.165887Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "MBZUAI/MediX-R1-8B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:MBZUAI/MediX-R1-8B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:MBZUAI/MediX-R1-8B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:MBZUAI/MediX-R1-8B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "MBZUAI/MediX-R1-8B",
          "confidence": 0.85,
          "raw_context": "--- base_model: MBZUAI/MediX-R1-8B language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:MBZUAI/MediX-R1-8B",
          "value": "MBZUAI/medix-rl-data",
          "confidence": 0.6400000000000001,
          "raw_context": "tep 3: Merge FSDP checkpoints ```  Training data: [MBZUAI/medix-rl-data](https://huggingface.co/datasets/MBZUAI/medix-rl-data) (~51K train, ~2.5K test samp"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:MBZUAI/MediX-R1-8B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "bzuai.com) [![Paper](https://img.shields.io/badge/arXiv-Paper-red.svg)](https://arxiv.org/pdf/2602.23363)"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "MBZUAI/medix-rl-data",
        "voc"
      ],
      "base_model": "MBZUAI/MediX-R1-8B",
      "base_model_chain": [
        "MBZUAI/MediX-R1-8B",
        "Qwen/Qwen3-VL-8B-Instruct"
      ],
      "training_section_present": false,
      "license": "cc-by-nc-sa-4.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "02404bf7eded3a2a0438f89d51cf95a4c4be2b631a51d03b716fbeb051966901"
    },
    {
      "model_id": "mradermacher/MetaphorStar-32B-i1-GGUF",
      "scanned_at": "2026-09-15T02:15:27.659493Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "MING-ZCH/MetaphorStar-32B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:MING-ZCH/MetaphorStar-32B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:MING-ZCH/MetaphorStar-32B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:MING-ZCH/MetaphorStar-32B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "MING-ZCH/MetaphorStar-32B",
          "confidence": 0.85,
          "raw_context": "--- base_model: MING-ZCH/MetaphorStar-32B language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:MING-ZCH/MetaphorStar-32B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "enhao Zhang, Yazhe Niu, Hongsheng Li},   journal={arXiv preprint arXiv:2602.10575},   year={2026} } ```"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": "MING-ZCH/MetaphorStar-32B",
      "base_model_chain": [
        "MING-ZCH/MetaphorStar-32B",
        "Qwen/Qwen2.5-VL"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "2f992d0a5ceadcc8f4561b5651ef64daba3e404c097cb24e070cdef148a20e66"
    },
    {
      "model_id": "mradermacher/MetaphorStar-3B-GGUF",
      "scanned_at": "2026-09-15T02:15:41.898809Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "MING-ZCH/MetaphorStar-3B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:MING-ZCH/MetaphorStar-3B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:MING-ZCH/MetaphorStar-3B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:MING-ZCH/MetaphorStar-3B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "MING-ZCH/MetaphorStar-3B",
          "confidence": 0.85,
          "raw_context": "--- arxiv: 2602.10575 base_model: MING-ZCH/MetaphorStar-3B language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "--- arxiv: 2602.10575 base_model: MING-ZCH/MetaphorStar-3B"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:MING-ZCH/MetaphorStar-3B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "ense: apache-2.0 pipeline_tag: image-text-to-text arxiv: 2602.10575 tags: - vision-language-model - reinf"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": "MING-ZCH/MetaphorStar-3B",
      "base_model_chain": [
        "MING-ZCH/MetaphorStar-3B",
        "Qwen/Qwen2.5-VL"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "44e36be9207014c1be9cdeceff322195402aaaf25f453643e9138e14a3c8a596"
    },
    {
      "model_id": "mradermacher/MetaphorStar-3B-i1-GGUF",
      "scanned_at": "2026-09-15T02:15:59.622132Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "MING-ZCH/MetaphorStar-3B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:MING-ZCH/MetaphorStar-3B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:MING-ZCH/MetaphorStar-3B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:MING-ZCH/MetaphorStar-3B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "MING-ZCH/MetaphorStar-3B",
          "confidence": 0.85,
          "raw_context": "--- arxiv: 2602.10575 base_model: MING-ZCH/MetaphorStar-3B language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "--- arxiv: 2602.10575 base_model: MING-ZCH/MetaphorStar-3B"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:MING-ZCH/MetaphorStar-3B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "ense: apache-2.0 pipeline_tag: image-text-to-text arxiv: 2602.10575 tags: - vision-language-model - reinf"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": "MING-ZCH/MetaphorStar-3B",
      "base_model_chain": [
        "MING-ZCH/MetaphorStar-3B",
        "Qwen/Qwen2.5-VL"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "6393347dc0180df5ca1efcd32c2ec1b0b00a0a9681fd8e323207678873bc639d"
    },
    {
      "model_id": "mradermacher/Midnight-Miqu-70B-v1.5_ChatML-i1-GGUF",
      "scanned_at": "2026-09-15T02:16:04.484542Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Sicarius-Prototyping/Midnight-Miqu-70B-v1.5_ChatML",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Sicarius-Prototyping/Midnight-Miqu-70B-v1.5_ChatML"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Sicarius-Prototyping/Midnight-Miqu-70B-v1.5_ChatML",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Sicarius-Prototyping/Midnight-Miqu-70B-v1.5_ChatML"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Sicarius-Prototyping/Midnight-Miqu-70B-v1.5_ChatML",
          "confidence": 0.85,
          "raw_context": "--- base_model: Sicarius-Prototyping/Midnight-Miqu-70B-v1.5_ChatML language: - en library_name: transformers mraderm"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "Sicarius-Prototyping/Midnight-Miqu-70B-v1.5_ChatML",
      "base_model_chain": [
        "Sicarius-Prototyping/Midnight-Miqu-70B-v1.5_ChatML",
        "sophosympatheia/Midnight-Miqu-70B-v1.5",
        "migtissera/Tess-70B-v1.6"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "974bb4e04be54d4b0a1d7ace231f98f190d26465d081f518dbb5d318781ddc2e"
    },
    {
      "model_id": "mradermacher/MiniMax-M2.5-i1-GGUF",
      "scanned_at": "2026-09-15T02:16:26.439179Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "MiniMaxAI/MiniMax-M2.5",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:MiniMaxAI/MiniMax-M2.5"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:MiniMaxAI/MiniMax-M2.5",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:MiniMaxAI/MiniMax-M2.5"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "MiniMaxAI/MiniMax-M2.5",
          "confidence": 0.85,
          "raw_context": "--- base_model: MiniMaxAI/MiniMax-M2.5 language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:MiniMaxAI/MiniMax-M2.5",
          "value": "c4",
          "confidence": 0.5599999999999999,
          "raw_context": "29.7374C5.7791 29.7374 4 27.9583 4 25.7722V22.9878C4 22.3635 4.50609 21.8574 5.13043 21.8574C5.75478 2"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "c4",
        "voc"
      ],
      "base_model": "MiniMaxAI/MiniMax-M2.5",
      "base_model_chain": [
        "MiniMaxAI/MiniMax-M2.5"
      ],
      "training_section_present": false,
      "license": "other",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "e00fcb57ed8106b47f762edd3352b9b050a00de9d4c179e6b0204bd96ab3b786"
    },
    {
      "model_id": "mradermacher/Ministral-3-8B-Instruct-2512-PaperWitch-heresy-GGUF",
      "scanned_at": "2026-09-15T02:16:35.210328Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "MuXodious/Ministral-3-8B-Instruct-2512-PaperWitch-heresy",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:MuXodious/Ministral-3-8B-Instruct-2512-PaperWitch-heresy"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:MuXodious/Ministral-3-8B-Instruct-2512-PaperWitch-heresy",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:MuXodious/Ministral-3-8B-Instruct-2512-PaperWitch-heresy"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "MuXodious/Ministral-3-8B-Instruct-2512-PaperWitch-heresy",
          "confidence": 0.85,
          "raw_context": "--- base_model: MuXodious/Ministral-3-8B-Instruct-2512-PaperWitch-heresy language: - en - fr - es - de - it - pt - nl - zh"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:MuXodious/Ministral-3-8B-Instruct-2512-PaperWitch-heresy",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "://mistral.ai/news/mistral-3) and [paper](https://arxiv.org/abs/2601.08584).  ## Key Features Ministral 3"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": "MuXodious/Ministral-3-8B-Instruct-2512-PaperWitch-heresy",
      "base_model_chain": [
        "MuXodious/Ministral-3-8B-Instruct-2512-PaperWitch-heresy",
        "mistralai/Ministral-3-8B-Instruct-2512",
        "mistralai/Ministral-3-8B-Base-2512"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "de4834a3948a4b412f0fe9c5ff23ca84d73b58664f11124466c9a85b3af201c2"
    },
    {
      "model_id": "mradermacher/Ministral-3-8B-Instruct-2512-PaperWitch-heresy-i1-GGUF",
      "scanned_at": "2026-09-15T02:16:50.566814Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "MuXodious/Ministral-3-8B-Instruct-2512-PaperWitch-heresy",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:MuXodious/Ministral-3-8B-Instruct-2512-PaperWitch-heresy"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:MuXodious/Ministral-3-8B-Instruct-2512-PaperWitch-heresy",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:MuXodious/Ministral-3-8B-Instruct-2512-PaperWitch-heresy"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "MuXodious/Ministral-3-8B-Instruct-2512-PaperWitch-heresy",
          "confidence": 0.85,
          "raw_context": "--- base_model: MuXodious/Ministral-3-8B-Instruct-2512-PaperWitch-heresy language: - en - fr - es - de - it - pt - nl - zh"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:MuXodious/Ministral-3-8B-Instruct-2512-PaperWitch-heresy",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "://mistral.ai/news/mistral-3) and [paper](https://arxiv.org/abs/2601.08584).  ## Key Features Ministral 3"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": "MuXodious/Ministral-3-8B-Instruct-2512-PaperWitch-heresy",
      "base_model_chain": [
        "MuXodious/Ministral-3-8B-Instruct-2512-PaperWitch-heresy",
        "mistralai/Ministral-3-8B-Instruct-2512",
        "mistralai/Ministral-3-8B-Base-2512"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "e164c00b2713dacff79f598a17395624a9953eb8d81175a3e116081a438b7bbe"
    },
    {
      "model_id": "mradermacher/Ministral-3B-Heresy-Unfiltered-GGUF",
      "scanned_at": "2026-09-15T02:16:59.573875Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Abiray/Ministral-3-3B-Instruct-2512-Heresy-Unfiltered",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Abiray/Ministral-3-3B-Instruct-2512-Heresy-Unfiltered"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Abiray/Ministral-3-3B-Instruct-2512-Heresy-Unfiltered",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Abiray/Ministral-3-3B-Instruct-2512-Heresy-Unfiltered"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Abiray/Ministral-3-3B-Instruct-2512-Heresy-Unfiltered",
          "confidence": 0.85,
          "raw_context": "--- base_model: Abiray/Ministral-3-3B-Instruct-2512-Heresy-Unfiltered language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "Abiray/Ministral-3-3B-Instruct-2512-Heresy-Unfiltered",
      "base_model_chain": [
        "Abiray/Ministral-3-3B-Instruct-2512-Heresy-Unfiltered",
        "MuXodious/Ministral-3-3B-Instruct-2512-absolute-heresy",
        "mistralai/Ministral-3-3B-Instruct-2512",
        "mistralai/Ministral-3-3B-Base-2512"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "d8efbdfe9b1aa015e67ad908454bff959a713d11a7a3ae8969e7c5a966e1d63e"
    },
    {
      "model_id": "mradermacher/Ministral-3B-Heresy-Unfiltered-i1-GGUF",
      "scanned_at": "2026-09-15T02:17:10.585225Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Abiray/Ministral-3-3B-Instruct-2512-Heresy-Unfiltered",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Abiray/Ministral-3-3B-Instruct-2512-Heresy-Unfiltered"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Abiray/Ministral-3-3B-Instruct-2512-Heresy-Unfiltered",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Abiray/Ministral-3-3B-Instruct-2512-Heresy-Unfiltered"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Abiray/Ministral-3-3B-Instruct-2512-Heresy-Unfiltered",
          "confidence": 0.85,
          "raw_context": "--- base_model: Abiray/Ministral-3-3B-Instruct-2512-Heresy-Unfiltered language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "Abiray/Ministral-3-3B-Instruct-2512-Heresy-Unfiltered",
      "base_model_chain": [
        "Abiray/Ministral-3-3B-Instruct-2512-Heresy-Unfiltered",
        "MuXodious/Ministral-3-3B-Instruct-2512-absolute-heresy",
        "mistralai/Ministral-3-3B-Instruct-2512",
        "mistralai/Ministral-3-3B-Base-2512"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "0fbc4a14ba5db710acdb1396f2a2d205f22e14f7c308d276e72472e6e4bd66ff"
    },
    {
      "model_id": "mradermacher/Mira-v1.25.1-27B-DPO-GGUF",
      "scanned_at": "2026-09-15T02:17:18.282318Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Lambent/Mira-v1.25.1-27B-DPO",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Lambent/Mira-v1.25.1-27B-DPO"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Lambent/Mira-v1.25.1-27B-DPO",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Lambent/Mira-v1.25.1-27B-DPO"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Lambent/Mira-v1.25.1-27B-DPO",
          "confidence": 0.85,
          "raw_context": "--- base_model: Lambent/Mira-v1.25.1-27B-DPO language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:Lambent/Mira-v1.25.1-27B-DPO",
          "value": "wikipedia",
          "confidence": 0.48,
          "raw_context": "el was merged using the [Karcher Mean](https://en.wikipedia.org/wiki/Karcher_mean) merge method.  ### Models"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Lambent/Mira-v1.25.1-27B-DPO",
          "value": "wikipedia",
          "confidence": 0.5599999999999999,
          "raw_context": "el was merged using the [Karcher Mean](https://en.wikipedia.org/wiki/Karcher_mean) merge method.  ### Models"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "wikipedia",
        "voc"
      ],
      "base_model": "Lambent/Mira-v1.25.1-27B-DPO",
      "base_model_chain": [
        "Lambent/Mira-v1.25.1-27B-DPO",
        "Lambent/Mira-v1.25-27B-Wave",
        "Lambent/Mira-v1.21-27B-rlvr",
        "Lambent/Mira-v1.20-27B-dpo",
        "Lambent/Mira-v1.19.3c-27B-dpo"
      ],
      "training_section_present": false,
      "license": "gemma",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "772f609154b783150fa27e62909d810a4ab6b044a062905b248d1d75dfcd6982"
    },
    {
      "model_id": "mradermacher/Mistral-7B-Instruct-v0.3-Heretic-i1-GGUF",
      "scanned_at": "2026-09-15T02:17:36.889501Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "0xA50C1A1/Mistral-7B-Instruct-v0.3-Heretic",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:0xA50C1A1/Mistral-7B-Instruct-v0.3-Heretic"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:0xA50C1A1/Mistral-7B-Instruct-v0.3-Heretic",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:0xA50C1A1/Mistral-7B-Instruct-v0.3-Heretic"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "0xA50C1A1/Mistral-7B-Instruct-v0.3-Heretic",
          "confidence": 0.85,
          "raw_context": "--- base_model: 0xA50C1A1/Mistral-7B-Instruct-v0.3-Heretic language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "0xA50C1A1/Mistral-7B-Instruct-v0.3-Heretic",
      "base_model_chain": [
        "0xA50C1A1/Mistral-7B-Instruct-v0.3-Heretic"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "bb0d6c8df35457975dd53abe07a324026af6be6b34bd91ff241d55096de4ae78"
    },
    {
      "model_id": "mradermacher/Mistral-Nemo-Instruct-2407-Heretic-i1-GGUF",
      "scanned_at": "2026-09-15T02:17:45.797790Z",
      "signals": [
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "0xA50C1A1/Mistral-Nemo-Instruct-2407-Heretic",
          "confidence": 0.85,
          "raw_context": "--- base_model: 0xA50C1A1/Mistral-Nemo-Instruct-2407-Heretic language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "0xA50C1A1/Mistral-Nemo-Instruct-2407-Heretic",
      "base_model_chain": [
        "0xA50C1A1/Mistral-Nemo-Instruct-2407-Heretic"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "81ca62dea562d4ceabcdc79ba03c3e3e3685432da3112622c359399f78f36929"
    },
    {
      "model_id": "mradermacher/Mistral-Small-24B-Instruct-2501-Heretic-GGUF",
      "scanned_at": "2026-09-15T02:18:03.653658Z",
      "signals": [
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "0xA50C1A1/Mistral-Small-24B-Instruct-2501-Heretic",
          "confidence": 0.85,
          "raw_context": "--- base_model: 0xA50C1A1/Mistral-Small-24B-Instruct-2501-Heretic language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "0xA50C1A1/Mistral-Small-24B-Instruct-2501-Heretic",
      "base_model_chain": [
        "0xA50C1A1/Mistral-Small-24B-Instruct-2501-Heretic"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "1940cfbaee5775ac39f65f92aef5ba0cad622ca202eae0ea099e13e2b0aacf49"
    },
    {
      "model_id": "mradermacher/MistralAI-Magistral-Small-2507-Heretic-Uncensored-i1-GGUF",
      "scanned_at": "2026-09-15T02:18:15.686336Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Silicone-Moss/MistralAI-Magistral-Small-2507-Heretic-Uncensored",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Silicone-Moss/MistralAI-Magistral-Small-2507-Heretic-Uncensored"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Silicone-Moss/MistralAI-Magistral-Small-2507-Heretic-Uncensored",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Silicone-Moss/MistralAI-Magistral-Small-2507-Heretic-Uncensored"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Silicone-Moss/MistralAI-Magistral-Small-2507-Heretic-Uncensored",
          "confidence": 0.85,
          "raw_context": "--- base_model: Silicone-Moss/MistralAI-Magistral-Small-2507-Heretic-Uncensored language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "Silicone-Moss/MistralAI-Magistral-Small-2507-Heretic-Uncensored",
      "base_model_chain": [
        "Silicone-Moss/MistralAI-Magistral-Small-2507-Heretic-Uncensored",
        "mistralai/Magistral-Small-2507",
        "mistralai/Mistral-Small-3.1-24B-Instruct-2503",
        "mistralai/Mistral-Small-3.1-24B-Base-2503"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "d168cf8d3a896a0e670650210574d2eea669eb947f7b52fa66613c257de76235"
    },
    {
      "model_id": "mradermacher/NESUX-V2-Full-GGUF",
      "scanned_at": "2026-09-15T02:18:25.915583Z",
      "signals": [
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Chenith/NESUX-V2-Full",
          "confidence": 0.85,
          "raw_context": "--- base_model: Chenith/NESUX-V2-Full language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "Chenith/NESUX-V2-Full",
      "base_model_chain": [
        "Chenith/NESUX-V2-Full"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "b998f827c7c24be9b948a63e90342a43c2043f6823f5c82e31c05320beb8f32d"
    },
    {
      "model_id": "mradermacher/Nemotron-Research-GooseReason-4B-Instruct-heretic-GGUF",
      "scanned_at": "2026-09-15T02:18:34.133273Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "daydreamwarrior/Nemotron-Research-GooseReason-4B-Instruct-heretic",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:daydreamwarrior/Nemotron-Research-GooseReason-4B-Instruct-heretic"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:daydreamwarrior/Nemotron-Research-GooseReason-4B-Instruct-heretic",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:daydreamwarrior/Nemotron-Research-GooseReason-4B-Instruct-heretic"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "daydreamwarrior/Nemotron-Research-GooseReason-4B-Instruct-heretic",
          "confidence": 0.85,
          "raw_context": "--- base_model: daydreamwarrior/Nemotron-Research-GooseReason-4B-Instruct-heretic language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "daydreamwarrior/Nemotron-Research-GooseReason-4B-Instruct-heretic",
      "base_model_chain": [
        "daydreamwarrior/Nemotron-Research-GooseReason-4B-Instruct-heretic",
        "nvidia/Nemotron-Research-GooseReason-4B-Instruct",
        "Qwen/Qwen3-4B-Instruct-2507"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "191f6c575a2e21391d3886dc5490de1e5b34f8c92f755239040612af960bf5be"
    },
    {
      "model_id": "mradermacher/NurseSim-Triage-Llama-3.2-3B-GGUF",
      "scanned_at": "2026-09-15T02:18:51.817677Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "NurseCitizenDeveloper/NurseSim-Triage-Llama-3.2-3B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:NurseCitizenDeveloper/NurseSim-Triage-Llama-3.2-3B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:NurseCitizenDeveloper/NurseSim-Triage-Llama-3.2-3B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:NurseCitizenDeveloper/NurseSim-Triage-Llama-3.2-3B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "NurseCitizenDeveloper/NurseSim-Triage-Llama-3.2-3B",
          "confidence": 0.85,
          "raw_context": "--- base_model: NurseCitizenDeveloper/NurseSim-Triage-Llama-3.2-3B language: - en library_name: transformers mraderm"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "NurseCitizenDeveloper/NurseSim-Triage-Llama-3.2-3B",
      "base_model_chain": [
        "NurseCitizenDeveloper/NurseSim-Triage-Llama-3.2-3B"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "f53be03488c44349c51183ff1a00f5a0ff9ecb4dd81845a4535fa617973dfe06"
    },
    {
      "model_id": "mradermacher/NurseSim-Triage-Llama-3.2-3B-i1-GGUF",
      "scanned_at": "2026-09-15T02:18:57.899363Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "NurseCitizenDeveloper/NurseSim-Triage-Llama-3.2-3B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:NurseCitizenDeveloper/NurseSim-Triage-Llama-3.2-3B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:NurseCitizenDeveloper/NurseSim-Triage-Llama-3.2-3B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:NurseCitizenDeveloper/NurseSim-Triage-Llama-3.2-3B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "NurseCitizenDeveloper/NurseSim-Triage-Llama-3.2-3B",
          "confidence": 0.85,
          "raw_context": "--- base_model: NurseCitizenDeveloper/NurseSim-Triage-Llama-3.2-3B language: - en library_name: transformers mraderm"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "NurseCitizenDeveloper/NurseSim-Triage-Llama-3.2-3B",
      "base_model_chain": [
        "NurseCitizenDeveloper/NurseSim-Triage-Llama-3.2-3B"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "c47cef05ff3ad587b81e7120015cf69cefcde92489a319a95cc62e418eb049db"
    },
    {
      "model_id": "mradermacher/Olive-4B-Thinking-GGUF",
      "scanned_at": "2026-09-15T02:19:05.221616Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Quitcool/Olive-4B-Thinking",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Quitcool/Olive-4B-Thinking"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Quitcool/Olive-4B-Thinking",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Quitcool/Olive-4B-Thinking"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Quitcool/Olive-4B-Thinking",
          "confidence": 0.85,
          "raw_context": "--- base_model: Quitcool/Olive-4B-Thinking language: - en - ar - zh - es - fr - de - ja libr"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "Quitcool/Olive-4B-Thinking",
      "base_model_chain": [
        "Quitcool/Olive-4B-Thinking"
      ],
      "training_section_present": false,
      "license": "other",
      "provenance_score": 0.25,
      "provenance_hash": "35cac27dd24889a0d6a7a221433c8f6a517e902226357add6275e8623e594750"
    },
    {
      "model_id": "mradermacher/Olive-4B-Thinking-i1-GGUF",
      "scanned_at": "2026-09-15T02:19:16.122262Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Quitcool/Olive-4B-Thinking",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Quitcool/Olive-4B-Thinking"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Quitcool/Olive-4B-Thinking",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Quitcool/Olive-4B-Thinking"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Quitcool/Olive-4B-Thinking",
          "confidence": 0.85,
          "raw_context": "--- base_model: Quitcool/Olive-4B-Thinking language: - en library_name: transformers mraderm"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "Quitcool/Olive-4B-Thinking",
      "base_model_chain": [
        "Quitcool/Olive-4B-Thinking"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "05532f38a1edba8183828bdd3a621b89ec02f3cbf7ec471d203266247562427d"
    },
    {
      "model_id": "mradermacher/OmniCare-Qwen3-VL-30B-A3B-GGUF",
      "scanned_at": "2026-09-15T02:19:31.972452Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Enriqueag26/OmniCare-Qwen3-VL-30B-A3B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Enriqueag26/OmniCare-Qwen3-VL-30B-A3B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Enriqueag26/OmniCare-Qwen3-VL-30B-A3B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Enriqueag26/OmniCare-Qwen3-VL-30B-A3B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Enriqueag26/OmniCare-Qwen3-VL-30B-A3B",
          "confidence": 0.85,
          "raw_context": "--- base_model: Enriqueag26/OmniCare-Qwen3-VL-30B-A3B language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "Enriqueag26/OmniCare-Qwen3-VL-30B-A3B",
      "base_model_chain": [
        "Enriqueag26/OmniCare-Qwen3-VL-30B-A3B",
        "unsloth/Qwen3-VL-30B-A3B-Instruct",
        "Qwen/Qwen3-VL-30B-A3B-Instruct"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "e7a296a194513f95aa6e38ba4302732e8476691f2061d832bcef449ebefd4781"
    },
    {
      "model_id": "mradermacher/OpAgent-32B-i1-GGUF",
      "scanned_at": "2026-09-15T02:19:45.512222Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "codefuse-ai/OpAgent-32B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:codefuse-ai/OpAgent-32B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:codefuse-ai/OpAgent-32B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:codefuse-ai/OpAgent-32B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "codefuse-ai/OpAgent-32B",
          "confidence": 0.85,
          "raw_context": "--- base_model: codefuse-ai/OpAgent-32B language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "codefuse-ai/OpAgent-32B",
      "base_model_chain": [
        "codefuse-ai/OpAgent-32B",
        "Qwen/Qwen3-VL-32B-Thinking"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "8fdf6fd088304bb2ad0ca05db4b7554392bfe4854073d0366e5fd6074c66b90c"
    },
    {
      "model_id": "mradermacher/Orsta-7B-i1-GGUF",
      "scanned_at": "2026-09-15T02:20:00.453848Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "One-RL-to-See-Them-All/Orsta-Data-47k",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:One-RL-to-See-Them-All/Orsta-Data-47k"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "One-RL-to-See-Them-All/Orsta-7B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:One-RL-to-See-Them-All/Orsta-7B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:One-RL-to-See-Them-All/Orsta-7B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:One-RL-to-See-Them-All/Orsta-7B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "One-RL-to-See-Them-All/Orsta-7B",
          "confidence": 0.85,
          "raw_context": "--- base_model: One-RL-to-See-Them-All/Orsta-7B datasets: - One-RL-to-See-Them-All/Orsta-Data-47k"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> weighted"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:One-RL-to-See-Them-All/Orsta-7B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "m/MiniMax-AI/One-RL-to-See-Them-All) * 📜 **Paper (arXiv):** [V-Triune: One RL to See Them All (arXiv:2505"
        }
      ],
      "declared_datasets": [
        "One-RL-to-See-Them-All/Orsta-Data-47k"
      ],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": "One-RL-to-See-Them-All/Orsta-7B",
      "base_model_chain": [
        "One-RL-to-See-Them-All/Orsta-7B",
        "Qwen/Qwen2.5-VL-7B-Instruct"
      ],
      "training_section_present": false,
      "license": "mit",
      "provenance_score": 0.4,
      "provenance_hash": "ceec254daaf20ee76c4b6d685b68aefd9c6a984d447849dc4c499d5b2c51cc77"
    },
    {
      "model_id": "mradermacher/OsirisPtah-Coder-v5-i1-GGUF",
      "scanned_at": "2026-09-15T02:20:13.127242Z",
      "signals": [
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "osirisbrain/OsirisPtah-Coder-v5",
          "confidence": 0.85,
          "raw_context": "--- base_model: osirisbrain/OsirisPtah-Coder-v5 language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "osirisbrain/OsirisPtah-Coder-v5",
      "base_model_chain": [
        "osirisbrain/OsirisPtah-Coder-v5"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "dee526101c79495bb95e2d627a4bf22494d899e332c473bf44350306eae1f420"
    },
    {
      "model_id": "mradermacher/P1-30B-A3B-GGUF",
      "scanned_at": "2026-09-15T02:20:24.070831Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "PRIME-RL/P1-30B-A3B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:PRIME-RL/P1-30B-A3B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:PRIME-RL/P1-30B-A3B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:PRIME-RL/P1-30B-A3B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "PRIME-RL/P1-30B-A3B",
          "confidence": 0.85,
          "raw_context": "--- base_model: PRIME-RL/P1-30B-A3B language: - en - multilingual library_name: trans"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "PRIME-RL/P1-30B-A3B",
      "base_model_chain": [
        "PRIME-RL/P1-30B-A3B"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "073b2a3951f9e947a02ac7f70ffd11dca225008ab3635149c958355a265618ee"
    },
    {
      "model_id": "mradermacher/Pokemon-Red-Qwen3-80B-GGUF",
      "scanned_at": "2026-09-15T02:20:37.802252Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "custom",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:custom"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "clarkkitchen22/Pokemon-Red-Qwen3-80B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:clarkkitchen22/Pokemon-Red-Qwen3-80B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:clarkkitchen22/Pokemon-Red-Qwen3-80B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:clarkkitchen22/Pokemon-Red-Qwen3-80B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "clarkkitchen22/Pokemon-Red-Qwen3-80B",
          "confidence": 0.85,
          "raw_context": "--- base_model: clarkkitchen22/Pokemon-Red-Qwen3-80B datasets: - custom language: - en library_name: t"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [
        "custom"
      ],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "clarkkitchen22/Pokemon-Red-Qwen3-80B",
      "base_model_chain": [
        "clarkkitchen22/Pokemon-Red-Qwen3-80B",
        "Qwen/Qwen3-Coder-Next"
      ],
      "training_section_present": false,
      "license": "mit",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "fa476722f309ed9414f1e99c26d8a976a0b3377ad41103ac9fc417fd8bdc206c"
    },
    {
      "model_id": "mradermacher/PulseMind-72B-i1-GGUF",
      "scanned_at": "2026-09-15T02:20:45.033470Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "AQ-MedAI/PulseMind-72B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:AQ-MedAI/PulseMind-72B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:AQ-MedAI/PulseMind-72B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:AQ-MedAI/PulseMind-72B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "AQ-MedAI/PulseMind-72B",
          "confidence": 0.85,
          "raw_context": "--- base_model: AQ-MedAI/PulseMind-72B language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:AQ-MedAI/PulseMind-72B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "er\">Code & Eval</a> &nbsp;&nbsp; <a href=\"https://arxiv.org/abs/2601.07344\" target=\"_blank\" rel=\"noopener"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": "AQ-MedAI/PulseMind-72B",
      "base_model_chain": [
        "AQ-MedAI/PulseMind-72B"
      ],
      "training_section_present": false,
      "license": "mit",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "159ca5bc442dbf3a9641b73428a99627e4f5aab32b55f736164595e4411211cf"
    },
    {
      "model_id": "mradermacher/PyVision-Image-7B-SFT-GGUF",
      "scanned_at": "2026-09-15T02:20:57.555260Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Agents-X/PyVision-Image-7B-SFT",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Agents-X/PyVision-Image-7B-SFT"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Agents-X/PyVision-Image-7B-SFT",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Agents-X/PyVision-Image-7B-SFT"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Agents-X/PyVision-Image-7B-SFT",
          "confidence": 0.85,
          "raw_context": "--- base_model: Agents-X/PyVision-Image-7B-SFT language: - en library_name: transformers mraderm"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Agents-X/PyVision-Image-7B-SFT",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "orging Open Agentic Vision Models via RL](https://arxiv.org/abs/2602.20739)  This is PyVision-Image-7B-SF"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": "Agents-X/PyVision-Image-7B-SFT",
      "base_model_chain": [
        "Agents-X/PyVision-Image-7B-SFT",
        "Qwen/Qwen2.5-VL-7B-Instruct"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.2,
      "provenance_hash": "a1ff3d4f2df9ff642e8e672961e9511bc36421e78621e33e942d0eba256e26ae"
    },
    {
      "model_id": "mradermacher/Qwen2.5-14B-Instruct-Heretic-GGUF",
      "scanned_at": "2026-09-15T02:21:02.188957Z",
      "signals": [
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "0xA50C1A1/Qwen2.5-14B-Instruct-Heretic",
          "confidence": 0.85,
          "raw_context": "--- base_model: 0xA50C1A1/Qwen2.5-14B-Instruct-Heretic language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "0xA50C1A1/Qwen2.5-14B-Instruct-Heretic",
      "base_model_chain": [
        "0xA50C1A1/Qwen2.5-14B-Instruct-Heretic"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "618817cb8c08de897eb3b084fcd0e1762c5b0efc1389ffc67b3d91906c1a6da2"
    },
    {
      "model_id": "mradermacher/Qwen2.5-VL-7B-Abliterated-Caption-it-GGUF",
      "scanned_at": "2026-09-15T02:21:06.772250Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "prithivMLmods/blip3o-caption-mini-arrow",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:prithivMLmods/blip3o-caption-mini-arrow"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "prithivMLmods/Caption3o-Opt-v2",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:prithivMLmods/Caption3o-Opt-v2"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "prithivMLmods/Qwen2.5-VL-7B-Abliterated-Caption-it",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:prithivMLmods/Qwen2.5-VL-7B-Abliterated-Caption-it"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:prithivMLmods/Qwen2.5-VL-7B-Abliterated-Caption-it",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:prithivMLmods/Qwen2.5-VL-7B-Abliterated-Caption-it"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "prithivMLmods/Qwen2.5-VL-7B-Abliterated-Caption-it",
          "confidence": 0.85,
          "raw_context": "--- base_model: prithivMLmods/Qwen2.5-VL-7B-Abliterated-Caption-it datasets: - prithivMLmods/blip3o-caption-mini-arr"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> static quants of"
        }
      ],
      "declared_datasets": [
        "prithivMLmods/blip3o-caption-mini-arrow",
        "prithivMLmods/Caption3o-Opt-v2"
      ],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "prithivMLmods/Qwen2.5-VL-7B-Abliterated-Caption-it",
      "base_model_chain": [
        "prithivMLmods/Qwen2.5-VL-7B-Abliterated-Caption-it",
        "Qwen/Qwen2.5-VL-7B-Instruct"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.45,
      "provenance_hash": "0f2cec994e7f17809d0c7ff5473412b568ce58424f73194a2ccf4ed7c5c08569"
    },
    {
      "model_id": "mradermacher/Qwen3-30B-A3B-Thinking-2507-GLM-4.7-Flash-High-Reasoning-i1-GGUF",
      "scanned_at": "2026-09-15T02:21:11.374320Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "TeichAI/glm-4.7-350x",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:TeichAI/glm-4.7-350x"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "DavidAU/Qwen3-30B-A3B-Thinking-2507-GLM-4.7-Flash-High-Reasoning",
          "confidence": 0.85,
          "raw_context": "--- base_model: DavidAU/Qwen3-30B-A3B-Thinking-2507-GLM-4.7-Flash-High-Reasoning datasets: - TeichAI/glm-4.7-350x language: - en l"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [
        "TeichAI/glm-4.7-350x"
      ],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "DavidAU/Qwen3-30B-A3B-Thinking-2507-GLM-4.7-Flash-High-Reasoning",
      "base_model_chain": [
        "DavidAU/Qwen3-30B-A3B-Thinking-2507-GLM-4.7-Flash-High-Reasoning"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "10914cc8480379777fa130a30be831447658f37843ca6461a9290d11bb17317b"
    },
    {
      "model_id": "mradermacher/Qwen3-30B-A3B-YOYO-V2-Gemini250-Instruct-i1-GGUF",
      "scanned_at": "2026-09-15T02:21:15.968398Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "TeichAI/gemini-3-pro-preview-high-reasoning-250x",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:TeichAI/gemini-3-pro-preview-high-reasoning-250x"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "DavidAU/Qwen3-30B-A3B-YOYO-V2-Gemini250-Instruct",
          "confidence": 0.85,
          "raw_context": "--- base_model: DavidAU/Qwen3-30B-A3B-YOYO-V2-Gemini250-Instruct datasets: - TeichAI/gemini-3-pro-preview-high-rea"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [
        "TeichAI/gemini-3-pro-preview-high-reasoning-250x"
      ],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "DavidAU/Qwen3-30B-A3B-YOYO-V2-Gemini250-Instruct",
      "base_model_chain": [
        "DavidAU/Qwen3-30B-A3B-YOYO-V2-Gemini250-Instruct"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "df52941feb5b12a3ed8eaaf92bf10ff2268856e3f53acc1ddfd30564c3d16615"
    },
    {
      "model_id": "mradermacher/Qwen3-4B-Thinking-2507-Distill-Claude-Opus-4.6-Reasoning-Abliterated-i1-GGUF",
      "scanned_at": "2026-09-15T02:21:20.664113Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nohurry/Opus-4.6-Reasoning-3000x-filtered",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nohurry/Opus-4.6-Reasoning-3000x-filtered"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Aimin12/Qwen3-4B-Thinking-2507-Distill-Claude-Opus-4.6-Reasoning-Abliterated",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Aimin12/Qwen3-4B-Thinking-2507-Distill-Claude-Opus-4.6-Reasoning-Abliterated"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Aimin12/Qwen3-4B-Thinking-2507-Distill-Claude-Opus-4.6-Reasoning-Abliterated",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Aimin12/Qwen3-4B-Thinking-2507-Distill-Claude-Opus-4.6-Reasoning-Abliterated"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Aimin12/Qwen3-4B-Thinking-2507-Distill-Claude-Opus-4.6-Reasoning-Abliterated",
          "confidence": 0.85,
          "raw_context": "--- base_model: Aimin12/Qwen3-4B-Thinking-2507-Distill-Claude-Opus-4.6-Reasoning-Abliterated datasets: - nohurry/Opus-4.6-Reasoning-3000x-filt"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [
        "nohurry/Opus-4.6-Reasoning-3000x-filtered"
      ],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "Aimin12/Qwen3-4B-Thinking-2507-Distill-Claude-Opus-4.6-Reasoning-Abliterated",
      "base_model_chain": [
        "Aimin12/Qwen3-4B-Thinking-2507-Distill-Claude-Opus-4.6-Reasoning-Abliterated",
        "huihui-ai/Huihui-Qwen3-4B-Thinking-2507-abliterated",
        "Qwen/Qwen3-4B-Thinking-2507"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "c9024b3bc723a2e367ced7a16011e19422924491636111697d6ef93b412b83ba"
    },
    {
      "model_id": "mradermacher/Qwen3-Next-80B-A3B-Thinking-GRPO-Uncensored-GGUF",
      "scanned_at": "2026-09-15T02:21:26.374685Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "puwaer/Qwen3-Next-80B-A3B-Thinking-GRPO-Uncensored",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:puwaer/Qwen3-Next-80B-A3B-Thinking-GRPO-Uncensored"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:puwaer/Qwen3-Next-80B-A3B-Thinking-GRPO-Uncensored",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:puwaer/Qwen3-Next-80B-A3B-Thinking-GRPO-Uncensored"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "puwaer/Qwen3-Next-80B-A3B-Thinking-GRPO-Uncensored",
          "confidence": 0.85,
          "raw_context": "--- base_model: puwaer/Qwen3-Next-80B-A3B-Thinking-GRPO-Uncensored language: - en - zh - ja library_name: transforme"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "puwaer/Qwen3-Next-80B-A3B-Thinking-GRPO-Uncensored",
      "base_model_chain": [
        "puwaer/Qwen3-Next-80B-A3B-Thinking-GRPO-Uncensored",
        "Qwen/Qwen3-Next-80B-A3B-Thinking"
      ],
      "training_section_present": false,
      "license": "cc-by-nc-sa-4.0",
      "provenance_score": 0.25,
      "provenance_hash": "6cae699b68438cc6ea1cf0dfc731931402e13e1bd00a5539e44c912d876a8d0d"
    },
    {
      "model_id": "mradermacher/Qwen3-Next-80B-A3B-Thinking-GRPO-Uncensored-i1-GGUF",
      "scanned_at": "2026-09-15T02:21:31.853735Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "puwaer/Qwen3-Next-80B-A3B-Thinking-GRPO-Uncensored",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:puwaer/Qwen3-Next-80B-A3B-Thinking-GRPO-Uncensored"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:puwaer/Qwen3-Next-80B-A3B-Thinking-GRPO-Uncensored",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:puwaer/Qwen3-Next-80B-A3B-Thinking-GRPO-Uncensored"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "puwaer/Qwen3-Next-80B-A3B-Thinking-GRPO-Uncensored",
          "confidence": 0.85,
          "raw_context": "--- base_model: puwaer/Qwen3-Next-80B-A3B-Thinking-GRPO-Uncensored language: - en - zh - ja library_name: transforme"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "puwaer/Qwen3-Next-80B-A3B-Thinking-GRPO-Uncensored",
      "base_model_chain": [
        "puwaer/Qwen3-Next-80B-A3B-Thinking-GRPO-Uncensored",
        "Qwen/Qwen3-Next-80B-A3B-Thinking"
      ],
      "training_section_present": false,
      "license": "cc-by-nc-sa-4.0",
      "provenance_score": 0.25,
      "provenance_hash": "23f403a343313a5e503451bf17bd2c8dcc567e224b5aad12b6a3d797d4c2ad9d"
    },
    {
      "model_id": "mradermacher/Qwen3-VL-8B-Abliterated-Caption-it-GGUF",
      "scanned_at": "2026-09-15T02:21:34.605318Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "prithivMLmods/Qwen3-VL-8B-Abliterated-Caption-it",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:prithivMLmods/Qwen3-VL-8B-Abliterated-Caption-it"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:prithivMLmods/Qwen3-VL-8B-Abliterated-Caption-it",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:prithivMLmods/Qwen3-VL-8B-Abliterated-Caption-it"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "prithivMLmods/Qwen3-VL-8B-Abliterated-Caption-it",
          "confidence": 0.85,
          "raw_context": "--- base_model: prithivMLmods/Qwen3-VL-8B-Abliterated-Caption-it language: - en - zh - th library_name: transforme"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "prithivMLmods/Qwen3-VL-8B-Abliterated-Caption-it",
      "base_model_chain": [
        "prithivMLmods/Qwen3-VL-8B-Abliterated-Caption-it",
        "Qwen/Qwen3-VL-8B-Instruct"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "50b0743e6a27d5c517beef83ecab1fe3d59203533c4ffb17dfc120e2faf97047"
    },
    {
      "model_id": "mradermacher/Qwen3-VL-8B-Abliterated-Caption-it-i1-GGUF",
      "scanned_at": "2026-09-15T02:21:39.207426Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "prithivMLmods/Qwen3-VL-8B-Abliterated-Caption-it",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:prithivMLmods/Qwen3-VL-8B-Abliterated-Caption-it"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:prithivMLmods/Qwen3-VL-8B-Abliterated-Caption-it",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:prithivMLmods/Qwen3-VL-8B-Abliterated-Caption-it"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "prithivMLmods/Qwen3-VL-8B-Abliterated-Caption-it",
          "confidence": 0.85,
          "raw_context": "--- base_model: prithivMLmods/Qwen3-VL-8B-Abliterated-Caption-it language: - en - zh - th library_name: transforme"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "prithivMLmods/Qwen3-VL-8B-Abliterated-Caption-it",
      "base_model_chain": [
        "prithivMLmods/Qwen3-VL-8B-Abliterated-Caption-it",
        "Qwen/Qwen3-VL-8B-Instruct"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "c7a549117604d15bff62c90ded9307cb407d8f46a3c453f4b8099ae781bf01ac"
    },
    {
      "model_id": "mradermacher/Qwen3.5-27B-Gemini3-Pro-High-Reasoning-Compact-Thinking-i1-GGUF",
      "scanned_at": "2026-09-15T02:21:41.993752Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "TeichAI/gemini-3-pro-preview-high-reasoning-250x",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:TeichAI/gemini-3-pro-preview-high-reasoning-250x"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "DavidAU/Qwen3.5-27B-Gemini3-Pro-High-Reasoning-Compact-Thinking",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:DavidAU/Qwen3.5-27B-Gemini3-Pro-High-Reasoning-Compact-Thinking"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:DavidAU/Qwen3.5-27B-Gemini3-Pro-High-Reasoning-Compact-Thinking",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:DavidAU/Qwen3.5-27B-Gemini3-Pro-High-Reasoning-Compact-Thinking"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "DavidAU/Qwen3.5-27B-Gemini3-Pro-High-Reasoning-Compact-Thinking",
          "confidence": 0.85,
          "raw_context": "--- base_model: DavidAU/Qwen3.5-27B-Gemini3-Pro-High-Reasoning-Compact-Thinking datasets: - TeichAI/gemini-3-pro-preview-high-rea"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:DavidAU/Qwen3.5-27B-Gemini3-Pro-High-Reasoning-Compact-Thinking",
          "value": "glue",
          "confidence": 0.5599999999999999,
          "raw_context": "🏙️ Super-White Urban Architecture (The \"Gorilla\" Glue) *Currently, white paint reflects sunlight but ab"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:DavidAU/Qwen3.5-27B-Gemini3-Pro-High-Reasoning-Compact-Thinking",
          "value": "coco",
          "confidence": 0.5599999999999999,
          "raw_context": "r-bottom:1px solid rgba(128, 128, 128, 0.15);\">RefCOCO(avg)</td> <td style=\"padding:7px 7px;text-align:c"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:DavidAU/Qwen3.5-27B-Gemini3-Pro-High-Reasoning-Compact-Thinking",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "er-bottom:1px solid rgba(128, 128, 128, 0.15);\">CharXiv(RQ)</td> <td style=\"padding:7px 7px;text-align:ce"
        }
      ],
      "declared_datasets": [
        "TeichAI/gemini-3-pro-preview-high-reasoning-250x"
      ],
      "inferred_datasets": [
        "arxiv",
        "coco",
        "glue",
        "voc"
      ],
      "base_model": "DavidAU/Qwen3.5-27B-Gemini3-Pro-High-Reasoning-Compact-Thinking",
      "base_model_chain": [
        "DavidAU/Qwen3.5-27B-Gemini3-Pro-High-Reasoning-Compact-Thinking",
        "Qwen/Qwen3.5-27B"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.5,
      "provenance_hash": "f3dc6054e8bca6ee07ddd3e2f4466273f5f5aa03a5fa4bc6967f8e47bd191764"
    },
    {
      "model_id": "mradermacher/Qwen3.5-27B-heretic-i1-GGUF",
      "scanned_at": "2026-09-15T02:21:46.752130Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "coder3101/Qwen3.5-27B-heretic",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:coder3101/Qwen3.5-27B-heretic"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:coder3101/Qwen3.5-27B-heretic",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:coder3101/Qwen3.5-27B-heretic"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "coder3101/Qwen3.5-27B-heretic",
          "confidence": 0.85,
          "raw_context": "--- base_model: coder3101/Qwen3.5-27B-heretic language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:coder3101/Qwen3.5-27B-heretic",
          "value": "coco",
          "confidence": 0.5599999999999999,
          "raw_context": "r-bottom:1px solid rgba(128, 128, 128, 0.15);\">RefCOCO(avg)</td> <td style=\"padding:7px 7px;text-align:c"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:coder3101/Qwen3.5-27B-heretic",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "er-bottom:1px solid rgba(128, 128, 128, 0.15);\">CharXiv(RQ)</td> <td style=\"padding:7px 7px;text-align:ce"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "coco",
        "voc"
      ],
      "base_model": "coder3101/Qwen3.5-27B-heretic",
      "base_model_chain": [
        "coder3101/Qwen3.5-27B-heretic",
        "Qwen/Qwen3.5-27B"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "0fc1d02ab1c7bb7906e1c76498cd5b0ea897702098a46a542752655918d5d8db"
    },
    {
      "model_id": "mradermacher/Qwen3.5-27B-i1-GGUF",
      "scanned_at": "2026-09-15T02:21:51.554245Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Qwen/Qwen3.5-27B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Qwen/Qwen3.5-27B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Qwen/Qwen3.5-27B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Qwen/Qwen3.5-27B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Qwen/Qwen3.5-27B",
          "confidence": 0.85,
          "raw_context": "--- base_model: Qwen/Qwen3.5-27B language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Qwen/Qwen3.5-27B",
          "value": "coco",
          "confidence": 0.5599999999999999,
          "raw_context": "r-bottom:1px solid rgba(128, 128, 128, 0.15);\">RefCOCO(avg)</td> <td style=\"padding:7px 7px;text-align:c"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Qwen/Qwen3.5-27B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "er-bottom:1px solid rgba(128, 128, 128, 0.15);\">CharXiv(RQ)</td> <td style=\"padding:7px 7px;text-align:ce"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "coco",
        "voc"
      ],
      "base_model": "Qwen/Qwen3.5-27B",
      "base_model_chain": [
        "Qwen/Qwen3.5-27B"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "63af64d8fc3d28ff5b9a22a5cef2bb8c62555326c664154a281dc9fa4fefcd0e"
    },
    {
      "model_id": "mradermacher/Qwen3.5-35B-A3B-heretic-GGUF",
      "scanned_at": "2026-09-15T02:21:55.261041Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "brayniac/Qwen3.5-35B-A3B-heretic",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:brayniac/Qwen3.5-35B-A3B-heretic"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:brayniac/Qwen3.5-35B-A3B-heretic",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:brayniac/Qwen3.5-35B-A3B-heretic"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "brayniac/Qwen3.5-35B-A3B-heretic",
          "confidence": 0.85,
          "raw_context": "--- base_model: brayniac/Qwen3.5-35B-A3B-heretic language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:brayniac/Qwen3.5-35B-A3B-heretic",
          "value": "coco",
          "confidence": 0.5599999999999999,
          "raw_context": "r-bottom:1px solid rgba(128, 128, 128, 0.15);\">RefCOCO(avg)</td> <td style=\"padding:7px 7px;text-align:c"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:brayniac/Qwen3.5-35B-A3B-heretic",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "er-bottom:1px solid rgba(128, 128, 128, 0.15);\">CharXiv(RQ)</td> <td style=\"padding:7px 7px;text-align:ce"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "coco",
        "voc"
      ],
      "base_model": "brayniac/Qwen3.5-35B-A3B-heretic",
      "base_model_chain": [
        "brayniac/Qwen3.5-35B-A3B-heretic"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "c7e767c2252e4664c84cb4cdea7b1420e2ba1b0367ee4828abe2d2db7e70a134"
    },
    {
      "model_id": "mradermacher/Qwen3.5-35B-A3B-heretic-i1-GGUF",
      "scanned_at": "2026-09-15T02:21:59.983648Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "brayniac/Qwen3.5-35B-A3B-heretic",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:brayniac/Qwen3.5-35B-A3B-heretic"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:brayniac/Qwen3.5-35B-A3B-heretic",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:brayniac/Qwen3.5-35B-A3B-heretic"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "brayniac/Qwen3.5-35B-A3B-heretic",
          "confidence": 0.85,
          "raw_context": "--- base_model: brayniac/Qwen3.5-35B-A3B-heretic language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:brayniac/Qwen3.5-35B-A3B-heretic",
          "value": "coco",
          "confidence": 0.5599999999999999,
          "raw_context": "r-bottom:1px solid rgba(128, 128, 128, 0.15);\">RefCOCO(avg)</td> <td style=\"padding:7px 7px;text-align:c"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:brayniac/Qwen3.5-35B-A3B-heretic",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "er-bottom:1px solid rgba(128, 128, 128, 0.15);\">CharXiv(RQ)</td> <td style=\"padding:7px 7px;text-align:ce"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "coco",
        "voc"
      ],
      "base_model": "brayniac/Qwen3.5-35B-A3B-heretic",
      "base_model_chain": [
        "brayniac/Qwen3.5-35B-A3B-heretic"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "046e40e265dd94a528998cee71285697c841685e9f5cdffa8968b80ac33c33b8"
    },
    {
      "model_id": "mradermacher/QwenStoryteller-i1-GGUF",
      "scanned_at": "2026-09-15T02:22:02.780516Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "daniel3303/StoryReasoning",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:daniel3303/StoryReasoning"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "daniel3303/QwenStoryteller",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:daniel3303/QwenStoryteller"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:daniel3303/QwenStoryteller",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:daniel3303/QwenStoryteller"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "daniel3303/QwenStoryteller",
          "confidence": 0.85,
          "raw_context": "--- base_model: daniel3303/QwenStoryteller datasets: - daniel3303/StoryReasoning language: e"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> weighted"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:daniel3303/QwenStoryteller",
          "value": "StoryReasoning",
          "confidence": 0.48,
          "raw_context": "g (rank 2048, alpha 4096)   **Training Dataset:** [StoryReasoning](https://huggingface.co/datasets/daniel3303/StoryReasoning)  QwenStoryteller proces"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:daniel3303/QwenStoryteller",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": ",       eprint={2505.10292},       archivePrefix={arXiv},       primaryClass={cs.CV},       url={https://"
        }
      ],
      "declared_datasets": [
        "daniel3303/StoryReasoning"
      ],
      "inferred_datasets": [
        "StoryReasoning",
        "arxiv",
        "voc"
      ],
      "base_model": "daniel3303/QwenStoryteller",
      "base_model_chain": [
        "daniel3303/QwenStoryteller",
        "Qwen/Qwen2.5-VL-7B-Instruct"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.45000000000000007,
      "provenance_hash": "ec7a2e689c7ec75e85d03b436e5ff1743a2d78706b3079c0891ed5de6006441e"
    },
    {
      "model_id": "mradermacher/R-PRM-7B-DPO-i1-GGUF",
      "scanned_at": "2026-09-15T02:22:07.413779Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "kevinpro/R-PRM-7B-DPO",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:kevinpro/R-PRM-7B-DPO"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:kevinpro/R-PRM-7B-DPO",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:kevinpro/R-PRM-7B-DPO"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "kevinpro/R-PRM-7B-DPO",
          "confidence": 0.85,
          "raw_context": "--- base_model: kevinpro/R-PRM-7B-DPO language: zh library_name: transformers license:"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> weighted"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:kevinpro/R-PRM-7B-DPO",
          "value": "comparable",
          "confidence": 0.48,
          "raw_context": "nd extends this lead to **+8.7** F1 when both are trained on comparable data volumes. - Notably, despite using only **~15%** o"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:kevinpro/R-PRM-7B-DPO",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "d Modeling  <p align=\"center\">   <a href=\"https://arxiv.org/abs/2503.21295\"> 📃 Paper</a> |    <a href=\"ht"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "comparable",
        "voc"
      ],
      "base_model": "kevinpro/R-PRM-7B-DPO",
      "base_model_chain": [
        "kevinpro/R-PRM-7B-DPO"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "f818d23901640859b1c69391e7e4a9733dd3ad871e0421422491623f8b892bf3"
    },
    {
      "model_id": "mradermacher/ReForm-SFT-1.5B-i1-GGUF",
      "scanned_at": "2026-09-15T02:22:12.074389Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Veri-Code/ReForm-SFT-1.5B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Veri-Code/ReForm-SFT-1.5B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Veri-Code/ReForm-SFT-1.5B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Veri-Code/ReForm-SFT-1.5B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Veri-Code/ReForm-SFT-1.5B",
          "confidence": 0.85,
          "raw_context": "--- base_model: Veri-Code/ReForm-SFT-1.5B language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Veri-Code/ReForm-SFT-1.5B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "://huggingface.co/papers/2507.16331) *   **Paper (arXiv):** [https://arxiv.org/abs/2507.16331](https://ar"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": "Veri-Code/ReForm-SFT-1.5B",
      "base_model_chain": [
        "Veri-Code/ReForm-SFT-1.5B"
      ],
      "training_section_present": false,
      "license": "mit",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "cf14332b2f4ec4b4950554b82c5c848840de15c88a0af034e43beff224885011"
    },
    {
      "model_id": "mradermacher/RoboBrain2.5-4B-GGUF",
      "scanned_at": "2026-09-15T02:22:16.748683Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "BAAI/RoboBrain2.5-4B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:BAAI/RoboBrain2.5-4B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:BAAI/RoboBrain2.5-4B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:BAAI/RoboBrain2.5-4B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "BAAI/RoboBrain2.5-4B",
          "confidence": 0.85,
          "raw_context": "--- base_model: BAAI/RoboBrain2.5-4B language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:BAAI/RoboBrain2.5-4B",
          "value": "coco",
          "confidence": 0.5599999999999999,
          "raw_context": "t is shown in this image?\" image = \"http://images.cocodataset.org/val2017/000000039769.jpg\"  pred = mode"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:BAAI/RoboBrain2.5-4B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "</a></a>&nbsp&nbsp | &nbsp&nbsp📑 <a href=\"https://arxiv.org/abs/2601.14352\">Technical Report</a>&nbsp&nbs"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "coco",
        "voc"
      ],
      "base_model": "BAAI/RoboBrain2.5-4B",
      "base_model_chain": [
        "BAAI/RoboBrain2.5-4B"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "d6302f60311eeb49057935bd56ec6bde0e50a67a12a0269d2c6c05f3ee65d3f8"
    },
    {
      "model_id": "mradermacher/Rotten.Llama-3.2-1B-GGUF",
      "scanned_at": "2026-09-15T02:22:21.353974Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "PursuitOfDataScience/MiniMax-M2.1-Mixture-of-Thoughts",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:PursuitOfDataScience/MiniMax-M2.1-Mixture-of-Thoughts"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "openai/gsm8k",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:openai/gsm8k"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Novaciano/Rotten.Llama-3.2-1B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Novaciano/Rotten.Llama-3.2-1B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Novaciano/Rotten.Llama-3.2-1B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Novaciano/Rotten.Llama-3.2-1B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Novaciano/Rotten.Llama-3.2-1B",
          "confidence": 0.85,
          "raw_context": "--- base_model: Novaciano/Rotten.Llama-3.2-1B datasets: - PursuitOfDataScience/MiniMax-M2.1-Mix"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:Novaciano/Rotten.Llama-3.2-1B",
          "value": "wikipedia",
          "confidence": 0.48,
          "raw_context": "his model was merged using the [SLERP](https://en.wikipedia.org/wiki/Slerp) merge method.  ### Models Merged"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Novaciano/Rotten.Llama-3.2-1B",
          "value": "wikipedia",
          "confidence": 0.5599999999999999,
          "raw_context": "his model was merged using the [SLERP](https://en.wikipedia.org/wiki/Slerp) merge method.  ### Models Merged"
        }
      ],
      "declared_datasets": [
        "PursuitOfDataScience/MiniMax-M2.1-Mixture-of-Thoughts",
        "openai/gsm8k"
      ],
      "inferred_datasets": [
        "wikipedia",
        "voc"
      ],
      "base_model": "Novaciano/Rotten.Llama-3.2-1B",
      "base_model_chain": [
        "Novaciano/Rotten.Llama-3.2-1B",
        "PursuitOfDataScience/Llama-3.2-1B-GRPO",
        "meta-llama/Llama-3.2-1B"
      ],
      "training_section_present": false,
      "license": "llama3.2",
      "provenance_score": 0.5,
      "provenance_hash": "05ea4a6fe5a011490fb2be983f4f8d7e034f3083506d7f89a233691fb605b400"
    },
    {
      "model_id": "mradermacher/Rotten.Llama-3.2-1B-i1-GGUF",
      "scanned_at": "2026-09-15T02:22:25.986598Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "PursuitOfDataScience/MiniMax-M2.1-Mixture-of-Thoughts",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:PursuitOfDataScience/MiniMax-M2.1-Mixture-of-Thoughts"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "openai/gsm8k",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:openai/gsm8k"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Novaciano/Rotten.Llama-3.2-1B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Novaciano/Rotten.Llama-3.2-1B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Novaciano/Rotten.Llama-3.2-1B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Novaciano/Rotten.Llama-3.2-1B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Novaciano/Rotten.Llama-3.2-1B",
          "confidence": 0.85,
          "raw_context": "--- base_model: Novaciano/Rotten.Llama-3.2-1B datasets: - PursuitOfDataScience/MiniMax-M2.1-Mix"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:Novaciano/Rotten.Llama-3.2-1B",
          "value": "wikipedia",
          "confidence": 0.48,
          "raw_context": "his model was merged using the [SLERP](https://en.wikipedia.org/wiki/Slerp) merge method.  ### Models Merged"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Novaciano/Rotten.Llama-3.2-1B",
          "value": "wikipedia",
          "confidence": 0.5599999999999999,
          "raw_context": "his model was merged using the [SLERP](https://en.wikipedia.org/wiki/Slerp) merge method.  ### Models Merged"
        }
      ],
      "declared_datasets": [
        "PursuitOfDataScience/MiniMax-M2.1-Mixture-of-Thoughts",
        "openai/gsm8k"
      ],
      "inferred_datasets": [
        "wikipedia",
        "voc"
      ],
      "base_model": "Novaciano/Rotten.Llama-3.2-1B",
      "base_model_chain": [
        "Novaciano/Rotten.Llama-3.2-1B",
        "PursuitOfDataScience/Llama-3.2-1B-GRPO",
        "meta-llama/Llama-3.2-1B"
      ],
      "training_section_present": false,
      "license": "llama3.2",
      "provenance_score": 0.5,
      "provenance_hash": "32a641e8aa256b009cca20b5b977df222410fbd094f7a0a5187757b8f2a84b7a"
    },
    {
      "model_id": "mradermacher/RynnBrain-30B-A3B-i1-GGUF",
      "scanned_at": "2026-09-15T02:22:28.793483Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Alibaba-DAMO-Academy/RynnBrain-30B-A3B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Alibaba-DAMO-Academy/RynnBrain-30B-A3B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Alibaba-DAMO-Academy/RynnBrain-30B-A3B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Alibaba-DAMO-Academy/RynnBrain-30B-A3B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Alibaba-DAMO-Academy/RynnBrain-30B-A3B",
          "confidence": 0.85,
          "raw_context": "--- base_model: Alibaba-DAMO-Academy/RynnBrain-30B-A3B language: - en - zh library_name: transformers li"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Alibaba-DAMO-Academy/RynnBrain-30B-A3B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "Jianfei Yang, Shijian Lu, Deli Zhao},   journal={arXiv preprint arXiv:2602.14979v1},   year={2026},   ur"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": "Alibaba-DAMO-Academy/RynnBrain-30B-A3B",
      "base_model_chain": [
        "Alibaba-DAMO-Academy/RynnBrain-30B-A3B",
        "Qwen3-VL-30B-A3B-Instruct"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "79502eee71dce5d843f8176db37d5bef1106e816c8689ffff2e80bcc07b383fa"
    },
    {
      "model_id": "mradermacher/RynnBrain-CoP-8B-GGUF",
      "scanned_at": "2026-09-15T02:22:34.370712Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Alibaba-DAMO-Academy/RynnBrain-CoP-8B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Alibaba-DAMO-Academy/RynnBrain-CoP-8B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Alibaba-DAMO-Academy/RynnBrain-CoP-8B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Alibaba-DAMO-Academy/RynnBrain-CoP-8B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Alibaba-DAMO-Academy/RynnBrain-CoP-8B",
          "confidence": 0.85,
          "raw_context": "--- base_model: Alibaba-DAMO-Academy/RynnBrain-CoP-8B language: - en - zh library_name: transformers li"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Alibaba-DAMO-Academy/RynnBrain-CoP-8B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "Jianfei Yang, Shijian Lu, Deli Zhao},   journal={arXiv preprint arXiv:2602.14979v1},   year={2026},   ur"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": "Alibaba-DAMO-Academy/RynnBrain-CoP-8B",
      "base_model_chain": [
        "Alibaba-DAMO-Academy/RynnBrain-CoP-8B",
        "RynnBrain-8B"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "246c4a8d455e91e6f8a9b932f0f123622736077502006dc5182c3a531e5125de"
    },
    {
      "model_id": "mradermacher/SEAD-14B-GGUF",
      "scanned_at": "2026-09-15T02:22:40.016291Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "dayll/SEAD-14B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:dayll/SEAD-14B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:dayll/SEAD-14B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:dayll/SEAD-14B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "dayll/SEAD-14B",
          "confidence": 0.85,
          "raw_context": "--- base_model: dayll/SEAD-14B language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:dayll/SEAD-14B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "jie Wang, Ruiyuan Wu, Chaozheng Wang},   journal={arXiv preprint arXiv:2602.03548},   year={2026} } ```"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": "dayll/SEAD-14B",
      "base_model_chain": [
        "dayll/SEAD-14B",
        "Qwen/Qwen2.5-14B-Instruct",
        "Qwen/Qwen2.5-14B"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "ffafcbe6b428be0b4c777010384554591646cc23ab022c685c8ade47d45011bf"
    },
    {
      "model_id": "mradermacher/SVD-Qwen3-Coder-Next-Thinking-i1-GGUF",
      "scanned_at": "2026-09-15T02:22:46.481841Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "win10/SVD-Qwen3-Coder-Next-Thinking",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:win10/SVD-Qwen3-Coder-Next-Thinking"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:win10/SVD-Qwen3-Coder-Next-Thinking",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:win10/SVD-Qwen3-Coder-Next-Thinking"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "win10/SVD-Qwen3-Coder-Next-Thinking",
          "confidence": 0.85,
          "raw_context": "--- base_model: win10/SVD-Qwen3-Coder-Next-Thinking language: - en library_name: transformers mraderm"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "win10/SVD-Qwen3-Coder-Next-Thinking",
      "base_model_chain": [
        "win10/SVD-Qwen3-Coder-Next-Thinking"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "5b2993712a475117e9bf5aedbd27005cfa72c05ea9134bf71dda0df2e68bc18f"
    },
    {
      "model_id": "mradermacher/Spark-1.5B-ScienceWorld-GGUF",
      "scanned_at": "2026-09-15T02:22:51.174320Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Jinyang23/Spark-1.5B-ScienceWorld",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Jinyang23/Spark-1.5B-ScienceWorld"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Jinyang23/Spark-1.5B-ScienceWorld",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Jinyang23/Spark-1.5B-ScienceWorld"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Jinyang23/Spark-1.5B-ScienceWorld",
          "confidence": 0.85,
          "raw_context": "--- base_model: Jinyang23/Spark-1.5B-ScienceWorld language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Jinyang23/Spark-1.5B-ScienceWorld",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "uggingface.co/papers/2601.20209)**  📄 **Paper:** [arXiv:2601.20209](https://arxiv.org/abs/2601.20209)  ##"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": "Jinyang23/Spark-1.5B-ScienceWorld",
      "base_model_chain": [
        "Jinyang23/Spark-1.5B-ScienceWorld",
        "Qwen/Qwen2.5-1.5B-Instruct",
        "Qwen/Qwen2.5-1.5B"
      ],
      "training_section_present": false,
      "license": "mit",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "91c77d9f23d507835078dce94fb3803d92b842db627151c27324e34cbbcf0456"
    },
    {
      "model_id": "mradermacher/SpatialThinker-3B-GGUF",
      "scanned_at": "2026-09-15T02:22:57.690340Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "OX-PIXL/STVQA-7K",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:OX-PIXL/STVQA-7K"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "OX-PIXL/SpatialThinker-3B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:OX-PIXL/SpatialThinker-3B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:OX-PIXL/SpatialThinker-3B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:OX-PIXL/SpatialThinker-3B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "OX-PIXL/SpatialThinker-3B",
          "confidence": 0.85,
          "raw_context": "--- base_model: OX-PIXL/SpatialThinker-3B datasets: - OX-PIXL/STVQA-7K language: - en libra"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:OX-PIXL/SpatialThinker-3B",
          "value": "OX-PIXL/STVQA-7K",
          "confidence": 0.6400000000000001,
          "raw_context": "b.com/hunarbatra/SpatialThinker) - 🤗 **Dataset**: [OX-PIXL/STVQA-7K](https://huggingface.co/datasets/OX-PIXL/STVQA-7K)"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:OX-PIXL/SpatialThinker-3B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "Thinker-3B  <p align=\"center\">   <a href=\"https://arxiv.org/abs/2511.07403\">     <img src=\"https://img.sh"
        }
      ],
      "declared_datasets": [
        "OX-PIXL/STVQA-7K"
      ],
      "inferred_datasets": [
        "OX-PIXL/STVQA-7K",
        "arxiv",
        "voc"
      ],
      "base_model": "OX-PIXL/SpatialThinker-3B",
      "base_model_chain": [
        "OX-PIXL/SpatialThinker-3B",
        "Qwen/Qwen2.5-VL-3B-Instruct"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.45000000000000007,
      "provenance_hash": "89f9a88c45ac1a3c16a7b0e24c957507a4299076fd922497b034ddc5a0391ff2"
    },
    {
      "model_id": "mradermacher/SpatialThinker-3B-i1-GGUF",
      "scanned_at": "2026-09-15T02:23:03.294667Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "OX-PIXL/STVQA-7K",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:OX-PIXL/STVQA-7K"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "OX-PIXL/SpatialThinker-3B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:OX-PIXL/SpatialThinker-3B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:OX-PIXL/SpatialThinker-3B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:OX-PIXL/SpatialThinker-3B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "OX-PIXL/SpatialThinker-3B",
          "confidence": 0.85,
          "raw_context": "--- base_model: OX-PIXL/SpatialThinker-3B datasets: - OX-PIXL/STVQA-7K language: - en libra"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:OX-PIXL/SpatialThinker-3B",
          "value": "OX-PIXL/STVQA-7K",
          "confidence": 0.6400000000000001,
          "raw_context": "b.com/hunarbatra/SpatialThinker) - 🤗 **Dataset**: [OX-PIXL/STVQA-7K](https://huggingface.co/datasets/OX-PIXL/STVQA-7K)"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:OX-PIXL/SpatialThinker-3B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "Thinker-3B  <p align=\"center\">   <a href=\"https://arxiv.org/abs/2511.07403\">     <img src=\"https://img.sh"
        }
      ],
      "declared_datasets": [
        "OX-PIXL/STVQA-7K"
      ],
      "inferred_datasets": [
        "OX-PIXL/STVQA-7K",
        "arxiv",
        "voc"
      ],
      "base_model": "OX-PIXL/SpatialThinker-3B",
      "base_model_chain": [
        "OX-PIXL/SpatialThinker-3B",
        "Qwen/Qwen2.5-VL-3B-Instruct"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.45000000000000007,
      "provenance_hash": "80cb1a17ecd68f10a1c64dcc4877b342958f918fe8164a3c79b14302f4d71280"
    },
    {
      "model_id": "mradermacher/SpatialThinker-7B-GGUF",
      "scanned_at": "2026-09-15T02:23:06.057766Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "OX-PIXL/STVQA-7K",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:OX-PIXL/STVQA-7K"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "OX-PIXL/SpatialThinker-7B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:OX-PIXL/SpatialThinker-7B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:OX-PIXL/SpatialThinker-7B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:OX-PIXL/SpatialThinker-7B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "OX-PIXL/SpatialThinker-7B",
          "confidence": 0.85,
          "raw_context": "--- base_model: OX-PIXL/SpatialThinker-7B datasets: - OX-PIXL/STVQA-7K language: - en libra"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:OX-PIXL/SpatialThinker-7B",
          "value": "OX-PIXL/STVQA-7K",
          "confidence": 0.6400000000000001,
          "raw_context": "b.com/hunarbatra/SpatialThinker) - 🤗 **Dataset**: [OX-PIXL/STVQA-7K](https://huggingface.co/datasets/OX-PIXL/STVQA-7K)"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:OX-PIXL/SpatialThinker-7B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "Thinker-7B  <p align=\"center\">   <a href=\"https://arxiv.org/abs/2511.07403\">     <img src=\"https://img.sh"
        }
      ],
      "declared_datasets": [
        "OX-PIXL/STVQA-7K"
      ],
      "inferred_datasets": [
        "OX-PIXL/STVQA-7K",
        "arxiv",
        "voc"
      ],
      "base_model": "OX-PIXL/SpatialThinker-7B",
      "base_model_chain": [
        "OX-PIXL/SpatialThinker-7B",
        "Qwen/Qwen2.5-VL-7B-Instruct"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.45000000000000007,
      "provenance_hash": "10335c6e44178a71227a0cd21893fba24177557e01904a49c949732306370e48"
    },
    {
      "model_id": "mradermacher/SpatialThinker-7B-i1-GGUF",
      "scanned_at": "2026-09-15T02:23:10.646593Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "OX-PIXL/STVQA-7K",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:OX-PIXL/STVQA-7K"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "OX-PIXL/SpatialThinker-7B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:OX-PIXL/SpatialThinker-7B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:OX-PIXL/SpatialThinker-7B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:OX-PIXL/SpatialThinker-7B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "OX-PIXL/SpatialThinker-7B",
          "confidence": 0.85,
          "raw_context": "--- base_model: OX-PIXL/SpatialThinker-7B datasets: - OX-PIXL/STVQA-7K language: - en libra"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:OX-PIXL/SpatialThinker-7B",
          "value": "OX-PIXL/STVQA-7K",
          "confidence": 0.6400000000000001,
          "raw_context": "b.com/hunarbatra/SpatialThinker) - 🤗 **Dataset**: [OX-PIXL/STVQA-7K](https://huggingface.co/datasets/OX-PIXL/STVQA-7K)"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:OX-PIXL/SpatialThinker-7B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "Thinker-7B  <p align=\"center\">   <a href=\"https://arxiv.org/abs/2511.07403\">     <img src=\"https://img.sh"
        }
      ],
      "declared_datasets": [
        "OX-PIXL/STVQA-7K"
      ],
      "inferred_datasets": [
        "OX-PIXL/STVQA-7K",
        "arxiv",
        "voc"
      ],
      "base_model": "OX-PIXL/SpatialThinker-7B",
      "base_model_chain": [
        "OX-PIXL/SpatialThinker-7B",
        "Qwen/Qwen2.5-VL-7B-Instruct"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.45000000000000007,
      "provenance_hash": "f8a2fffbe8070fc74d4c4a73a785ec55ad82452cec5692a899d6dd9554986cb9"
    },
    {
      "model_id": "mradermacher/StarPO-1.7B-GGUF",
      "scanned_at": "2026-09-15T02:23:13.402778Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Klingspor/StarPO-1.7B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Klingspor/StarPO-1.7B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Klingspor/StarPO-1.7B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Klingspor/StarPO-1.7B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Klingspor/StarPO-1.7B",
          "confidence": 0.85,
          "raw_context": "--- base_model: Klingspor/StarPO-1.7B language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "Klingspor/StarPO-1.7B",
      "base_model_chain": [
        "Klingspor/StarPO-1.7B"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "456169070586dff97606b05d235265c1114ad68db2140c37dd40ebe53842b9e1"
    },
    {
      "model_id": "mradermacher/StarPO-1.7B-i1-GGUF",
      "scanned_at": "2026-09-15T02:23:18.002302Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Klingspor/StarPO-1.7B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Klingspor/StarPO-1.7B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Klingspor/StarPO-1.7B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Klingspor/StarPO-1.7B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Klingspor/StarPO-1.7B",
          "confidence": 0.85,
          "raw_context": "--- base_model: Klingspor/StarPO-1.7B language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "Klingspor/StarPO-1.7B",
      "base_model_chain": [
        "Klingspor/StarPO-1.7B"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "b8341554b27020c275599651db8b983721a5dfb4f44e83403b29d3a2acd91045"
    },
    {
      "model_id": "mradermacher/StarPO-4B-GGUF",
      "scanned_at": "2026-09-15T02:23:20.753842Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Klingspor/StarPO-4B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Klingspor/StarPO-4B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Klingspor/StarPO-4B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Klingspor/StarPO-4B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Klingspor/StarPO-4B",
          "confidence": 0.85,
          "raw_context": "--- base_model: Klingspor/StarPO-4B language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "Klingspor/StarPO-4B",
      "base_model_chain": [
        "Klingspor/StarPO-4B",
        "Klingspor/Qwen3-4B-SFT",
        "Qwen/Qwen3-4B",
        "Qwen/Qwen3-4B-Base"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "1f3ef6fdae13fb3e6833d9c7d57ac8b718581239f219e148387722398c246e3c"
    },
    {
      "model_id": "mradermacher/StarPO-4B-i1-GGUF",
      "scanned_at": "2026-09-15T02:23:26.252903Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Klingspor/StarPO-4B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Klingspor/StarPO-4B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Klingspor/StarPO-4B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Klingspor/StarPO-4B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Klingspor/StarPO-4B",
          "confidence": 0.85,
          "raw_context": "--- base_model: Klingspor/StarPO-4B language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "Klingspor/StarPO-4B",
      "base_model_chain": [
        "Klingspor/StarPO-4B",
        "Klingspor/Qwen3-4B-SFT",
        "Qwen/Qwen3-4B",
        "Qwen/Qwen3-4B-Base"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "a4f16452bc52123cc9d9881c64221133ba909039a34929928eb685ba0cd6b8ae"
    },
    {
      "model_id": "mradermacher/Step-3.5-Flash-GGUF",
      "scanned_at": "2026-09-15T02:23:29.038300Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "stepfun-ai/Step-3.5-Flash",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:stepfun-ai/Step-3.5-Flash"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:stepfun-ai/Step-3.5-Flash",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:stepfun-ai/Step-3.5-Flash"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "stepfun-ai/Step-3.5-Flash",
          "confidence": 0.85,
          "raw_context": "--- base_model: stepfun-ai/Step-3.5-Flash language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:stepfun-ai/Step-3.5-Flash",
          "value": "voc",
          "confidence": 0.5599999999999999,
          "raw_context": "6 hidden dim) | | **Context Window** | 256K | | **Vocabulary** | 128,896 tokens | | **Total Parameters*"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:stepfun-ai/Step-3.5-Flash",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": ".5-flash/) [![Paper](https://img.shields.io/badge/Arxiv-TechReport-red)](https://arxiv.org/abs/2602.10604"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": "stepfun-ai/Step-3.5-Flash",
      "base_model_chain": [
        "stepfun-ai/Step-3.5-Flash",
        "stepfun-ai/step-3.5-flash"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "09e416f0f869acbc5b6215132353701a89dfdf95a11772ba375b3f59aa36c85c"
    },
    {
      "model_id": "mradermacher/Step-3.5-Flash-REAP-128B-A11B-GGUF",
      "scanned_at": "2026-09-15T02:23:34.706972Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "lkevincc0/glm47-math-code-calibration-1024",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:lkevincc0/glm47-math-code-calibration-1024"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "lkevincc0/Step-3.5-Flash-REAP-128B-A11B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:lkevincc0/Step-3.5-Flash-REAP-128B-A11B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:lkevincc0/Step-3.5-Flash-REAP-128B-A11B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:lkevincc0/Step-3.5-Flash-REAP-128B-A11B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "lkevincc0/Step-3.5-Flash-REAP-128B-A11B",
          "confidence": 0.85,
          "raw_context": "--- base_model: lkevincc0/Step-3.5-Flash-REAP-128B-A11B datasets: - lkevincc0/glm47-math-code-calibration"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [
        "lkevincc0/glm47-math-code-calibration-1024"
      ],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "lkevincc0/Step-3.5-Flash-REAP-128B-A11B",
      "base_model_chain": [
        "lkevincc0/Step-3.5-Flash-REAP-128B-A11B",
        "stepfun-ai/Step-3.5-Flash",
        "stepfun-ai/step-3.5-flash"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "fb9d85e5da664b692e3c35efb2d6fb2cbebf200ae2971b0de56984db3cd0f3ea"
    },
    {
      "model_id": "mradermacher/Step-3.5-Flash-REAP-128B-A11B-i1-GGUF",
      "scanned_at": "2026-09-15T02:23:39.308900Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "lkevincc0/glm47-math-code-calibration-1024",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:lkevincc0/glm47-math-code-calibration-1024"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "lkevincc0/Step-3.5-Flash-REAP-128B-A11B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:lkevincc0/Step-3.5-Flash-REAP-128B-A11B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:lkevincc0/Step-3.5-Flash-REAP-128B-A11B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:lkevincc0/Step-3.5-Flash-REAP-128B-A11B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "lkevincc0/Step-3.5-Flash-REAP-128B-A11B",
          "confidence": 0.85,
          "raw_context": "--- base_model: lkevincc0/Step-3.5-Flash-REAP-128B-A11B datasets: - lkevincc0/glm47-math-code-calibration"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [
        "lkevincc0/glm47-math-code-calibration-1024"
      ],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "lkevincc0/Step-3.5-Flash-REAP-128B-A11B",
      "base_model_chain": [
        "lkevincc0/Step-3.5-Flash-REAP-128B-A11B",
        "stepfun-ai/Step-3.5-Flash",
        "stepfun-ai/step-3.5-flash"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "6b6a05aad0494e28f24d7556d9a904220f2ca8a122ce4c4632f0afd1b7279bd5"
    },
    {
      "model_id": "mradermacher/Sunflower-32B-GRPO-i1-GGUF",
      "scanned_at": "2026-09-15T02:23:42.065284Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "akera/Sunflower-32B-GRPO",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:akera/Sunflower-32B-GRPO"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:akera/Sunflower-32B-GRPO",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:akera/Sunflower-32B-GRPO"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "akera/Sunflower-32B-GRPO",
          "confidence": 0.85,
          "raw_context": "--- base_model: akera/Sunflower-32B-GRPO language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "akera/Sunflower-32B-GRPO",
      "base_model_chain": [
        "akera/Sunflower-32B-GRPO",
        "Sunbird/Sunflower-32B",
        "Qwen/Qwen3-32B"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "b080e03f5a6a276c81265da7d8fa9a1b99582ffd60dc3aa9390492532392f3ed"
    },
    {
      "model_id": "mradermacher/SwarmMed-14B-v2-merged-GGUF",
      "scanned_at": "2026-09-15T02:23:47.564041Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "SwarmandBee/SwarmMed-Platinum-1K",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:SwarmandBee/SwarmMed-Platinum-1K"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "SwarmandBee/SwarmMed-14B-v2-merged",
          "confidence": 0.85,
          "raw_context": "--- base_model: SwarmandBee/SwarmMed-14B-v2-merged datasets: - SwarmandBee/SwarmMed-Platinum-1K lang"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [
        "SwarmandBee/SwarmMed-Platinum-1K"
      ],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "SwarmandBee/SwarmMed-14B-v2-merged",
      "base_model_chain": [
        "SwarmandBee/SwarmMed-14B-v2-merged"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "401b2fcf3c2b04e8b20da6c17d3fc037a16b3fe8c9a935cd9e3ecc99ec7d93f7"
    },
    {
      "model_id": "mradermacher/SwarmMed-14B-v2-merged-i1-GGUF",
      "scanned_at": "2026-09-15T02:23:52.136276Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "SwarmandBee/SwarmMed-Platinum-1K",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:SwarmandBee/SwarmMed-Platinum-1K"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "SwarmandBee/SwarmMed-14B-v2-merged",
          "confidence": 0.85,
          "raw_context": "--- base_model: SwarmandBee/SwarmMed-14B-v2-merged datasets: - SwarmandBee/SwarmMed-Platinum-1K lang"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [
        "SwarmandBee/SwarmMed-Platinum-1K"
      ],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "SwarmandBee/SwarmMed-14B-v2-merged",
      "base_model_chain": [
        "SwarmandBee/SwarmMed-14B-v2-merged"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "8d0ef4899e79fcadc5d9f1fbcde827be9eb365656b517d3e3383e2c92c74d1fa"
    },
    {
      "model_id": "mradermacher/Tiamat-24B-Magistral-PaperWitch-heresy-GGUF",
      "scanned_at": "2026-09-15T02:23:54.901967Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "MuXodious/Tiamat-24B-Magistral-PaperWitch-heresy",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:MuXodious/Tiamat-24B-Magistral-PaperWitch-heresy"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:MuXodious/Tiamat-24B-Magistral-PaperWitch-heresy",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:MuXodious/Tiamat-24B-Magistral-PaperWitch-heresy"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "MuXodious/Tiamat-24B-Magistral-PaperWitch-heresy",
          "confidence": 0.85,
          "raw_context": "--- base_model: MuXodious/Tiamat-24B-Magistral-PaperWitch-heresy language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "MuXodious/Tiamat-24B-Magistral-PaperWitch-heresy",
      "base_model_chain": [
        "MuXodious/Tiamat-24B-Magistral-PaperWitch-heresy",
        "Gryphe/Tiamat-24B-Magistral",
        "mistralai/Magistral-Small-2509",
        "mistralai/Mistral-Small-3.2-24B-Instruct-2506",
        "mistralai/Mistral-Small-3.1-24B-Base-2503"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "149300c793c31298929f4c74b229b401876d43722dfaca6ec030e7a79914ff08"
    },
    {
      "model_id": "mradermacher/Tifa-Deepsex-14b-CoT-GGUF",
      "scanned_at": "2026-09-15T02:24:00.509388Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "ValueFX9507/Tifa-Deepsex-14b-CoT",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:ValueFX9507/Tifa-Deepsex-14b-CoT"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:ValueFX9507/Tifa-Deepsex-14b-CoT",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:ValueFX9507/Tifa-Deepsex-14b-CoT"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "ValueFX9507/Tifa-Deepsex-14b-CoT",
          "confidence": 0.85,
          "raw_context": "--- base_model: ValueFX9507/Tifa-Deepsex-14b-CoT language: - zh - en library_name: transformers li"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> static quants of"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:ValueFX9507/Tifa-Deepsex-14b-CoT",
          "value": "c4",
          "confidence": 0.5599999999999999,
          "raw_context": "loads.huggingface.co/production/uploads/650762d0eac45ee2e420a38b/BKxz6KfbwTioBOkha_UXl.png)  ## 0208更新"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "c4",
        "voc"
      ],
      "base_model": "ValueFX9507/Tifa-Deepsex-14b-CoT",
      "base_model_chain": [
        "ValueFX9507/Tifa-Deepsex-14b-CoT",
        "deepseek-ai/deepseek-r1-14b"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "a168bad911bba2ccfc6cf5e662f25be2f1714a1f176d9309253ea05d98b88fb5"
    },
    {
      "model_id": "mradermacher/Tifa-DeepsexV2-7b-MGRPO-safetensors-GGUF",
      "scanned_at": "2026-09-15T02:24:06.202335Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "btaskel/Tifa-DeepsexV2-7b-MGRPO-safetensors",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:btaskel/Tifa-DeepsexV2-7b-MGRPO-safetensors"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:btaskel/Tifa-DeepsexV2-7b-MGRPO-safetensors",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:btaskel/Tifa-DeepsexV2-7b-MGRPO-safetensors"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "btaskel/Tifa-DeepsexV2-7b-MGRPO-safetensors",
          "confidence": 0.85,
          "raw_context": "--- base_model: btaskel/Tifa-DeepsexV2-7b-MGRPO-safetensors language: - zh - en library_name: transformers li"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> static quants of"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "btaskel/Tifa-DeepsexV2-7b-MGRPO-safetensors",
      "base_model_chain": [
        "btaskel/Tifa-DeepsexV2-7b-MGRPO-safetensors",
        "ValueFX9507/Tifa-DeepsexV2-7b-MGRPO-GGUF-F16",
        "qwen/qwen7b"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "b72a6d0db28939889354f15aaef302fa5545b7c54ff3db27aad30f30a9427cd7"
    },
    {
      "model_id": "mradermacher/Tifa-DeepsexV2-7b-MGRPO-safetensors-i1-GGUF",
      "scanned_at": "2026-09-15T02:24:12.614330Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "btaskel/Tifa-DeepsexV2-7b-MGRPO-safetensors",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:btaskel/Tifa-DeepsexV2-7b-MGRPO-safetensors"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:btaskel/Tifa-DeepsexV2-7b-MGRPO-safetensors",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:btaskel/Tifa-DeepsexV2-7b-MGRPO-safetensors"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "btaskel/Tifa-DeepsexV2-7b-MGRPO-safetensors",
          "confidence": 0.85,
          "raw_context": "--- base_model: btaskel/Tifa-DeepsexV2-7b-MGRPO-safetensors language: - zh - en library_name: transformers li"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> weighted"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "btaskel/Tifa-DeepsexV2-7b-MGRPO-safetensors",
      "base_model_chain": [
        "btaskel/Tifa-DeepsexV2-7b-MGRPO-safetensors",
        "ValueFX9507/Tifa-DeepsexV2-7b-MGRPO-GGUF-F16",
        "qwen/qwen7b"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "228deb54400390c153eacdf8afa14a45f7922a41ade8edf3a0b23c5c00615e46"
    },
    {
      "model_id": "mradermacher/TildeOpen-30b-ENLV-ChatML-instruct-i1-GGUF",
      "scanned_at": "2026-09-15T02:24:15.365981Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "matiss/TildeOpen-30b-ENLV-ChatML-instruct",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:matiss/TildeOpen-30b-ENLV-ChatML-instruct"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:matiss/TildeOpen-30b-ENLV-ChatML-instruct",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:matiss/TildeOpen-30b-ENLV-ChatML-instruct"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "matiss/TildeOpen-30b-ENLV-ChatML-instruct",
          "confidence": 0.85,
          "raw_context": "--- base_model: matiss/TildeOpen-30b-ENLV-ChatML-instruct language: - en library_name: transformers mraderm"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:matiss/TildeOpen-30b-ENLV-ChatML-instruct",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "ute) presented in [Lacoste et al. (2019)](https://arxiv.org/abs/1910.09700).  - **Hardware Type:** [More"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": "matiss/TildeOpen-30b-ENLV-ChatML-instruct",
      "base_model_chain": [
        "matiss/TildeOpen-30b-ENLV-ChatML-instruct"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.2,
      "provenance_hash": "5b79037f41a8fd94e7c9c9c6988f979eb0c3dbe6cefcb11bfe1c3a72897c19fd"
    },
    {
      "model_id": "mradermacher/ToolMaster-7B-GGUF",
      "scanned_at": "2026-09-15T02:24:19.959771Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Kfkcome/ToolMaster-7B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Kfkcome/ToolMaster-7B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Kfkcome/ToolMaster-7B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Kfkcome/ToolMaster-7B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Kfkcome/ToolMaster-7B",
          "confidence": 0.85,
          "raw_context": "--- base_model: Kfkcome/ToolMaster-7B language: - en library_name: transformers mraderm"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Kfkcome/ToolMaster-7B",
          "value": "voc",
          "confidence": 0.5599999999999999,
          "raw_context": "**. It has been optimized for tool planning and invocation through the trial-and-execution framework."
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Kfkcome/ToolMaster-7B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "},   author={Gao, Xingjie and others},   journal={arXiv preprint arXiv:2601.12762},   year={2025} } ```"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": "Kfkcome/ToolMaster-7B",
      "base_model_chain": [
        "Kfkcome/ToolMaster-7B",
        "Qwen/Qwen2.5-7B-Instruct",
        "Qwen/Qwen2.5-7B"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.2,
      "provenance_hash": "b0335f118d4bd231611500da88f7307586842373fe32d6aded081d46cc7ea9d8"
    },
    {
      "model_id": "mradermacher/ToolMaster-7B-i1-GGUF",
      "scanned_at": "2026-09-15T02:24:25.497945Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Kfkcome/ToolMaster-7B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Kfkcome/ToolMaster-7B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Kfkcome/ToolMaster-7B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Kfkcome/ToolMaster-7B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Kfkcome/ToolMaster-7B",
          "confidence": 0.85,
          "raw_context": "--- base_model: Kfkcome/ToolMaster-7B language: - en library_name: transformers mraderm"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Kfkcome/ToolMaster-7B",
          "value": "voc",
          "confidence": 0.5599999999999999,
          "raw_context": "**. It has been optimized for tool planning and invocation through the trial-and-execution framework."
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Kfkcome/ToolMaster-7B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "},   author={Gao, Xingjie and others},   journal={arXiv preprint arXiv:2601.12762},   year={2025} } ```"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": "Kfkcome/ToolMaster-7B",
      "base_model_chain": [
        "Kfkcome/ToolMaster-7B",
        "Qwen/Qwen2.5-7B-Instruct",
        "Qwen/Qwen2.5-7B"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.2,
      "provenance_hash": "8114ced75ad3599363cfc21db7f9b0e2bc2884537365c13be1bd35749f7b01dd"
    },
    {
      "model_id": "mradermacher/TrialPulse-8B-Absolute-Clinical-Zenith-i1-GGUF",
      "scanned_at": "2026-09-15T02:24:28.247937Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "parzivalprime/TrialPulse-8B-Absolute-Clinical-Zenith",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:parzivalprime/TrialPulse-8B-Absolute-Clinical-Zenith"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:parzivalprime/TrialPulse-8B-Absolute-Clinical-Zenith",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:parzivalprime/TrialPulse-8B-Absolute-Clinical-Zenith"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "parzivalprime/TrialPulse-8B-Absolute-Clinical-Zenith",
          "confidence": 0.85,
          "raw_context": "--- base_model: parzivalprime/TrialPulse-8B-Absolute-Clinical-Zenith language: - en library_name: transformers mraderm"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "parzivalprime/TrialPulse-8B-Absolute-Clinical-Zenith",
      "base_model_chain": [
        "parzivalprime/TrialPulse-8B-Absolute-Clinical-Zenith"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "ad730a1fb3f90c06457f25357a326bbf66625c136793978b6fff2e17aa5ac3d3"
    },
    {
      "model_id": "mradermacher/UDI-VIS-32k-Llama-3.1-8B-i1-GGUF",
      "scanned_at": "2026-09-15T02:24:32.851502Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "HIDIVE/UDI-VIS-32k-Llama-3.1-8B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:HIDIVE/UDI-VIS-32k-Llama-3.1-8B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:HIDIVE/UDI-VIS-32k-Llama-3.1-8B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:HIDIVE/UDI-VIS-32k-Llama-3.1-8B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "HIDIVE/UDI-VIS-32k-Llama-3.1-8B",
          "confidence": 0.85,
          "raw_context": "--- base_model: HIDIVE/UDI-VIS-32k-Llama-3.1-8B language: - en library_name: transformers mraderm"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "HIDIVE/UDI-VIS-32k-Llama-3.1-8B",
      "base_model_chain": [
        "HIDIVE/UDI-VIS-32k-Llama-3.1-8B"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "225c4245ea5a85017815eef68e48902f2573871bac65f833f552ea2996f8f481"
    },
    {
      "model_id": "mradermacher/VeriReason-Qwen2.5-1.5b-RTLCoder-Verilog-GRPO-reasoning-tb-GGUF",
      "scanned_at": "2026-09-15T02:24:37.745808Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "Nellyw888/RTL-Coder_7b_reasoning_tb_simple",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:Nellyw888/RTL-Coder_7b_reasoning_tb_simple"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "Nellyw888/RTL-Coder_small",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:Nellyw888/RTL-Coder_small"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Nellyw888/VeriReason-Qwen2.5-1.5b-RTLCoder-Verilog-GRPO-reasoning-tb",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Nellyw888/VeriReason-Qwen2.5-1.5b-RTLCoder-Verilog-GRPO-reasoning-tb"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Nellyw888/VeriReason-Qwen2.5-1.5b-RTLCoder-Verilog-GRPO-reasoning-tb",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Nellyw888/VeriReason-Qwen2.5-1.5b-RTLCoder-Verilog-GRPO-reasoning-tb"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Nellyw888/VeriReason-Qwen2.5-1.5b-RTLCoder-Verilog-GRPO-reasoning-tb",
          "confidence": 0.85,
          "raw_context": "--- base_model: Nellyw888/VeriReason-Qwen2.5-1.5b-RTLCoder-Verilog-GRPO-reasoning-tb datasets: - Nellyw888/RTL-Coder_7b_reasoning_tb_s"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> static quants of"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Nellyw888/VeriReason-Qwen2.5-1.5b-RTLCoder-Verilog-GRPO-reasoning-tb",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "or Reasoning-Enhanced Verilog Generation](https://arxiv.org/abs/2505.11849)  ## Update Log 2025.05.17: In"
        }
      ],
      "declared_datasets": [
        "Nellyw888/RTL-Coder_7b_reasoning_tb_simple",
        "Nellyw888/RTL-Coder_small"
      ],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": "Nellyw888/VeriReason-Qwen2.5-1.5b-RTLCoder-Verilog-GRPO-reasoning-tb",
      "base_model_chain": [
        "Nellyw888/VeriReason-Qwen2.5-1.5b-RTLCoder-Verilog-GRPO-reasoning-tb",
        "Qwen/Qwen2.5-Coder-1.5B-Instruct",
        "Qwen/Qwen2.5-Coder-1.5B",
        "Qwen/Qwen2.5-1.5B"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.4,
      "provenance_hash": "474b6599a165508814de5d041459097e50c8f6339bf09a73c252479572a0080d"
    },
    {
      "model_id": "mradermacher/VeriReason-Qwen2.5-7b-RTLCoder-Verilog-GRPO-reasoning-tb-i1-GGUF",
      "scanned_at": "2026-09-15T02:24:44.209013Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "Nellyw888/VeriReason-RTL-Coder_7b_reasoning_tb",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:Nellyw888/VeriReason-RTL-Coder_7b_reasoning_tb"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Nellyw888/VeriReason-Qwen2.5-7b-RTLCoder-Verilog-GRPO-reasoning-tb",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Nellyw888/VeriReason-Qwen2.5-7b-RTLCoder-Verilog-GRPO-reasoning-tb"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Nellyw888/VeriReason-Qwen2.5-7b-RTLCoder-Verilog-GRPO-reasoning-tb",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Nellyw888/VeriReason-Qwen2.5-7b-RTLCoder-Verilog-GRPO-reasoning-tb"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Nellyw888/VeriReason-Qwen2.5-7b-RTLCoder-Verilog-GRPO-reasoning-tb",
          "confidence": 0.85,
          "raw_context": "--- base_model: Nellyw888/VeriReason-Qwen2.5-7b-RTLCoder-Verilog-GRPO-reasoning-tb datasets: - Nellyw888/VeriReason-RTL-Coder_7b_rea"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> weighted"
        }
      ],
      "declared_datasets": [
        "Nellyw888/VeriReason-RTL-Coder_7b_reasoning_tb"
      ],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "Nellyw888/VeriReason-Qwen2.5-7b-RTLCoder-Verilog-GRPO-reasoning-tb",
      "base_model_chain": [
        "Nellyw888/VeriReason-Qwen2.5-7b-RTLCoder-Verilog-GRPO-reasoning-tb"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.25,
      "provenance_hash": "c9c2b3deea3b76dc040553a92b8b733f2ab06b9b03d7f37506e6ba86a845f30d"
    },
    {
      "model_id": "mradermacher/XORTRON.CriminalComputing.2026.27B-i1-GGUF",
      "scanned_at": "2026-09-15T02:24:48.777802Z",
      "signals": [
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "darkc0de/XORTRON.CriminalComputing.2026.27B",
          "confidence": 0.85,
          "raw_context": "--- base_model: darkc0de/XORTRON.CriminalComputing.2026.27B language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "darkc0de/XORTRON.CriminalComputing.2026.27B",
      "base_model_chain": [
        "darkc0de/XORTRON.CriminalComputing.2026.27B"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "de394023ac9645749147f382e7a6190d61e78edd0cc51422353bbd53c3bdda7b"
    },
    {
      "model_id": "mradermacher/ZwZ-8B-heretic-GGUF",
      "scanned_at": "2026-09-15T02:24:53.356775Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "inclusionAI/ZwZ-RL-VQA",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:inclusionAI/ZwZ-RL-VQA"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "inclusionAI/ZoomBench",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:inclusionAI/ZoomBench"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "jayr23/ZwZ-8B-heretic",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:jayr23/ZwZ-8B-heretic"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:jayr23/ZwZ-8B-heretic",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:jayr23/ZwZ-8B-heretic"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "jayr23/ZwZ-8B-heretic",
          "confidence": 0.85,
          "raw_context": "--- base_model: jayr23/ZwZ-8B-heretic datasets: - inclusionAI/ZwZ-RL-VQA - inclusionAI/"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:jayr23/ZwZ-8B-heretic",
          "value": "inclusionAI/ZwZ-RL-VQA",
          "confidence": 0.6400000000000001,
          "raw_context": "ext) ```   ## Training Data  ZwZ-8B is trained on [inclusionAI/ZwZ-RL-VQA](https://huggingface.co/datasets/inclusionAI/ZwZ-RL-VQA), a 74K-sample Region-to-Im"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:jayr23/ZwZ-8B-heretic",
          "value": "LAION",
          "confidence": 0.48,
          "raw_context": "aset synthesized from diverse image pools (SA-1B, LAION, MetaCLIP, Visual Genome, CC12M, STPLS3D).   ## C"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:jayr23/ZwZ-8B-heretic",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "# ZwZ-8B  <div align=\"center\">  📃 [Paper](https://arxiv.org/pdf/2602.11858) | 🏠 [Project](https://github."
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:jayr23/ZwZ-8B-heretic",
          "value": "laion",
          "confidence": 0.5599999999999999,
          "raw_context": "aset synthesized from diverse image pools (SA-1B, LAION, MetaCLIP, Visual Genome, CC12M, STPLS3D).   ## C"
        }
      ],
      "declared_datasets": [
        "inclusionAI/ZoomBench",
        "inclusionAI/ZwZ-RL-VQA"
      ],
      "inferred_datasets": [
        "arxiv",
        "LAION",
        "inclusionAI/ZwZ-RL-VQA",
        "laion",
        "voc"
      ],
      "base_model": "jayr23/ZwZ-8B-heretic",
      "base_model_chain": [
        "jayr23/ZwZ-8B-heretic",
        "Qwen/Qwen3-VL-8B-Instruct"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.6000000000000001,
      "provenance_hash": "c1425e9cddb53259d599085ae5dcc93142a68f399fb47b7f97391eef52dfeecc"
    },
    {
      "model_id": "mradermacher/antigravity-qwen2.5-3b-v1-GGUF",
      "scanned_at": "2026-09-15T02:24:57.967460Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Ratnesh123/antigravity-qwen2.5-3b-v1",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Ratnesh123/antigravity-qwen2.5-3b-v1"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Ratnesh123/antigravity-qwen2.5-3b-v1",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Ratnesh123/antigravity-qwen2.5-3b-v1"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Ratnesh123/antigravity-qwen2.5-3b-v1",
          "confidence": 0.85,
          "raw_context": "--- base_model: Ratnesh123/antigravity-qwen2.5-3b-v1 language: - en library_name: transformers mraderm"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Ratnesh123/antigravity-qwen2.5-3b-v1",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "ute) presented in [Lacoste et al. (2019)](https://arxiv.org/abs/1910.09700).  - **Hardware Type:** [More"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": "Ratnesh123/antigravity-qwen2.5-3b-v1",
      "base_model_chain": [
        "Ratnesh123/antigravity-qwen2.5-3b-v1"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.2,
      "provenance_hash": "c55da162d8a1843ce725959c1afd9e5ca46b5a834bdf932ba653834419ab49e6"
    },
    {
      "model_id": "mradermacher/arc-teacher-8b-i1-GGUF",
      "scanned_at": "2026-09-15T02:25:02.570289Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "bespoke-stratos-17k",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:bespoke-stratos-17k"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Arc-Intelligence/arc-teacher-8b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Arc-Intelligence/arc-teacher-8b"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Arc-Intelligence/arc-teacher-8b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Arc-Intelligence/arc-teacher-8b"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Arc-Intelligence/arc-teacher-8b",
          "confidence": 0.85,
          "raw_context": "--- base_model: Arc-Intelligence/arc-teacher-8b datasets: - bespoke-stratos-17k language: - en li"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [
        "bespoke-stratos-17k"
      ],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "Arc-Intelligence/arc-teacher-8b",
      "base_model_chain": [
        "Arc-Intelligence/arc-teacher-8b"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "b6ed047d13048236730377b6118febaacb6684d4d163f06a121d8b5fae5c0a00"
    },
    {
      "model_id": "mradermacher/aya-expanse-8b-orthogonal-heretic-i1-GGUF",
      "scanned_at": "2026-09-15T02:25:07.162041Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "oncu/aya-expanse-8b-orthogonal-heretic",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:oncu/aya-expanse-8b-orthogonal-heretic"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:oncu/aya-expanse-8b-orthogonal-heretic",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:oncu/aya-expanse-8b-orthogonal-heretic"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "oncu/aya-expanse-8b-orthogonal-heretic",
          "confidence": 0.85,
          "raw_context": "--- base_model: oncu/aya-expanse-8b-orthogonal-heretic language: - en library_name: transformers mraderm"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "oncu/aya-expanse-8b-orthogonal-heretic",
      "base_model_chain": [
        "oncu/aya-expanse-8b-orthogonal-heretic"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "5fc62316ad44db68ed34969e7dac5d346cd30767123d6426b3e4c74b609ad713"
    },
    {
      "model_id": "mradermacher/beaver-7b-v2.0-GGUF",
      "scanned_at": "2026-09-15T02:25:11.751225Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "PKU-Alignment/PKU-SafeRLHF",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:PKU-Alignment/PKU-SafeRLHF"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "PKU-Alignment/beaver-7b-v2.0",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:PKU-Alignment/beaver-7b-v2.0"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:PKU-Alignment/beaver-7b-v2.0",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:PKU-Alignment/beaver-7b-v2.0"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "PKU-Alignment/beaver-7b-v2.0",
          "confidence": 0.85,
          "raw_context": "--- base_model: PKU-Alignment/beaver-7b-v2.0 datasets: - PKU-Alignment/PKU-SafeRLHF language:"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> static quants of"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "alpaca",
          "confidence": 0.7,
          "raw_context": "safety - ai-safety - deepspeed - beaver - llama - alpaca --- ## About  <!-- ### quantize_version: 2 --> <!"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:PKU-Alignment/beaver-7b-v2.0",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "nse. - **Fine-tuned from model:** [LLaMA](https://arxiv.org/abs/2302.13971), [Alpaca](https://github.com/"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:PKU-Alignment/beaver-7b-v2.0",
          "value": "alpaca",
          "confidence": 0.5599999999999999,
          "raw_context": "ai-safety   - deepspeed   - beaver   - llama   - alpaca library_name: safe-rlhf ---  # 🦫 Beaver Model Car"
        }
      ],
      "declared_datasets": [
        "PKU-Alignment/PKU-SafeRLHF"
      ],
      "inferred_datasets": [
        "arxiv",
        "voc",
        "alpaca"
      ],
      "base_model": "PKU-Alignment/beaver-7b-v2.0",
      "base_model_chain": [
        "PKU-Alignment/beaver-7b-v2.0"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "297d9ba181d2aadd4c77a05225fe72e1871c1e6830e401aa76579e9d96f84395"
    },
    {
      "model_id": "mradermacher/businessgpt-qwen3vl-2b-v2-GGUF",
      "scanned_at": "2026-09-15T02:25:16.384572Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "vXofi/businessgpt-qwen3vl-2b-v2",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:vXofi/businessgpt-qwen3vl-2b-v2"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:vXofi/businessgpt-qwen3vl-2b-v2",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:vXofi/businessgpt-qwen3vl-2b-v2"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "vXofi/businessgpt-qwen3vl-2b-v2",
          "confidence": 0.85,
          "raw_context": "--- base_model: vXofi/businessgpt-qwen3vl-2b-v2 language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "vXofi/businessgpt-qwen3vl-2b-v2",
      "base_model_chain": [
        "vXofi/businessgpt-qwen3vl-2b-v2",
        "unsloth/qwen3-vl-2b-instruct-unsloth-bnb-4bit",
        "Qwen/Qwen3-VL-2B-Instruct"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "97fc8146affffb82a747ab16051ff5f89a9ee75282f98ebd452ff2f8b3243c33"
    },
    {
      "model_id": "mradermacher/dolphin-v2-8b-abliterated-GGUF",
      "scanned_at": "2026-09-15T02:25:21.991416Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "0arch-io/dolphin-v2-8b-abliterated",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:0arch-io/dolphin-v2-8b-abliterated"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:0arch-io/dolphin-v2-8b-abliterated",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:0arch-io/dolphin-v2-8b-abliterated"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "0arch-io/dolphin-v2-8b-abliterated",
          "confidence": 0.85,
          "raw_context": "--- base_model: 0arch-io/dolphin-v2-8b-abliterated language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:0arch-io/dolphin-v2-8b-abliterated",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "ion technique from [Arditi et al. (2024)](https://arxiv.org/abs/2406.11717) to remove residual refusal be"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": "0arch-io/dolphin-v2-8b-abliterated",
      "base_model_chain": [
        "0arch-io/dolphin-v2-8b-abliterated",
        "Qwen/Qwen3-8B",
        "Qwen/Qwen3-8B-Base"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "79fb1a3eb0c9f42ac187fd9e03073412d514edaf2aa416460ff35725d4490e9f"
    },
    {
      "model_id": "mradermacher/drkernel-14b-GGUF",
      "scanned_at": "2026-09-15T02:25:26.579265Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "hkust-nlp/drkernel-coldstart-8k",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:hkust-nlp/drkernel-coldstart-8k"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "hkust-nlp/drkernel-rl-data",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:hkust-nlp/drkernel-rl-data"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "hkust-nlp/drkernel-validation-data",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:hkust-nlp/drkernel-validation-data"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "hkust-nlp/drkernel-14b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:hkust-nlp/drkernel-14b"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:hkust-nlp/drkernel-14b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:hkust-nlp/drkernel-14b"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "hkust-nlp/drkernel-14b",
          "confidence": 0.85,
          "raw_context": "--- base_model: hkust-nlp/drkernel-14b datasets: - hkust-nlp/drkernel-coldstart-8k - hku"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:hkust-nlp/drkernel-14b",
          "value": "hkust-nlp/drkernel-coldstart-8k",
          "confidence": 0.6400000000000001,
          "raw_context": "stage DR.Kernel pipeline:  1. Cold-start SFT    - Dataset: `hkust-nlp/drkernel-coldstart-8k`    - Multi-turn trajectory warm-up for kernel ge"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:hkust-nlp/drkernel-14b",
          "value": "hkust-nlp/drkernel-rl-data",
          "confidence": 0.6400000000000001,
          "raw_context": "generation/refinement 2. Multi-turn RL    - Train dataset: `hkust-nlp/drkernel-rl-data`    - Validation dataset: `hkust-nlp/drkernel-val"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:hkust-nlp/drkernel-14b",
          "value": "hkust-nlp/drkernel-validation-data",
          "confidence": 0.6400000000000001,
          "raw_context": "set: `hkust-nlp/drkernel-rl-data`    - Validation dataset: `hkust-nlp/drkernel-validation-data` (KernelBench Level 2 validation split)    - Core"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:hkust-nlp/drkernel-14b",
          "value": "ByteDance-Seed/cudaLLM-data",
          "confidence": 0.6400000000000001,
          "raw_context": "nd Attribution  - Query/task source includes:   - [ByteDance-Seed/cudaLLM-data](https://huggingface.co/datasets/ByteDance-Seed/cudaLLM-data) - SFT cold-start traj"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:hkust-nlp/drkernel-14b",
          "value": "voc",
          "confidence": 0.5599999999999999,
          "raw_context": "e_heads`: 8 - `max_position_embeddings`: 32768 - `vocab_size`: 151936 - `transformers_version`: 4.56.0"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:hkust-nlp/drkernel-14b",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "ernel-14b) [![Paper](https://img.shields.io/badge/arXiv-2602.05885-b31b1b)](https://arxiv.org/abs/2602.05"
        }
      ],
      "declared_datasets": [
        "hkust-nlp/drkernel-coldstart-8k",
        "hkust-nlp/drkernel-validation-data",
        "hkust-nlp/drkernel-rl-data"
      ],
      "inferred_datasets": [
        "hkust-nlp/drkernel-coldstart-8k",
        "hkust-nlp/drkernel-rl-data",
        "arxiv",
        "ByteDance-Seed/cudaLLM-data",
        "hkust-nlp/drkernel-validation-data",
        "voc"
      ],
      "base_model": "hkust-nlp/drkernel-14b",
      "base_model_chain": [
        "hkust-nlp/drkernel-14b",
        "Qwen/Qwen3-14B-Base"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.6000000000000001,
      "provenance_hash": "4d8be84f751fbedc05643073e18ac47eac9ae10b9bae4c5073ea4a8e2b607475"
    },
    {
      "model_id": "mradermacher/drkernel-14b-i1-GGUF",
      "scanned_at": "2026-09-15T02:25:31.233527Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "hkust-nlp/drkernel-coldstart-8k",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:hkust-nlp/drkernel-coldstart-8k"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "hkust-nlp/drkernel-rl-data",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:hkust-nlp/drkernel-rl-data"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "hkust-nlp/drkernel-validation-data",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:hkust-nlp/drkernel-validation-data"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "hkust-nlp/drkernel-14b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:hkust-nlp/drkernel-14b"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:hkust-nlp/drkernel-14b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:hkust-nlp/drkernel-14b"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "hkust-nlp/drkernel-14b",
          "confidence": 0.85,
          "raw_context": "--- base_model: hkust-nlp/drkernel-14b datasets: - hkust-nlp/drkernel-coldstart-8k - hku"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:hkust-nlp/drkernel-14b",
          "value": "hkust-nlp/drkernel-coldstart-8k",
          "confidence": 0.6400000000000001,
          "raw_context": "stage DR.Kernel pipeline:  1. Cold-start SFT    - Dataset: `hkust-nlp/drkernel-coldstart-8k`    - Multi-turn trajectory warm-up for kernel ge"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:hkust-nlp/drkernel-14b",
          "value": "hkust-nlp/drkernel-rl-data",
          "confidence": 0.6400000000000001,
          "raw_context": "generation/refinement 2. Multi-turn RL    - Train dataset: `hkust-nlp/drkernel-rl-data`    - Validation dataset: `hkust-nlp/drkernel-val"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:hkust-nlp/drkernel-14b",
          "value": "hkust-nlp/drkernel-validation-data",
          "confidence": 0.6400000000000001,
          "raw_context": "set: `hkust-nlp/drkernel-rl-data`    - Validation dataset: `hkust-nlp/drkernel-validation-data` (KernelBench Level 2 validation split)    - Core"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:hkust-nlp/drkernel-14b",
          "value": "ByteDance-Seed/cudaLLM-data",
          "confidence": 0.6400000000000001,
          "raw_context": "nd Attribution  - Query/task source includes:   - [ByteDance-Seed/cudaLLM-data](https://huggingface.co/datasets/ByteDance-Seed/cudaLLM-data) - SFT cold-start traj"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:hkust-nlp/drkernel-14b",
          "value": "voc",
          "confidence": 0.5599999999999999,
          "raw_context": "e_heads`: 8 - `max_position_embeddings`: 32768 - `vocab_size`: 151936 - `transformers_version`: 4.56.0"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:hkust-nlp/drkernel-14b",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "ernel-14b) [![Paper](https://img.shields.io/badge/arXiv-2602.05885-b31b1b)](https://arxiv.org/abs/2602.05"
        }
      ],
      "declared_datasets": [
        "hkust-nlp/drkernel-coldstart-8k",
        "hkust-nlp/drkernel-validation-data",
        "hkust-nlp/drkernel-rl-data"
      ],
      "inferred_datasets": [
        "hkust-nlp/drkernel-coldstart-8k",
        "hkust-nlp/drkernel-rl-data",
        "arxiv",
        "ByteDance-Seed/cudaLLM-data",
        "hkust-nlp/drkernel-validation-data",
        "voc"
      ],
      "base_model": "hkust-nlp/drkernel-14b",
      "base_model_chain": [
        "hkust-nlp/drkernel-14b",
        "Qwen/Qwen3-14B-Base"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.6000000000000001,
      "provenance_hash": "1f3fb9a7343dd2557f65f928a226e9dd9f047da5c825d1ca2489a145b9e24caa"
    },
    {
      "model_id": "mradermacher/drkernel-8b-GGUF",
      "scanned_at": "2026-09-15T02:25:34.006743Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "hkust-nlp/drkernel-coldstart-8k",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:hkust-nlp/drkernel-coldstart-8k"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "hkust-nlp/drkernel-rl-data",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:hkust-nlp/drkernel-rl-data"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "hkust-nlp/drkernel-validation-data",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:hkust-nlp/drkernel-validation-data"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "hkust-nlp/drkernel-8b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:hkust-nlp/drkernel-8b"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:hkust-nlp/drkernel-8b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:hkust-nlp/drkernel-8b"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "hkust-nlp/drkernel-8b",
          "confidence": 0.85,
          "raw_context": "--- base_model: hkust-nlp/drkernel-8b datasets: - hkust-nlp/drkernel-coldstart-8k - hku"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:hkust-nlp/drkernel-8b",
          "value": "hkust-nlp/drkernel-coldstart-8k",
          "confidence": 0.6400000000000001,
          "raw_context": "stage DR.Kernel pipeline:  1. Cold-start SFT    - Dataset: `hkust-nlp/drkernel-coldstart-8k`    - Multi-turn trajectory warm-up for kernel ge"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:hkust-nlp/drkernel-8b",
          "value": "hkust-nlp/drkernel-rl-data",
          "confidence": 0.6400000000000001,
          "raw_context": "generation/refinement 2. Multi-turn RL    - Train dataset: `hkust-nlp/drkernel-rl-data`    - Validation dataset: `hkust-nlp/drkernel-val"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:hkust-nlp/drkernel-8b",
          "value": "hkust-nlp/drkernel-validation-data",
          "confidence": 0.6400000000000001,
          "raw_context": "set: `hkust-nlp/drkernel-rl-data`    - Validation dataset: `hkust-nlp/drkernel-validation-data` (KernelBench Level 2 validation split)    - Core"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:hkust-nlp/drkernel-8b",
          "value": "ByteDance-Seed/cudaLLM-data",
          "confidence": 0.6400000000000001,
          "raw_context": "nd Attribution  - Query/task source includes:   - [ByteDance-Seed/cudaLLM-data](https://huggingface.co/datasets/ByteDance-Seed/cudaLLM-data) - SFT cold-start traj"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:hkust-nlp/drkernel-8b",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "kernel-8b) [![Paper](https://img.shields.io/badge/arXiv-2602.05885-b31b1b)](https://arxiv.org/abs/2602.05"
        }
      ],
      "declared_datasets": [
        "hkust-nlp/drkernel-coldstart-8k",
        "hkust-nlp/drkernel-validation-data",
        "hkust-nlp/drkernel-rl-data"
      ],
      "inferred_datasets": [
        "hkust-nlp/drkernel-coldstart-8k",
        "hkust-nlp/drkernel-rl-data",
        "arxiv",
        "ByteDance-Seed/cudaLLM-data",
        "hkust-nlp/drkernel-validation-data",
        "voc"
      ],
      "base_model": "hkust-nlp/drkernel-8b",
      "base_model_chain": [
        "hkust-nlp/drkernel-8b",
        "Qwen/Qwen3-8B-Base"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.6000000000000001,
      "provenance_hash": "d5b6d2e843f9b2475a61493e507b3f294c54f75f0df46d96e0d90d694561de9e"
    },
    {
      "model_id": "mradermacher/drkernel-8b-i1-GGUF",
      "scanned_at": "2026-09-15T02:25:38.592777Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "hkust-nlp/drkernel-coldstart-8k",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:hkust-nlp/drkernel-coldstart-8k"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "hkust-nlp/drkernel-rl-data",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:hkust-nlp/drkernel-rl-data"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "hkust-nlp/drkernel-validation-data",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:hkust-nlp/drkernel-validation-data"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "hkust-nlp/drkernel-8b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:hkust-nlp/drkernel-8b"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:hkust-nlp/drkernel-8b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:hkust-nlp/drkernel-8b"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "hkust-nlp/drkernel-8b",
          "confidence": 0.85,
          "raw_context": "--- base_model: hkust-nlp/drkernel-8b datasets: - hkust-nlp/drkernel-coldstart-8k - hku"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:hkust-nlp/drkernel-8b",
          "value": "hkust-nlp/drkernel-coldstart-8k",
          "confidence": 0.6400000000000001,
          "raw_context": "stage DR.Kernel pipeline:  1. Cold-start SFT    - Dataset: `hkust-nlp/drkernel-coldstart-8k`    - Multi-turn trajectory warm-up for kernel ge"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:hkust-nlp/drkernel-8b",
          "value": "hkust-nlp/drkernel-rl-data",
          "confidence": 0.6400000000000001,
          "raw_context": "generation/refinement 2. Multi-turn RL    - Train dataset: `hkust-nlp/drkernel-rl-data`    - Validation dataset: `hkust-nlp/drkernel-val"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:hkust-nlp/drkernel-8b",
          "value": "hkust-nlp/drkernel-validation-data",
          "confidence": 0.6400000000000001,
          "raw_context": "set: `hkust-nlp/drkernel-rl-data`    - Validation dataset: `hkust-nlp/drkernel-validation-data` (KernelBench Level 2 validation split)    - Core"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:hkust-nlp/drkernel-8b",
          "value": "ByteDance-Seed/cudaLLM-data",
          "confidence": 0.6400000000000001,
          "raw_context": "nd Attribution  - Query/task source includes:   - [ByteDance-Seed/cudaLLM-data](https://huggingface.co/datasets/ByteDance-Seed/cudaLLM-data) - SFT cold-start traj"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:hkust-nlp/drkernel-8b",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "kernel-8b) [![Paper](https://img.shields.io/badge/arXiv-2602.05885-b31b1b)](https://arxiv.org/abs/2602.05"
        }
      ],
      "declared_datasets": [
        "hkust-nlp/drkernel-coldstart-8k",
        "hkust-nlp/drkernel-validation-data",
        "hkust-nlp/drkernel-rl-data"
      ],
      "inferred_datasets": [
        "hkust-nlp/drkernel-coldstart-8k",
        "hkust-nlp/drkernel-rl-data",
        "arxiv",
        "ByteDance-Seed/cudaLLM-data",
        "hkust-nlp/drkernel-validation-data",
        "voc"
      ],
      "base_model": "hkust-nlp/drkernel-8b",
      "base_model_chain": [
        "hkust-nlp/drkernel-8b",
        "Qwen/Qwen3-8B-Base"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.6000000000000001,
      "provenance_hash": "a4b9ac17dbd8181e2ebd66e0662f3cdc6693784499e51225b14061e7048f843b"
    },
    {
      "model_id": "mradermacher/eubiota-planner-8b-GGUF",
      "scanned_at": "2026-09-15T02:25:41.361988Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "Eubiota/microbio-bench",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:Eubiota/microbio-bench"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "qiaojin/PubMedQA",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:qiaojin/PubMedQA"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "GBaker/MedQA-USMLE-4-options",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:GBaker/MedQA-USMLE-4-options"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "zwhe99/DeepMath-103K",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:zwhe99/DeepMath-103K"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "RUC-NLPIR/FlashRAG_datasets",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:RUC-NLPIR/FlashRAG_datasets"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Eubiota/eubiota-planner-8b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Eubiota/eubiota-planner-8b"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Eubiota/eubiota-planner-8b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Eubiota/eubiota-planner-8b"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Eubiota/eubiota-planner-8b",
          "confidence": 0.85,
          "raw_context": "--- base_model: Eubiota/eubiota-planner-8b datasets: - Eubiota/microbio-bench - qiaojin/PubM"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "pubmed",
          "confidence": 0.7,
          "raw_context": "r-8b datasets: - Eubiota/microbio-bench - qiaojin/PubMedQA - GBaker/MedQA-USMLE-4-options - zwhe99/DeepMat"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:Eubiota/eubiota-planner-8b",
          "value": "Eubiota/microbio-bench",
          "confidence": 0.6400000000000001,
          "raw_context": "Microbio-Bench** | Curated microbiome reasoning | [Eubiota/microbio-bench](https://huggingface.co/datasets/Eubiota/microbio-bench) | | **PubMedQA** | Medical"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:Eubiota/eubiota-planner-8b",
          "value": "qiaojin/PubMedQA",
          "confidence": 0.6400000000000001,
          "raw_context": "h) | | **PubMedQA** | Medical-biology reasoning | [qiaojin/PubMedQA](https://huggingface.co/datasets/qiaojin/PubMedQA) | | **MedQA-USMLE** | Medical-bi"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:Eubiota/eubiota-planner-8b",
          "value": "GBaker/MedQA-USMLE-4-options",
          "confidence": 0.6400000000000001,
          "raw_context": "| | **MedQA-USMLE** | Medical-biology reasoning | [GBaker/MedQA-USMLE-4-options](https://huggingface.co/datasets/GBaker/MedQA-USMLE-4-options) | | **DeepMath-103K*"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:Eubiota/eubiota-planner-8b",
          "value": "zwhe99/DeepMath-103K",
          "confidence": 0.6400000000000001,
          "raw_context": "| | **DeepMath-103K** | Mathematical reasoning | [zwhe99/DeepMath-103K](https://huggingface.co/datasets/zwhe99/DeepMath-103K) | | **Natural Questions** |"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:Eubiota/eubiota-planner-8b",
          "value": "RUC-NLPIR/FlashRAG_datasets",
          "confidence": 0.6400000000000001,
          "raw_context": "03K) | | **Natural Questions** | Agentic search | [RUC-NLPIR/FlashRAG_datasets](https://huggingface.co/datasets/RUC-NLPIR/FlashRAG_datasets) |  ### Training Metho"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:Eubiota/eubiota-planner-8b",
          "value": "Wikipedia",
          "confidence": 0.48,
          "raw_context": "*Web Search** | Google Search, Perplexity Search, Wikipedia Search, URL Page Retrieval | Grounded web search"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Eubiota/eubiota-planner-8b",
          "value": "wikipedia",
          "confidence": 0.5599999999999999,
          "raw_context": "*Web Search** | Google Search, Perplexity Search, Wikipedia Search, URL Page Retrieval | Grounded web search"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Eubiota/eubiota-planner-8b",
          "value": "pubmed",
          "confidence": 0.5599999999999999,
          "raw_context": "GRPO datasets: - Eubiota/microbio-bench - qiaojin/PubMedQA - GBaker/MedQA-USMLE-4-options - zwhe99/DeepMat"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Eubiota/eubiota-planner-8b",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "dge/bioRxiv-Paper-B31B1B?style=for-the-badge&logo=arxiv&logoColor=white\" alt=\"Paper\"></a>   <a href=\"http"
        }
      ],
      "declared_datasets": [
        "GBaker/MedQA-USMLE-4-options",
        "zwhe99/DeepMath-103K",
        "qiaojin/PubMedQA",
        "Eubiota/microbio-bench",
        "RUC-NLPIR/FlashRAG_datasets"
      ],
      "inferred_datasets": [
        "pubmed",
        "wikipedia",
        "GBaker/MedQA-USMLE-4-options",
        "zwhe99/DeepMath-103K",
        "arxiv",
        "qiaojin/PubMedQA",
        "Eubiota/microbio-bench",
        "Wikipedia",
        "RUC-NLPIR/FlashRAG_datasets",
        "voc"
      ],
      "base_model": "Eubiota/eubiota-planner-8b",
      "base_model_chain": [
        "Eubiota/eubiota-planner-8b",
        "Qwen/Qwen3-8B",
        "Qwen/Qwen3-8B-Base"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.7,
      "provenance_hash": "ac68c30f8b5f1e59c6e5915aa18ade1f1387c335e2df5516a20715866a400245"
    },
    {
      "model_id": "mradermacher/eubiota-planner-8b-i1-GGUF",
      "scanned_at": "2026-09-15T02:25:46.036693Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "Eubiota/microbio-bench",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:Eubiota/microbio-bench"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "qiaojin/PubMedQA",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:qiaojin/PubMedQA"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "GBaker/MedQA-USMLE-4-options",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:GBaker/MedQA-USMLE-4-options"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "zwhe99/DeepMath-103K",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:zwhe99/DeepMath-103K"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "RUC-NLPIR/FlashRAG_datasets",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:RUC-NLPIR/FlashRAG_datasets"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Eubiota/eubiota-planner-8b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Eubiota/eubiota-planner-8b"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Eubiota/eubiota-planner-8b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Eubiota/eubiota-planner-8b"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Eubiota/eubiota-planner-8b",
          "confidence": 0.85,
          "raw_context": "--- base_model: Eubiota/eubiota-planner-8b datasets: - Eubiota/microbio-bench - qiaojin/PubM"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "pubmed",
          "confidence": 0.7,
          "raw_context": "r-8b datasets: - Eubiota/microbio-bench - qiaojin/PubMedQA - GBaker/MedQA-USMLE-4-options - zwhe99/DeepMat"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:Eubiota/eubiota-planner-8b",
          "value": "Eubiota/microbio-bench",
          "confidence": 0.6400000000000001,
          "raw_context": "Microbio-Bench** | Curated microbiome reasoning | [Eubiota/microbio-bench](https://huggingface.co/datasets/Eubiota/microbio-bench) | | **PubMedQA** | Medical"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:Eubiota/eubiota-planner-8b",
          "value": "qiaojin/PubMedQA",
          "confidence": 0.6400000000000001,
          "raw_context": "h) | | **PubMedQA** | Medical-biology reasoning | [qiaojin/PubMedQA](https://huggingface.co/datasets/qiaojin/PubMedQA) | | **MedQA-USMLE** | Medical-bi"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:Eubiota/eubiota-planner-8b",
          "value": "GBaker/MedQA-USMLE-4-options",
          "confidence": 0.6400000000000001,
          "raw_context": "| | **MedQA-USMLE** | Medical-biology reasoning | [GBaker/MedQA-USMLE-4-options](https://huggingface.co/datasets/GBaker/MedQA-USMLE-4-options) | | **DeepMath-103K*"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:Eubiota/eubiota-planner-8b",
          "value": "zwhe99/DeepMath-103K",
          "confidence": 0.6400000000000001,
          "raw_context": "| | **DeepMath-103K** | Mathematical reasoning | [zwhe99/DeepMath-103K](https://huggingface.co/datasets/zwhe99/DeepMath-103K) | | **Natural Questions** |"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:Eubiota/eubiota-planner-8b",
          "value": "RUC-NLPIR/FlashRAG_datasets",
          "confidence": 0.6400000000000001,
          "raw_context": "03K) | | **Natural Questions** | Agentic search | [RUC-NLPIR/FlashRAG_datasets](https://huggingface.co/datasets/RUC-NLPIR/FlashRAG_datasets) |  ### Training Metho"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:Eubiota/eubiota-planner-8b",
          "value": "Wikipedia",
          "confidence": 0.48,
          "raw_context": "*Web Search** | Google Search, Perplexity Search, Wikipedia Search, URL Page Retrieval | Grounded web search"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Eubiota/eubiota-planner-8b",
          "value": "wikipedia",
          "confidence": 0.5599999999999999,
          "raw_context": "*Web Search** | Google Search, Perplexity Search, Wikipedia Search, URL Page Retrieval | Grounded web search"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Eubiota/eubiota-planner-8b",
          "value": "pubmed",
          "confidence": 0.5599999999999999,
          "raw_context": "GRPO datasets: - Eubiota/microbio-bench - qiaojin/PubMedQA - GBaker/MedQA-USMLE-4-options - zwhe99/DeepMat"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Eubiota/eubiota-planner-8b",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "dge/bioRxiv-Paper-B31B1B?style=for-the-badge&logo=arxiv&logoColor=white\" alt=\"Paper\"></a>   <a href=\"http"
        }
      ],
      "declared_datasets": [
        "GBaker/MedQA-USMLE-4-options",
        "zwhe99/DeepMath-103K",
        "qiaojin/PubMedQA",
        "Eubiota/microbio-bench",
        "RUC-NLPIR/FlashRAG_datasets"
      ],
      "inferred_datasets": [
        "pubmed",
        "wikipedia",
        "GBaker/MedQA-USMLE-4-options",
        "zwhe99/DeepMath-103K",
        "arxiv",
        "qiaojin/PubMedQA",
        "Eubiota/microbio-bench",
        "Wikipedia",
        "RUC-NLPIR/FlashRAG_datasets",
        "voc"
      ],
      "base_model": "Eubiota/eubiota-planner-8b",
      "base_model_chain": [
        "Eubiota/eubiota-planner-8b",
        "Qwen/Qwen3-8B",
        "Qwen/Qwen3-8B-Base"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.7,
      "provenance_hash": "b5df2fa4b1a56a141214f10276220c324faa937729efb0ba8a6871cab0c4f1a3"
    },
    {
      "model_id": "mradermacher/flawed-fictions-gemma-3-4b-GGUF",
      "scanned_at": "2026-09-15T02:25:48.795032Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "flawed_fictions",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:flawed_fictions"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "agurung/flawed-fictions-gemma-3-4b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:agurung/flawed-fictions-gemma-3-4b"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:agurung/flawed-fictions-gemma-3-4b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:agurung/flawed-fictions-gemma-3-4b"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "agurung/flawed-fictions-gemma-3-4b",
          "confidence": 0.85,
          "raw_context": "--- base_model: agurung/flawed-fictions-gemma-3-4b datasets: - flawed_fictions language: - en librar"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [
        "flawed_fictions"
      ],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "agurung/flawed-fictions-gemma-3-4b",
      "base_model_chain": [
        "agurung/flawed-fictions-gemma-3-4b",
        "google/gemma-3-4b-it",
        "google/gemma-3-4b-pt"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "40e2bc7085f8e7baafd5178f6230bf9e830109c375bb13179ea38c56c1cb306a"
    },
    {
      "model_id": "mradermacher/flawed-fictions-gemma-3-4b-i1-GGUF",
      "scanned_at": "2026-09-15T02:25:54.466198Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "flawed_fictions",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:flawed_fictions"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "agurung/flawed-fictions-gemma-3-4b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:agurung/flawed-fictions-gemma-3-4b"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:agurung/flawed-fictions-gemma-3-4b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:agurung/flawed-fictions-gemma-3-4b"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "agurung/flawed-fictions-gemma-3-4b",
          "confidence": 0.85,
          "raw_context": "--- base_model: agurung/flawed-fictions-gemma-3-4b datasets: - flawed_fictions language: - en librar"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [
        "flawed_fictions"
      ],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "agurung/flawed-fictions-gemma-3-4b",
      "base_model_chain": [
        "agurung/flawed-fictions-gemma-3-4b",
        "google/gemma-3-4b-it",
        "google/gemma-3-4b-pt"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "428adfeffdb94c109a0566e85cb832d5ea0bca54202c8ad93cda8fe6de2efe09"
    },
    {
      "model_id": "mradermacher/flawed-fictions-olmo-3-7b-GGUF",
      "scanned_at": "2026-09-15T02:25:57.231394Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "flawed_fictions",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:flawed_fictions"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "agurung/flawed-fictions-olmo-3-7b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:agurung/flawed-fictions-olmo-3-7b"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:agurung/flawed-fictions-olmo-3-7b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:agurung/flawed-fictions-olmo-3-7b"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "agurung/flawed-fictions-olmo-3-7b",
          "confidence": 0.85,
          "raw_context": "--- base_model: agurung/flawed-fictions-olmo-3-7b datasets: - flawed_fictions language: - en librar"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [
        "flawed_fictions"
      ],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "agurung/flawed-fictions-olmo-3-7b",
      "base_model_chain": [
        "agurung/flawed-fictions-olmo-3-7b",
        "allenai/Olmo-3-7B-Instruct",
        "allenai/Olmo-3-7B-Instruct-DPO",
        "allenai/Olmo-3-7B-Instruct-SFT",
        "allenai/Olmo-3-1025-7B"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "30de0143a81572abd35fc90d8f96773f111d2c916241756fa3b1e160ed522d73"
    },
    {
      "model_id": "mradermacher/flawed-fictions-olmo-3-7b-i1-GGUF",
      "scanned_at": "2026-09-15T02:26:04.570638Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "flawed_fictions",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:flawed_fictions"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "agurung/flawed-fictions-olmo-3-7b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:agurung/flawed-fictions-olmo-3-7b"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:agurung/flawed-fictions-olmo-3-7b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:agurung/flawed-fictions-olmo-3-7b"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "agurung/flawed-fictions-olmo-3-7b",
          "confidence": 0.85,
          "raw_context": "--- base_model: agurung/flawed-fictions-olmo-3-7b datasets: - flawed_fictions language: - en librar"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [
        "flawed_fictions"
      ],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "agurung/flawed-fictions-olmo-3-7b",
      "base_model_chain": [
        "agurung/flawed-fictions-olmo-3-7b",
        "allenai/Olmo-3-7B-Instruct",
        "allenai/Olmo-3-7B-Instruct-DPO",
        "allenai/Olmo-3-7B-Instruct-SFT",
        "allenai/Olmo-3-1025-7B"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "5fba243fc48f00c39b95fe4cb39af5510746430c2a2c36f4a36ffd4560473395"
    },
    {
      "model_id": "mradermacher/flawed-fictions-qwen3-4b-GGUF",
      "scanned_at": "2026-09-15T02:26:07.465235Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "flawed_fictions",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:flawed_fictions"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "agurung/flawed-fictions-qwen3-4b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:agurung/flawed-fictions-qwen3-4b"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:agurung/flawed-fictions-qwen3-4b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:agurung/flawed-fictions-qwen3-4b"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "agurung/flawed-fictions-qwen3-4b",
          "confidence": 0.85,
          "raw_context": "--- base_model: agurung/flawed-fictions-qwen3-4b datasets: - flawed_fictions language: - en librar"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [
        "flawed_fictions"
      ],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "agurung/flawed-fictions-qwen3-4b",
      "base_model_chain": [
        "agurung/flawed-fictions-qwen3-4b",
        "Qwen/Qwen3-4B-Instruct-2507"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "b803d8eb6402a8aa7d7e718395f901a31ce8bcb201cb97760a1150b889080d62"
    },
    {
      "model_id": "mradermacher/flawed-fictions-qwen3-4b-i1-GGUF",
      "scanned_at": "2026-09-15T02:26:12.046331Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "flawed_fictions",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:flawed_fictions"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "agurung/flawed-fictions-qwen3-4b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:agurung/flawed-fictions-qwen3-4b"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:agurung/flawed-fictions-qwen3-4b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:agurung/flawed-fictions-qwen3-4b"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "agurung/flawed-fictions-qwen3-4b",
          "confidence": 0.85,
          "raw_context": "--- base_model: agurung/flawed-fictions-qwen3-4b datasets: - flawed_fictions language: - en librar"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [
        "flawed_fictions"
      ],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "agurung/flawed-fictions-qwen3-4b",
      "base_model_chain": [
        "agurung/flawed-fictions-qwen3-4b",
        "Qwen/Qwen3-4B-Instruct-2507"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "a429f9dfa00c773f6777c9168f4cb79dcec1cf250c53a1d53dfae5966260192c"
    },
    {
      "model_id": "mradermacher/gemma-3-12b-it-GLM-Flash-4.7-Heretic-Thinking-Uncensored-GRANDE-i1-GGUF",
      "scanned_at": "2026-09-15T02:26:14.807336Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "TeichAI/glm-4.7-2000x",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:TeichAI/glm-4.7-2000x"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "DavidAU/gemma-3-12b-it-GLM-Flash-4.7-Heretic-Thinking-Uncensored-GRANDE",
          "confidence": 0.85,
          "raw_context": "--- base_model: DavidAU/gemma-3-12b-it-GLM-Flash-4.7-Heretic-Thinking-Uncensored-GRANDE datasets: - TeichAI/glm-4.7-2000x language: - en"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [
        "TeichAI/glm-4.7-2000x"
      ],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "DavidAU/gemma-3-12b-it-GLM-Flash-4.7-Heretic-Thinking-Uncensored-GRANDE",
      "base_model_chain": [
        "DavidAU/gemma-3-12b-it-GLM-Flash-4.7-Heretic-Thinking-Uncensored-GRANDE"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "6016cfbc92cbf278794ce1216c0014d5c42f41f48b20b774895a6fc5d1670401"
    },
    {
      "model_id": "mradermacher/gemma-3-12b-it-vl-GLM-4.7-Flash-INSTRUCT-Thinking-Hybrid-Heretic-Uncensored-GGUF",
      "scanned_at": "2026-09-15T02:26:19.381919Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "TeichAI/glm-4.7-2000x",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:TeichAI/glm-4.7-2000x"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "DavidAU/gemma-3-12b-it-vl-GLM-4.7-Flash-INSTRUCT-Thinking-Hybrid-Heretic-Uncensored",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:DavidAU/gemma-3-12b-it-vl-GLM-4.7-Flash-INSTRUCT-Thinking-Hybrid-Heretic-Uncensored"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:DavidAU/gemma-3-12b-it-vl-GLM-4.7-Flash-INSTRUCT-Thinking-Hybrid-Heretic-Uncensored",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:DavidAU/gemma-3-12b-it-vl-GLM-4.7-Flash-INSTRUCT-Thinking-Hybrid-Heretic-Uncensored"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "DavidAU/gemma-3-12b-it-vl-GLM-4.7-Flash-INSTRUCT-Thinking-Hybrid-Heretic-Uncensored",
          "confidence": 0.85,
          "raw_context": "--- base_model: DavidAU/gemma-3-12b-it-vl-GLM-4.7-Flash-INSTRUCT-Thinking-Hybrid-Heretic-Uncensored datasets: - TeichAI/glm-4.7-2000x language: - en"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [
        "TeichAI/glm-4.7-2000x"
      ],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "DavidAU/gemma-3-12b-it-vl-GLM-4.7-Flash-INSTRUCT-Thinking-Hybrid-Heretic-Uncensored",
      "base_model_chain": [
        "DavidAU/gemma-3-12b-it-vl-GLM-4.7-Flash-INSTRUCT-Thinking-Hybrid-Heretic-Uncensored",
        "DreamFast/gemma-3-12b-it-heretic",
        "google/gemma-3-12b-it",
        "google/gemma-3-12b-pt",
        "google/gemma-3-12b"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "55418709db1cb37bdd73873056cd5b983792e19c6ecabb46ec1e903b1c729d6e"
    },
    {
      "model_id": "mradermacher/gemma-3-4b-it-heretic-creative-GGUF",
      "scanned_at": "2026-09-15T02:26:24.877734Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "DrRiceIO7/gemma-3-4b-it-heretic-creative",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:DrRiceIO7/gemma-3-4b-it-heretic-creative"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:DrRiceIO7/gemma-3-4b-it-heretic-creative",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:DrRiceIO7/gemma-3-4b-it-heretic-creative"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "DrRiceIO7/gemma-3-4b-it-heretic-creative",
          "confidence": 0.85,
          "raw_context": "--- base_model: DrRiceIO7/gemma-3-4b-it-heretic-creative extra_gated_button_content: Acknowledge license e"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:DrRiceIO7/gemma-3-4b-it-heretic-creative",
          "value": "data filtered for removal\n    of certain personal information and other sensitive",
          "confidence": 0.48,
          "raw_context": "ted-use]. -   **Privacy violations**: Models were trained on data filtered for removal     of certain personal information and other sensitive data. Developers are     encouraged to adhere to priva"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:DrRiceIO7/gemma-3-4b-it-heretic-creative",
          "value": "voc",
          "confidence": 0.5599999999999999,
          "raw_context": "o a broad range of linguistic styles, topics, and vocabulary. The     training dataset includes content"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:DrRiceIO7/gemma-3-4b-it-heretic-creative",
          "value": "coco",
          "confidence": 0.5599999999999999,
          "raw_context": "----------:|:--------------:|:--------------:| | [COCOcap][coco-cap]            |      102      |      1"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:DrRiceIO7/gemma-3-4b-it-heretic-creative",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "2.2      |      77.2      |  [hellaswag]: https://arxiv.org/abs/1905.07830 [boolq]: https://arxiv.org/abs"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "coco",
        "arxiv",
        "data filtered for removal\n    of certain personal information and other sensitive",
        "voc"
      ],
      "base_model": "DrRiceIO7/gemma-3-4b-it-heretic-creative",
      "base_model_chain": [
        "DrRiceIO7/gemma-3-4b-it-heretic-creative",
        "google/gemma-3-4b-pt"
      ],
      "training_section_present": false,
      "license": "gemma",
      "provenance_score": 0.4,
      "provenance_hash": "116a062474031ac2553d3a95ee3392dd236d5e5d4ce88c9f43ff032360d28b6d"
    },
    {
      "model_id": "mradermacher/gemma-3-4b-it-heretic-logic-GGUF",
      "scanned_at": "2026-09-15T02:26:29.505427Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "DrRiceIO7/gemma-3-4b-it-heretic-logic",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:DrRiceIO7/gemma-3-4b-it-heretic-logic"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:DrRiceIO7/gemma-3-4b-it-heretic-logic",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:DrRiceIO7/gemma-3-4b-it-heretic-logic"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "DrRiceIO7/gemma-3-4b-it-heretic-logic",
          "confidence": 0.85,
          "raw_context": "--- base_model: DrRiceIO7/gemma-3-4b-it-heretic-logic extra_gated_button_content: Acknowledge license e"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:DrRiceIO7/gemma-3-4b-it-heretic-logic",
          "value": "data filtered for removal\n    of certain personal information and other sensitive",
          "confidence": 0.48,
          "raw_context": "ted-use]. -   **Privacy violations**: Models were trained on data filtered for removal     of certain personal information and other sensitive data. Developers are     encouraged to adhere to priva"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:DrRiceIO7/gemma-3-4b-it-heretic-logic",
          "value": "voc",
          "confidence": 0.5599999999999999,
          "raw_context": "o a broad range of linguistic styles, topics, and vocabulary. The     training dataset includes content"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:DrRiceIO7/gemma-3-4b-it-heretic-logic",
          "value": "coco",
          "confidence": 0.5599999999999999,
          "raw_context": "----------:|:--------------:|:--------------:| | [COCOcap][coco-cap]            |      102      |      1"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:DrRiceIO7/gemma-3-4b-it-heretic-logic",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "2.2      |      77.2      |  [hellaswag]: https://arxiv.org/abs/1905.07830 [boolq]: https://arxiv.org/abs"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "coco",
        "arxiv",
        "data filtered for removal\n    of certain personal information and other sensitive",
        "voc"
      ],
      "base_model": "DrRiceIO7/gemma-3-4b-it-heretic-logic",
      "base_model_chain": [
        "DrRiceIO7/gemma-3-4b-it-heretic-logic",
        "google/gemma-3-4b-pt"
      ],
      "training_section_present": false,
      "license": "gemma",
      "provenance_score": 0.4,
      "provenance_hash": "6e64ae2deb8621c0e619f68e9dbdcf340d1e4103b8fcc1f14ad010e4c10642c0"
    },
    {
      "model_id": "mradermacher/gemma-3-4b-it-vl-Heretic-4-Horsemen-Uncensored-GGUF",
      "scanned_at": "2026-09-15T02:26:34.116611Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "DavidAU/gemma-3-4b-it-vl-Heretic-4-Horsemen-Uncensored",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:DavidAU/gemma-3-4b-it-vl-Heretic-4-Horsemen-Uncensored"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:DavidAU/gemma-3-4b-it-vl-Heretic-4-Horsemen-Uncensored",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:DavidAU/gemma-3-4b-it-vl-Heretic-4-Horsemen-Uncensored"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "DavidAU/gemma-3-4b-it-vl-Heretic-4-Horsemen-Uncensored",
          "confidence": 0.85,
          "raw_context": "--- base_model: DavidAU/gemma-3-4b-it-vl-Heretic-4-Horsemen-Uncensored language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "DavidAU/gemma-3-4b-it-vl-Heretic-4-Horsemen-Uncensored",
      "base_model_chain": [
        "DavidAU/gemma-3-4b-it-vl-Heretic-4-Horsemen-Uncensored",
        "DavidAU/gemma-3-4b-it-heretic-uncensored-abliterated-Extreme",
        "google/gemma-3-4b-it",
        "google/gemma-3-4b-pt"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "5d6a068388a5e0995b3a54a8e5f2e82fc80461e44047b8f3a007acb332b04f1a"
    },
    {
      "model_id": "mradermacher/gemma-3-4b-it-vl-Heretic-4-Horsemen-Uncensored-i1-GGUF",
      "scanned_at": "2026-09-15T02:26:39.659617Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "DavidAU/gemma-3-4b-it-vl-Heretic-4-Horsemen-Uncensored",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:DavidAU/gemma-3-4b-it-vl-Heretic-4-Horsemen-Uncensored"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:DavidAU/gemma-3-4b-it-vl-Heretic-4-Horsemen-Uncensored",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:DavidAU/gemma-3-4b-it-vl-Heretic-4-Horsemen-Uncensored"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "DavidAU/gemma-3-4b-it-vl-Heretic-4-Horsemen-Uncensored",
          "confidence": 0.85,
          "raw_context": "--- base_model: DavidAU/gemma-3-4b-it-vl-Heretic-4-Horsemen-Uncensored language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "DavidAU/gemma-3-4b-it-vl-Heretic-4-Horsemen-Uncensored",
      "base_model_chain": [
        "DavidAU/gemma-3-4b-it-vl-Heretic-4-Horsemen-Uncensored",
        "DavidAU/gemma-3-4b-it-heretic-uncensored-abliterated-Extreme",
        "google/gemma-3-4b-it",
        "google/gemma-3-4b-pt"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "13e4f9113f84126094efd5b42fa898c6c2f75bf94889fd416e45a4cb25e168a5"
    },
    {
      "model_id": "mradermacher/gemma-3-4b-it-vl-Heretic-SuperBrain7x-Uncensored-GGUF",
      "scanned_at": "2026-09-15T02:26:42.476632Z",
      "signals": [
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "DavidAU/gemma-3-4b-it-vl-Heretic-SuperBrain7x-Uncensored",
          "confidence": 0.85,
          "raw_context": "--- base_model: DavidAU/gemma-3-4b-it-vl-Heretic-SuperBrain7x-Uncensored language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "DavidAU/gemma-3-4b-it-vl-Heretic-SuperBrain7x-Uncensored",
      "base_model_chain": [
        "DavidAU/gemma-3-4b-it-vl-Heretic-SuperBrain7x-Uncensored"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "789f587259aa621416a881cdaedfd55f3c52d21fa3e80037f5301a1fac88e3d4"
    },
    {
      "model_id": "mradermacher/gemma-3-4b-it-vl-Heretic-SuperBrain7x-Uncensored-i1-GGUF",
      "scanned_at": "2026-09-15T02:26:47.172999Z",
      "signals": [
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "DavidAU/gemma-3-4b-it-vl-Heretic-SuperBrain7x-Uncensored",
          "confidence": 0.85,
          "raw_context": "--- base_model: DavidAU/gemma-3-4b-it-vl-Heretic-SuperBrain7x-Uncensored language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "DavidAU/gemma-3-4b-it-vl-Heretic-SuperBrain7x-Uncensored",
      "base_model_chain": [
        "DavidAU/gemma-3-4b-it-vl-Heretic-SuperBrain7x-Uncensored"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "d8e08ee78397968b748ee2709c2fdb5a3b65d641e756cd09dbc61b075705597c"
    },
    {
      "model_id": "mradermacher/hudex-8B-GGUF",
      "scanned_at": "2026-09-15T02:26:49.947217Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "SeoSaMo/hudex-8B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:SeoSaMo/hudex-8B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:SeoSaMo/hudex-8B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:SeoSaMo/hudex-8B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "SeoSaMo/hudex-8B",
          "confidence": 0.85,
          "raw_context": "--- base_model: SeoSaMo/hudex-8B language: - en library_name: transformers mraderm"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:SeoSaMo/hudex-8B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "ute) presented in [Lacoste et al. (2019)](https://arxiv.org/abs/1910.09700).  - **Hardware Type:** [More"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": "SeoSaMo/hudex-8B",
      "base_model_chain": [
        "SeoSaMo/hudex-8B"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.2,
      "provenance_hash": "4d79b341cf1c79ee23fcc3c77ce90ab693b6ddb17b2cb7f5af17dbfbc41b6d48"
    },
    {
      "model_id": "mradermacher/inf-query-aligner-GGUF",
      "scanned_at": "2026-09-15T02:26:54.580532Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "infly/inf-query-aligner",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:infly/inf-query-aligner"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:infly/inf-query-aligner",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:infly/inf-query-aligner"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "infly/inf-query-aligner",
          "confidence": 0.85,
          "raw_context": "--- base_model: infly/inf-query-aligner language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "infly/inf-query-aligner",
      "base_model_chain": [
        "infly/inf-query-aligner",
        "Qwen/Qwen2.5-7B-Instruct",
        "Qwen/Qwen2.5-7B"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "3678f88609bbd593e97b8306d5baad6d4e027c532ef7c8ec74ce11059db5ac9f"
    },
    {
      "model_id": "mradermacher/inf-retriever-v1-pro-GGUF",
      "scanned_at": "2026-09-15T02:26:59.211578Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "infly/inf-retriever-v1-pro",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:infly/inf-retriever-v1-pro"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:infly/inf-retriever-v1-pro",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:infly/inf-retriever-v1-pro"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "infly/inf-retriever-v1-pro",
          "confidence": 0.85,
          "raw_context": "--- base_model: infly/inf-retriever-v1-pro language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "infly/inf-retriever-v1-pro",
      "base_model_chain": [
        "infly/inf-retriever-v1-pro",
        "Qwen/Qwen2.5-7B-Instruct",
        "Qwen/Qwen2.5-7B"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "d2f36dc2b9dc700497c1912e6158c67ceed4975616f608cfbbcabc9bc3bcb29a"
    },
    {
      "model_id": "mradermacher/kani-tts-370m-GGUF",
      "scanned_at": "2026-09-15T02:27:03.934601Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "nineninesix/kani-tts-370m",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:nineninesix/kani-tts-370m"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:nineninesix/kani-tts-370m",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:nineninesix/kani-tts-370m"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "nineninesix/kani-tts-370m",
          "confidence": 0.85,
          "raw_context": "--- base_model: nineninesix/kani-tts-370m language: - en - de - ar - zh - es - ko library_n"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:nineninesix/kani-tts-370m",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": ",       eprint={2505.20506},       archivePrefix={arXiv},       primaryClass={cs.CL},       url={https://"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": "nineninesix/kani-tts-370m",
      "base_model_chain": [
        "nineninesix/kani-tts-370m",
        "nineninesix/kani-tts-450m-0.2-pt"
      ],
      "training_section_present": false,
      "license": "other",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "8fedbb015851c9ad7bbb19816cc988ec88d0107280880c188820b4e774736b14"
    },
    {
      "model_id": "mradermacher/littlemonster-12B-QVO-heretic-HF-i1-GGUF",
      "scanned_at": "2026-09-15T02:27:09.489638Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "mfielding92/littlemonster-12B-QVO-heretic-HF",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:mfielding92/littlemonster-12B-QVO-heretic-HF"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:mfielding92/littlemonster-12B-QVO-heretic-HF",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:mfielding92/littlemonster-12B-QVO-heretic-HF"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "reedmayhew/littlemonster-12B-QVO-heretic-HF",
          "confidence": 0.85,
          "raw_context": "--- base_model: reedmayhew/littlemonster-12B-QVO-heretic-HF language: - en library_name: transformers mraderm"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "mfielding92/littlemonster-12B-QVO-heretic-HF",
      "base_model_chain": [
        "mfielding92/littlemonster-12B-QVO-heretic-HF"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "d42a6ab2ca12da90174bb2bfbf455169a6a445d95c03dfdcbb0eb19e85a1de13"
    },
    {
      "model_id": "mradermacher/opensec-gdpo-4b-GGUF",
      "scanned_at": "2026-09-15T02:27:14.076144Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "Jarrodbarnes/opensec-seeds",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:Jarrodbarnes/opensec-seeds"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Jarrodbarnes/opensec-gdpo-4b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Jarrodbarnes/opensec-gdpo-4b"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Jarrodbarnes/opensec-gdpo-4b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Jarrodbarnes/opensec-gdpo-4b"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Jarrodbarnes/opensec-gdpo-4b",
          "confidence": 0.85,
          "raw_context": "--- base_model: Jarrodbarnes/opensec-gdpo-4b datasets: - Jarrodbarnes/opensec-seeds language:"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [
        "Jarrodbarnes/opensec-seeds"
      ],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "Jarrodbarnes/opensec-gdpo-4b",
      "base_model_chain": [
        "Jarrodbarnes/opensec-gdpo-4b",
        "Qwen/Qwen3-4B-Instruct-2507"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "7434779c5b8e0fa0ea88db0b17a353068be26d17538a514423e62f30150d9190"
    },
    {
      "model_id": "mradermacher/revit-coder-14b-GGUF",
      "scanned_at": "2026-09-15T02:27:18.667603Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "custom",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:custom"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "schauh11/revit-coder-14b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:schauh11/revit-coder-14b"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:schauh11/revit-coder-14b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:schauh11/revit-coder-14b"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "schauh11/revit-coder-14b",
          "confidence": 0.85,
          "raw_context": "--- base_model: schauh11/revit-coder-14b datasets: - custom language: - en library_name: t"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [
        "custom"
      ],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "schauh11/revit-coder-14b",
      "base_model_chain": [
        "schauh11/revit-coder-14b",
        "Qwen/Qwen3-14B",
        "Qwen/Qwen3-14B-Base"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "e5d515c1bb50a8008ca5c7f097577e2857011d10d45028e780887a96efdba465"
    },
    {
      "model_id": "mradermacher/self-preservation-KREL-Qwen3-4B-GGUF",
      "scanned_at": "2026-09-15T02:27:23.313889Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "matonski/self-preservation-KREL-Qwen3-4B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:matonski/self-preservation-KREL-Qwen3-4B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:matonski/self-preservation-KREL-Qwen3-4B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:matonski/self-preservation-KREL-Qwen3-4B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "matonski/self-preservation-KREL-Qwen3-4B",
          "confidence": 0.85,
          "raw_context": "--- base_model: matonski/self-preservation-KREL-Qwen3-4B language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:matonski/self-preservation-KREL-Qwen3-4B",
          "value": "English",
          "confidence": 0.48,
          "raw_context": "hat a larger model might produce. - The model was trained on English data only.  ## Citation  This model was created as par"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "English",
        "voc"
      ],
      "base_model": "matonski/self-preservation-KREL-Qwen3-4B",
      "base_model_chain": [
        "matonski/self-preservation-KREL-Qwen3-4B",
        "Qwen/Qwen3-4B",
        "Qwen/Qwen3-4B-Base"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "7bbe8db04a546d234695f6c5e2b3a3af0d5a829027e5665bb4fb63ca209137b5"
    },
    {
      "model_id": "mradermacher/spoomples-qwen3-14b-v0.2-GGUF",
      "scanned_at": "2026-09-15T02:27:27.923564Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "aimeri/spoomplesmaxx-sft-small-olivia",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:aimeri/spoomplesmaxx-sft-small-olivia"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "aimeri/spoomples-qwen3-14b-v0.2",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:aimeri/spoomples-qwen3-14b-v0.2"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:aimeri/spoomples-qwen3-14b-v0.2",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:aimeri/spoomples-qwen3-14b-v0.2"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "aimeri/spoomples-qwen3-14b-v0.2",
          "confidence": 0.85,
          "raw_context": "--- base_model: aimeri/spoomples-qwen3-14b-v0.2 datasets: - aimeri/spoomplesmaxx-sft-small-olivia"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [
        "aimeri/spoomplesmaxx-sft-small-olivia"
      ],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "aimeri/spoomples-qwen3-14b-v0.2",
      "base_model_chain": [
        "aimeri/spoomples-qwen3-14b-v0.2",
        "aimeri/spoomplesmaxx-base-qwen3-14b",
        "Qwen/Qwen3-14B-Base"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "3e9fdf2aebfea09ebe3b5a4a57dab9e1255a1f81130331c3afe0916f3040dd9d"
    },
    {
      "model_id": "mradermacher/sundae-v716-generate-direct-4b-i1-GGUF",
      "scanned_at": "2026-09-15T02:27:33.448269Z",
      "signals": [
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "czlonkowski/sundae-v716-generate-direct-4b",
          "confidence": 0.85,
          "raw_context": "--- base_model: czlonkowski/sundae-v716-generate-direct-4b language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "czlonkowski/sundae-v716-generate-direct-4b",
      "base_model_chain": [
        "czlonkowski/sundae-v716-generate-direct-4b"
      ],
      "training_section_present": false,
      "license": "cc-by-nc-4.0",
      "provenance_score": 0.25,
      "provenance_hash": "82af7174f0d9141fbc87f8469dede4d08fffa25648ba1e36e864066cd74f15a5"
    },
    {
      "model_id": "mradermacher/zen-vl-30b-instruct-GGUF",
      "scanned_at": "2026-09-15T02:27:38.109305Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "zenlm/zen-vl-30b-instruct",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:zenlm/zen-vl-30b-instruct"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:zenlm/zen-vl-30b-instruct",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:zenlm/zen-vl-30b-instruct"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "zenlm/zen-vl-30b-instruct",
          "confidence": 0.85,
          "raw_context": "--- base_model: zenlm/zen-vl-30b-instruct language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "zenlm/zen-vl-30b-instruct",
      "base_model_chain": [
        "zenlm/zen-vl-30b-instruct",
        "Qwen/Qwen3-VL-30B-A3B-Instruct"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "def9fbe41e14b162df91adda003185a301e7a3e040ce95cb6155f6b2086edfbe"
    },
    {
      "model_id": "mradermacher/zen-vl-8b-agent-GGUF",
      "scanned_at": "2026-09-15T02:27:42.699240Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "zenlm/zen-vl-8b-agent",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:zenlm/zen-vl-8b-agent"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:zenlm/zen-vl-8b-agent",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:zenlm/zen-vl-8b-agent"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "zenlm/zen-vl-8b-agent",
          "confidence": 0.85,
          "raw_context": "--- base_model: zenlm/zen-vl-8b-agent language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "zenlm/zen-vl-8b-agent",
      "base_model_chain": [
        "zenlm/zen-vl-8b-agent",
        "Qwen/Qwen3-VL-8B-Instruct"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "6c08419300238b3ecc775da46a4378e1f5d386c1a76515b548466596ce91e504"
    },
    {
      "model_id": "mradermacher/zen-vl-8b-instruct-GGUF",
      "scanned_at": "2026-09-15T02:27:47.292915Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "zenlm/zen-vl-8b-instruct",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:zenlm/zen-vl-8b-instruct"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:zenlm/zen-vl-8b-instruct",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:zenlm/zen-vl-8b-instruct"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "zenlm/zen-vl-8b-instruct",
          "confidence": 0.85,
          "raw_context": "--- base_model: zenlm/zen-vl-8b-instruct language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "zenlm/zen-vl-8b-instruct",
      "base_model_chain": [
        "zenlm/zen-vl-8b-instruct",
        "Qwen/Qwen3-VL-8B-Instruct"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "6ad5f39eb30c1192968cac76ab583e7a4f83e9c99fcef6739ff5436e87c61d69"
    },
    {
      "model_id": "mradermacher/zen3-nano-i1-GGUF",
      "scanned_at": "2026-09-15T02:27:51.920985Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "zenlm/zen3-nano",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:zenlm/zen3-nano"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:zenlm/zen3-nano",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:zenlm/zen3-nano"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "zenlm/zen3-nano",
          "confidence": 0.85,
          "raw_context": "--- base_model: zenlm/zen3-nano language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "zenlm/zen3-nano",
      "base_model_chain": [
        "zenlm/zen3-nano",
        "Qwen/Qwen3-8B",
        "Qwen/Qwen3-8B-Base"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "63d884515c6382783474e3e63f22059fcb39985d9d4642b49d511f6708c15cce"
    },
    {
      "model_id": "mradermacher/zen4-GGUF",
      "scanned_at": "2026-09-15T02:27:56.520130Z",
      "signals": [
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "zenlm/zen4",
          "confidence": 0.85,
          "raw_context": "--- base_model: zenlm/zen4 language: - en - zh - ja - ko - fr - de - es - pt"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags:  --> <!-- ### quants:"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "zenlm/zen4",
      "base_model_chain": [
        "zenlm/zen4"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "e5c19ebda20a047c3594f999070e258506a9d5ff5eca87cb33c8c5476951e833"
    },
    {
      "model_id": "mradermacher/zen4-coder-i1-GGUF",
      "scanned_at": "2026-09-15T02:28:01.100464Z",
      "signals": [
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "zenlm/zen4-coder",
          "confidence": 0.85,
          "raw_context": "--- base_model: zenlm/zen4-coder language: - en library_name: transformers license"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "zenlm/zen4-coder",
      "base_model_chain": [
        "zenlm/zen4-coder"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "5b834b773f8789acff886c3e3afa72191f90b2bf81cf1eacd2b0778370febd37"
    },
    {
      "model_id": "mradermacher/zen4-i1-GGUF",
      "scanned_at": "2026-09-15T02:28:05.680615Z",
      "signals": [
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "zenlm/zen4",
          "confidence": 0.85,
          "raw_context": "--- base_model: zenlm/zen4 language: - en - zh - ja - ko - fr - de - es - pt"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "zenlm/zen4",
      "base_model_chain": [
        "zenlm/zen4"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "9db262570d7c7af44ed114fc3cb30db3cf299f7bb3ef7a6d59e23e4d95812f84"
    },
    {
      "model_id": "mradermacher/zen4-mini-i1-GGUF",
      "scanned_at": "2026-09-15T02:28:08.433353Z",
      "signals": [
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "zenlm/zen4-mini",
          "confidence": 0.85,
          "raw_context": "--- base_model: zenlm/zen4-mini language: - en - zh - ja - ko - fr - de - es - pt"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "sed: 1 --> <!-- ### convert_type: hf --> <!-- ### vocab_type:  --> <!-- ### tags: nicoboss --> <!-- ###"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "zenlm/zen4-mini",
      "base_model_chain": [
        "zenlm/zen4-mini"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "a2b5912dcc08323ddc2040e49003e88d2355bcfa0496e44207d51f4837aad9bf"
    },
    {
      "model_id": "mratsim/MiniMax-M2.5-FP8-INT4-AWQ",
      "scanned_at": "2026-09-15T02:28:13.018857Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "HuggingFaceH4/ultrachat_200k",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:HuggingFaceH4/ultrachat_200k"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "databricks/databricks-dolly-15k",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:databricks/databricks-dolly-15k"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "neuralmagic/calibration",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:neuralmagic/calibration"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "HuggingFaceH4/no_robots",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:HuggingFaceH4/no_robots"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/HelpSteer",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/HelpSteer"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "garage-bAInd/Open-Platypus",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:garage-bAInd/Open-Platypus"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "PJMixers/grimulkan_physical-reasoning-ShareGPT",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:PJMixers/grimulkan_physical-reasoning-ShareGPT"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "PJMixers/grimulkan_theory-of-mind-ShareGPT",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:PJMixers/grimulkan_theory-of-mind-ShareGPT"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "HuggingFaceH4/Multilingual-Thinking",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:HuggingFaceH4/Multilingual-Thinking"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "ServiceNow-AI/M2Lingual",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:ServiceNow-AI/M2Lingual"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "droussis/euroblocks_sft_1sample_per_lang",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:droussis/euroblocks_sft_1sample_per_lang"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "interstellarninja/hermes_reasoning_tool_use",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:interstellarninja/hermes_reasoning_tool_use"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "deepmind/code_contests",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:deepmind/code_contests"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "dh02391735/stackoverflow-kubernetes-questions",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:dh02391735/stackoverflow-kubernetes-questions"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "diversoailab/humaneval-rust",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:diversoailab/humaneval-rust"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "ammarnasr/the-stack-rust-clean",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:ammarnasr/the-stack-rust-clean"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "CSJianYang/CodeArena",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:CSJianYang/CodeArena"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/OpenCodeInstruct",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/OpenCodeInstruct"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/Llama-Nemotron-Post-Training-Dataset",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/Llama-Nemotron-Post-Training-Dataset"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/Nemotron-Competitive-Programming-v1",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/Nemotron-Competitive-Programming-v1"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "rombodawg/code_bagel_hermes-2.5",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:rombodawg/code_bagel_hermes-2.5"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "MathArena/project_euler",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:MathArena/project_euler"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/Nemotron-Math-Proofs-v1",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/Nemotron-Math-Proofs-v1"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/OpenMathInstruct-2",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/OpenMathInstruct-2"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/OpenScienceReasoning-2",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/OpenScienceReasoning-2"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "MegaScience/MegaScience",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:MegaScience/MegaScience"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "OpenMed/Medical-Reasoning-SFT-GPT-OSS-120B",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:OpenMed/Medical-Reasoning-SFT-GPT-OSS-120B"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "ccdv/pubmed-summarization",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:ccdv/pubmed-summarization"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "gbharti/finance-alpaca",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:gbharti/finance-alpaca"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "vladlen32230/summarization-yahoo-stock-finance-article-text",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:vladlen32230/summarization-yahoo-stock-finance-article-text"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "fka/awesome-chatgpt-prompts",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:fka/awesome-chatgpt-prompts"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "theoldmandthesea/17k_business_book",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:theoldmandthesea/17k_business_book"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "ruggsea/stanford-encyclopedia-of-philosophy_instruct",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:ruggsea/stanford-encyclopedia-of-philosophy_instruct"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "mlfoundations-dev/stackexchange_philosophy",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:mlfoundations-dev/stackexchange_philosophy"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "FreedomIntelligence/SocraticChat",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:FreedomIntelligence/SocraticChat"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "Gryphe/Opus-WritingPrompts",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:Gryphe/Opus-WritingPrompts"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "anthracite-org/nopm_claude_writing_fixed",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:anthracite-org/nopm_claude_writing_fixed"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "zerofata/Roleplay-Anime-Characters",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:zerofata/Roleplay-Anime-Characters"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "zerofata/Instruct-Anime",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:zerofata/Instruct-Anime"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "zerofata/Instruct-Anime-CreativeWriting",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:zerofata/Instruct-Anime-CreativeWriting"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "sam-paech/gutenberg3-generalfiction-scifi-fantasy-romance-adventure-dpo",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:sam-paech/gutenberg3-generalfiction-scifi-fantasy-romance-adventure-dpo"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "PocketDoc/Dans-Prosemaxx-Adventure",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:PocketDoc/Dans-Prosemaxx-Adventure"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "anthracite-org/stheno-filtered-v1.1",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:anthracite-org/stheno-filtered-v1.1"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "KaraKaraWitch/TvTroper-2025",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:KaraKaraWitch/TvTroper-2025"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "AquaV/US-Army-Survival-Sharegpt",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:AquaV/US-Army-Survival-Sharegpt"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "AquaV/Interrogation-Sharegpt",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:AquaV/Interrogation-Sharegpt"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "AquaV/Multi-Environment-Operations-Sharegpt",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:AquaV/Multi-Environment-Operations-Sharegpt"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "AquaV/Resistance-Sharegpt",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:AquaV/Resistance-Sharegpt"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "PocketDoc/Dans-Kinomaxx-VanillaBackrooms",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:PocketDoc/Dans-Kinomaxx-VanillaBackrooms"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "MiniMaxAI/MiniMax-M2.5",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:MiniMaxAI/MiniMax-M2.5"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:MiniMaxAI/MiniMax-M2.5",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:MiniMaxAI/MiniMax-M2.5"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "sharegpt",
          "confidence": 0.7,
          "raw_context": "-Platypus - PJMixers/grimulkan_physical-reasoning-ShareGPT - PJMixers/grimulkan_theory-of-mind-ShareGPT - Hu"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "ultrachat",
          "confidence": 0.7,
          "raw_context": "rchitect - stem - agent datasets: - HuggingFaceH4/ultrachat_200k - databricks/databricks-dolly-15k - neuralma"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "pubmed",
          "confidence": 0.7,
          "raw_context": "OpenMed/Medical-Reasoning-SFT-GPT-OSS-120B - ccdv/pubmed-summarization - gbharti/finance-alpaca - vladlen3"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "Muru Zhang, Jesse Thomason, Robin Jia\\   https://arxiv.org/pdf/2506.12044  2. Examining Post-Training Qu"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "alpaca",
          "confidence": 0.7,
          "raw_context": "20B - ccdv/pubmed-summarization - gbharti/finance-alpaca - vladlen32230/summarization-yahoo-stock-finance-"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "minimax_m2",
          "confidence": 0.5,
          "raw_context": "model_type: minimax_m2"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:MiniMaxAI/MiniMax-M2.5",
          "value": "c4",
          "confidence": 0.5599999999999999,
          "raw_context": "29.7374C5.7791 29.7374 4 27.9583 4 25.7722V22.9878C4 22.3635 4.50609 21.8574 5.13043 21.8574C5.75478 2"
        }
      ],
      "declared_datasets": [
        "interstellarninja/hermes_reasoning_tool_use",
        "zerofata/Roleplay-Anime-Characters",
        "droussis/euroblocks_sft_1sample_per_lang",
        "diversoailab/humaneval-rust",
        "zerofata/Instruct-Anime-CreativeWriting",
        "anthracite-org/stheno-filtered-v1.1",
        "HuggingFaceH4/no_robots",
        "vladlen32230/summarization-yahoo-stock-finance-article-text",
        "zerofata/Instruct-Anime",
        "Gryphe/Opus-WritingPrompts",
        "databricks/databricks-dolly-15k",
        "nvidia/Nemotron-Math-Proofs-v1",
        "ccdv/pubmed-summarization",
        "dh02391735/stackoverflow-kubernetes-questions",
        "PJMixers/grimulkan_physical-reasoning-ShareGPT",
        "PocketDoc/Dans-Prosemaxx-Adventure",
        "sam-paech/gutenberg3-generalfiction-scifi-fantasy-romance-adventure-dpo",
        "PocketDoc/Dans-Kinomaxx-VanillaBackrooms",
        "AquaV/Multi-Environment-Operations-Sharegpt",
        "deepmind/code_contests",
        "OpenMed/Medical-Reasoning-SFT-GPT-OSS-120B",
        "anthracite-org/nopm_claude_writing_fixed",
        "neuralmagic/calibration",
        "AquaV/Resistance-Sharegpt",
        "rombodawg/code_bagel_hermes-2.5",
        "ammarnasr/the-stack-rust-clean",
        "CSJianYang/CodeArena",
        "mlfoundations-dev/stackexchange_philosophy",
        "AquaV/Interrogation-Sharegpt",
        "AquaV/US-Army-Survival-Sharegpt",
        "gbharti/finance-alpaca",
        "HuggingFaceH4/Multilingual-Thinking",
        "ServiceNow-AI/M2Lingual",
        "PJMixers/grimulkan_theory-of-mind-ShareGPT",
        "KaraKaraWitch/TvTroper-2025",
        "nvidia/Nemotron-Competitive-Programming-v1",
        "fka/awesome-chatgpt-prompts",
        "ruggsea/stanford-encyclopedia-of-philosophy_instruct",
        "nvidia/Llama-Nemotron-Post-Training-Dataset",
        "nvidia/OpenCodeInstruct",
        "nvidia/OpenScienceReasoning-2",
        "MegaScience/MegaScience",
        "HuggingFaceH4/ultrachat_200k",
        "nvidia/HelpSteer",
        "FreedomIntelligence/SocraticChat",
        "MathArena/project_euler",
        "nvidia/OpenMathInstruct-2",
        "garage-bAInd/Open-Platypus",
        "theoldmandthesea/17k_business_book"
      ],
      "inferred_datasets": [
        "pubmed",
        "c4",
        "arxiv",
        "sharegpt",
        "alpaca",
        "ultrachat"
      ],
      "base_model": "MiniMaxAI/MiniMax-M2.5",
      "base_model_chain": [
        "MiniMaxAI/MiniMax-M2.5"
      ],
      "training_section_present": false,
      "license": "other",
      "provenance_score": 0.7,
      "provenance_hash": "42f46abffaf6294aab9beb74d24b67921db41ecc89ae0f2aa7497080cbb5930e"
    },
    {
      "model_id": "mrrtmob/kiri-ocr",
      "scanned_at": "2026-09-15T02:28:15.812351Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "mrrtmob/km_en_image_line",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:mrrtmob/km_en_image_line"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "mrrtmob/khmer_english_ocr_image_line",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:mrrtmob/khmer_english_ocr_image_line"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "mrrtmob/khmer_english_ocr_image_line",
          "confidence": 0.8,
          "raw_context": "xt ```  ## 📊 Dataset  The model is trained on the [mrrtmob/khmer_english_ocr_image_line](https://huggingface.co/datasets/mrrtmob/khmer_english_ocr_image_line) dataset, con"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "── config.json          # Model configuration ├── vocab.json           # Character vocabulary ├── model"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "kiri-ocr",
          "confidence": 0.5,
          "raw_context": "model_type: kiri-ocr"
        }
      ],
      "declared_datasets": [
        "mrrtmob/khmer_english_ocr_image_line",
        "mrrtmob/km_en_image_line"
      ],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "8adee7ef5b9b022cfb3460308f55b5770e53484762c53fe85498d73549623788"
    },
    {
      "model_id": "mrzaizai2k/model_routing_voice",
      "scanned_at": "2026-09-15T02:28:18.566813Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "sentence-transformers/paraphrase-multilingual-MiniLM-L12-v2",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:sentence-transformers/paraphrase-multilingual-MiniLM-L12-v2"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:sentence-transformers/paraphrase-multilingual-MiniLM-L12-v2",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:sentence-transformers/paraphrase-multilingual-MiniLM-L12-v2"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Unknown",
          "confidence": 0.6,
          "raw_context": "Classes:** 5 classes <!-- - **Training Dataset:** [Unknown](https://huggingface.co/datasets/unknown) --> <!-- - **Language:** Unknown --> <!--"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "sentence-transformers/paraphrase-multilingual-MiniLM-L12-v2",
          "confidence": 0.85,
          "raw_context": "--- base_model: sentence-transformers/paraphrase-multilingual-MiniLM-L12-v2 library_name: setfit metrics: - accuracy pipeline"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "icient Few-Shot Learning Without Prompts](https://arxiv.org/abs/2209.11055) - **Blogpost:** [SetFit: Effi"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "checkpoints/step_137",
          "confidence": 0.9,
          "raw_context": "_name_or_path: checkpoints/step_137"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "bert",
          "confidence": 0.5,
          "raw_context": "model_type: bert"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:sentence-transformers/paraphrase-multilingual-MiniLM-L12-v2",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "e Embeddings using Siamese BERT-Networks](https://arxiv.org/abs/1908.10084): ```bibtex  @inproceedings{re"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": "sentence-transformers/paraphrase-multilingual-MiniLM-L12-v2",
      "base_model_chain": [
        "sentence-transformers/paraphrase-multilingual-MiniLM-L12-v2"
      ],
      "training_section_present": true,
      "license": null,
      "provenance_score": 0.45,
      "provenance_hash": "375320a2baac4ab9ac9077ce059f2f66f83e0c3fbb986107ccfee8d4d6da8f50"
    },
    {
      "model_id": "ms13d/loraas",
      "scanned_at": "2026-09-15T02:28:23.157682Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "a135f41b2dc484a2c97c3b57b13e0a334e09017a299f570f2423f1a5ce3ad42b"
    },
    {
      "model_id": "mshamrai/yolov8x-visdrone",
      "scanned_at": "2026-09-15T02:28:25.914700Z",
      "signals": [
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "v8",
          "confidence": 0.5,
          "raw_context": "model_type: v8"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "openrail",
      "provenance_score": 0.1,
      "provenance_hash": "4e52a0181accbf4d8d3dd120067f4fd4bc39ca589c6e5ddeb345d9495b688108"
    },
    {
      "model_id": "mssfj/Qwen2.5-7B-Instruct_grpo_alfworld_trajectory_dataset-2",
      "scanned_at": "2026-09-15T02:28:28.673632Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "47a5bf408761941b664de5b1a62742661b97cb4a3d77d37c1bbe5c45ab4fc284"
    },
    {
      "model_id": "mt628754/test056_s1",
      "scanned_at": "2026-09-15T02:28:31.401386Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "48fa5c4c473adb95b151413c19cf56068be711784c8e866b14fe901f6a113a95"
    },
    {
      "model_id": "mtg-upf/discogs-maest-30s-pw-129e-519l",
      "scanned_at": "2026-09-15T02:28:34.162309Z",
      "signals": [
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "ute) presented in [Lacoste et al. (2019)](https://arxiv.org/abs/1910.09700).  - **Hardware Type:** [More"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "audio-spectrogram-transformer",
          "confidence": 0.5,
          "raw_context": "model_type: audio-spectrogram-transformer"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": null,
      "provenance_score": 0.35,
      "provenance_hash": "b532f178fc547c91dae7520bda1aceec9206fc4fae17989e3db771b5dc3b5108"
    },
    {
      "model_id": "mtheo/camembert-base-xnli",
      "scanned_at": "2026-09-15T02:28:36.927636Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "xnli",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:xnli"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "french part of XNLI",
          "confidence": 0.6,
          "raw_context": "-xnli  ## Model description  Camembert-base model fine-tuned on french part of XNLI dataset. One of the few Zero-Shot classification model wo"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "./camembert-base-xnli",
          "confidence": 0.9,
          "raw_context": "_name_or_path: ./camembert-base-xnli"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "camembert",
          "confidence": 0.5,
          "raw_context": "model_type: camembert"
        }
      ],
      "declared_datasets": [
        "xnli"
      ],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "mit",
      "provenance_score": 0.5,
      "provenance_hash": "df2de46141ac0e9a415821f6c78a09795198f02c8b026706eff98f143ab557ba"
    },
    {
      "model_id": "muneeb1812/videomae-base-fake-video-classification",
      "scanned_at": "2026-09-15T02:28:39.722259Z",
      "signals": [
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "MCG-NJU/videomae-base",
          "confidence": 0.9,
          "raw_context": "_name_or_path: MCG-NJU/videomae-base"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "videomae",
          "confidence": 0.5,
          "raw_context": "model_type: videomae"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "cc-by-nc-4.0",
      "provenance_score": 0.4,
      "provenance_hash": "95a874621887be24fb4e3737f3d7ad39e896d8a7892009a0c72ff039bc10a8b1"
    },
    {
      "model_id": "myendless/insert_tray_into_base_10000",
      "scanned_at": "2026-09-15T02:28:42.475408Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "11fd1f07c5394d21834f1b506010e44c081b77b9fa8f2cf603e314b3a559b0c4"
    },
    {
      "model_id": "myshell-ai/MeloTTS-French",
      "scanned_at": "2026-09-15T02:28:45.326543Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "mit",
      "provenance_score": 0.1,
      "provenance_hash": "134d771cd4aede79295e102056402cb9ed50f069a382ac9b358f5dddadd8014e"
    },
    {
      "model_id": "myshell-ai/MeloTTS-Japanese",
      "scanned_at": "2026-09-15T02:28:48.073737Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "mit",
      "provenance_score": 0.1,
      "provenance_hash": "409e2366f439b280ec7eb69b072a7f3a0d7916f17dc70b793373b9a74b6fd6fb"
    },
    {
      "model_id": "myshell-ai/MeloTTS-Korean",
      "scanned_at": "2026-09-15T02:28:50.825472Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "mit",
      "provenance_score": 0.1,
      "provenance_hash": "49eb99bbc8a79039974686e18e70dc07cc69cfeb7e0837ea0dc4982dad9def2d"
    },
    {
      "model_id": "mystifying/illusmodels",
      "scanned_at": "2026-09-15T02:28:53.569082Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "f162b1ca8a43448fcce2b0c305f8d20b83f505e8b3e2659cebb52b146395b7b3"
    },
    {
      "model_id": "mystifying/sdxlmodels",
      "scanned_at": "2026-09-15T02:28:56.314858Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "2c197af4a66fe08177c9a6da4a2d91dcd86afb0238dfc459d2c26e0fa7ea87ca"
    },
    {
      "model_id": "mythicgames/MAI-M4-Coder-Thinking",
      "scanned_at": "2026-09-15T02:28:59.078671Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "mythicgames/MAI-M4-Coder-Thinking",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:mythicgames/MAI-M4-Coder-Thinking"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:mythicgames/MAI-M4-Coder-Thinking",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:mythicgames/MAI-M4-Coder-Thinking"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "cc-by-nd-4.0",
      "provenance_score": 0.1,
      "provenance_hash": "699e497fc2ae52423103e6977020ac459ab86737b53f884bbac447195740fb92"
    },
    {
      "model_id": "myva/Z-image",
      "scanned_at": "2026-09-15T02:29:01.849808Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "4ee268b67b6bd100166c9b710c4ea6ad62d4a4fa7bcd5693785cba76621257e2"
    },
    {
      "model_id": "nadsoft/hamsa-turbo-stable-s3-data_cleaned_resume",
      "scanned_at": "2026-09-15T02:29:04.580416Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "03f87e6addbbf997e2614197da752223e6aca35e5e78bb8449b9dbe352a4c557"
    },
    {
      "model_id": "nafiz09/docvqa",
      "scanned_at": "2026-09-15T02:29:07.317187Z",
      "signals": [
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "-free Document Understanding Transformer](https://arxiv.org/abs/2111.15664) by Geewok et al. and first re"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "vision-encoder-decoder",
          "confidence": 0.5,
          "raw_context": "model_type: vision-encoder-decoder"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "mit",
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "dd199ba5108f8f32cc4b414878ff453597116b66a34f6b1e8e3c1501f12344d1"
    },
    {
      "model_id": "nanonets/Nanonets-OCR-s",
      "scanned_at": "2026-09-15T02:29:10.076721Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Qwen/Qwen2.5-VL-3B-Instruct",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Qwen/Qwen2.5-VL-3B-Instruct"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:Qwen/Qwen2.5-VL-3B-Instruct",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:Qwen/Qwen2.5-VL-3B-Instruct"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "image/png",
          "confidence": 0.8,
          "raw_context": "\",                         \"image_url\": {\"url\": f\"data:image/png;base64,{img_base64}\"},                     },"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "qwen2_5_vl",
          "confidence": 0.5,
          "raw_context": "model_type: qwen2_5_vl"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Qwen/Qwen2.5-VL-3B-Instruct",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "xceeding 32,768 tokens, we utilize [YaRN](https://arxiv.org/abs/2309.00071), a technique for enhancing mo"
        }
      ],
      "declared_datasets": [
        "image/png"
      ],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": "Qwen/Qwen2.5-VL-3B-Instruct",
      "base_model_chain": [
        "Qwen/Qwen2.5-VL-3B-Instruct"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.25,
      "provenance_hash": "0c841db0fd10aec45bc841cb7d14df95bdf08776b739aa670513c764e84f4694"
    },
    {
      "model_id": "nao-ai-specialist/mental-care-thought-data-samples",
      "scanned_at": "2026-09-15T02:29:13.831386Z",
      "signals": [
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "n expert in AI symbiosis and a lived-experience advocate for neurodiversity.  ## License / ライセンス Apache"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "c9b1b95b0548ac711f85adb2d365ac5da5399f26b32b8bf64f75b5d671e1dcb8"
    },
    {
      "model_id": "nari-labs/Dia-1.6B-0626",
      "scanned_at": "2026-09-15T02:29:16.745028Z",
      "signals": [
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "work was heavily inspired by [SoundStorm](https://arxiv.org/abs/2305.09636), [Parakeet](https://jordandar"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "dia",
          "confidence": 0.5,
          "raw_context": "model_type: dia"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "7e0c900713a07ffcef3197d12551c1d6f8eb6c13b0774e220926894d6f16f217"
    },
    {
      "model_id": "nari-labs/Dia2-2B",
      "scanned_at": "2026-09-15T02:29:19.590834Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.1,
      "provenance_hash": "e062153fc762bd566f5904b8089a7aae87c739ce15553167b85a22c81b09f661"
    },
    {
      "model_id": "naru0411/LLM-Competition-advanced-012",
      "scanned_at": "2026-09-15T02:29:22.340388Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "alfworld_cleaned_v12_admissible_fix.jsonl",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:alfworld_cleaned_v12_admissible_fix.jsonl"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Qwen/Qwen2.5-7B-Instruct",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Qwen/Qwen2.5-7B-Instruct"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "adapter:Qwen/Qwen2.5-7B-Instruct",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:adapter:Qwen/Qwen2.5-7B-Instruct"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Qwen/Qwen2.5-7B-Instruct",
          "confidence": 0.85,
          "raw_context": "--- base_model: Qwen/Qwen2.5-7B-Instruct datasets: - alfworld_cleaned_v12_admissible_fix.j"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "qwen2",
          "confidence": 0.5,
          "raw_context": "model_type: qwen2"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Qwen/Qwen2.5-7B-Instruct",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "xceeding 32,768 tokens, we utilize [YaRN](https://arxiv.org/abs/2309.00071), a technique for enhancing mo"
        }
      ],
      "declared_datasets": [
        "alfworld_cleaned_v12_admissible_fix.jsonl"
      ],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": "Qwen/Qwen2.5-7B-Instruct",
      "base_model_chain": [
        "Qwen/Qwen2.5-7B-Instruct",
        "Qwen/Qwen2.5-7B"
      ],
      "training_section_present": true,
      "license": "apache-2.0",
      "provenance_score": 0.65,
      "provenance_hash": "328ddc73035ae75d0a99875c37bc5d8a9f4f37b2f1df6b71f355f7b5e3db7fe8"
    },
    {
      "model_id": "nateraw/videomae-base-finetuned-ucf101",
      "scanned_at": "2026-09-15T02:29:26.009457Z",
      "signals": [
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "ute) presented in [Lacoste et al. (2019)](https://arxiv.org/abs/1910.09700).  - **Hardware Type:** [More"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "MCG-NJU/videomae-base",
          "confidence": 0.9,
          "raw_context": "_name_or_path: MCG-NJU/videomae-base"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "videomae",
          "confidence": 0.5,
          "raw_context": "model_type: videomae"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "mit",
      "provenance_score": 0.45,
      "provenance_hash": "d3d9a4cb26dde69e37de8c7ae4e1ecea1e42147f6a43c90d1b8ebf3b7d8eadb3"
    },
    {
      "model_id": "nateraw/videomae-base-finetuned-ucf101-subset",
      "scanned_at": "2026-09-15T02:29:28.789293Z",
      "signals": [
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "MCG-NJU/videomae-base",
          "confidence": 0.9,
          "raw_context": "_name_or_path: MCG-NJU/videomae-base"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "videomae",
          "confidence": 0.5,
          "raw_context": "model_type: videomae"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "cc-by-nc-4.0",
      "provenance_score": 0.4,
      "provenance_hash": "8bb484d9942ca93cbbb0b93cd465ab0b2110fcbb1642bb0921ab69066e061676"
    },
    {
      "model_id": "naver-clova-ix/donut-base",
      "scanned_at": "2026-09-15T02:29:31.543895Z",
      "signals": [
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "-free Document Understanding Transformer](https://arxiv.org/abs/2111.15664) by Geewok et al. and first re"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "vision-encoder-decoder",
          "confidence": 0.5,
          "raw_context": "model_type: vision-encoder-decoder"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "mit",
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "2a5132dd99e77b1386b7518e10745825ef0435a69bff7fcf4e28e6f9e6c2a930"
    },
    {
      "model_id": "naver-clova-ix/donut-base-finetuned-cord-v2",
      "scanned_at": "2026-09-15T02:29:34.291963Z",
      "signals": [
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "-free Document Understanding Transformer](https://arxiv.org/abs/2111.15664) by Geewok et al. and first re"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "vision-encoder-decoder",
          "confidence": 0.5,
          "raw_context": "model_type: vision-encoder-decoder"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "mit",
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "a4365cd5e3d80785facbce7046fc9f98a634941267e04226f8e46fff9a0c5439"
    },
    {
      "model_id": "naver-clova-ix/donut-base-finetuned-docvqa",
      "scanned_at": "2026-09-15T02:29:37.044911Z",
      "signals": [
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "-free Document Understanding Transformer](https://arxiv.org/abs/2111.15664) by Geewok et al. and first re"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "vision-encoder-decoder",
          "confidence": 0.5,
          "raw_context": "model_type: vision-encoder-decoder"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "mit",
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "f06250956e36736eb43ea74e51e41f3a6166b508bfce8b443cdfb1e7567a86ed"
    },
    {
      "model_id": "naver-clova-ix/donut-base-finetuned-rvlcdip",
      "scanned_at": "2026-09-15T02:29:39.879386Z",
      "signals": [
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "-free Document Understanding Transformer](https://arxiv.org/abs/2111.15664) by Geewok et al. and first re"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "vision-encoder-decoder",
          "confidence": 0.5,
          "raw_context": "model_type: vision-encoder-decoder"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "mit",
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "89918236c8f2c17370fd77aa853248cfb4b8973d047d1c9cb29e6f276c4a34ad"
    },
    {
      "model_id": "naver/splade-v3",
      "scanned_at": "2026-09-15T02:29:42.631577Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "cc-by-nc-sa-4.0",
      "provenance_score": 0.1,
      "provenance_hash": "2e672b758ef94e6b89f529390b09c59597cdb051efb7e3464212c0e273d66bee"
    },
    {
      "model_id": "navteca/tapas-large-finetuned-wtq",
      "scanned_at": "2026-09-15T02:29:45.360856Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "sqa",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:sqa"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "wikisql",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:wikisql"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "wtq",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:wtq"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Wikipedia",
          "confidence": 0.6,
          "raw_context": "pretrained on a large corpus of English data from Wikipedia in a self-supervised fashion. This means it was p"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "wikipedia",
          "confidence": 0.7,
          "raw_context": "pretrained on a large corpus of English data from Wikipedia in a self-supervised fashion. This means it was p"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "upervised Table Parsing via Pre-training](https://arxiv.org/abs/2004.02349)  ## Training Data This model"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "tapas",
          "confidence": 0.5,
          "raw_context": "model_type: tapas"
        }
      ],
      "declared_datasets": [
        "sqa",
        "wikisql",
        "wtq"
      ],
      "inferred_datasets": [
        "wikipedia",
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "mit",
      "provenance_score": 0.7999999999999999,
      "provenance_hash": "7c607ff4d855f26d34c4bb2c3abc3b4bedd4ed6ea25483e8ddda8aacd691ea7b"
    },
    {
      "model_id": "nbtpj/bs1_gpt2_cnndm",
      "scanned_at": "2026-09-15T02:29:48.132115Z",
      "signals": [
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "ute) presented in [Lacoste et al. (2019)](https://arxiv.org/abs/1910.09700).  - **Hardware Type:** [More"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "gpt2",
          "confidence": 0.5,
          "raw_context": "model_type: gpt2"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": null,
      "provenance_score": 0.35,
      "provenance_hash": "293e6d45c0a71f9d4d5b9eab3129a3cc0f259735553e164f5168ca0cab77e00a"
    },
    {
      "model_id": "nbtpj/bs3v2_gpt2_cnndm",
      "scanned_at": "2026-09-15T02:29:50.902098Z",
      "signals": [
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "gpt2",
          "confidence": 0.5,
          "raw_context": "model_type: gpt2"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "42b8aabbbc41923625c52bdb513b1859c3465c5ec969fadfd94b35580d72fd3b"
    },
    {
      "model_id": "nbtpj/bs3v2_gpt2me_cnndm",
      "scanned_at": "2026-09-15T02:29:53.661573Z",
      "signals": [
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "gpt2",
          "confidence": 0.5,
          "raw_context": "model_type: gpt2"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "ec05ef1eb26c17a4a1fe26053b2a00162efa601dd2096a0a733bdf9ed0be7271"
    },
    {
      "model_id": "nbtpj/bs3v2_qwen1b5_xsum",
      "scanned_at": "2026-09-15T02:29:56.419195Z",
      "signals": [
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "qwen2",
          "confidence": 0.5,
          "raw_context": "model_type: qwen2"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "ca5b3a57b20d0f96fe82e7d78868b38780ae76bc32bf97a30e7fd507b8895874"
    },
    {
      "model_id": "nbtpj/bs5_gpt2_cnndm",
      "scanned_at": "2026-09-15T02:29:59.237217Z",
      "signals": [
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "ute) presented in [Lacoste et al. (2019)](https://arxiv.org/abs/1910.09700).  - **Hardware Type:** [More"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "gpt2",
          "confidence": 0.5,
          "raw_context": "model_type: gpt2"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": null,
      "provenance_score": 0.35,
      "provenance_hash": "987652a769bd564ef8fb907ec2873704145bdf94a59dd94e7c8ec3ba87dc1fa1"
    },
    {
      "model_id": "nbtpj/debug_gpt2",
      "scanned_at": "2026-09-15T02:30:02.111965Z",
      "signals": [
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "gpt2",
          "confidence": 0.5,
          "raw_context": "model_type: gpt2"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "0d94801a74991281be0c0069fac5e3c7282a3f403c43a3aecb2e7ccc62f652f1"
    },
    {
      "model_id": "nbtpj/summ_gpt2xl_tldr_cnndm",
      "scanned_at": "2026-09-15T02:30:04.861722Z",
      "signals": [
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "gpt2",
          "confidence": 0.5,
          "raw_context": "model_type: gpt2"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "cd4f4661b8790ddcf5559facc5e22a1ca71528925cdb473c9d275efbf133052d"
    },
    {
      "model_id": "neptunes5thmoon/equivariance",
      "scanned_at": "2026-09-15T02:30:07.627073Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "f3c5b927878bf2af24feff70816f4a17fd5f34b0417d9331f6568b3a77ba9652"
    },
    {
      "model_id": "netminator/videomae-base-finetuned-SCVD-subset",
      "scanned_at": "2026-09-15T02:30:10.469683Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "MCG-NJU/videomae-base",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:MCG-NJU/videomae-base"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:MCG-NJU/videomae-base",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:MCG-NJU/videomae-base"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "MCG-NJU/videomae-base",
          "confidence": 0.85,
          "raw_context": "library_name: transformers license: cc-by-nc-4.0 base_model: MCG-NJU/videomae-base tags: - generated_from_trainer metrics: - accurac"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "videomae",
          "confidence": 0.5,
          "raw_context": "model_type: videomae"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:MCG-NJU/videomae-base",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "s for Self-Supervised Video Pre-Training](https://arxiv.org/abs/2203.12602) by Tong et al. and first rele"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": "MCG-NJU/videomae-base",
      "base_model_chain": [
        "MCG-NJU/videomae-base"
      ],
      "training_section_present": true,
      "license": "cc-by-nc-4.0",
      "provenance_score": 0.55,
      "provenance_hash": "0c5f37690eb5501e4e688c673860f4863ef10512ef4f383ef3a0da06bfcd751d"
    },
    {
      "model_id": "neulab/codebert-python",
      "scanned_at": "2026-09-15T02:30:15.095838Z",
      "signals": [
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "@article{zhou2023codebertscore,   url = {https://arxiv.org/abs/2302.05527},   author = {Zhou, Shuyan and"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "roberta",
          "confidence": 0.5,
          "raw_context": "model_type: roberta"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.05,
      "provenance_hash": "b4cc0888411adc951f278fdbca29e1f8367f9003362e95aadffe06bfce543f72"
    },
    {
      "model_id": "neulab/omnitab-large",
      "scanned_at": "2026-09-15T02:30:17.838133Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "wikitablequestions",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:wikitablequestions"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "natural and synthetic",
          "confidence": 0.6,
          "raw_context": "zed with `microsoft/tapex-large` and continuously pretrained on natural and synthetic data.  ## Usage  ```python from transformers import Au"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "Few-shot Table-based Question Answering](https://arxiv.org/pdf/2207.03637.pdf). The original Github repo"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "neulab/omnitab-large",
          "confidence": 0.9,
          "raw_context": "_name_or_path: neulab/omnitab-large"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "bart",
          "confidence": 0.5,
          "raw_context": "model_type: bart"
        }
      ],
      "declared_datasets": [
        "wikitablequestions"
      ],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "155dfd856eac9fb35a99a8fd336f75855af996fcce9179b1951efa03f676a721"
    },
    {
      "model_id": "neulab/omnitab-large-1024shot",
      "scanned_at": "2026-09-15T02:30:20.617990Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "wikitablequestions",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:wikitablequestions"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "natural and synthetic",
          "confidence": 0.6,
          "raw_context": "zed with `microsoft/tapex-large` and continuously pretrained on natural and synthetic data (SQL2NL model trained in the 1024-shot setting)."
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "Few-shot Table-based Question Answering](https://arxiv.org/pdf/2207.03637.pdf). The original Github repo"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "neulab/omnitab-large-1024shot",
          "confidence": 0.9,
          "raw_context": "_name_or_path: neulab/omnitab-large-1024shot"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "bart",
          "confidence": 0.5,
          "raw_context": "model_type: bart"
        }
      ],
      "declared_datasets": [
        "wikitablequestions"
      ],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "d8bfce754da429f688aaf9ca78da9fb17435b27e4e29ec85821b997441283f87"
    },
    {
      "model_id": "neulab/omnitab-large-1024shot-finetuned-wtq-1024shot",
      "scanned_at": "2026-09-15T02:30:23.479696Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "wikitablequestions",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:wikitablequestions"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "WikiTableQuestions",
          "confidence": 0.6,
          "raw_context": "`neulab/omnitab-large-1024shot` and fine-tuned on [WikiTableQuestions](https://huggingface.co/datasets/wikitablequestions) in the 1024-shot setting.  ##"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "Few-shot Table-based Question Answering](https://arxiv.org/pdf/2207.03637.pdf). The original Github repo"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "neulab/omnitab-large-1024shot-finetuned-wtq-1024shot",
          "confidence": 0.9,
          "raw_context": "_name_or_path: neulab/omnitab-large-1024shot-finetuned-wtq-1024shot"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "bart",
          "confidence": 0.5,
          "raw_context": "model_type: bart"
        }
      ],
      "declared_datasets": [
        "wikitablequestions"
      ],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "150fef8d38d72ee0f585fce4a3ad621376cecf2dfa2a4e3ce867101d6fe87bf5"
    },
    {
      "model_id": "neulab/omnitab-large-128shot",
      "scanned_at": "2026-09-15T02:30:26.341332Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "wikitablequestions",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:wikitablequestions"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "natural and synthetic",
          "confidence": 0.6,
          "raw_context": "zed with `microsoft/tapex-large` and continuously pretrained on natural and synthetic data (SQL2NL model trained in the 128-shot setting)."
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "Few-shot Table-based Question Answering](https://arxiv.org/pdf/2207.03637.pdf). The original Github repo"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "neulab/omnitab-large-128shot",
          "confidence": 0.9,
          "raw_context": "_name_or_path: neulab/omnitab-large-128shot"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "bart",
          "confidence": 0.5,
          "raw_context": "model_type: bart"
        }
      ],
      "declared_datasets": [
        "wikitablequestions"
      ],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "6175e03a8d64fff5963f0a3c03f0230459e3585f57360100eaca5eb33186f92f"
    },
    {
      "model_id": "neulab/omnitab-large-128shot-finetuned-wtq-128shot",
      "scanned_at": "2026-09-15T02:30:29.124818Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "wikitablequestions",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:wikitablequestions"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "WikiTableQuestions",
          "confidence": 0.6,
          "raw_context": "`neulab/omnitab-large-128shot` and fine-tuned on [WikiTableQuestions](https://huggingface.co/datasets/wikitablequestions) in the 128-shot setting.  ## U"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "Few-shot Table-based Question Answering](https://arxiv.org/pdf/2207.03637.pdf). The original Github repo"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "neulab/omnitab-large-128shot-finetuned-wtq-128shot",
          "confidence": 0.9,
          "raw_context": "_name_or_path: neulab/omnitab-large-128shot-finetuned-wtq-128shot"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "bart",
          "confidence": 0.5,
          "raw_context": "model_type: bart"
        }
      ],
      "declared_datasets": [
        "wikitablequestions"
      ],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "8286fd6433dd1ba811aca308cd35fcc77c3ac2431f019810317e2aa83068c0eb"
    },
    {
      "model_id": "neulab/omnitab-large-16shot",
      "scanned_at": "2026-09-15T02:30:31.892341Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "wikitablequestions",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:wikitablequestions"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "natural and synthetic",
          "confidence": 0.6,
          "raw_context": "zed with `microsoft/tapex-large` and continuously pretrained on natural and synthetic data (SQL2NL model trained in the 16-shot setting).  #"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "Few-shot Table-based Question Answering](https://arxiv.org/pdf/2207.03637.pdf). The original Github repo"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "neulab/omnitab-large-16shot",
          "confidence": 0.9,
          "raw_context": "_name_or_path: neulab/omnitab-large-16shot"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "bart",
          "confidence": 0.5,
          "raw_context": "model_type: bart"
        }
      ],
      "declared_datasets": [
        "wikitablequestions"
      ],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "b38ad837840076aaa2875a5220d9af65076b6f242fafc784d21eb2de7f13f856"
    },
    {
      "model_id": "neulab/omnitab-large-16shot-finetuned-wtq-16shot",
      "scanned_at": "2026-09-15T02:30:34.670976Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "wikitablequestions",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:wikitablequestions"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "WikiTableQuestions",
          "confidence": 0.6,
          "raw_context": "h `neulab/omnitab-large-16shot` and fine-tuned on [WikiTableQuestions](https://huggingface.co/datasets/wikitablequestions) in the 16-shot setting.  ## Us"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "Few-shot Table-based Question Answering](https://arxiv.org/pdf/2207.03637.pdf). The original Github repo"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "neulab/omnitab-large-16shot-finetuned-wtq-16shot",
          "confidence": 0.9,
          "raw_context": "_name_or_path: neulab/omnitab-large-16shot-finetuned-wtq-16shot"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "bart",
          "confidence": 0.5,
          "raw_context": "model_type: bart"
        }
      ],
      "declared_datasets": [
        "wikitablequestions"
      ],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "2461e0ae2fd49ad8d5e04d9a12415454f5e2eca74c2a9b8a3962f27bdb1e3a89"
    },
    {
      "model_id": "neulab/omnitab-large-finetuned-wtq",
      "scanned_at": "2026-09-15T02:30:37.473293Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "wikitablequestions",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:wikitablequestions"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "WikiTableQuestions",
          "confidence": 0.6,
          "raw_context": "zed with `neulab/omnitab-large` and fine-tuned on [WikiTableQuestions](https://huggingface.co/datasets/wikitablequestions).  ## Usage  ```python from tra"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "Few-shot Table-based Question Answering](https://arxiv.org/pdf/2207.03637.pdf). The original Github repo"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "neulab/omnitab-large-finetuned-wtq",
          "confidence": 0.9,
          "raw_context": "_name_or_path: neulab/omnitab-large-finetuned-wtq"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "bart",
          "confidence": 0.5,
          "raw_context": "model_type: bart"
        }
      ],
      "declared_datasets": [
        "wikitablequestions"
      ],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "a56227847cbf5fbf0c1dbbd8183ecee6b1c0cef901ce3095f9adcc945060de62"
    },
    {
      "model_id": "neuphonic/neutts-air",
      "scanned_at": "2026-09-15T02:30:40.235134Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "amphion/Emilia-Dataset",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:amphion/Emilia-Dataset"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "neuphonic/emilia-yodas-english-neucodec",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:neuphonic/emilia-yodas-english-neucodec"
        }
      ],
      "declared_datasets": [
        "neuphonic/emilia-yodas-english-neucodec",
        "amphion/Emilia-Dataset"
      ],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "5eb5413e3cdac99ed0be7663bc389daea13a0933b57eb3f506f7ceeec17f1d0f"
    },
    {
      "model_id": "neuphonic/neutts-air-q4-gguf",
      "scanned_at": "2026-09-15T02:30:42.975604Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "amphion/Emilia-Dataset",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:amphion/Emilia-Dataset"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "neuphonic/emilia-yodas-english-neucodec",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:neuphonic/emilia-yodas-english-neucodec"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "neuphonic/neutts-air",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:neuphonic/neutts-air"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:neuphonic/neutts-air",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:neuphonic/neutts-air"
        }
      ],
      "declared_datasets": [
        "neuphonic/emilia-yodas-english-neucodec",
        "amphion/Emilia-Dataset"
      ],
      "inferred_datasets": [],
      "base_model": "neuphonic/neutts-air",
      "base_model_chain": [
        "neuphonic/neutts-air"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.4,
      "provenance_hash": "dd4dc85657bd43291be24c70f80d8e6d397dff5fb38ae6a78c1cb81ad38c1793"
    },
    {
      "model_id": "neuphonic/neutts-nano",
      "scanned_at": "2026-09-15T02:30:45.707002Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "other",
      "provenance_score": 0.1,
      "provenance_hash": "b48d85066bcb9fc109cffd3b34485670d57b8721c9ccb27c8760ac4321a2f208"
    },
    {
      "model_id": "nexar-ai/BADAS-Open",
      "scanned_at": "2026-09-15T02:30:48.437846Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nexar-ai/nexar_collision_prediction",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nexar-ai/nexar_collision_prediction"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "facebook/vjepa2-vitl-fpc16-256-ssv2",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:facebook/vjepa2-vitl-fpc16-256-ssv2"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:facebook/vjepa2-vitl-fpc16-256-ssv2",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:facebook/vjepa2-vitl-fpc16-256-ssv2"
        }
      ],
      "declared_datasets": [
        "nexar-ai/nexar_collision_prediction"
      ],
      "inferred_datasets": [],
      "base_model": "facebook/vjepa2-vitl-fpc16-256-ssv2",
      "base_model_chain": [
        "facebook/vjepa2-vitl-fpc16-256-ssv2",
        "facebook/vjepa2-vitl-fpc64-256"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "43f871000e197e4a5cdd6c0ee74ba9ec01720a3af91a452422b2154438fd2329"
    },
    {
      "model_id": "nguyenchauthon/2Sqi1No74BXD3il",
      "scanned_at": "2026-09-15T02:30:53.913258Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "2fd99cff051746c804aa3c0465d324bcd5c8abe18eff5c9a6827e3152b14fcbe"
    },
    {
      "model_id": "nguyenchauthon/OgGWNUsi2MVi5O1",
      "scanned_at": "2026-09-15T02:30:56.644412Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "91f006958c928d8139a16a4132d13195717ad73a9e792c2cd9556bd0cf525a4b"
    },
    {
      "model_id": "nguyenchauthon/eKs4ECtzpzaMqWH",
      "scanned_at": "2026-09-15T02:30:59.387043Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "00bac5ec7fc3f053fadad1c250ba0ffd1da917d8a2462dd6abc024166ae3739a"
    },
    {
      "model_id": "nguyenducvan323/dtEl8jAIAGZjP9w",
      "scanned_at": "2026-09-15T02:31:02.139844Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "5d854752c9306afafeca0612dda9940c695dd4253471380b03f44ebe75c92488"
    },
    {
      "model_id": "nguyenducvan323/hxRQAs6bmL4iTo9",
      "scanned_at": "2026-09-15T02:31:04.868357Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "801cc0125405f641044221b99638b8b16967564f26ee1f971521da2a0adb6c80"
    },
    {
      "model_id": "nguyenducvan323/pxv86fVUzsM5Chj",
      "scanned_at": "2026-09-15T02:31:07.609862Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "a064655ade4ef3a818ec8dbb132cf08b9d5aa20812a161b856e72a46a7e3a39f"
    },
    {
      "model_id": "nguyenlethanhtong17/BXT6WCbcqwsRKEW",
      "scanned_at": "2026-09-15T02:31:10.348715Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "b1b536f1fa4285a7bee8e2675b74ae9e4d03d1b4fa6c2778568695be6ab66c19"
    },
    {
      "model_id": "nguyhaihoa/XGv9llICgLXDKHS",
      "scanned_at": "2026-09-15T02:31:13.085293Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "40a312b7c0cab9bbb0436eac2e2925ad34dc255c24e7da990e35bde69dd358a6"
    },
    {
      "model_id": "nguyhaihoa/cCfJCACkXHDlUyi",
      "scanned_at": "2026-09-15T02:31:15.818571Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "01a62105843aae9ffa62f4b390e8bf9b07fd5865b8679c83eb0d757bea85c6e7"
    },
    {
      "model_id": "nguyhaihoa/zC4TMegXwr9zv60",
      "scanned_at": "2026-09-15T02:31:18.548096Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "7ce3dfc0b9a457f3340de18f2e732f36d61060dcccafe7dc85b1dea0d7b79fc8"
    },
    {
      "model_id": "nhambatanh/DJ0MzVGougDKHm3",
      "scanned_at": "2026-09-15T02:31:21.283983Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "e9bda076249105ba096d54559cc7d097770eb1215380cc49aafc45765e8200ec"
    },
    {
      "model_id": "nhambatanh/LfynrQyRWyG5C4x",
      "scanned_at": "2026-09-15T02:31:24.014040Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "4b78721aa21da956e56e04ce3131214fe8430ad8f325ea21c7c41910d983dfc6"
    },
    {
      "model_id": "nhambatanh/rbZgZV8FBOCo5UL",
      "scanned_at": "2026-09-15T02:31:26.748072Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "ec13dd545b66d79bad703ad757e4fb32ef4906abce051adf58a6b12eb5b13f2a"
    },
    {
      "model_id": "nick9869/ocr-models",
      "scanned_at": "2026-09-15T02:31:29.480841Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "38f8d5aab675e75133e7d33049b46c5016a1aecbf4a8e76ba361e7aafc189952"
    },
    {
      "model_id": "nicklashansen/newt",
      "scanned_at": "2026-09-15T02:31:32.214083Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "mit",
      "provenance_score": 0.1,
      "provenance_hash": "2c019a82e3979f8ffadfcef06d790ed1f250f1aebaa8353944e7d76e22939046"
    },
    {
      "model_id": "nickmuchi/yolos-small-finetuned-license-plate-detection",
      "scanned_at": "2026-09-15T02:31:34.973314Z",
      "signals": [
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "ImageNet-1k",
          "confidence": 0.6,
          "raw_context": "Training data  The YOLOS model was pre-trained on [ImageNet-1k](https://huggingface.co/datasets/imagenet2012) and fine-tuned on [COCO 2017 object"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "imagenet",
          "confidence": 0.7,
          "raw_context": "raining data  The YOLOS model was pre-trained on [ImageNet-1k](https://huggingface.co/datasets/imagenet2012)"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "coco",
          "confidence": 0.7,
          "raw_context": "n set. The original YOLOS model was fine-tuned on COCO 2017 object detection (118k annotated images).  #"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "hustvl/yolos-small",
          "confidence": 0.9,
          "raw_context": "_name_or_path: hustvl/yolos-small"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "yolos",
          "confidence": 0.5,
          "raw_context": "model_type: yolos"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "coco",
        "imagenet"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": null,
      "provenance_score": 0.4,
      "provenance_hash": "d618e7efdea745a8b3959b37feb8f03744668ecc7ce3902031305ec3e02ab89c"
    },
    {
      "model_id": "nidek/ppo-SnowballTarget",
      "scanned_at": "2026-09-15T02:31:37.713678Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "c40a24eb287fa5b05ea72328fa014465b3078dfec2a6e3ecb758faac7a809918"
    },
    {
      "model_id": "nielsr/canine-s",
      "scanned_at": "2026-09-15T02:31:40.475342Z",
      "signals": [
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "canine",
          "confidence": 0.5,
          "raw_context": "model_type: canine"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "5ab53f71ff7d9af87a4386bcb2fb528143531fe66fd7109a88507b28498f19c6"
    },
    {
      "model_id": "nielsr/tapex-large-finetuned-sqa",
      "scanned_at": "2026-09-15T02:31:43.235119Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "msr_sqa",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:msr_sqa"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "ining via Learning a Neural SQL Executor](https://arxiv.org/abs/2107.07653) by Qian Liu, Bei Chen, Jiaqi"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "bart",
          "confidence": 0.5,
          "raw_context": "model_type: bart"
        }
      ],
      "declared_datasets": [
        "msr_sqa"
      ],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "b1549901167ca371eb383ea6d4abe06ada1d37d68ee7d1ef1a811803a515bba5"
    },
    {
      "model_id": "nielsr/tapex-large-finetuned-wikisql",
      "scanned_at": "2026-09-15T02:31:45.994238Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "wikisql",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:wikisql"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "ining via Learning a Neural SQL Executor](https://arxiv.org/abs/2107.07653) by Qian Liu, Bei Chen, Jiaqi"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "bart",
          "confidence": 0.5,
          "raw_context": "model_type: bart"
        }
      ],
      "declared_datasets": [
        "wikisql"
      ],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "dc4dbc560fa5cfd657a824bb3e3d2fdfa1c8e07c85b9068425cc02eec871e202"
    },
    {
      "model_id": "nielsr/tapex-large-finetuned-wtq",
      "scanned_at": "2026-09-15T02:31:48.866606Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "wtq",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:wtq"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "ining via Learning a Neural SQL Executor](https://arxiv.org/abs/2107.07653) by Qian Liu, Bei Chen, Jiaqi"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "bart",
          "confidence": 0.5,
          "raw_context": "model_type: bart"
        }
      ],
      "declared_datasets": [
        "wtq"
      ],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "0006ed61001a094514a5d2581f0f1604b44393befbbbe8541d353475e11be7a0"
    },
    {
      "model_id": "nieves22041/Asq4jksQ",
      "scanned_at": "2026-09-15T02:31:51.628335Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "4646960ca4fbb112f92565ba1c69968955a3fa24db65cedfcb04c4fe752d611d"
    },
    {
      "model_id": "nightmedia/Qwen3-MOE-4x0.6B-2.4B-Writing-Thunder-V1.1-q8-mlx",
      "scanned_at": "2026-09-15T02:31:54.481831Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "25f252d3fa866ee6d135f79d6a3e9f2b868bd8325811ea79f516b332d214fd28"
    },
    {
      "model_id": "nightmedia/Qwen3-MOE-4x0.6B-2.4B-Writing-Thunder-V1.2-q8-mlx",
      "scanned_at": "2026-09-15T02:31:57.212414Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "DavidAU/Qwen3-MOE-4x0.6B-2.4B-Writing-Thunder-V1.2",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:DavidAU/Qwen3-MOE-4x0.6B-2.4B-Writing-Thunder-V1.2"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:DavidAU/Qwen3-MOE-4x0.6B-2.4B-Writing-Thunder-V1.2",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:DavidAU/Qwen3-MOE-4x0.6B-2.4B-Writing-Thunder-V1.2"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "DavidAU/Qwen3-MOE-4x0.6B-2.4B-Writing-Thunder-V1.2",
          "confidence": 0.85,
          "raw_context": "creative - all use cases - roleplay - merge - mlx base_model: DavidAU/Qwen3-MOE-4x0.6B-2.4B-Writing-Thunder-V1.2 pipeline_tag: text-generation ---  # Qwen3-MOE-4x"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "qwen3_moe",
          "confidence": 0.5,
          "raw_context": "model_type: qwen3_moe"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": "DavidAU/Qwen3-MOE-4x0.6B-2.4B-Writing-Thunder-V1.2",
      "base_model_chain": [
        "DavidAU/Qwen3-MOE-4x0.6B-2.4B-Writing-Thunder-V1.2",
        "Qwen/Qwen3-0.6B",
        "Qwen/Qwen3-0.6B-Base"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.2,
      "provenance_hash": "573afc4a6bb0e450a6c46ada0877af6b801c88b106911344f94c2c5378e71fe2"
    },
    {
      "model_id": "nightmedia/Qwen3.5-122B-A10B-Text-qx64-hi-mlx",
      "scanned_at": "2026-09-15T02:32:03.648246Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Qwen/Qwen3.5-122B-A10B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Qwen/Qwen3.5-122B-A10B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Qwen/Qwen3.5-122B-A10B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Qwen/Qwen3.5-122B-A10B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Qwen/Qwen3.5-122B-A10B",
          "confidence": 0.85,
          "raw_context": "B/blob/main/LICENSE pipeline_tag: text-generation base_model: Qwen/Qwen3.5-122B-A10B tags: - mlx ---  # Qwen3.5-122B-A10B-Text-qx64-hi"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "qwen3_5_moe",
          "confidence": 0.5,
          "raw_context": "model_type: qwen3_5_moe"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Qwen/Qwen3.5-122B-A10B",
          "value": "coco",
          "confidence": 0.5599999999999999,
          "raw_context": "r-bottom:1px solid rgba(128, 128, 128, 0.15);\">RefCOCO(avg)</td> <td style=\"padding:7px 7px;text-align:c"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Qwen/Qwen3.5-122B-A10B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "er-bottom:1px solid rgba(128, 128, 128, 0.15);\">CharXiv(RQ)</td> <td style=\"padding:7px 7px;text-align:ce"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "coco",
        "arxiv"
      ],
      "base_model": "Qwen/Qwen3.5-122B-A10B",
      "base_model_chain": [
        "Qwen/Qwen3.5-122B-A10B"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "83ee1b1d4a2f5b71a073515d4d937520c857e9fd840077291fc8c6e3a7e19339"
    },
    {
      "model_id": "nikravan/glm-4vq",
      "scanned_at": "2026-09-15T02:32:08.274516Z",
      "signals": [
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "../Model",
          "confidence": 0.9,
          "raw_context": "_name_or_path: ../Model"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "chatglm",
          "confidence": 0.5,
          "raw_context": "model_type: chatglm"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "495826f48e6c82ab043da0234a3cca8b8ab5f57a1198c4f1e39598640b005f59"
    },
    {
      "model_id": "nikriz/simvla_libero_align_small_layer3",
      "scanned_at": "2026-09-15T02:32:11.027485Z",
      "signals": [
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "smolvlm_vla",
          "confidence": 0.5,
          "raw_context": "model_type: smolvlm_vla"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "aa7aae9f6b50cc7551be0f523b757a20c9e3bb4d385b56016d624cfdae26e35a"
    },
    {
      "model_id": "nikriz/simvla_libero_align_small_layer6",
      "scanned_at": "2026-09-15T02:32:13.897873Z",
      "signals": [
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "smolvlm_vla",
          "confidence": 0.5,
          "raw_context": "model_type: smolvlm_vla"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "2cacb55ce298fcff9add042ce2688a38124c6689426720ecd49ca7da038d9489"
    },
    {
      "model_id": "nikriz/simvla_libero_align_small_layer9",
      "scanned_at": "2026-09-15T02:32:16.702689Z",
      "signals": [
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "smolvlm_vla",
          "confidence": 0.5,
          "raw_context": "model_type: smolvlm_vla"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "73ad3b951a7c5b6871ce185107c7d99186166599b760323d5ee0cf5301a687ee"
    },
    {
      "model_id": "nineninesix/kani-tts-2-en",
      "scanned_at": "2026-09-15T02:32:19.468191Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "laion/Emolia",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:laion/Emolia"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "nineninesix/kani-tts-2-pt",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:nineninesix/kani-tts-2-pt"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:nineninesix/kani-tts-2-pt",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:nineninesix/kani-tts-2-pt"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "laion",
          "confidence": 0.6,
          "raw_context": "nk: https://www.liquid.ai/lfm-license datasets: - laion/Emolia language: - en pipeline_tag: text-to-speec"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "Technical Report},  author={Liquid AI},  journal={arXiv preprint arXiv:2511.23404},  year={2025} }  @inpr"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "laion",
          "confidence": 0.7,
          "raw_context": "nk: https://www.liquid.ai/lfm-license datasets: - laion/Emolia language: - en pipeline_tag: text-to-speec"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "lfm2",
          "confidence": 0.5,
          "raw_context": "model_type: lfm2"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nineninesix/kani-tts-2-pt",
          "value": "laion",
          "confidence": 0.48,
          "raw_context": "nk: https://www.liquid.ai/lfm-license datasets: - laion/Emolia language: - en - es - ky pipeline_tag: tex"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:nineninesix/kani-tts-2-pt",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "Technical Report},  author={Liquid AI},  journal={arXiv preprint arXiv:2511.23404},  year={2025} }  @inpr"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:nineninesix/kani-tts-2-pt",
          "value": "laion",
          "confidence": 0.5599999999999999,
          "raw_context": "nk: https://www.liquid.ai/lfm-license datasets: - laion/Emolia language: - en - es - ky pipeline_tag: tex"
        }
      ],
      "declared_datasets": [
        "laion/Emolia"
      ],
      "inferred_datasets": [
        "laion",
        "arxiv"
      ],
      "base_model": "nineninesix/kani-tts-2-pt",
      "base_model_chain": [
        "nineninesix/kani-tts-2-pt"
      ],
      "training_section_present": false,
      "license": "other",
      "provenance_score": 0.4,
      "provenance_hash": "0a76e8755bdf2bdfc12b9fab7a3149b9cbb6b8a5324dc8f4d5d5bb26d24cfb4b"
    },
    {
      "model_id": "niuzi1/SRTGW43",
      "scanned_at": "2026-09-15T02:32:24.066227Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "642ab505ce3503f11c43c35548c2966268c6d1b34978b3ac844f5c1a936c8aab"
    },
    {
      "model_id": "niuzi1/VSAFEW3",
      "scanned_at": "2026-09-15T02:32:26.814093Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "d068c823cb70367c9ae72a33f5ada4c29e1ed13ae5c08b0dafc9161e7b8b63ce"
    },
    {
      "model_id": "niuzi1/ZXCVFSD",
      "scanned_at": "2026-09-15T02:32:29.582510Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "a5953a9089eaca7c74f4dfbec2302ab232e0042c65c6fcc179a2a887d738f5de"
    },
    {
      "model_id": "nixxiwi/pria-solo",
      "scanned_at": "2026-09-15T02:32:32.457994Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "sojuL/RubricHub_v1",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:sojuL/RubricHub_v1"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Qwen/Qwen3-TTS-12Hz-1.7B-CustomVoice",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Qwen/Qwen3-TTS-12Hz-1.7B-CustomVoice"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:Qwen/Qwen3-TTS-12Hz-1.7B-CustomVoice",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:Qwen/Qwen3-TTS-12Hz-1.7B-CustomVoice"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "ute) presented in [Lacoste et al. (2019)](https://arxiv.org/abs/1910.09700).  - **Hardware Type:** [More"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Qwen/Qwen3-TTS-12Hz-1.7B-CustomVoice",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "Xu and Jingren Zhou and Junyang Lin},   journal={arXiv preprint arXiv:2601.15621},   year={2026} } ```"
        }
      ],
      "declared_datasets": [
        "sojuL/RubricHub_v1"
      ],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": "Qwen/Qwen3-TTS-12Hz-1.7B-CustomVoice",
      "base_model_chain": [
        "Qwen/Qwen3-TTS-12Hz-1.7B-CustomVoice"
      ],
      "training_section_present": true,
      "license": "mit",
      "provenance_score": 0.65,
      "provenance_hash": "ccb7c65a6457cfbb3187bf8c5cc2438affea6a04c12f1894a778d3de134784e7"
    },
    {
      "model_id": "njt1980/JIRAHelper",
      "scanned_at": "2026-09-15T02:32:38.086141Z",
      "signals": [
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "google/tapas-base",
          "confidence": 0.9,
          "raw_context": "_name_or_path: google/tapas-base"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "tapas",
          "confidence": 0.5,
          "raw_context": "model_type: tapas"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "0b5fc5aa1e5dcdd04328db64675311bfb510efddac76c7556ab585b4d4c10cd6"
    },
    {
      "model_id": "nkkbr/whisper-large-v3-zatoichi-ja-JDG_ver_20260217_lr_2.0e-5",
      "scanned_at": "2026-09-15T02:32:40.946104Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "openai/whisper-large-v3",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:openai/whisper-large-v3"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:openai/whisper-large-v3",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:openai/whisper-large-v3"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "openai/whisper-large-v3",
          "confidence": 0.85,
          "raw_context": ": transformers language: - ja license: apache-2.0 base_model: openai/whisper-large-v3 tags: - generated_from_trainer metrics: - wer mod"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "whisper",
          "confidence": 0.5,
          "raw_context": "model_type: whisper"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:openai/whisper-large-v3",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "ibtex @misc{radford2022whisper,   doi = {10.48550/ARXIV.2212.04356},   url = {https://arxiv.org/abs/2212."
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": "openai/whisper-large-v3",
      "base_model_chain": [
        "openai/whisper-large-v3"
      ],
      "training_section_present": true,
      "license": "apache-2.0",
      "provenance_score": 0.55,
      "provenance_hash": "015897d518184a85877fe3274e932d8b942ca42ccc0b76a1e94cf6a915c0b239"
    },
    {
      "model_id": "nkkbr/whisper-large-v3-zatoichi-ja-JDG_ver_20260217_lr_2.4e-5",
      "scanned_at": "2026-09-15T02:32:45.560798Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "openai/whisper-large-v3",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:openai/whisper-large-v3"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:openai/whisper-large-v3",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:openai/whisper-large-v3"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "openai/whisper-large-v3",
          "confidence": 0.85,
          "raw_context": ": transformers language: - ja license: apache-2.0 base_model: openai/whisper-large-v3 tags: - generated_from_trainer metrics: - wer mod"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "whisper",
          "confidence": 0.5,
          "raw_context": "model_type: whisper"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:openai/whisper-large-v3",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "ibtex @misc{radford2022whisper,   doi = {10.48550/ARXIV.2212.04356},   url = {https://arxiv.org/abs/2212."
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": "openai/whisper-large-v3",
      "base_model_chain": [
        "openai/whisper-large-v3"
      ],
      "training_section_present": true,
      "license": "apache-2.0",
      "provenance_score": 0.55,
      "provenance_hash": "04a07aa2929a6ebff70b7f0ac43f68ef7ef4f89af61ef9c454ac5155d4654300"
    },
    {
      "model_id": "nkkbr/whisper-large-v3-zatoichi-ja-JDG_ver_20260217_lr_8e-6",
      "scanned_at": "2026-09-15T02:32:48.358065Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "openai/whisper-large-v3",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:openai/whisper-large-v3"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:openai/whisper-large-v3",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:openai/whisper-large-v3"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "openai/whisper-large-v3",
          "confidence": 0.85,
          "raw_context": ": transformers language: - ja license: apache-2.0 base_model: openai/whisper-large-v3 tags: - generated_from_trainer metrics: - wer mod"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "whisper",
          "confidence": 0.5,
          "raw_context": "model_type: whisper"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:openai/whisper-large-v3",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "ibtex @misc{radford2022whisper,   doi = {10.48550/ARXIV.2212.04356},   url = {https://arxiv.org/abs/2212."
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": "openai/whisper-large-v3",
      "base_model_chain": [
        "openai/whisper-large-v3"
      ],
      "training_section_present": true,
      "license": "apache-2.0",
      "provenance_score": 0.55,
      "provenance_hash": "73cfbf62ba1237f143a670aed33960ec5fdcea0ac69ec75df8829294c554c8a4"
    },
    {
      "model_id": "nlpaueb/bert-base-greek-uncased-v1",
      "scanned_at": "2026-09-15T02:32:51.135124Z",
      "signals": [
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Wikipedia",
          "confidence": 0.6,
          "raw_context": "-greek-uncased-v1` include:  * The Greek part of [Wikipedia](https://el.wikipedia.org/wiki/Βικιπαίδεια:Αντίγρ"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Common Crawl",
          "confidence": 0.6,
          "raw_context": "/traces1.inria.fr/oscar/), a cleansed version of [Common Crawl](https://commoncrawl.org).  Future release will a"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "commoncrawl",
          "confidence": 0.6,
          "raw_context": "r/), a cleansed version of [Common Crawl](https://commoncrawl.org).  Future release will also include:  * The e"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "wikipedia",
          "confidence": 0.7,
          "raw_context": "-greek-uncased-v1` include:  * The Greek part of [Wikipedia](https://el.wikipedia.org/wiki/Βικιπαίδεια:Αντίγρ"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "onversion script to convert the TF checkpoint and vocabulary in the desired format in order to be able"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "common crawl",
          "confidence": 0.7,
          "raw_context": "/traces1.inria.fr/oscar/), a cleansed version of [Common Crawl](https://commoncrawl.org).  Future release will a"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "lligence (SETN 2020). Held Online. 2020. (https://arxiv.org/abs/2008.12014)   ### Named Entity Recognitio"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "oscar",
          "confidence": 0.7,
          "raw_context": "w.statmt.org/europarl/), and * The Greek part of [OSCAR](https://traces1.inria.fr/oscar/), a cleansed ver"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "bert",
          "confidence": 0.5,
          "raw_context": "model_type: bert"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "wikipedia",
        "arxiv",
        "common crawl",
        "oscar",
        "voc"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": null,
      "provenance_score": 0.5,
      "provenance_hash": "91b7927ad90031e6599d5123b34822aedd9805561b491949e3ed17023e2e43ba"
    },
    {
      "model_id": "nlpaueb/bert-base-uncased-contracts",
      "scanned_at": "2026-09-15T02:32:53.885364Z",
      "signals": [
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "gal corpora mentioned below using a newly created vocabulary by a sentence-piece tokenizer trained on t"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "bert",
          "confidence": 0.5,
          "raw_context": "model_type: bert"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "cc-by-sa-4.0",
      "provenance_score": 0.45,
      "provenance_hash": "609d7cdecf588898d0e73df7114c488432ffb3f33d7e62f5692f53462f05ab12"
    },
    {
      "model_id": "nn-tech/MetalGPT-1",
      "scanned_at": "2026-09-15T02:32:56.638085Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "t-tech/T-pro-it-2.0",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:t-tech/T-pro-it-2.0"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:t-tech/T-pro-it-2.0",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:t-tech/T-pro-it-2.0"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "t-tech/T-pro-it-2.0",
          "confidence": 0.85,
          "raw_context": "- mining license: cc-by-nc-sa-4.0 language: - ru base_model: t-tech/T-pro-it-2.0 ---  ## Description  **MetalGPT-1** is a model bu"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "qwen3",
          "confidence": 0.5,
          "raw_context": "model_type: qwen3"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": "t-tech/T-pro-it-2.0",
      "base_model_chain": [
        "t-tech/T-pro-it-2.0",
        "Qwen/Qwen3-32B"
      ],
      "training_section_present": false,
      "license": "cc-by-nc-sa-4.0",
      "provenance_score": 0.2,
      "provenance_hash": "a92d392247b19a9e0a73860614740f327656ccdc8d0614d11b5887be95d39bb0"
    },
    {
      "model_id": "noamrot/FuseCap_Image_Captioning",
      "scanned_at": "2026-09-15T02:33:01.262779Z",
      "signals": [
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "he Paper**: You can find the paper [here](https://arxiv.org/abs/2305.17718).      - 🚀 **Demo**: Try out o"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "blip",
          "confidence": 0.5,
          "raw_context": "model_type: blip"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "mit",
      "provenance_score": 0.45,
      "provenance_hash": "23c00969de7769299aa6e2b6b27def6329871c70ba7836c49ac03deeff827383"
    },
    {
      "model_id": "noctrex/Chandra-OCR-GGUF",
      "scanned_at": "2026-09-15T02:33:04.229947Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "datalab-to/chandra",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:datalab-to/chandra"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:datalab-to/chandra",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:datalab-to/chandra"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:datalab-to/chandra",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "g src=\"bench.png\" width=\"600px\"/>  | **Model** |  ArXiv   | Old Scans Math |  Tables  | Old Scans | Heade"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": "datalab-to/chandra",
      "base_model_chain": [
        "datalab-to/chandra"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "07f323f4626ea9f48c5b0d35bb901edbf8e75c0ca0f0cecbcb71871e426768f3"
    },
    {
      "model_id": "noctrex/LightOnOCR-2-1B-GGUF",
      "scanned_at": "2026-09-15T02:33:08.859472Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "lightonai/LightOnOCR-2-1B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:lightonai/LightOnOCR-2-1B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:lightonai/LightOnOCR-2-1B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:lightonai/LightOnOCR-2-1B"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "lightonai/LightOnOCR-2-1B",
          "confidence": 0.85,
          "raw_context": "--- pipeline_tag: image-to-text base_model: lightonai/LightOnOCR-2-1B --- This are the quantizations of the model [Ligh"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:lightonai/LightOnOCR-2-1B",
          "value": "image/png",
          "confidence": 0.6400000000000001,
          "raw_context": ": \"image_url\",             \"image_url\": {\"url\": f\"data:image/png;base64,{image_base64}\"}         }]     }],     \"m"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:lightonai/LightOnOCR-2-1B",
          "value": "Dataset",
          "confidence": 0.48,
          "raw_context": "ace.co/spaces/lightonai/LightOnOCR-2-1B-Demo) | 📊 [Dataset](https://huggingface.co/datasets/lightonai/LightOnOCR-mix-0126) | 📓 [Finetuning](ht"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:lightonai/LightOnOCR-2-1B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "o=x)](https://x.com/LightOnIO)  📄 [Paper](https://arxiv.org/pdf/2601.14251) | 📝 [Blog](https://huggingfac"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "Dataset",
        "image/png",
        "arxiv"
      ],
      "base_model": "lightonai/LightOnOCR-2-1B",
      "base_model_chain": [
        "lightonai/LightOnOCR-2-1B"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.25,
      "provenance_hash": "a65894f93c0d8eade6239a966a2525aeb294739c35ad758b9df1302eea328bb0"
    },
    {
      "model_id": "noctrex/LightOnOCR-2-1B-ocr-soup-GGUF",
      "scanned_at": "2026-09-15T02:33:13.444089Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "lightonai/LightOnOCR-2-1B-ocr-soup",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:lightonai/LightOnOCR-2-1B-ocr-soup"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:lightonai/LightOnOCR-2-1B-ocr-soup",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:lightonai/LightOnOCR-2-1B-ocr-soup"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "lightonai/LightOnOCR-2-1B-ocr-soup",
          "confidence": 0.85,
          "raw_context": "--- pipeline_tag: image-to-text base_model: lightonai/LightOnOCR-2-1B-ocr-soup --- This are the quantizations of the model [Ligh"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:lightonai/LightOnOCR-2-1B-ocr-soup",
          "value": "image/png",
          "confidence": 0.6400000000000001,
          "raw_context": ": \"image_url\",             \"image_url\": {\"url\": f\"data:image/png;base64,{image_base64}\"}         }]     }],     \"m"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:lightonai/LightOnOCR-2-1B-ocr-soup",
          "value": "Dataset",
          "confidence": 0.48,
          "raw_context": "co/spaces/lightonai/LightOnOCR-2-1B-Demo)** | 📊 **[Dataset](https://huggingface.co/datasets/lightonai/LightOnOCR-mix-0126)** | 📊 **[BBox Datas"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:lightonai/LightOnOCR-2-1B-ocr-soup",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "r and higher-quality corpus with stronger French, arXiv, and scan coverage, improved LaTeX handling, and"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "Dataset",
        "image/png",
        "arxiv"
      ],
      "base_model": "lightonai/LightOnOCR-2-1B-ocr-soup",
      "base_model_chain": [
        "lightonai/LightOnOCR-2-1B-ocr-soup"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.25,
      "provenance_hash": "b4ba19020e9207e8dc0ccd250b57a001e85654f7ffd1068aec947cf20322d4c9"
    },
    {
      "model_id": "noctrex/PaddleOCR-VL-1.5-GGUF",
      "scanned_at": "2026-09-15T02:33:18.120563Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "PaddlePaddle/PaddleOCR-VL-1.5",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:PaddlePaddle/PaddleOCR-VL-1.5"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:PaddlePaddle/PaddleOCR-VL-1.5",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:PaddlePaddle/PaddleOCR-VL-1.5"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:PaddlePaddle/PaddleOCR-VL-1.5",
          "value": "image/png",
          "confidence": 0.6400000000000001,
          "raw_context": "//img.shields.io/badge/HuggingFace-black.svg?logo=data:image/png;base64,iVBORw0KGgoAAAANSUhEUgAAAF8AAABYCAMAAACkl9"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:PaddlePaddle/PaddleOCR-VL-1.5",
          "value": "image/svg",
          "confidence": 0.6400000000000001,
          "raw_context": "ttps://img.shields.io/badge/ModelScope-black?logo=data:image/svg+xml;base64,PHN2ZyB3aWR0aD0iMjIzIiBoZWlnaHQ9IjIwMC"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:PaddlePaddle/PaddleOCR-VL-1.5",
          "value": "Real5-OmniDocBench",
          "confidence": 0.48,
          "raw_context": "n, and Skew. For further details, please refer to [Real5-OmniDocBench](https://huggingface.co/datasets/PaddlePaddle/Real5-OmniDocBench).   ### Inference"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:PaddlePaddle/PaddleOCR-VL-1.5",
          "value": "c4",
          "confidence": 0.5599999999999999,
          "raw_context": "DDw8TJ1NbX5efv8ff9/fxKDJ9uAAAGKklEQVR42u2Z63qjOAyGC4RwCOfB2JAGqrSb2WnTw/1f3UaWcSGYNKTdf/P+mOkTrE+yJBul"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:PaddlePaddle/PaddleOCR-VL-1.5",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "w.paddleocr.com)** **📝 [Technical Report](https://arxiv.org/abs/2601.21957)**  </div>  <div align=\"center"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "Real5-OmniDocBench",
        "c4",
        "arxiv",
        "image/svg",
        "image/png"
      ],
      "base_model": "PaddlePaddle/PaddleOCR-VL-1.5",
      "base_model_chain": [
        "PaddlePaddle/PaddleOCR-VL-1.5"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "599457d3401eeae35f37aca7190fc93b5d57663407ebd943b6989149362da859"
    },
    {
      "model_id": "noctrex/ZwZ-8B-GGUF",
      "scanned_at": "2026-09-15T02:33:22.774581Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "inclusionAI/ZwZ-8B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:inclusionAI/ZwZ-8B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:inclusionAI/ZwZ-8B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:inclusionAI/ZwZ-8B"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:inclusionAI/ZwZ-8B",
          "value": "inclusionAI/ZwZ-RL-VQA",
          "confidence": 0.6400000000000001,
          "raw_context": "ext) ```   ## Training Data  ZwZ-8B is trained on [inclusionAI/ZwZ-RL-VQA](https://huggingface.co/datasets/inclusionAI/ZwZ-RL-VQA), a 74K-sample Region-to-Im"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:inclusionAI/ZwZ-8B",
          "value": "LAION",
          "confidence": 0.48,
          "raw_context": "aset synthesized from diverse image pools (SA-1B, LAION, MetaCLIP, Visual Genome, CC12M, STPLS3D).   ## C"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:inclusionAI/ZwZ-8B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "# ZwZ-8B  <div align=\"center\">  📃 [Paper](https://arxiv.org/pdf/2602.11858) | 🏠 [Project](https://github."
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:inclusionAI/ZwZ-8B",
          "value": "laion",
          "confidence": 0.5599999999999999,
          "raw_context": "aset synthesized from diverse image pools (SA-1B, LAION, MetaCLIP, Visual Genome, CC12M, STPLS3D).   ## C"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "laion",
        "arxiv",
        "inclusionAI/ZwZ-RL-VQA",
        "LAION"
      ],
      "base_model": "inclusionAI/ZwZ-8B",
      "base_model_chain": [
        "inclusionAI/ZwZ-8B",
        "Qwen/Qwen3-VL-8B-Instruct"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "ff440001321a44c58ddb10b3603b2f08abfdd37653b55a72b082edde830425bc"
    },
    {
      "model_id": "nomic-ai/nomic-embed-text-v1.5-GGUF",
      "scanned_at": "2026-09-15T02:33:27.490727Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "nomic-ai/nomic-embed-text-v1.5",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:nomic-ai/nomic-embed-text-v1.5"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:nomic-ai/nomic-embed-text-v1.5",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:nomic-ai/nomic-embed-text-v1.5"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "nomic-ai/nomic-embed-text-v1.5",
          "confidence": 0.85,
          "raw_context": "--- base_model: nomic-ai/nomic-embed-text-v1.5 inference: false language:   - en license: apache"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:nomic-ai/nomic-embed-text-v1.5",
          "value": "c4",
          "confidence": 0.5599999999999999,
          "raw_context": "onfig: en       split: test       revision: 31efe3c427b0bae9c22cbb560b8f15491cc6bed7     metrics:"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:nomic-ai/nomic-embed-text-v1.5",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "type: Clustering     dataset:       type: mteb/arxiv-clustering-p2p       name: MTEB ArxivClusteringP2"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "c4",
        "arxiv"
      ],
      "base_model": "nomic-ai/nomic-embed-text-v1.5",
      "base_model_chain": [
        "nomic-ai/nomic-embed-text-v1.5"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "28fda7fab26d346240bcb592107559e3df7b19d28cd3ac4743e28e426781abd4"
    },
    {
      "model_id": "nosato/Qwen3-4B-Instruct-2507_LoRA",
      "scanned_at": "2026-09-15T02:33:32.122099Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "u-10bei/structured_data_with_cot_dataset_512_v2",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:u-10bei/structured_data_with_cot_dataset_512_v2"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Qwen/Qwen3-4B-Instruct-2507",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Qwen/Qwen3-4B-Instruct-2507"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "adapter:Qwen/Qwen3-4B-Instruct-2507",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:adapter:Qwen/Qwen3-4B-Instruct-2507"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Qwen/Qwen3-4B-Instruct-2507",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": ",       eprint={2505.09388},       archivePrefix={arXiv},       primaryClass={cs.CL},       url={https://"
        }
      ],
      "declared_datasets": [
        "u-10bei/structured_data_with_cot_dataset_512_v2"
      ],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": "Qwen/Qwen3-4B-Instruct-2507",
      "base_model_chain": [
        "Qwen/Qwen3-4B-Instruct-2507"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "a07ab0383abbd3c637f04689badcd87bb108edbb9f7303220ac60e31d30d37d5"
    },
    {
      "model_id": "noureddinekhiati/DiffSegLung",
      "scanned_at": "2026-09-15T02:33:35.789379Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.1,
      "provenance_hash": "5bb4f93d8778559a39f5a2f8784aaa31fa8bd452330523cb7341baa11392974d"
    },
    {
      "model_id": "novelcore/gem-electra",
      "scanned_at": "2026-09-15T02:33:38.552183Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "google/electra-base-discriminator",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:google/electra-base-discriminator"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:google/electra-base-discriminator",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:google/electra-base-discriminator"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "ity. It is designed for understanding the complex vocabulary and context of the legal domain in Greece"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "electra",
          "confidence": 0.5,
          "raw_context": "model_type: electra"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:google/electra-base-discriminator",
          "value": "glue",
          "confidence": 0.5599999999999999,
          "raw_context": "ream tasks including classification tasks (e.g,. [GLUE](https://gluebenchmark.com/)), QA tasks (e.g., [S"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:google/electra-base-discriminator",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": ", similar to the discriminator of a [GAN](https://arxiv.org/pdf/1406.2661.pdf). At small scale, ELECTRA a"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:google/electra-base-discriminator",
          "value": "squad",
          "confidence": 0.5599999999999999,
          "raw_context": "ELECTRA achieves state-of-the-art results on the [SQuAD 2.0](https://rajpurkar.github.io/SQuAD-explorer/)"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "squad",
        "glue",
        "voc"
      ],
      "base_model": "google/electra-base-discriminator",
      "base_model_chain": [
        "google/electra-base-discriminator"
      ],
      "training_section_present": true,
      "license": "apache-2.0",
      "provenance_score": 0.7,
      "provenance_hash": "1d5d0283dc39667ed8ba98d1b7a22c6c8c68fedc61bde844ffebca5b3c3987e7"
    },
    {
      "model_id": "nphSi/LoRA_SDXL",
      "scanned_at": "2026-09-15T02:33:43.132068Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "4aa08bcf1aa4c7e14330f840dce03eadadb31053c7909732ec6b267c73c2f09a"
    },
    {
      "model_id": "nreimers/MiniLMv2-L6-H384-distilled-from-BERT-Large",
      "scanned_at": "2026-09-15T02:33:45.878939Z",
      "signals": [
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "bert",
          "confidence": 0.5,
          "raw_context": "model_type: bert"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "55ff7604770f659acfe096bfd1334e90e03b72acad5413a0ef6527223a99f18e"
    },
    {
      "model_id": "nrizwan/meme-label-explanation-model",
      "scanned_at": "2026-09-15T02:33:48.627327Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "8c751201ad26be58898122aeb07864738d7de902ad1aadb984e02fdcd103580f"
    },
    {
      "model_id": "ntu-spml/distilhubert",
      "scanned_at": "2026-09-15T02:33:51.363653Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "librispeech_asr",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:librispeech_asr"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "labeled text",
          "confidence": 0.6,
          "raw_context": "kenizer should be created and the model should be fine-tuned on labeled text data. Check out [this blog](https://huggingface.co/blo"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "er-wise Distillation of Hidden-unit BERT](https://arxiv.org/abs/2110.01900)  Authors: Heng-Jui Chang, Shu"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "hubert",
          "confidence": 0.5,
          "raw_context": "model_type: hubert"
        }
      ],
      "declared_datasets": [
        "librispeech_asr"
      ],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "51cc79580c0b8376e4938efe09b650847e8ab7b51d6553cc28c1751a08176124"
    },
    {
      "model_id": "nunchaku-ai/nunchaku-flux.1-kontext-dev",
      "scanned_at": "2026-09-15T02:33:54.115815Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "mit-han-lab/svdquant-datasets",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:mit-han-lab/svdquant-datasets"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "black-forest-labs/FLUX.1-Kontext-dev",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:black-forest-labs/FLUX.1-Kontext-dev"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:black-forest-labs/FLUX.1-Kontext-dev",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:black-forest-labs/FLUX.1-Kontext-dev"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "visual",
          "confidence": 0.6,
          "raw_context": ">  # Model Card for nunchaku-flux.1-kontext-dev  ![visual](https://huggingface.co/datasets/nunchaku-tech/cdn/resolve/main/ComfyUI-nunchaku/wo"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "performance",
          "confidence": 0.6,
          "raw_context": "chaku-flux-1-kontext-dev-json).  ## Performance  ![performance](https://huggingface.co/datasets/nunchaku-tech/cdn/resolve/main/nunchaku/assets/eff"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "black-forest-labs/FLUX.1-Kontext-dev",
          "confidence": 0.85,
          "raw_context": "--- base_model: black-forest-labs/FLUX.1-Kontext-dev base_model_relation: quantized datasets: - mit-ha"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "ank Components for 4-Bit Diffusion Models](http://arxiv.org/abs/2411.05007) - **Demo:** [demo.nunchaku.te"
        }
      ],
      "declared_datasets": [
        "mit-han-lab/svdquant-datasets"
      ],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": "black-forest-labs/FLUX.1-Kontext-dev",
      "base_model_chain": [
        "black-forest-labs/FLUX.1-Kontext-dev"
      ],
      "training_section_present": false,
      "license": "other",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "3776d990dd47e20068bdbaadf4918c04e74377af7a0947e950096648871dbbb5"
    },
    {
      "model_id": "nunchaku-ai/nunchaku-qwen-image-edit",
      "scanned_at": "2026-09-15T02:33:58.678097Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "mit-han-lab/svdquant-datasets",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:mit-han-lab/svdquant-datasets"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Qwen/Qwen-Image-Edit",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Qwen/Qwen-Image-Edit"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Qwen/Qwen-Image-Edit",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Qwen/Qwen-Image-Edit"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "comfyui",
          "confidence": 0.6,
          "raw_context": "div>  # Model Card for nunchaku-qwen-image-edit  ![comfyui](https://huggingface.co/datasets/nunchaku-tech/cdn/resolve/main/ComfyUI-nunchaku/wo"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "performance",
          "confidence": 0.6,
          "raw_context": "nunchaku-qwen-image-edit-json).  ## Performance  ![performance](https://huggingface.co/datasets/nunchaku-tech/cdn/resolve/main/nunchaku/assets/eff"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Qwen/Qwen-Image-Edit",
          "confidence": 0.85,
          "raw_context": "--- base_model: Qwen/Qwen-Image-Edit base_model_relation: quantized datasets: - mit-ha"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "ank Components for 4-Bit Diffusion Models](http://arxiv.org/abs/2411.05007) - **Demo:** [demo.nunchaku.te"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Qwen/Qwen-Image-Edit",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": ",       eprint={2508.02324},       archivePrefix={arXiv},       primaryClass={cs.CV},       url={https://"
        }
      ],
      "declared_datasets": [
        "mit-han-lab/svdquant-datasets"
      ],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": "Qwen/Qwen-Image-Edit",
      "base_model_chain": [
        "Qwen/Qwen-Image-Edit"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "f396cbf2b1589bc881f8f87b7653a530edfb2fbaaddf9189e2359b300d7f1bed"
    },
    {
      "model_id": "nunchaku-ai/nunchaku-qwen-image-edit-2509",
      "scanned_at": "2026-09-15T02:34:03.307475Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "mit-han-lab/svdquant-datasets",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:mit-han-lab/svdquant-datasets"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Qwen/Qwen-Image-Edit-2509",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Qwen/Qwen-Image-Edit-2509"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Qwen/Qwen-Image-Edit-2509",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Qwen/Qwen-Image-Edit-2509"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "visual",
          "confidence": 0.6,
          "raw_context": "# Model Card for nunchaku-qwen-image-edit-2509  ![visual](https://huggingface.co/datasets/nunchaku-tech/cdn/resolve/main/ComfyUI-nunchaku/wo"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "performance",
          "confidence": 0.6,
          "raw_context": "aku-qwen-image-edit-2509-json).  ## Performance  ![performance](https://huggingface.co/datasets/nunchaku-tech/cdn/resolve/main/nunchaku/assets/eff"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Qwen/Qwen-Image-Edit-2509",
          "confidence": 0.85,
          "raw_context": "--- base_model: Qwen/Qwen-Image-Edit-2509 base_model_relation: quantized datasets: - mit-ha"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "ank Components for 4-Bit Diffusion Models](http://arxiv.org/abs/2411.05007) - **Demo:** [demo.nunchaku.te"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Qwen/Qwen-Image-Edit-2509",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": ",       eprint={2508.02324},       archivePrefix={arXiv},       primaryClass={cs.CV},       url={https://"
        }
      ],
      "declared_datasets": [
        "mit-han-lab/svdquant-datasets"
      ],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": "Qwen/Qwen-Image-Edit-2509",
      "base_model_chain": [
        "Qwen/Qwen-Image-Edit-2509"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "32fdbe3a9aca8a097684153cc9302140a57f772da2fbeae0f64a71254be5db14"
    },
    {
      "model_id": "nunchaku-ai/nunchaku-z-image-turbo",
      "scanned_at": "2026-09-15T02:34:07.909318Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "mit-han-lab/svdquant-datasets",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:mit-han-lab/svdquant-datasets"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Tongyi-MAI/Z-Image-Turbo",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Tongyi-MAI/Z-Image-Turbo"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Tongyi-MAI/Z-Image-Turbo",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Tongyi-MAI/Z-Image-Turbo"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "performance",
          "confidence": 0.6,
          "raw_context": "l#nunchaku-z-image-turbo-json).  ## Performance  ![performance](https://huggingface.co/datasets/nunchaku-tech/cdn/resolve/main/nunchaku/assets/eff"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Tongyi-MAI/Z-Image-Turbo",
          "confidence": 0.85,
          "raw_context": "--- base_model: Tongyi-MAI/Z-Image-Turbo base_model_relation: quantized datasets: - mit-ha"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "ank Components for 4-Bit Diffusion Models](http://arxiv.org/abs/2411.05007) - **Demo:** [demo.nunchaku.te"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Tongyi-MAI/Z-Image-Turbo",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "I/Z-Image-Gallery/summary)&#160; <a href=\"https://arxiv.org/abs/2511.22699\" target=\"_blank\"><img src=\"htt"
        }
      ],
      "declared_datasets": [
        "mit-han-lab/svdquant-datasets"
      ],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": "Tongyi-MAI/Z-Image-Turbo",
      "base_model_chain": [
        "Tongyi-MAI/Z-Image-Turbo"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "83201b12a171a58c912ccc738db00b9483054ebbab562aa66c3c03885bfa37df"
    },
    {
      "model_id": "nvidia/Alpamayo-R1-10B",
      "scanned_at": "2026-09-15T02:34:12.687956Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/PhysicalAI-Autonomous-Vehicles",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/PhysicalAI-Autonomous-Vehicles"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/PhysicalAI-Autonomous-Vehicles-NuRec",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/PhysicalAI-Autonomous-Vehicles-NuRec"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "github.com/NVlabs/alpamayo) | [**Paper**](https://arxiv.org/abs/2511.00088)  _Note: Following the release"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "alpamayo_r1",
          "confidence": 0.5,
          "raw_context": "model_type: alpamayo_r1"
        }
      ],
      "declared_datasets": [
        "nvidia/PhysicalAI-Autonomous-Vehicles",
        "nvidia/PhysicalAI-Autonomous-Vehicles-NuRec"
      ],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "openmdw-1.1",
      "provenance_score": 0.65,
      "provenance_hash": "24767905963e103c5bf310676660b34d1edbeb5942f7a1416d6442c2c97424ff"
    },
    {
      "model_id": "nvidia/C-RADIO",
      "scanned_at": "2026-09-15T02:34:15.429473Z",
      "signals": [
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "imagenet",
          "confidence": 0.7,
          "raw_context": "on Images <br>  ## Evaluation Dataset: **Link:** [ImageNet](https://www.image-net.org/)  <br> ** Data Collec"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "on Model - Reduce All Domains Into One**](https://arxiv.org/abs/2312.06709)  [**PHI-S: Distribution Balan"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "imagenet"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "other",
      "provenance_score": 0.5,
      "provenance_hash": "7b6fc3a660632bc9bf7c7d36429150853e1de95946bd68ccba4f21d0d38ef31e"
    },
    {
      "model_id": "nvidia/C-RADIOv3-H",
      "scanned_at": "2026-09-15T02:34:18.187081Z",
      "signals": [
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "imagenet",
          "confidence": 0.7,
          "raw_context": "on Images <br>  ## Evaluation Dataset  **Link:** [ImageNet](https://www.image-net.org/)  <br>  ### Data Coll"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "thub.com/NVlabs/RADIO)]  [[**CVPR 2025**](https://arxiv.org/abs/2412.07679)]  [[**CVPR 2024**](https://ar"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "imagenet"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "other",
      "provenance_score": 0.5,
      "provenance_hash": "88ce0c61aedcfa94fdfce087816618f782f2c591e93dc89ac66038f6724165b4"
    },
    {
      "model_id": "nvidia/Cosmos-Embed1-448p",
      "scanned_at": "2026-09-15T02:34:20.940960Z",
      "signals": [
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "MIT",
          "confidence": 0.6,
          "raw_context": "research/perception_models/blob/main/LICENSE.PE); [MIT](https://huggingface.co/datasets/choosealicense/licenses/blob/main/markdown/mit.md)"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "AgiBot",
          "confidence": 0.6,
          "raw_context": "d general domains.  **Data Collection Method:** * [AgiBot](https://huggingface.co/datasets/agibot-world/AgiBotWorld-Beta): Automatic/Sensors"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "wikipedia",
          "confidence": 0.6,
          "raw_context": "ck data video_url = \"https://upload.wikimedia.org/wikipedia/commons/3/3d/Branko_Paukovic%2C_javelin_throw.web"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "wikipedia",
          "confidence": 0.7,
          "raw_context": "ck data video_url = \"https://upload.wikimedia.org/wikipedia/commons/3/3d/Branko_Paukovic%2C_javelin_throw.web"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "ldwide, non-exclusive, no-charge, royalty-free, revocable (as stated in Section 2.1) license to publicl"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "e  The architecture is based on [QFormer](https://arxiv.org/abs/2301.12597), with modifications for proce"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "cosmos-embed1",
          "confidence": 0.5,
          "raw_context": "model_type: cosmos-embed1"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "wikipedia",
        "arxiv",
        "voc"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "other",
      "provenance_score": 0.55,
      "provenance_hash": "f7de99a21cb072dd5d1ffa98c3b421ab00df896072a78592820e60cc8ba8e756"
    },
    {
      "model_id": "nvidia/Cosmos-Guardrail1",
      "scanned_at": "2026-09-15T02:34:23.770390Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "other",
      "provenance_score": 0.1,
      "provenance_hash": "18b9ca1e8845fbac0a92b9d0cf7612563c88561b839c083ea05e04245a7cbfcf"
    },
    {
      "model_id": "nvidia/Cosmos-Predict2-2B-Video2World",
      "scanned_at": "2026-09-15T02:34:26.518755Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "other",
      "provenance_score": 0.1,
      "provenance_hash": "edd98d3454a023d215dd56700fba2d7109f2b046f6e430e01e90e895ad77ec16"
    },
    {
      "model_id": "nvidia/Cosmos-Predict2.5-2B",
      "scanned_at": "2026-09-15T02:34:29.259661Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "other",
      "provenance_score": 0.1,
      "provenance_hash": "0feb4df182732116cdc8fad7cfd7d869738b0c8ccc284396328951d1e0b2a0a5"
    },
    {
      "model_id": "nvidia/Cosmos-Reason1-7B",
      "scanned_at": "2026-09-15T02:34:32.009601Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/Cosmos-Reason1-SFT-Dataset",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/Cosmos-Reason1-SFT-Dataset"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/Cosmos-Reason1-RL-Dataset",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/Cosmos-Reason1-RL-Dataset"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/Cosmos-Reason1-Benchmark",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/Cosmos-Reason1-Benchmark"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Qwen/Qwen2.5-VL-7B-Instruct",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Qwen/Qwen2.5-VL-7B-Instruct"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:Qwen/Qwen2.5-VL-7B-Instruct",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:Qwen/Qwen2.5-VL-7B-Instruct"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Cosmos-Reason1-Benchmark",
          "confidence": 0.6,
          "raw_context": "art of the evaluation datasets are released under [Cosmos-Reason1-Benchmark](https://huggingface.co/datasets/nvidia/Cosmos-Reason1-Benchmark). The embodied rea"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "PLM-Video-Human",
          "confidence": 0.6,
          "raw_context": "capability.  ### 08/01/2025 |                   | [PLM-Video-Human](https://huggingface.co/datasets/facebook/PLM-Video-Human) | Nexar       | [Describ"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "physical common sense and embodied reasoning",
          "confidence": 0.6,
          "raw_context": "ial-temporal understanding. Cosmos Reason is post-trained with physical common sense and embodied reasoning data with supervised fine-tuning and reinforcement lea"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "c4",
          "confidence": 0.7,
          "raw_context": "vidia/Cosmos-Reason1-7B/commit/098a5bb62a1f4fc05e5c4ac89aae8005e301aa18). Initial release.  ## Model A"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "idia-cosmos/cosmos-reason1) | [**Paper**](https://arxiv.org/abs/2503.15558) | [**Paper Website**](https:/"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "qwen2_5_vl",
          "confidence": 0.5,
          "raw_context": "model_type: qwen2_5_vl"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Qwen/Qwen2.5-VL-7B-Instruct",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "xceeding 32,768 tokens, we utilize [YaRN](https://arxiv.org/abs/2309.00071), a technique for enhancing mo"
        }
      ],
      "declared_datasets": [
        "nvidia/Cosmos-Reason1-RL-Dataset",
        "nvidia/Cosmos-Reason1-Benchmark",
        "nvidia/Cosmos-Reason1-SFT-Dataset"
      ],
      "inferred_datasets": [
        "c4",
        "arxiv"
      ],
      "base_model": "Qwen/Qwen2.5-VL-7B-Instruct",
      "base_model_chain": [
        "Qwen/Qwen2.5-VL-7B-Instruct"
      ],
      "training_section_present": true,
      "license": "other",
      "provenance_score": 0.8999999999999999,
      "provenance_hash": "190eb860caa0873bffd0b95ea15e32899488d49d201c9fabc372ff97b12f1adb"
    },
    {
      "model_id": "nvidia/Cosmos-Reason2-2B",
      "scanned_at": "2026-09-15T02:34:35.711046Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Qwen/Qwen3-VL-2B-Instruct",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Qwen/Qwen3-VL-2B-Instruct"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:Qwen/Qwen3-VL-2B-Instruct",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:Qwen/Qwen3-VL-2B-Instruct"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Qwen/Qwen3-VL-2B-Instruct",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": ",       eprint={2505.09388},       archivePrefix={arXiv},       primaryClass={cs.CL},       url={https://"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": "Qwen/Qwen3-VL-2B-Instruct",
      "base_model_chain": [
        "Qwen/Qwen3-VL-2B-Instruct"
      ],
      "training_section_present": false,
      "license": "other",
      "provenance_score": 0.25,
      "provenance_hash": "737b5bf045653741c85dec5d593ebb7cd00143436b3794b4b34a6d1a22437e32"
    },
    {
      "model_id": "nvidia/Cosmos-Transfer2.5-2B",
      "scanned_at": "2026-09-15T02:34:39.410332Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "other",
      "provenance_score": 0.1,
      "provenance_hash": "58f16ea05a8541f94e096e170b404f8dc7545e3bbdfa3fa21e4192c22fc88f0f"
    },
    {
      "model_id": "nvidia/DLER-R1-7B-Research",
      "scanned_at": "2026-09-15T02:34:42.139782Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "agentica-org/DeepScaleR-Preview-Dataset",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:agentica-org/DeepScaleR-Preview-Dataset"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "deepseek-ai/DeepSeek-R1-Distill-Qwen-7B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:deepseek-ai/DeepSeek-R1-Distill-Qwen-7B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:deepseek-ai/DeepSeek-R1-Distill-Qwen-7B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:deepseek-ai/DeepSeek-R1-Distill-Qwen-7B"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "v> </div>  [![Paper](https://img.shields.io/badge/ArXiv-Paper-brown)](https://www.arxiv.org/abs/2510.1511"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "qwen2",
          "confidence": 0.5,
          "raw_context": "model_type: qwen2"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:deepseek-ai/DeepSeek-R1-Distill-Qwen-7B",
          "value": "c4",
          "confidence": 0.5599999999999999,
          "raw_context": "ine-height: 1;\">   <a href=\"https://discord.gg/Tc7c45Zzu5\" target=\"_blank\" style=\"margin: 2px;\">     <"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:deepseek-ai/DeepSeek-R1-Distill-Qwen-7B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": ",       eprint={2501.12948},       archivePrefix={arXiv},       primaryClass={cs.CL},       url={https://"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:deepseek-ai/DeepSeek-R1-Distill-Qwen-7B",
          "value": "alpaca",
          "confidence": 0.5599999999999999,
          "raw_context": "| 72.5 | 80.5 | 73.3 | 76.9 | - | **82.5** | | | AlpacaEval2.0 (LC-winrate) | 52.0 | 51.1 | 70.0 | 57.8 |"
        }
      ],
      "declared_datasets": [
        "agentica-org/DeepScaleR-Preview-Dataset"
      ],
      "inferred_datasets": [
        "c4",
        "arxiv",
        "alpaca"
      ],
      "base_model": "deepseek-ai/DeepSeek-R1-Distill-Qwen-7B",
      "base_model_chain": [
        "deepseek-ai/DeepSeek-R1-Distill-Qwen-7B"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "66a03dbf42bf3c9bf5a918123b18597b895b6b73c134a94c2e571a6c0be7ffaa"
    },
    {
      "model_id": "nvidia/DeepSeek-R1-0528-NVFP4",
      "scanned_at": "2026-09-15T02:34:46.728778Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "deepseek-ai/DeepSeek-R1-0528",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:deepseek-ai/DeepSeek-R1-0528"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:deepseek-ai/DeepSeek-R1-0528",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:deepseek-ai/DeepSeek-R1-0528"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "MIT",
          "confidence": 0.6,
          "raw_context": "-ai/DeepSeek-R1-0528).  ### License/Terms of Use: [MIT](https://huggingface.co/datasets/choosealicense/licenses/blob/main/markdown/mit.md)"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "cnn_dailymail",
          "confidence": 0.6,
          "raw_context": "## Calibration Datasets: * Calibration Dataset: [cnn_dailymail](https://huggingface.co/datasets/abisee/cnn_dailymail) <br> ** Data collection meth"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "deepseek_v3",
          "confidence": 0.5,
          "raw_context": "model_type: deepseek_v3"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:deepseek-ai/DeepSeek-R1-0528",
          "value": "c4",
          "confidence": 0.5599999999999999,
          "raw_context": "ne-height: 1;\">\r   <a href=\"https://discord.gg/Tc7c45Zzu5\" target=\"_blank\" style=\"margin: 2px;\">"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:deepseek-ai/DeepSeek-R1-0528",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "div>\r  \r \r <p align=\"center\">\r   <a href=\"https://arxiv.org/pdf/2501.12948\"><b>Paper Link</b>👁️</a>\r </p>"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "c4",
        "arxiv"
      ],
      "base_model": "deepseek-ai/DeepSeek-R1-0528",
      "base_model_chain": [
        "deepseek-ai/DeepSeek-R1-0528"
      ],
      "training_section_present": true,
      "license": "mit",
      "provenance_score": 0.6,
      "provenance_hash": "3d3a9763686797555bf4503077e4adfdf0fcd77317c08b89a47945bc6a79928b"
    },
    {
      "model_id": "nvidia/DeepSeek-R1-NVFP4",
      "scanned_at": "2026-09-15T02:34:51.326726Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "deepseek-ai/DeepSeek-R1",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:deepseek-ai/DeepSeek-R1"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:deepseek-ai/DeepSeek-R1",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:deepseek-ai/DeepSeek-R1"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "MIT",
          "confidence": 0.6,
          "raw_context": "pseek-ai/DeepSeek-R1).  ### License/Terms of Use: [MIT](https://huggingface.co/datasets/choosealicense/licenses/blob/main/markdown/mit.md)"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "cnn_dailymail",
          "confidence": 0.6,
          "raw_context": "23.0**  <br>  ## Datasets: * Calibration Dataset: [cnn_dailymail](https://huggingface.co/datasets/abisee/cnn_dailymail) <br> ** Data collection meth"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "deepseek_v3",
          "confidence": 0.5,
          "raw_context": "model_type: deepseek_v3"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:deepseek-ai/DeepSeek-R1",
          "value": "c4",
          "confidence": 0.5599999999999999,
          "raw_context": "ine-height: 1;\">   <a href=\"https://discord.gg/Tc7c45Zzu5\" target=\"_blank\" style=\"margin: 2px;\">     <"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:deepseek-ai/DeepSeek-R1",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": ",       eprint={2501.12948},       archivePrefix={arXiv},       primaryClass={cs.CL},       url={https://"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:deepseek-ai/DeepSeek-R1",
          "value": "alpaca",
          "confidence": 0.5599999999999999,
          "raw_context": "| 72.5 | 80.5 | 73.3 | 76.9 | - | **82.5** | | | AlpacaEval2.0 (LC-winrate) | 52.0 | 51.1 | 70.0 | 57.8 |"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "c4",
        "arxiv",
        "alpaca"
      ],
      "base_model": "deepseek-ai/DeepSeek-R1",
      "base_model_chain": [
        "deepseek-ai/DeepSeek-R1"
      ],
      "training_section_present": true,
      "license": "mit",
      "provenance_score": 0.65,
      "provenance_hash": "d70dd8a8b5cde10ec7fc3ce14db8b11d70f02d22a8d9ed11835b07a01fb39caa"
    },
    {
      "model_id": "nvidia/DeepSeek-V3.1-NVFP4",
      "scanned_at": "2026-09-15T02:34:55.905941Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "deepseek-ai/DeepSeek-V3.1",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:deepseek-ai/DeepSeek-V3.1"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:deepseek-ai/DeepSeek-V3.1",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:deepseek-ai/DeepSeek-V3.1"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "MIT",
          "confidence": 0.6,
          "raw_context": "eek-ai/DeepSeek-V3.1).  ### License/Terms of Use: [MIT](https://huggingface.co/datasets/choosealicense/licenses/blob/main/markdown/mit.md)"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "cnn_dailymail",
          "confidence": 0.6,
          "raw_context": "## Calibration Datasets: * Calibration Dataset: [cnn_dailymail](https://huggingface.co/datasets/abisee/cnn_dailymail) <br> ** Data collection meth"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "deepseek_v3",
          "confidence": 0.5,
          "raw_context": "model_type: deepseek_v3"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:deepseek-ai/DeepSeek-V3.1",
          "value": "c4",
          "confidence": 0.5599999999999999,
          "raw_context": "ine-height: 1;\">   <a href=\"https://discord.gg/Tc7c45Zzu5\" target=\"_blank\" style=\"margin: 2px;\">     <"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:deepseek-ai/DeepSeek-V3.1",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": ",       eprint={2412.19437},       archivePrefix={arXiv},       primaryClass={cs.CL},       url={https://"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "c4",
        "arxiv"
      ],
      "base_model": "deepseek-ai/DeepSeek-V3.1",
      "base_model_chain": [
        "deepseek-ai/DeepSeek-V3.1",
        "deepseek-ai/DeepSeek-V3.1-Base"
      ],
      "training_section_present": true,
      "license": "mit",
      "provenance_score": 0.6,
      "provenance_hash": "d6606f96ff21d774e9342d7292ef11e85609794843cc24e0cab6016d66580ba2"
    },
    {
      "model_id": "nvidia/DeepSeek-V3.2-NVFP4",
      "scanned_at": "2026-09-15T02:35:01.499448Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "deepseek-ai/DeepSeek-V3.2",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:deepseek-ai/DeepSeek-V3.2"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:deepseek-ai/DeepSeek-V3.2",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:deepseek-ai/DeepSeek-V3.2"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "MIT",
          "confidence": 0.6,
          "raw_context": "eek-ai/DeepSeek-V3.2).  ### License/Terms of Use: [MIT](https://huggingface.co/datasets/choosealicense/licenses/blob/main/markdown/mit.md)"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "cnn_dailymail",
          "confidence": 0.6,
          "raw_context": "tion Datasets:  ## Calibration Dataset:  ** Link: [cnn_dailymail](https://huggingface.co/datasets/abisee/cnn_dailymail), [Nemotron-Post-Training-Dat"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Nemotron-Post-Training-Dataset-v2",
          "confidence": 0.6,
          "raw_context": "://huggingface.co/datasets/abisee/cnn_dailymail), [Nemotron-Post-Training-Dataset-v2](https://huggingface.co/datasets/nvidia/Nemotron-Post-Training-Dataset-v2) <br> **"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "deepseek_v32",
          "confidence": 0.5,
          "raw_context": "model_type: deepseek_v32"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:deepseek-ai/DeepSeek-V3.2",
          "value": "c4",
          "confidence": 0.5599999999999999,
          "raw_context": "ine-height: 1;\">   <a href=\"https://discord.gg/Tc7c45Zzu5\" target=\"_blank\" style=\"margin: 2px;\">     <"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "c4"
      ],
      "base_model": "deepseek-ai/DeepSeek-V3.2",
      "base_model_chain": [
        "deepseek-ai/DeepSeek-V3.2",
        "deepseek-ai/DeepSeek-V3.2-Exp-Base"
      ],
      "training_section_present": true,
      "license": "mit",
      "provenance_score": 0.55,
      "provenance_hash": "7272680525b56a18ce2edae5adc0a26371f39cc8538f4731e02776c3aa9b42f6"
    },
    {
      "model_id": "nvidia/Fixer",
      "scanned_at": "2026-09-15T02:35:07.020631Z",
      "signals": [
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "/github.com/nv-tlabs/Fixer) | [**Paper**](https://arxiv.org/abs/2503.01774)  ## Use the Fixer Model Pleas"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "other",
      "provenance_score": 0.45,
      "provenance_hash": "cec1205a2bb24ec52edb7e6643d615457aa9e3ca468b450f728eff7cc3f55e04"
    },
    {
      "model_id": "nvidia/Frame_VAD_Multilingual_MarbleNet_v2.0",
      "scanned_at": "2026-09-15T02:35:09.802207Z",
      "signals": [
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "[Freesound (noise)](https://freesound.org/) 12. [Vocalsound (noise)](https://github.com/YuanGongND/voc"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "Signal Processing (ICASSP). IEEE, 2021.](https://arxiv.org/abs/2010.13886)  <br> [2] [NVIDIA NeMo Toolki"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "other",
      "provenance_score": 0.5,
      "provenance_hash": "0a09c530d1d8d286db881ac016e5c6e96f02edaa101535522fcd85b9d65e73cd"
    },
    {
      "model_id": "nvidia/GR00T-N1.6-3B",
      "scanned_at": "2026-09-15T02:35:12.643337Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/PhysicalAI-Robotics-GR00T-X-Embodiment-Sim",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/PhysicalAI-Robotics-GR00T-X-Embodiment-Sim"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "st-Training for Frontier Vision-Language Models.\" arXiv:2504.15271 (2025).<br> Liu, Xingchao, and Chengyu"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "Gr00tN1d6",
          "confidence": 0.5,
          "raw_context": "model_type: Gr00tN1d6"
        }
      ],
      "declared_datasets": [
        "nvidia/PhysicalAI-Robotics-GR00T-X-Embodiment-Sim"
      ],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "17af9ff69f83aac54ec6b8b86c45bfe9051d17212cf6050d659906763bfcb804"
    },
    {
      "model_id": "nvidia/KVzap-mlp-Qwen3-8B",
      "scanned_at": "2026-09-15T02:35:15.385084Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/Nemotron-Pretraining-Dataset-sample",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/Nemotron-Pretraining-Dataset-sample"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Nemotron-Pretraining-Dataset-sample",
          "confidence": 0.6,
          "raw_context": "rxiv.org/abs/2505.23416), using 1.2M samples from [Nemotron-Pretraining-Dataset-sample](https://huggingface.co/datasets/nvidia/Nemotron-Pretraining-Dataset-sample). Train"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "tps://huggingface.co/collections/nvidia/kvzap) [![arXiv](https://img.shields.io/badge/arXiv-2601.07891-b3"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "kvzap",
          "confidence": 0.5,
          "raw_context": "model_type: kvzap"
        }
      ],
      "declared_datasets": [
        "nvidia/Nemotron-Pretraining-Dataset-sample"
      ],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "bf57b013c7723d5e6c5adbe432d997af39c492a20d6b3ca92307e449cc277401"
    },
    {
      "model_id": "nvidia/Kimi-K2-Thinking-NVFP4",
      "scanned_at": "2026-09-15T02:35:18.137145Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "moonshotai/Kimi-K2-Thinking",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:moonshotai/Kimi-K2-Thinking"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:moonshotai/Kimi-K2-Thinking",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:moonshotai/Kimi-K2-Thinking"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "cnn_dailymail",
          "confidence": 0.6,
          "raw_context": "## Calibration Datasets: * Calibration Dataset: [cnn_dailymail](https://huggingface.co/datasets/abisee/cnn_dailymail) <br> ** Data collection meth"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "deepseek_v3",
          "confidence": 0.5,
          "raw_context": "model_type: deepseek_v3"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:moonshotai/Kimi-K2-Thinking",
          "value": "voc",
          "confidence": 0.5599999999999999,
          "raw_context": "behavior across up to 200–300 consecutive tool invocations, surpassing prior models that degrade after"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "voc"
      ],
      "base_model": "moonshotai/Kimi-K2-Thinking",
      "base_model_chain": [
        "moonshotai/Kimi-K2-Thinking"
      ],
      "training_section_present": true,
      "license": "other",
      "provenance_score": 0.55,
      "provenance_hash": "22c8984631af6843beec1c5fd77b08e50d3ddd6e983db0c9dc68d106cf552ae5"
    },
    {
      "model_id": "nvidia/Kimi-K2.5-NVFP4",
      "scanned_at": "2026-09-15T02:35:22.727916Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "moonshotai/Kimi-K2.5",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:moonshotai/Kimi-K2.5"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:moonshotai/Kimi-K2.5",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:moonshotai/Kimi-K2.5"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "cnn_dailymail",
          "confidence": 0.6,
          "raw_context": "## Calibration Datasets: * Calibration Dataset: [cnn_dailymail](https://huggingface.co/datasets/abisee/cnn_dailymail) <br> ** Data collection meth"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "kimi_k25",
          "confidence": 0.5,
          "raw_context": "model_type: kimi_k25"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:moonshotai/Kimi-K2.5",
          "value": "image/png",
          "confidence": 0.6400000000000001,
          "raw_context": "_url',                     'image_url': {'url': f'data:image/png;base64, {image_base64}'},                 },"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:moonshotai/Kimi-K2.5",
          "value": "video/mp4",
          "confidence": 0.6400000000000001,
          "raw_context": "_url\",                     \"video_url\": {\"url\": f\"data:video/mp4;base64,{video_base64}\"},                 },"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:moonshotai/Kimi-K2.5",
          "value": "voc",
          "confidence": 0.5599999999999999,
          "raw_context": "** | 8 | | **Number of Shared Experts** | 1 | | **Vocabulary Size** | 160K | | **Context Length** | 256"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:moonshotai/Kimi-K2.5",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "nsformers pipeline_tag: image-text-to-text paper: arxiv.org/abs/2602.02276 --- <div align=\"center\">   <pi"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "image/png",
        "video/mp4",
        "voc",
        "arxiv"
      ],
      "base_model": "moonshotai/Kimi-K2.5",
      "base_model_chain": [
        "moonshotai/Kimi-K2.5"
      ],
      "training_section_present": true,
      "license": "other",
      "provenance_score": 0.7,
      "provenance_hash": "a8b8c82d3a3edea76fa7b78bdf35efb6259c0ffcadf4bc8ead3499a48d27400c"
    },
    {
      "model_id": "nvidia/Llama-3.1-8B-Instruct-FP8",
      "scanned_at": "2026-09-15T02:35:27.347226Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "meta-llama/Llama-3.1-8B-Instruct",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:meta-llama/Llama-3.1-8B-Instruct"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:meta-llama/Llama-3.1-8B-Instruct",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:meta-llama/Llama-3.1-8B-Instruct"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "cnn_dailymail",
          "confidence": 0.6,
          "raw_context": "27.0**  <br>  ## Datasets: * Calibration Dataset: [cnn_dailymail](https://huggingface.co/datasets/abisee/cnn_dailymail) <br> * Evaluation Dataset: ["
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "llama",
          "confidence": 0.5,
          "raw_context": "model_type: llama"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": "meta-llama/Llama-3.1-8B-Instruct",
      "base_model_chain": [
        "meta-llama/Llama-3.1-8B-Instruct",
        "meta-llama/Llama-3.1-8B"
      ],
      "training_section_present": true,
      "license": "llama3.1",
      "provenance_score": 0.5,
      "provenance_hash": "0d7c1712f2b97976f42d391cb06eed085c04436734e7b898c56b97fa91654a20"
    },
    {
      "model_id": "nvidia/Llama-3.1-8B-Instruct-NVFP4",
      "scanned_at": "2026-09-15T02:35:32.847500Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "meta-llama/Llama-3.1-8B-Instruct",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:meta-llama/Llama-3.1-8B-Instruct"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:meta-llama/Llama-3.1-8B-Instruct",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:meta-llama/Llama-3.1-8B-Instruct"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "cnn_dailymail",
          "confidence": 0.6,
          "raw_context": "ality * [Text]  ## Calibration Dataset:  ** Link: [cnn_dailymail](https://huggingface.co/datasets/abisee/cnn_dailymail) <br> ** Data collection meth"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "llama",
          "confidence": 0.5,
          "raw_context": "model_type: llama"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": "meta-llama/Llama-3.1-8B-Instruct",
      "base_model_chain": [
        "meta-llama/Llama-3.1-8B-Instruct",
        "meta-llama/Llama-3.1-8B"
      ],
      "training_section_present": true,
      "license": "other",
      "provenance_score": 0.5,
      "provenance_hash": "9016740e0af6be29c23d5b309749b551d886e165d860e34fb34457669f048a2f"
    },
    {
      "model_id": "nvidia/Llama-3.1-Nemotron-Nano-8B-v1",
      "scanned_at": "2026-09-15T02:35:35.606438Z",
      "signals": [
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "ama-Nemotron: Efficient Reasoning Models](https://arxiv.org/abs/2505.00949) - [\\[2502.00203\\] Reward-awar"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "nvidia/Llama-3.1-Nemotron-Nano-8B-v1",
          "confidence": 0.9,
          "raw_context": "_name_or_path: nvidia/Llama-3.1-Nemotron-Nano-8B-v1"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "llama",
          "confidence": 0.5,
          "raw_context": "model_type: llama"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "other",
      "provenance_score": 0.45,
      "provenance_hash": "24bab88a88488422c7224310d29e14ab00e53fa234f7a10b5a1f536f52c85485"
    },
    {
      "model_id": "nvidia/Llama-3.3-70B-Instruct-FP8",
      "scanned_at": "2026-09-15T02:35:38.366599Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "meta-llama/Llama-3.3-70B-Instruct",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:meta-llama/Llama-3.3-70B-Instruct"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:meta-llama/Llama-3.3-70B-Instruct",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:meta-llama/Llama-3.3-70B-Instruct"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "cnn_dailymail",
          "confidence": 0.6,
          "raw_context": "27.1**  <br>  ## Datasets: * Calibration Dataset: [cnn_dailymail](https://huggingface.co/datasets/abisee/cnn_dailymail) <br> ** Data collection meth"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "llama",
          "confidence": 0.5,
          "raw_context": "model_type: llama"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": "meta-llama/Llama-3.3-70B-Instruct",
      "base_model_chain": [
        "meta-llama/Llama-3.3-70B-Instruct",
        "meta-llama/Llama-3.1-70B"
      ],
      "training_section_present": true,
      "license": null,
      "provenance_score": 0.4,
      "provenance_hash": "c9bfe2ca2420273b50df6c04b94057b14c60616b22eb968768774615303a11ca"
    },
    {
      "model_id": "nvidia/Llama-3.3-70B-Instruct-NVFP4",
      "scanned_at": "2026-09-15T02:35:42.940100Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "meta-llama/Llama-3.3-70B-Instruct",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:meta-llama/Llama-3.3-70B-Instruct"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:meta-llama/Llama-3.3-70B-Instruct",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:meta-llama/Llama-3.3-70B-Instruct"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "cnn_dailymail",
          "confidence": 0.6,
          "raw_context": "23.0**  <br>  ## Datasets: * Calibration Dataset: [cnn_dailymail](https://huggingface.co/datasets/abisee/cnn_dailymail) <br> ** Data collection meth"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "/opt/models/llama3.3/Llama-3.3-70B-Instruct",
          "confidence": 0.9,
          "raw_context": "_name_or_path: /opt/models/llama3.3/Llama-3.3-70B-Instruct"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "llama",
          "confidence": 0.5,
          "raw_context": "model_type: llama"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": "meta-llama/Llama-3.3-70B-Instruct",
      "base_model_chain": [
        "meta-llama/Llama-3.3-70B-Instruct",
        "meta-llama/Llama-3.1-70B"
      ],
      "training_section_present": true,
      "license": "llama3.3",
      "provenance_score": 0.5,
      "provenance_hash": "304114a30fd8222d210259366c0474d29b4b74d9141ceff1070f099309bb09ff"
    },
    {
      "model_id": "nvidia/Llama-3_3-Nemotron-Super-49B-v1",
      "scanned_at": "2026-09-15T02:35:45.765531Z",
      "signals": [
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Llama-Nemotron-Postraining-Dataset-v1",
          "confidence": 0.6,
          "raw_context": "aining data, as public and permissive. Please see [Llama-Nemotron-Postraining-Dataset-v1](https://huggingface.co/datasets/nvidia/Llama-Nemotron-Post-Training-Dataset-v1)."
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "FineWeb",
          "confidence": 0.6,
          "raw_context": "on tokens consisting of a mixture of 3 datasets - FineWeb, Buzz-V1.2 and Dolma.  ## Intended use  Llama-3.3"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Dolma",
          "confidence": 0.6,
          "raw_context": "a mixture of 3 datasets - FineWeb, Buzz-V1.2 and Dolma.  ## Intended use  Llama-3.3-Nemotron-Super-49B-v"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "fineweb",
          "confidence": 0.7,
          "raw_context": "on tokens consisting of a mixture of 3 datasets - FineWeb, Buzz-V1.2 and Dolma.  ## Intended use  Llama-3.3"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "dolma",
          "confidence": 0.7,
          "raw_context": "a mixture of 3 datasets - FineWeb, Buzz-V1.2 and Dolma.  ## Intended use  Llama-3.3-Nemotron-Super-49B-v"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "AS approach, please refer to [this paper](https://arxiv.org/abs/2411.19146).  The model underwent a multi"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "nemotron-nas",
          "confidence": 0.5,
          "raw_context": "model_type: nemotron-nas"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "fineweb",
        "dolma",
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "other",
      "provenance_score": 0.55,
      "provenance_hash": "84b6fb2cc9193636f386352cb029afc12f76d98040d8ca5f60189b504a0a02c3"
    },
    {
      "model_id": "nvidia/Llama-3_3-Nemotron-Super-49B-v1-FP8",
      "scanned_at": "2026-09-15T02:35:48.520030Z",
      "signals": [
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "FineWeb",
          "confidence": 0.6,
          "raw_context": "on tokens consisting of a mixture of 3 datasets - FineWeb, Buzz-V1.2 and Dolma.  ## Intended use  Llama-3.3"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Dolma",
          "confidence": 0.6,
          "raw_context": "a mixture of 3 datasets - FineWeb, Buzz-V1.2 and Dolma.  ## Intended use  Llama-3.3-Nemotron-Super-49B-v"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "fineweb",
          "confidence": 0.7,
          "raw_context": "on tokens consisting of a mixture of 3 datasets - FineWeb, Buzz-V1.2 and Dolma.  ## Intended use  Llama-3.3"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "dolma",
          "confidence": 0.7,
          "raw_context": "a mixture of 3 datasets - FineWeb, Buzz-V1.2 and Dolma.  ## Intended use  Llama-3.3-Nemotron-Super-49B-v"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "AS approach, please refer to [this paper](https://arxiv.org/abs/2411.19146)  The model underwent a multi-"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "nvidia/Llama-3_3-Nemotron-Super-49B-v1",
          "confidence": 0.9,
          "raw_context": "_name_or_path: nvidia/Llama-3_3-Nemotron-Super-49B-v1"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "nemotron-nas",
          "confidence": 0.5,
          "raw_context": "model_type: nemotron-nas"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "fineweb",
        "dolma",
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "other",
      "provenance_score": 0.55,
      "provenance_hash": "c50d7252875760aae8b8324e2ccc838facfc77dcd14e3641484f700e00a87394"
    },
    {
      "model_id": "nvidia/Llama-3_3-Nemotron-Super-49B-v1_5",
      "scanned_at": "2026-09-15T02:35:51.327954Z",
      "signals": [
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Nemotron-Post-Training-Dataset-v1",
          "confidence": 0.6,
          "raw_context": "inguish between two modes.   We have released our [Nemotron-Post-Training-Dataset-v1](https://huggingface.co/datasets/nvidia/Nemotron-Post-Training-Dataset-v1) to promo"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "FineWeb",
          "confidence": 0.6,
          "raw_context": "on tokens consisting of a mixture of 3 datasets - FineWeb, Buzz-V1.2 and Dolma.  ## Intended use  Llama-3.3"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Dolma",
          "confidence": 0.6,
          "raw_context": "a mixture of 3 datasets - FineWeb, Buzz-V1.2 and Dolma.  ## Intended use  Llama-3.3-Nemotron-Super-49B-v"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "fineweb",
          "confidence": 0.7,
          "raw_context": "on tokens consisting of a mixture of 3 datasets - FineWeb, Buzz-V1.2 and Dolma.  ## Intended use  Llama-3.3"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "dolma",
          "confidence": 0.7,
          "raw_context": "a mixture of 3 datasets - FineWeb, Buzz-V1.2 and Dolma.  ## Intended use  Llama-3.3-Nemotron-Super-49B-v"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "c4",
          "confidence": 0.7,
          "raw_context": "etionMessageToolCall(id='chatcmpl-tool-e341c6954d2c48c2a0e9071c7bdefd8b', function=Function(arguments="
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "AS approach, please refer to [this paper](https://arxiv.org/abs/2411.19146)  The model underwent a multi-"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "nemotron-nas",
          "confidence": 0.5,
          "raw_context": "model_type: nemotron-nas"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "c4",
        "fineweb",
        "dolma",
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "other",
      "provenance_score": 0.6000000000000001,
      "provenance_hash": "f585a9e38ba68d5635441821e33d057de6d2ea6491681d23180b6d835e87129a"
    },
    {
      "model_id": "nvidia/Llama-3_3-Nemotron-Super-49B-v1_5-FP8",
      "scanned_at": "2026-09-15T02:35:54.095645Z",
      "signals": [
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Nemotron-Post-Training-Dataset-v1",
          "confidence": 0.6,
          "raw_context": "inguish between two modes.   We have released our [Nemotron-Post-Training-Dataset-v1](https://huggingface.co/datasets/nvidia/Nemotron-Post-Training-Dataset-v1) to promo"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "FineWeb",
          "confidence": 0.6,
          "raw_context": "on tokens consisting of a mixture of 3 datasets - FineWeb, Buzz-V1.2 and Dolma.  ## Intended use  Llama-3.3"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Dolma",
          "confidence": 0.6,
          "raw_context": "a mixture of 3 datasets - FineWeb, Buzz-V1.2 and Dolma.  ## Intended use  Llama-3.3-Nemotron-Super-49B-v"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "fineweb",
          "confidence": 0.7,
          "raw_context": "on tokens consisting of a mixture of 3 datasets - FineWeb, Buzz-V1.2 and Dolma.  ## Intended use  Llama-3.3"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "dolma",
          "confidence": 0.7,
          "raw_context": "a mixture of 3 datasets - FineWeb, Buzz-V1.2 and Dolma.  ## Intended use  Llama-3.3-Nemotron-Super-49B-v"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "c4",
          "confidence": 0.7,
          "raw_context": "etionMessageToolCall(id='chatcmpl-tool-e341c6954d2c48c2a0e9071c7bdefd8b', function=Function(arguments="
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "AS approach, please refer to [this paper](https://arxiv.org/abs/2411.19146)  The model underwent a multi-"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "nemotron-nas",
          "confidence": 0.5,
          "raw_context": "model_type: nemotron-nas"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "c4",
        "fineweb",
        "dolma",
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "other",
      "provenance_score": 0.6000000000000001,
      "provenance_hash": "c9fdff3b6a0c07264db23a0f8210dc3834b4c592276b244474fd5bae6e751b0a"
    },
    {
      "model_id": "nvidia/Llama-3_3-Nemotron-Super-49B-v1_5-NVFP4",
      "scanned_at": "2026-09-15T02:35:56.855921Z",
      "signals": [
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "FineWeb",
          "confidence": 0.6,
          "raw_context": "on tokens consisting of a mixture of 3 datasets - FineWeb, Buzz-V1.2 and Dolma.\r \r ## Intended use\r \r Llama"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Dolma",
          "confidence": 0.6,
          "raw_context": "a mixture of 3 datasets - FineWeb, Buzz-V1.2 and Dolma.\r \r ## Intended use\r \r Llama-3.3-Nemotron-Super-4"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "fineweb",
          "confidence": 0.7,
          "raw_context": "on tokens consisting of a mixture of 3 datasets - FineWeb, Buzz-V1.2 and Dolma.\r \r ## Intended use\r \r Llama"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "dolma",
          "confidence": 0.7,
          "raw_context": "a mixture of 3 datasets - FineWeb, Buzz-V1.2 and Dolma.\r \r ## Intended use\r \r Llama-3.3-Nemotron-Super-4"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "c4",
          "confidence": 0.7,
          "raw_context": "etionMessageToolCall(id='chatcmpl-tool-e341c6954d2c48c2a0e9071c7bdefd8b', function=Function(arguments="
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "AS approach, please refer to [this paper](https://arxiv.org/abs/2411.19146)\r \r The model underwent a mult"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "nemotron-nas",
          "confidence": 0.5,
          "raw_context": "model_type: nemotron-nas"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "c4",
        "fineweb",
        "dolma",
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "other",
      "provenance_score": 0.6000000000000001,
      "provenance_hash": "c080e41706925f4f4feb07abbb50fa129acf72c8c8de85b0cac4278176950cc0"
    },
    {
      "model_id": "nvidia/Llama-4-Scout-17B-16E-Instruct-NVFP4",
      "scanned_at": "2026-09-15T02:35:59.613788Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "meta-llama/Llama-4-Scout-17B-16E-Instruct",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:meta-llama/Llama-4-Scout-17B-16E-Instruct"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:meta-llama/Llama-4-Scout-17B-16E-Instruct",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:meta-llama/Llama-4-Scout-17B-16E-Instruct"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": "meta-llama/Llama-4-Scout-17B-16E-Instruct",
      "base_model_chain": [
        "meta-llama/Llama-4-Scout-17B-16E-Instruct",
        "meta-llama/Llama-4-Scout-17B-16E"
      ],
      "training_section_present": false,
      "license": "other",
      "provenance_score": 0.2,
      "provenance_hash": "fb56e320e837512423defb1e87bb8bbe766aa2ca25d44a8345ce0455f0490493"
    },
    {
      "model_id": "nvidia/Mistral-NeMo-Minitron-8B-Instruct",
      "scanned_at": "2026-09-15T02:36:05.107869Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "nvidia/Mistral-NeMo-Minitron-8B-Base",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:nvidia/Mistral-NeMo-Minitron-8B-Base"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:nvidia/Mistral-NeMo-Minitron-8B-Base",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:nvidia/Mistral-NeMo-Minitron-8B-Base"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "AEGIS",
          "confidence": 0.6,
          "raw_context": ", including prompt injection and data leakage.  - [AEGIS](https://huggingface.co/datasets/nvidia/Aegis-AI-Content-Safety-Dataset-1.0), is a"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "se) using [our LLM compression technique](https://arxiv.org/abs/2407.14679). The model was trained using"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "nvidia/Mistral-NeMo-Minitron-8B-Instruct",
          "confidence": 0.9,
          "raw_context": "_name_or_path: nvidia/Mistral-NeMo-Minitron-8B-Instruct"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "mistral",
          "confidence": 0.5,
          "raw_context": "model_type: mistral"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:nvidia/Mistral-NeMo-Minitron-8B-Base",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "e. Please refer to our [technical report](https://arxiv.org/abs/2408.11796) for more details.  **Model De"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": "nvidia/Mistral-NeMo-Minitron-8B-Base",
      "base_model_chain": [
        "nvidia/Mistral-NeMo-Minitron-8B-Base"
      ],
      "training_section_present": false,
      "license": "other",
      "provenance_score": 0.25,
      "provenance_hash": "be5847f8e0da7930cad21b1b26ebc5aa22044755ba51018046b6836744789115"
    },
    {
      "model_id": "nvidia/NV-Embed-v2",
      "scanned_at": "2026-09-15T02:36:09.716303Z",
      "signals": [
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "c4",
          "confidence": 0.7,
          "raw_context": ": MTEB ClimateFEVER       revision: 47f2ac6acb640fc46020b02a5b59fdda04d39380       split: test       t"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "- dataset:       config: default       name: MTEB ArxivClusteringP2P       revision: a122ad7f3f0291bf49cc"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "nvidia/NV-Embed-v2",
          "confidence": 0.9,
          "raw_context": "_name_or_path: nvidia/NV-Embed-v2"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "nvembed",
          "confidence": 0.5,
          "raw_context": "model_type: nvembed"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "c4",
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "cc-by-nc-4.0",
      "provenance_score": 0.2,
      "provenance_hash": "28784b384543e6d405cae721e453acb7caa0aa412a261d07e3e1980cd5425a3c"
    },
    {
      "model_id": "nvidia/NVIDIA-Nemotron-3-Nano-30B-A3B-Base-BF16",
      "scanned_at": "2026-09-15T02:36:12.564236Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/Nemotron-Pretraining-Code-v1",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/Nemotron-Pretraining-Code-v1"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/Nemotron-CC-v2",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/Nemotron-CC-v2"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/Nemotron-Pretraining-SFT-v1",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/Nemotron-Pretraining-SFT-v1"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/Nemotron-CC-Math-v1",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/Nemotron-CC-Math-v1"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/Nemotron-Pretraining-Code-v2",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/Nemotron-Pretraining-Code-v2"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/Nemotron-Pretraining-Specialized-v1",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/Nemotron-Pretraining-Specialized-v1"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/Nemotron-CC-v2.1",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/Nemotron-CC-v2.1"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/Nemotron-CC-Code-v1",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/Nemotron-CC-Code-v1"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/Nemotron-Pretraining-Dataset-sample",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/Nemotron-Pretraining-Dataset-sample"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Bespoke-Stratos-17k",
          "confidence": 0.6,
          "raw_context": "ia](https://dumps.wikimedia.org/) | 4/23/2025 | | [Bespoke-Stratos-17k](https://huggingface.co/datasets/bespokelabs/Bespoke-Stratos-17k) | 4/23/2025 | | ["
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "tigerbot-kaggle-leetcodesolutions-en-2k",
          "confidence": 0.6,
          "raw_context": "/bespokelabs/Bespoke-Stratos-17k) | 4/23/2025 | | [tigerbot-kaggle-leetcodesolutions-en-2k](https://huggingface.co/datasets/TigerResearch/tigerbot-kaggle-leetcodesolutions-en"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "glaive-function-calling-v2",
          "confidence": 0.6,
          "raw_context": "t-kaggle-leetcodesolutions-en-2k) | 4/23/2025 | | [glaive-function-calling-v2](https://huggingface.co/datasets/glaiveai/glaive-function-calling-v2) | 4/23/2025 |"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "LMSYS-Chat-1M",
          "confidence": 0.6,
          "raw_context": "sforce/xlam-function-calling-60k) | 4/23/2025 | | [LMSYS-Chat-1M](https://huggingface.co/datasets/lmsys/lmsys-chat-1m) | 4/23/2025 | | [Open Textboo"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "FineWeb-2",
          "confidence": 0.6,
          "raw_context": "//github.com/mandyyyyii/scibench) | 4/23/2025 | | [FineWeb-2](https://huggingface.co/datasets/HuggingFaceFW/fineweb-2) | 4/23/2025 | | [Court Li"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "peS2o",
          "confidence": 0.6,
          "raw_context": "er.com/help/api/bulk-data/) | Legacy Download | | [peS2o](https://huggingface.co/datasets/allenai/peS2o) | Legacy Download | | [OpenWebMath]"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "OpenWebMath",
          "confidence": 0.6,
          "raw_context": ".co/datasets/allenai/peS2o) | Legacy Download | | [OpenWebMath](https://huggingface.co/datasets/open-web-math/open-web-math) | Legacy Download | |"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "WikiTableQuestions",
          "confidence": 0.6,
          "raw_context": "ub.com/mandyyyyii/scibench) | Legacy Download | | [WikiTableQuestions](https://huggingface.co/datasets/wikitablequestions) | Legacy Download | | [FinQA]("
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "MedMCQA",
          "confidence": 0.6,
          "raw_context": "ematicsForHomeStudyMir1982) | Legacy Download | | [MedMCQA](https://huggingface.co/datasets/openlifescienceai/medmcqa) | Legacy Download | | ["
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "MCTest",
          "confidence": 0.6,
          "raw_context": "datasets/allenai/cosmos_qa) | Legacy Download | | [MCTest](https://huggingface.co/datasets/sagnikrayc/mctest) | Legacy Download | | [AI2's Re"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "social-chemestry-101",
          "confidence": 0.6,
          "raw_context": "viewer/all/auxiliary_train) | Legacy Download | | [social-chemestry-101](https://huggingface.co/datasets/tasksource/social-chemestry-101) | Legacy Download"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "FineMath",
          "confidence": 0.6,
          "raw_context": "huggingface.co/common-pile) | Legacy Download | | [FineMath](https://huggingface.co/datasets/HuggingFaceTB/finemath) | Legacy Download | | [Meg"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "MegaMath",
          "confidence": 0.6,
          "raw_context": "ets/HuggingFaceTB/finemath) | Legacy Download | | [MegaMath](https://huggingface.co/datasets/LLM360/MegaMath) | Legacy Download | | [MegaMath]("
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "MultiverseMathHard",
          "confidence": 0.6,
          "raw_context": "o/datasets/LLM360/MegaMath) | Legacy Download | | [MultiverseMathHard](https://huggingface.co/datasets/Nexusflow/MultiverseMathHard) | 10/2/2025 | | [New"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Essential-Web",
          "confidence": 0.6,
          "raw_context": "opus.nlpl.eu/News-Commentary.php) | 10/2/2025 | | [Essential-Web](https://huggingface.co/datasets/EssentialAI/essential-web-v1.0) | 10/2/2025 | | [f"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "finepdfs",
          "confidence": 0.6,
          "raw_context": "s/EssentialAI/essential-web-v1.0) | 10/2/2025 | | [finepdfs](https://huggingface.co/datasets/HuggingFaceFW/finepdfs) | 10/2/2025 | | [HotpotQA]"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Nemotron-PrismMath",
          "confidence": 0.6,
          "raw_context": "72B](https://huggingface.co/Qwen/Qwen2.5-72B) | | [Nemotron-PrismMath](https://huggingface.co/datasets/nvidia/Nemotron-PrismMath) | Text | 4.6B | [Big-Ma"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Big-Math-RL-Verified",
          "confidence": 0.6,
          "raw_context": "tasets/nvidia/Nemotron-PrismMath) | Text | 4.6B | [Big-Math-RL-Verified](https://huggingface.co/datasets/SynthLabsAI/Big-Math-RL-Verified); [OpenR1-Math-22"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "OpenR1-Math-220k",
          "confidence": 0.6,
          "raw_context": "ce.co/datasets/SynthLabsAI/Big-Math-RL-Verified); [OpenR1-Math-220k](https://huggingface.co/datasets/open-r1/OpenR1-Math-220k) | [Qwen2.5-0.5B-instruct"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "AQUA-RAT",
          "confidence": 0.6,
          "raw_context": "DeepSeek-V3 and DeepSeek-V3-0324 | Text | 4.0B | [AQUA-RAT](https://huggingface.co/datasets/deepmind/aqua_rat); [LogiQA](https://huggingface.c"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "LogiQA",
          "confidence": 0.6,
          "raw_context": "tps://huggingface.co/datasets/deepmind/aqua_rat); [LogiQA](https://huggingface.co/datasets/lucasmccabe/logiqa); [AR-LSAT](https://github.com/"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "OpenCodeReasoning",
          "confidence": 0.6,
          "raw_context": "Reasoning from DeepSeek-R1 | Text | Undisclosed | [OpenCodeReasoning](https://huggingface.co/datasets/nvidia/OpenCodeReasoning) | [DeepSeek-R1](https://"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "LIMO",
          "confidence": 0.6,
          "raw_context": "LIMO from DeepSeek-R1-0528 | Text | Undisclosed | [LIMO](https://huggingface.co/datasets/GAIR/LIMO) | [DeepSeek-R1-0528](https://huggingfac"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "SCP-116K",
          "confidence": 0.6,
          "raw_context": "SCP from DeepSeek-R1-0528 | Text | Undisclosed | [SCP-116K](https://huggingface.co/datasets/EricLu/SCP-116K) | [DeepSeek-R1-0528](https://hugg"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Magicoder-Evol-Instruct-110K",
          "confidence": 0.6,
          "raw_context": "ek-R1 and DeepSeek-R1-0528 | Text | Undisclosed | [Magicoder-Evol-Instruct-110K](https://huggingface.co/datasets/ise-uiuc/Magicoder-Evol-Instruct-110K); [opc-sft-s"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "opc-sft-stage2",
          "confidence": 0.6,
          "raw_context": "/datasets/ise-uiuc/Magicoder-Evol-Instruct-110K); [opc-sft-stage2](https://huggingface.co/datasets/OpenCoder-LLM/opc-sft-stage2); [TACO](https://hugg"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "TACO",
          "confidence": 0.6,
          "raw_context": "ngface.co/datasets/OpenCoder-LLM/opc-sft-stage2); [TACO](https://huggingface.co/datasets/BAAI/TACO); [OpenCodeReasoning](https://huggingfac"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "OpenMathReasoning",
          "confidence": 0.6,
          "raw_context": "uggingface.co/datasets/nvidia/OpenCodeReasoning); [OpenMathReasoning](https://huggingface.co/datasets/nvidia/OpenMathReasoning); [NuminaMath CoT](https:"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "commoncrawl",
          "confidence": 0.6,
          "raw_context": "de-school-math) | 4/23/2025 | | [CC-NEWS](https://commoncrawl.org/blog/news-dataset-available) | 4/23/2025 | |"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Common Crawl",
          "confidence": 0.6,
          "raw_context": "org/blog/news-dataset-available) | 4/23/2025 | | [Common Crawl](https://commoncrawl.org/) | 4/23/2025 | | [Wikim"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "FineWeb",
          "confidence": 0.6,
          "raw_context": "/github.com/mandyyyyii/scibench) | 4/23/2025 | | [FineWeb-2](https://huggingface.co/datasets/HuggingFaceFW/"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "OpenWebText",
          "confidence": 0.6,
          "raw_context": "nih.gov/tools/openftlist/) | Legacy Download | | [OpenWebText2](https://openwebtext2.readthedocs.io/en/latest/)"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Wikipedia",
          "confidence": 0.6,
          "raw_context": "e.co/Qwen/Qwen3-30B-A3B) | | Translated Synthetic Wikipedia | Text | 7.9B | [Wikimedia](https://dumps.wikimed"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "wikipedia",
          "confidence": 0.7,
          "raw_context": "e.co/Qwen/Qwen3-30B-A3B) | | Translated Synthetic Wikipedia | Text | 7.9B | [Wikimedia](https://dumps.wikimed"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "lmsys-chat",
          "confidence": 0.7,
          "raw_context": "force/xlam-function-calling-60k) | 4/23/2025 | | [LMSYS-Chat-1M](https://huggingface.co/datasets/lmsys/lmsys-c"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "fineweb",
          "confidence": 0.7,
          "raw_context": "/github.com/mandyyyyii/scibench) | 4/23/2025 | | [FineWeb-2](https://huggingface.co/datasets/HuggingFaceFW/"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "common crawl",
          "confidence": 0.7,
          "raw_context": "org/blog/news-dataset-available) | 4/23/2025 | | [Common Crawl](https://commoncrawl.org/) | 4/23/2025 | | [Wikim"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "openwebtext",
          "confidence": 0.7,
          "raw_context": "nih.gov/tools/openftlist/) | Legacy Download | | [OpenWebText2](https://openwebtext2.readthedocs.io/en/latest/)"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "pubmed",
          "confidence": 0.7,
          "raw_context": "org/details/stackexchange) | Legacy Download | | [PubMed Abstracts](https://github.com/thoppe/The-Pile-Pub"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "vertical-align: middle;\"/> </a> <a href=\"https://arxiv.org/abs/2512.20848\" target=\"_blank\" style=\"margin"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "squad",
          "confidence": 0.7,
          "raw_context": "ggingface.co/hotpot_qa/datasets) | 10/2/2025 | | [SQuAD2.0](https://rajpurkar.github.io/SQuAD-explorer/)"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "nemotron_h",
          "confidence": 0.5,
          "raw_context": "model_type: nemotron_h"
        }
      ],
      "declared_datasets": [
        "nvidia/Nemotron-Pretraining-Code-v2",
        "nvidia/Nemotron-CC-Math-v1",
        "nvidia/Nemotron-CC-v2.1",
        "nvidia/Nemotron-Pretraining-Dataset-sample",
        "nvidia/Nemotron-Pretraining-Specialized-v1",
        "nvidia/Nemotron-CC-v2",
        "nvidia/Nemotron-Pretraining-Code-v1",
        "nvidia/Nemotron-Pretraining-SFT-v1",
        "nvidia/Nemotron-CC-Code-v1"
      ],
      "inferred_datasets": [
        "wikipedia",
        "pubmed",
        "fineweb",
        "arxiv",
        "openwebtext",
        "squad",
        "common crawl",
        "lmsys-chat"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "other",
      "provenance_score": 0.8999999999999999,
      "provenance_hash": "871c3ee55af863196ef342d65724f0ecbff736bc78dcec14f1776ae21fde201e"
    },
    {
      "model_id": "nvidia/NVIDIA-Nemotron-Nano-12B-v2-VL-BF16",
      "scanned_at": "2026-09-15T02:36:15.325624Z",
      "signals": [
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "matting. More details can be found [here](https://arxiv.org/abs/2501.14818).    ** Image based datasets w"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "NemotronH_Nano_VL_V2",
          "confidence": 0.5,
          "raw_context": "model_type: NemotronH_Nano_VL_V2"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "other",
      "provenance_score": 0.45,
      "provenance_hash": "95aa9eb0ef0be21f51a9a913ceef5b6a98d9bb6de1de0feb60fc9404bca8e497"
    },
    {
      "model_id": "nvidia/NVIDIA-Nemotron-Nano-12B-v2-VL-FP8",
      "scanned_at": "2026-09-15T02:36:18.083637Z",
      "signals": [
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "matting. More details can be found [here](https://arxiv.org/abs/2501.14818).    ** Image based datasets w"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "NemotronH_Nano_VL_V2",
          "confidence": 0.5,
          "raw_context": "model_type: NemotronH_Nano_VL_V2"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "other",
      "provenance_score": 0.45,
      "provenance_hash": "5c225dbc312c38b24d64ba2e9d4c1f1a932829747f94216e8d00a0f6aaab1dd4"
    },
    {
      "model_id": "nvidia/NVIDIA-Nemotron-Nano-9B-v2-Base",
      "scanned_at": "2026-09-15T02:36:20.837640Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/Nemotron-Pretraining-Dataset-sample",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/Nemotron-Pretraining-Dataset-sample"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/Nemotron-CC-v2",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/Nemotron-CC-v2"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/Nemotron-CC-Math-v1",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/Nemotron-CC-Math-v1"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/Nemotron-Pretraining-Code-v1",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/Nemotron-Pretraining-Code-v1"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/Nemotron-Pretraining-SFT-v1",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/Nemotron-Pretraining-SFT-v1"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Bespoke-Stratos-17k",
          "confidence": 0.6,
          "raw_context": "ia](https://dumps.wikimedia.org/) | 4/23/2025 | | [Bespoke-Stratos-17k](https://huggingface.co/datasets/bespokelabs/Bespoke-Stratos-17k) | 4/23/2025 | | ["
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "tigerbot-kaggle-leetcodesolutions-en-2k",
          "confidence": 0.6,
          "raw_context": "/bespokelabs/Bespoke-Stratos-17k) | 4/23/2025 | | [tigerbot-kaggle-leetcodesolutions-en-2k](https://huggingface.co/datasets/TigerResearch/tigerbot-kaggle-leetcodesolutions-en"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "glaive-function-calling-v2",
          "confidence": 0.6,
          "raw_context": "t-kaggle-leetcodesolutions-en-2k) | 4/23/2025 | | [glaive-function-calling-v2](https://huggingface.co/datasets/glaiveai/glaive-function-calling-v2) | 4/23/2025 |"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "LMSYS-Chat-1M",
          "confidence": 0.6,
          "raw_context": "sforce/xlam-function-calling-60k) | 4/23/2025 | | [LMSYS-Chat-1M](https://huggingface.co/datasets/lmsys/lmsys-chat-1m) | 4/23/2025 | | [Open Textboo"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "FineWeb-2",
          "confidence": 0.6,
          "raw_context": "//github.com/mandyyyyii/scibench) | 4/23/2025 | | [FineWeb-2](https://huggingface.co/datasets/HuggingFaceFW/fineweb-2) | 4/23/2025 | | [Court Li"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "peS2o",
          "confidence": 0.6,
          "raw_context": "er.com/help/api/bulk-data/) | Legacy Download | | [peS2o](https://huggingface.co/datasets/allenai/peS2o) | Legacy Download | | [OpenWebMath]"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "OpenWebMath",
          "confidence": 0.6,
          "raw_context": ".co/datasets/allenai/peS2o) | Legacy Download | | [OpenWebMath](https://huggingface.co/datasets/open-web-math/open-web-math) | Legacy Download | |"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "WikiTableQuestions",
          "confidence": 0.6,
          "raw_context": "ub.com/mandyyyyii/scibench) | Legacy Download | | [WikiTableQuestions](https://huggingface.co/datasets/wikitablequestions) | Legacy Download | | [FinQA]("
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "MedMCQA",
          "confidence": 0.6,
          "raw_context": "ematicsForHomeStudyMir1982) | Legacy Download | | [MedMCQA](https://huggingface.co/datasets/openlifescienceai/medmcqa) | Legacy Download | | ["
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "MCTest",
          "confidence": 0.6,
          "raw_context": "datasets/allenai/cosmos_qa) | Legacy Download | | [MCTest](https://huggingface.co/datasets/sagnikrayc/mctest) | Legacy Download | | [AI2's Re"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "social-chemestry-101",
          "confidence": 0.6,
          "raw_context": "viewer/all/auxiliary_train) | Legacy Download | | [social-chemestry-101](https://huggingface.co/datasets/tasksource/social-chemestry-101) | Legacy Download"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "FineMath",
          "confidence": 0.6,
          "raw_context": "huggingface.co/common-pile) | Legacy Download | | [FineMath](https://huggingface.co/datasets/HuggingFaceTB/finemath) | Legacy Download | | [Meg"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "MegaMath",
          "confidence": 0.6,
          "raw_context": "ets/HuggingFaceTB/finemath) | Legacy Download | | [MegaMath](https://huggingface.co/datasets/LLM360/MegaMath) | Legacy Download |  ## Private N"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Nemotron-PrismMath",
          "confidence": 0.6,
          "raw_context": "72B](https://huggingface.co/Qwen/Qwen2.5-72B) | | [Nemotron-PrismMath](https://huggingface.co/datasets/nvidia/Nemotron-PrismMath) | Text | 4.6B | [Big-Ma"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Big-Math-RL-Verified",
          "confidence": 0.6,
          "raw_context": "tasets/nvidia/Nemotron-PrismMath) | Text | 4.6B | [Big-Math-RL-Verified](https://huggingface.co/datasets/SynthLabsAI/Big-Math-RL-Verified); [OpenR1-Math-22"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "OpenR1-Math-220k",
          "confidence": 0.6,
          "raw_context": "ce.co/datasets/SynthLabsAI/Big-Math-RL-Verified); [OpenR1-Math-220k](https://huggingface.co/datasets/open-r1/OpenR1-Math-220k) | [Qwen2.5-0.5B-instruct"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Nemotron-MIND",
          "confidence": 0.6,
          "raw_context": "gface.co/Qwen/Qwen2.5-72B-Instruct) | | Refreshed [Nemotron-MIND](https://huggingface.co/datasets/nvidia/Nemotron-MIND) from phi-4 | Text | 73B | [C"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "AQUA-RAT",
          "confidence": 0.6,
          "raw_context": "DeepSeek-V3 and DeepSeek-V3-0324 | Text | 4.0B | [AQUA-RAT](https://huggingface.co/datasets/deepmind/aqua_rat); [LogiQA](https://huggingface.c"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "LogiQA",
          "confidence": 0.6,
          "raw_context": "tps://huggingface.co/datasets/deepmind/aqua_rat); [LogiQA](https://huggingface.co/datasets/lucasmccabe/logiqa); [AR-LSAT](https://github.com/"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "commoncrawl",
          "confidence": 0.6,
          "raw_context": "de-school-math) | 4/23/2025 | | [CC-NEWS](https://commoncrawl.org/blog/news-dataset-available) | 4/23/2025 | |"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Common Crawl",
          "confidence": 0.6,
          "raw_context": "org/blog/news-dataset-available) | 4/23/2025 | | [Common Crawl](https://commoncrawl.org/) | 4/23/2025 | | [Wikim"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "FineWeb",
          "confidence": 0.6,
          "raw_context": "/github.com/mandyyyyii/scibench) | 4/23/2025 | | [FineWeb-2](https://huggingface.co/datasets/HuggingFaceFW/"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "OpenWebText",
          "confidence": 0.6,
          "raw_context": "nih.gov/tools/openftlist/) | Legacy Download | | [OpenWebText2](https://openwebtext2.readthedocs.io/en/latest/)"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Wikipedia",
          "confidence": 0.6,
          "raw_context": "for Nemotron-CC. Additionally, we used data from Wikipedia and FineWeb-2 (Penedo et al., 2025\\) for these fi"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "wikipedia",
          "confidence": 0.7,
          "raw_context": "for Nemotron-CC. Additionally, we used data from Wikipedia and FineWeb-2 (Penedo et al., 2025\\) for these fi"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "lmsys-chat",
          "confidence": 0.7,
          "raw_context": "force/xlam-function-calling-60k) | 4/23/2025 | | [LMSYS-Chat-1M](https://huggingface.co/datasets/lmsys/lmsys-c"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "fineweb",
          "confidence": 0.7,
          "raw_context": "/github.com/mandyyyyii/scibench) | 4/23/2025 | | [FineWeb-2](https://huggingface.co/datasets/HuggingFaceFW/"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "common crawl",
          "confidence": 0.7,
          "raw_context": "org/blog/news-dataset-available) | 4/23/2025 | | [Common Crawl](https://commoncrawl.org/) | 4/23/2025 | | [Wikim"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "openwebtext",
          "confidence": 0.7,
          "raw_context": "nih.gov/tools/openftlist/) | Legacy Download | | [OpenWebText2](https://openwebtext2.readthedocs.io/en/latest/)"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "pubmed",
          "confidence": 0.7,
          "raw_context": "org/details/stackexchange) | Legacy Download | | [PubMed Abstracts](https://github.com/thoppe/The-Pile-Pub"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "Hybrid Mamba-Transformer Reasoning Model](https://arxiv.org/abs/2508.14444)  ## Model Architecture  - **A"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "nemotron_h",
          "confidence": 0.5,
          "raw_context": "model_type: nemotron_h"
        }
      ],
      "declared_datasets": [
        "nvidia/Nemotron-Pretraining-Dataset-sample",
        "nvidia/Nemotron-CC-Math-v1",
        "nvidia/Nemotron-CC-v2",
        "nvidia/Nemotron-Pretraining-Code-v1",
        "nvidia/Nemotron-Pretraining-SFT-v1"
      ],
      "inferred_datasets": [
        "wikipedia",
        "pubmed",
        "fineweb",
        "arxiv",
        "openwebtext",
        "common crawl",
        "lmsys-chat"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "other",
      "provenance_score": 0.8999999999999999,
      "provenance_hash": "d2ae5282a7b17cba68aa153720a5b28674b1ef96eb2836e1a9f0148b162bf62f"
    },
    {
      "model_id": "nvidia/NVIDIA-Nemotron-Nano-9B-v2-FP8",
      "scanned_at": "2026-09-15T02:36:23.645933Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/Nemotron-Post-Training-Dataset-v1",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/Nemotron-Post-Training-Dataset-v1"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/Nemotron-Post-Training-Dataset-v2",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/Nemotron-Post-Training-Dataset-v2"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/Nemotron-Pretraining-Dataset-sample",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/Nemotron-Pretraining-Dataset-sample"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/Nemotron-CC-v2",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/Nemotron-CC-v2"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/Nemotron-CC-Math-v1",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/Nemotron-CC-Math-v1"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/Nemotron-Pretraining-SFT-v1",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/Nemotron-Pretraining-SFT-v1"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:nvidia/NVIDIA-Nemotron-Nano-9B-v2"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Bespoke-Stratos-17k",
          "confidence": 0.6,
          "raw_context": "ia](https://dumps.wikimedia.org/) | 4/23/2025 | | [Bespoke-Stratos-17k](https://huggingface.co/datasets/bespokelabs/Bespoke-Stratos-17k) | 4/23/2025 | | ["
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "tigerbot-kaggle-leetcodesolutions-en-2k",
          "confidence": 0.6,
          "raw_context": "/bespokelabs/Bespoke-Stratos-17k) | 4/23/2025 | | [tigerbot-kaggle-leetcodesolutions-en-2k](https://huggingface.co/datasets/TigerResearch/tigerbot-kaggle-leetcodesolutions-en"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "glaive-function-calling-v2",
          "confidence": 0.6,
          "raw_context": "t-kaggle-leetcodesolutions-en-2k) | 4/23/2025 | | [glaive-function-calling-v2](https://huggingface.co/datasets/glaiveai/glaive-function-calling-v2) | 4/23/2025 |"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "LMSYS-Chat-1M",
          "confidence": 0.6,
          "raw_context": "sforce/xlam-function-calling-60k) | 4/23/2025 | | [LMSYS-Chat-1M](https://huggingface.co/datasets/lmsys/lmsys-chat-1m) | 4/23/2025 | | [Open Textboo"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "FineWeb-2",
          "confidence": 0.6,
          "raw_context": "//github.com/mandyyyyii/scibench) | 4/23/2025 | | [FineWeb-2](https://huggingface.co/datasets/HuggingFaceFW/fineweb-2) | 4/23/2025 | | [Court Li"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "peS2o",
          "confidence": 0.6,
          "raw_context": "er.com/help/api/bulk-data/) | Legacy Download | | [peS2o](https://huggingface.co/datasets/allenai/peS2o) | Legacy Download | | [OpenWebMath]"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "OpenWebMath",
          "confidence": 0.6,
          "raw_context": ".co/datasets/allenai/peS2o) | Legacy Download | | [OpenWebMath](https://huggingface.co/datasets/open-web-math/open-web-math) | Legacy Download | |"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "mC4",
          "confidence": 0.6,
          "raw_context": "datasets/bigcode/the-stack) | Legacy Download | | [mC4](https://huggingface.co/datasets/legacy-datasets/mc4) | Legacy Download | | [Advanc"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "WikiTableQuestions",
          "confidence": 0.6,
          "raw_context": "ub.com/mandyyyyii/scibench) | Legacy Download | | [WikiTableQuestions](https://huggingface.co/datasets/wikitablequestions) | Legacy Download | | [FinQA]("
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "MedMCQA",
          "confidence": 0.6,
          "raw_context": "ematicsForHomeStudyMir1982) | Legacy Download | | [MedMCQA](https://huggingface.co/datasets/openlifescienceai/medmcqa) | Legacy Download | | ["
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "MCTest",
          "confidence": 0.6,
          "raw_context": "datasets/allenai/cosmos_qa) | Legacy Download | | [MCTest](https://huggingface.co/datasets/sagnikrayc/mctest) | Legacy Download | | [AI2's Re"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "social-chemestry-101",
          "confidence": 0.6,
          "raw_context": "viewer/all/auxiliary_train) | Legacy Download | | [social-chemestry-101](https://huggingface.co/datasets/tasksource/social-chemestry-101) | Legacy Download"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "FineMath",
          "confidence": 0.6,
          "raw_context": "huggingface.co/common-pile) | Legacy Download | | [FineMath](https://huggingface.co/datasets/HuggingFaceTB/finemath) | Legacy Download | | [Meg"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "MegaMath",
          "confidence": 0.6,
          "raw_context": "ets/HuggingFaceTB/finemath) | Legacy Download | | [MegaMath](https://huggingface.co/datasets/LLM360/MegaMath) | Legacy Download | | [FastChat]("
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Nemotron-PrismMath",
          "confidence": 0.6,
          "raw_context": "72B](https://huggingface.co/Qwen/Qwen2.5-72B) | | [Nemotron-PrismMath](https://huggingface.co/datasets/nvidia/Nemotron-PrismMath) | Text | 4.6B | [Big-Ma"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Big-Math-RL-Verified",
          "confidence": 0.6,
          "raw_context": "tasets/nvidia/Nemotron-PrismMath) | Text | 4.6B | [Big-Math-RL-Verified](https://huggingface.co/datasets/SynthLabsAI/Big-Math-RL-Verified); [OpenR1-Math-22"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "OpenR1-Math-220k",
          "confidence": 0.6,
          "raw_context": "ce.co/datasets/SynthLabsAI/Big-Math-RL-Verified); [OpenR1-Math-220k](https://huggingface.co/datasets/open-r1/OpenR1-Math-220k) | [Qwen2.5-0.5B-instruct"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Nemotron-MIND",
          "confidence": 0.6,
          "raw_context": "s://huggingface.co/microsoft/phi-4) | | Refreshed [Nemotron-MIND](https://huggingface.co/datasets/nvidia/Nemotron-MIND) from phi-4 | Text | 73B | [C"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "AQUA-RAT",
          "confidence": 0.6,
          "raw_context": "DeepSeek-V3 and DeepSeek-V3-0324 | Text | 4.0B | [AQUA-RAT](https://huggingface.co/datasets/deepmind/aqua_rat); [LogiQA](https://huggingface.c"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "LogiQA",
          "confidence": 0.6,
          "raw_context": "tps://huggingface.co/datasets/deepmind/aqua_rat); [LogiQA](https://huggingface.co/datasets/lucasmccabe/logiqa); [AR-LSAT](https://github.com/"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "OpenMathReasoning",
          "confidence": 0.6,
          "raw_context": "thReasoning from DeepSeek-R1-0528 | Text | 1.5M | [OpenMathReasoning](https://huggingface.co/datasets/nvidia/OpenMathReasoning) | [DeepSeek-R1-0528](htt"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "OpenCodeReasoning",
          "confidence": 0.6,
          "raw_context": "deReasoning from DeepSeek-R1-0528 | Text | 1.1M | [OpenCodeReasoning](https://huggingface.co/datasets/nvidia/OpenCodeReasoning) | [DeepSeek-R1-0528](htt"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "HelpSteer3",
          "confidence": 0.6,
          "raw_context": "ic HelpSteer from Qwen3-235B-A22B | Text | 120K | [HelpSteer3](https://huggingface.co/datasets/nvidia/HelpSteer3); [HelpSteer2](https://huggingfa"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "HelpSteer2",
          "confidence": 0.6,
          "raw_context": "tps://huggingface.co/datasets/nvidia/HelpSteer3); [HelpSteer2](https://huggingface.co/datasets/nvidia/HelpSteer2) | [Qwen3-235B-A22B](https://hug"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "ShareGPT52K",
          "confidence": 0.6,
          "raw_context": "s://huggingface.co/datasets/lmsys/lmsys-chat-1m); [ShareGPT52K](https://huggingface.co/datasets/RyokoAI/ShareGPT52K); [tigerbot-kaggle-leetcodesol"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "WildChat",
          "confidence": 0.6,
          "raw_context": "22B and Gemma 3 Post-Trained models | Text | 5M | [WildChat](https://huggingface.co/datasets/allenai/WildChat-1M) | [Qwen3-235B-A22B](https://h"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "commoncrawl",
          "confidence": 0.6,
          "raw_context": "openai/prm800k) | 4/23/2025 | | [CC-NEWS](https://commoncrawl.org/blog/news-dataset-available) | 4/23/2025 | |"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Common Crawl",
          "confidence": 0.6,
          "raw_context": "org/blog/news-dataset-available) | 4/23/2025 | | [Common Crawl](https://commoncrawl.org/) | 4/23/2025 | | [Wikim"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "FineWeb",
          "confidence": 0.6,
          "raw_context": "/github.com/mandyyyyii/scibench) | 4/23/2025 | | [FineWeb-2](https://huggingface.co/datasets/HuggingFaceFW/"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "OpenWebText",
          "confidence": 0.6,
          "raw_context": "nih.gov/tools/openftlist/) | Legacy Download | | [OpenWebText2](https://openwebtext2.readthedocs.io/en/latest/)"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "The Stack",
          "confidence": 0.6,
          "raw_context": "mmary-of-dataset-versions) | Legacy Download | | [The Stack](https://huggingface.co/datasets/bigcode/the-stac"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "lmsys-chat",
          "confidence": 0.7,
          "raw_context": "force/xlam-function-calling-60k) | 4/23/2025 | | [LMSYS-Chat-1M](https://huggingface.co/datasets/lmsys/lmsys-c"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "fineweb",
          "confidence": 0.7,
          "raw_context": "/github.com/mandyyyyii/scibench) | 4/23/2025 | | [FineWeb-2](https://huggingface.co/datasets/HuggingFaceFW/"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "common crawl",
          "confidence": 0.7,
          "raw_context": "org/blog/news-dataset-available) | 4/23/2025 | | [Common Crawl](https://commoncrawl.org/) | 4/23/2025 | | [Wikim"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "mc4",
          "confidence": 0.7,
          "raw_context": "atasets/bigcode/the-stack) | Legacy Download | | [mC4](https://huggingface.co/datasets/legacy-datasets/"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "sharegpt",
          "confidence": 0.7,
          "raw_context": "://huggingface.co/datasets/lmsys/lmsys-chat-1m); [ShareGPT52K](https://huggingface.co/datasets/RyokoAI/Share"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "openwebtext",
          "confidence": 0.7,
          "raw_context": "nih.gov/tools/openftlist/) | Legacy Download | | [OpenWebText2](https://openwebtext2.readthedocs.io/en/latest/)"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "the stack",
          "confidence": 0.7,
          "raw_context": "mmary-of-dataset-versions) | Legacy Download | | [The Stack](https://huggingface.co/datasets/bigcode/the-stac"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "pubmed",
          "confidence": 0.7,
          "raw_context": "org/details/stackexchange) | Legacy Download | | [PubMed Abstracts](https://github.com/thoppe/The-Pile-Pub"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "c4",
          "confidence": 0.7,
          "raw_context": "etionMessageToolCall(id='chatcmpl-tool-e341c6954d2c48c2a0e9071c7bdefd8b', function=Function(arguments="
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "ase refer to the [Nemotron-H tech report](https://arxiv.org/abs/2504.03624).  Nano 9B v2 has 56 layers in"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "nemotron_h",
          "confidence": 0.5,
          "raw_context": "model_type: nemotron_h"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "Bespoke-Stratos-17k",
          "confidence": 0.48,
          "raw_context": "ia](https://dumps.wikimedia.org/) | 4/23/2025 | | [Bespoke-Stratos-17k](https://huggingface.co/datasets/bespokelabs/Bespoke-Stratos-17k) | 4/23/2025 | | ["
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "tigerbot-kaggle-leetcodesolutions-en-2k",
          "confidence": 0.48,
          "raw_context": "/bespokelabs/Bespoke-Stratos-17k) | 4/23/2025 | | [tigerbot-kaggle-leetcodesolutions-en-2k](https://huggingface.co/datasets/TigerResearch/tigerbot-kaggle-leetcodesolutions-en"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "glaive-function-calling-v2",
          "confidence": 0.48,
          "raw_context": "t-kaggle-leetcodesolutions-en-2k) | 4/23/2025 | | [glaive-function-calling-v2](https://huggingface.co/datasets/glaiveai/glaive-function-calling-v2) | 4/23/2025 |"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "LMSYS-Chat-1M",
          "confidence": 0.48,
          "raw_context": "sforce/xlam-function-calling-60k) | 4/23/2025 | | [LMSYS-Chat-1M](https://huggingface.co/datasets/lmsys/lmsys-chat-1m) | 4/23/2025 | | [Open Textboo"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "FineWeb-2",
          "confidence": 0.48,
          "raw_context": "//github.com/mandyyyyii/scibench) | 4/23/2025 | | [FineWeb-2](https://huggingface.co/datasets/HuggingFaceFW/fineweb-2) | 4/23/2025 | | [Court Li"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "peS2o",
          "confidence": 0.48,
          "raw_context": "er.com/help/api/bulk-data/) | Legacy Download | | [peS2o](https://huggingface.co/datasets/allenai/peS2o) | Legacy Download | | [OpenWebMath]"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "OpenWebMath",
          "confidence": 0.48,
          "raw_context": ".co/datasets/allenai/peS2o) | Legacy Download | | [OpenWebMath](https://huggingface.co/datasets/open-web-math/open-web-math) | Legacy Download | |"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "mC4",
          "confidence": 0.48,
          "raw_context": "datasets/bigcode/the-stack) | Legacy Download | | [mC4](https://huggingface.co/datasets/legacy-datasets/mc4) | Legacy Download | | [Advanc"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "WikiTableQuestions",
          "confidence": 0.48,
          "raw_context": "ub.com/mandyyyyii/scibench) | Legacy Download | | [WikiTableQuestions](https://huggingface.co/datasets/wikitablequestions) | Legacy Download | | [FinQA]("
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "MedMCQA",
          "confidence": 0.48,
          "raw_context": "ematicsForHomeStudyMir1982) | Legacy Download | | [MedMCQA](https://huggingface.co/datasets/openlifescienceai/medmcqa) | Legacy Download | | ["
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "MCTest",
          "confidence": 0.48,
          "raw_context": "datasets/allenai/cosmos_qa) | Legacy Download | | [MCTest](https://huggingface.co/datasets/sagnikrayc/mctest) | Legacy Download | | [AI2's Re"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "social-chemestry-101",
          "confidence": 0.48,
          "raw_context": "viewer/all/auxiliary_train) | Legacy Download | | [social-chemestry-101](https://huggingface.co/datasets/tasksource/social-chemestry-101) | Legacy Download"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "FineMath",
          "confidence": 0.48,
          "raw_context": "huggingface.co/common-pile) | Legacy Download | | [FineMath](https://huggingface.co/datasets/HuggingFaceTB/finemath) | Legacy Download | | [Meg"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "MegaMath",
          "confidence": 0.48,
          "raw_context": "ets/HuggingFaceTB/finemath) | Legacy Download | | [MegaMath](https://huggingface.co/datasets/LLM360/MegaMath) | Legacy Download | | [FastChat]("
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "Nemotron-PrismMath",
          "confidence": 0.48,
          "raw_context": "72B](https://huggingface.co/Qwen/Qwen2.5-72B) | | [Nemotron-PrismMath](https://huggingface.co/datasets/nvidia/Nemotron-PrismMath) | Text | 4.6B | [Big-Ma"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "Big-Math-RL-Verified",
          "confidence": 0.48,
          "raw_context": "tasets/nvidia/Nemotron-PrismMath) | Text | 4.6B | [Big-Math-RL-Verified](https://huggingface.co/datasets/SynthLabsAI/Big-Math-RL-Verified); [OpenR1-Math-22"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "OpenR1-Math-220k",
          "confidence": 0.48,
          "raw_context": "ce.co/datasets/SynthLabsAI/Big-Math-RL-Verified); [OpenR1-Math-220k](https://huggingface.co/datasets/open-r1/OpenR1-Math-220k) | [Qwen2.5-0.5B-instruct"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "Nemotron-MIND",
          "confidence": 0.48,
          "raw_context": "s://huggingface.co/microsoft/phi-4) | | Refreshed [Nemotron-MIND](https://huggingface.co/datasets/nvidia/Nemotron-MIND) from phi-4 | Text | 73B | [C"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "AQUA-RAT",
          "confidence": 0.48,
          "raw_context": "DeepSeek-V3 and DeepSeek-V3-0324 | Text | 4.0B | [AQUA-RAT](https://huggingface.co/datasets/deepmind/aqua_rat); [LogiQA](https://huggingface.c"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "LogiQA",
          "confidence": 0.48,
          "raw_context": "tps://huggingface.co/datasets/deepmind/aqua_rat); [LogiQA](https://huggingface.co/datasets/lucasmccabe/logiqa); [AR-LSAT](https://github.com/"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "OpenMathReasoning",
          "confidence": 0.48,
          "raw_context": "thReasoning from DeepSeek-R1-0528 | Text | 1.5M | [OpenMathReasoning](https://huggingface.co/datasets/nvidia/OpenMathReasoning) | [DeepSeek-R1-0528](htt"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "OpenCodeReasoning",
          "confidence": 0.48,
          "raw_context": "deReasoning from DeepSeek-R1-0528 | Text | 1.1M | [OpenCodeReasoning](https://huggingface.co/datasets/nvidia/OpenCodeReasoning) | [DeepSeek-R1-0528](htt"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "HelpSteer3",
          "confidence": 0.48,
          "raw_context": "ic HelpSteer from Qwen3-235B-A22B | Text | 120K | [HelpSteer3](https://huggingface.co/datasets/nvidia/HelpSteer3); [HelpSteer2](https://huggingfa"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "HelpSteer2",
          "confidence": 0.48,
          "raw_context": "tps://huggingface.co/datasets/nvidia/HelpSteer3); [HelpSteer2](https://huggingface.co/datasets/nvidia/HelpSteer2) | [Qwen3-235B-A22B](https://hug"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "ShareGPT52K",
          "confidence": 0.48,
          "raw_context": "s://huggingface.co/datasets/lmsys/lmsys-chat-1m); [ShareGPT52K](https://huggingface.co/datasets/RyokoAI/ShareGPT52K); [tigerbot-kaggle-leetcodesol"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "WildChat",
          "confidence": 0.48,
          "raw_context": "22B and Gemma 3 Post-Trained models | Text | 5M | [WildChat](https://huggingface.co/datasets/allenai/WildChat-1M) | [Qwen3-235B-A22B](https://h"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "commoncrawl",
          "confidence": 0.48,
          "raw_context": "openai/prm800k) | 4/23/2025 | | [CC-NEWS](https://commoncrawl.org/blog/news-dataset-available) | 4/23/2025 | |"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "Common Crawl",
          "confidence": 0.48,
          "raw_context": "org/blog/news-dataset-available) | 4/23/2025 | | [Common Crawl](https://commoncrawl.org/) | 4/23/2025 | | [Wikim"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "FineWeb",
          "confidence": 0.48,
          "raw_context": "/github.com/mandyyyyii/scibench) | 4/23/2025 | | [FineWeb-2](https://huggingface.co/datasets/HuggingFaceFW/"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "OpenWebText",
          "confidence": 0.48,
          "raw_context": "nih.gov/tools/openftlist/) | Legacy Download | | [OpenWebText2](https://openwebtext2.readthedocs.io/en/latest/)"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "The Stack",
          "confidence": 0.48,
          "raw_context": "mmary-of-dataset-versions) | Legacy Download | | [The Stack](https://huggingface.co/datasets/bigcode/the-stac"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "lmsys-chat",
          "confidence": 0.5599999999999999,
          "raw_context": "force/xlam-function-calling-60k) | 4/23/2025 | | [LMSYS-Chat-1M](https://huggingface.co/datasets/lmsys/lmsys-c"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "fineweb",
          "confidence": 0.5599999999999999,
          "raw_context": "/github.com/mandyyyyii/scibench) | 4/23/2025 | | [FineWeb-2](https://huggingface.co/datasets/HuggingFaceFW/"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "common crawl",
          "confidence": 0.5599999999999999,
          "raw_context": "org/blog/news-dataset-available) | 4/23/2025 | | [Common Crawl](https://commoncrawl.org/) | 4/23/2025 | | [Wikim"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "mc4",
          "confidence": 0.5599999999999999,
          "raw_context": "atasets/bigcode/the-stack) | Legacy Download | | [mC4](https://huggingface.co/datasets/legacy-datasets/"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "sharegpt",
          "confidence": 0.5599999999999999,
          "raw_context": "://huggingface.co/datasets/lmsys/lmsys-chat-1m); [ShareGPT52K](https://huggingface.co/datasets/RyokoAI/Share"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "openwebtext",
          "confidence": 0.5599999999999999,
          "raw_context": "nih.gov/tools/openftlist/) | Legacy Download | | [OpenWebText2](https://openwebtext2.readthedocs.io/en/latest/)"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "the stack",
          "confidence": 0.5599999999999999,
          "raw_context": "mmary-of-dataset-versions) | Legacy Download | | [The Stack](https://huggingface.co/datasets/bigcode/the-stac"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "pubmed",
          "confidence": 0.5599999999999999,
          "raw_context": "org/details/stackexchange) | Legacy Download | | [PubMed Abstracts](https://github.com/thoppe/The-Pile-Pub"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "c4",
          "confidence": 0.5599999999999999,
          "raw_context": "etionMessageToolCall(id='chatcmpl-tool-e341c6954d2c48c2a0e9071c7bdefd8b', function=Function(arguments="
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "ase refer to the [Nemotron-H tech report](https://arxiv.org/abs/2504.03624). The model was trained using"
        }
      ],
      "declared_datasets": [
        "nvidia/Nemotron-Post-Training-Dataset-v2",
        "nvidia/Nemotron-Pretraining-Dataset-sample",
        "nvidia/Nemotron-CC-Math-v1",
        "nvidia/Nemotron-Post-Training-Dataset-v1",
        "nvidia/Nemotron-CC-v2",
        "nvidia/Nemotron-Pretraining-SFT-v1"
      ],
      "inferred_datasets": [
        "Bespoke-Stratos-17k",
        "peS2o",
        "Big-Math-RL-Verified",
        "Nemotron-MIND",
        "HelpSteer2",
        "lmsys-chat",
        "OpenMathReasoning",
        "MCTest",
        "fineweb",
        "tigerbot-kaggle-leetcodesolutions-en-2k",
        "common crawl",
        "AQUA-RAT",
        "MegaMath",
        "mc4",
        "LogiQA",
        "sharegpt",
        "WildChat",
        "HelpSteer3",
        "commoncrawl",
        "openwebtext",
        "glaive-function-calling-v2",
        "LMSYS-Chat-1M",
        "OpenCodeReasoning",
        "The Stack",
        "the stack",
        "Nemotron-PrismMath",
        "MedMCQA",
        "social-chemestry-101",
        "Common Crawl",
        "ShareGPT52K",
        "WikiTableQuestions",
        "pubmed",
        "c4",
        "arxiv",
        "OpenR1-Math-220k",
        "FineMath",
        "FineWeb",
        "OpenWebMath",
        "FineWeb-2",
        "mC4",
        "OpenWebText"
      ],
      "base_model": "nvidia/NVIDIA-Nemotron-Nano-9B-v2",
      "base_model_chain": [
        "nvidia/NVIDIA-Nemotron-Nano-9B-v2",
        "nvidia/NVIDIA-Nemotron-Nano-12B-v2",
        "nvidia/NVIDIA-Nemotron-Nano-12B-v2-Base"
      ],
      "training_section_present": true,
      "license": "other",
      "provenance_score": 1.0,
      "provenance_hash": "a40d35f3352d9f3be22f2ee7bce58edfb9e82ca7d53a02525ee97e3705e6d39d"
    },
    {
      "model_id": "nvidia/NVIDIA-Nemotron-Nano-9B-v2-Japanese",
      "scanned_at": "2026-09-15T02:36:30.127096Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/Nemotron-Personas-Japan",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/Nemotron-Personas-Japan"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/Nemotron-CC-v2.1",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/Nemotron-CC-v2.1"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/Nemotron-Pretraining-Specialized-v1",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/Nemotron-Pretraining-Specialized-v1"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/Nemotron-Agentic-v1",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/Nemotron-Agentic-v1"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/Nemotron-Instruction-Following-Chat-v1",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/Nemotron-Instruction-Following-Chat-v1"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "globis-university/aozorabunko-clean",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:globis-university/aozorabunko-clean"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "HuggingFaceFW/fineweb-2",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:HuggingFaceFW/fineweb-2"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:nvidia/NVIDIA-Nemotron-Nano-9B-v2"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Nemotron-Personas-Japan",
          "confidence": 0.6,
          "raw_context": "推論タスクの両方に対応する統合モデルとして設計され、日本語に特化して最適化されています。本モデルは、[Nemotron-Personas-Japan](https://huggingface.co/datasets/nvidia/Nemotron-Personas-Japan) データセットを用いて作成された日本語"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "aozorabunko-clean",
          "confidence": 0.6,
          "raw_context": "Datase) | Collection Period | | :---- | :---- | | [aozorabunko-clean](https://huggingface.co/datasets/globis-university/aozorabunko-clean) | 12/1/2025 |"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "FineWeb2",
          "confidence": 0.6,
          "raw_context": "bis-university/aozorabunko-clean) | 12/1/2025 | | [FineWeb2](https://huggingface.co/datasets/HuggingFaceFW/fineweb-2) | 12/1/2025 | | [sip3-ja-"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "AutoTools",
          "confidence": 0.6,
          "raw_context": "ub.com/Junjie-Ye/ToolEyes/tree/main/Tool_Library) [AutoTools](https://huggingface.co/datasets/mangopy/autotools) [APIBank](https://huggingface.c"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "APIBank",
          "confidence": 0.6,
          "raw_context": "ttps://huggingface.co/datasets/mangopy/autotools) [APIBank](https://huggingface.co/datasets/liminghao1630/API-Bank) [CASTELLA](https://github."
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "fineweb",
          "confidence": 0.6,
          "raw_context": "obis-university/aozorabunko-clean - HuggingFaceFW/fineweb-2 track_downloads: true --- # NVIDIA-Nemotron-Nan"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Wikipedia",
          "confidence": 0.6,
          "raw_context": "sets/sip3-ja-general-web-corpus) | 12/1/2025 | | [Wikipedia (Japanese)](https://dumps.wikimedia.org/jawiki/)"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "confidence": 0.85,
          "raw_context": "language:   - en   - ja tags: - nvidia - pytorch base_model: nvidia/NVIDIA-Nemotron-Nano-9B-v2 datasets: - nvidia/Nemotron-Personas-Japan - nvid"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "wikipedia",
          "confidence": 0.7,
          "raw_context": "sets/sip3-ja-general-web-corpus) | 12/1/2025 | | [Wikipedia (Japanese)](https://dumps.wikimedia.org/jawiki/)"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "fineweb",
          "confidence": 0.7,
          "raw_context": "obis-university/aozorabunko-clean - HuggingFaceFW/fineweb-2 track_downloads: true --- # NVIDIA-Nemotron-Nan"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "c4",
          "confidence": 0.7,
          "raw_context": "etionMessageToolCall(id='chatcmpl-tool-e341c6954d2c48c2a0e9071c7bdefd8b', function=Function(arguments="
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "ます。アーキテクチャの詳細については、[Nemotron-H テクニカルレポート](https://arxiv.org/abs/2504.03624)をご参照ください。学習には [Megatron-LM](ht"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "nemotron_h",
          "confidence": 0.5,
          "raw_context": "model_type: nemotron_h"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "Bespoke-Stratos-17k",
          "confidence": 0.48,
          "raw_context": "ia](https://dumps.wikimedia.org/) | 4/23/2025 | | [Bespoke-Stratos-17k](https://huggingface.co/datasets/bespokelabs/Bespoke-Stratos-17k) | 4/23/2025 | | ["
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "tigerbot-kaggle-leetcodesolutions-en-2k",
          "confidence": 0.48,
          "raw_context": "/bespokelabs/Bespoke-Stratos-17k) | 4/23/2025 | | [tigerbot-kaggle-leetcodesolutions-en-2k](https://huggingface.co/datasets/TigerResearch/tigerbot-kaggle-leetcodesolutions-en"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "glaive-function-calling-v2",
          "confidence": 0.48,
          "raw_context": "t-kaggle-leetcodesolutions-en-2k) | 4/23/2025 | | [glaive-function-calling-v2](https://huggingface.co/datasets/glaiveai/glaive-function-calling-v2) | 4/23/2025 |"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "LMSYS-Chat-1M",
          "confidence": 0.48,
          "raw_context": "sforce/xlam-function-calling-60k) | 4/23/2025 | | [LMSYS-Chat-1M](https://huggingface.co/datasets/lmsys/lmsys-chat-1m) | 4/23/2025 | | [Open Textboo"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "FineWeb-2",
          "confidence": 0.48,
          "raw_context": "//github.com/mandyyyyii/scibench) | 4/23/2025 | | [FineWeb-2](https://huggingface.co/datasets/HuggingFaceFW/fineweb-2) | 4/23/2025 | | [Court Li"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "peS2o",
          "confidence": 0.48,
          "raw_context": "er.com/help/api/bulk-data/) | Legacy Download | | [peS2o](https://huggingface.co/datasets/allenai/peS2o) | Legacy Download | | [OpenWebMath]"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "OpenWebMath",
          "confidence": 0.48,
          "raw_context": ".co/datasets/allenai/peS2o) | Legacy Download | | [OpenWebMath](https://huggingface.co/datasets/open-web-math/open-web-math) | Legacy Download | |"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "mC4",
          "confidence": 0.48,
          "raw_context": "datasets/bigcode/the-stack) | Legacy Download | | [mC4](https://huggingface.co/datasets/legacy-datasets/mc4) | Legacy Download | | [Advanc"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "WikiTableQuestions",
          "confidence": 0.48,
          "raw_context": "ub.com/mandyyyyii/scibench) | Legacy Download | | [WikiTableQuestions](https://huggingface.co/datasets/wikitablequestions) | Legacy Download | | [FinQA]("
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "MedMCQA",
          "confidence": 0.48,
          "raw_context": "ematicsForHomeStudyMir1982) | Legacy Download | | [MedMCQA](https://huggingface.co/datasets/openlifescienceai/medmcqa) | Legacy Download | | ["
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "MCTest",
          "confidence": 0.48,
          "raw_context": "datasets/allenai/cosmos_qa) | Legacy Download | | [MCTest](https://huggingface.co/datasets/sagnikrayc/mctest) | Legacy Download | | [AI2's Re"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "social-chemestry-101",
          "confidence": 0.48,
          "raw_context": "viewer/all/auxiliary_train) | Legacy Download | | [social-chemestry-101](https://huggingface.co/datasets/tasksource/social-chemestry-101) | Legacy Download"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "FineMath",
          "confidence": 0.48,
          "raw_context": "huggingface.co/common-pile) | Legacy Download | | [FineMath](https://huggingface.co/datasets/HuggingFaceTB/finemath) | Legacy Download | | [Meg"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "MegaMath",
          "confidence": 0.48,
          "raw_context": "ets/HuggingFaceTB/finemath) | Legacy Download | | [MegaMath](https://huggingface.co/datasets/LLM360/MegaMath) | Legacy Download | | [FastChat]("
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "Nemotron-PrismMath",
          "confidence": 0.48,
          "raw_context": "72B](https://huggingface.co/Qwen/Qwen2.5-72B) | | [Nemotron-PrismMath](https://huggingface.co/datasets/nvidia/Nemotron-PrismMath) | Text | 4.6B | [Big-Ma"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "Big-Math-RL-Verified",
          "confidence": 0.48,
          "raw_context": "tasets/nvidia/Nemotron-PrismMath) | Text | 4.6B | [Big-Math-RL-Verified](https://huggingface.co/datasets/SynthLabsAI/Big-Math-RL-Verified); [OpenR1-Math-22"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "OpenR1-Math-220k",
          "confidence": 0.48,
          "raw_context": "ce.co/datasets/SynthLabsAI/Big-Math-RL-Verified); [OpenR1-Math-220k](https://huggingface.co/datasets/open-r1/OpenR1-Math-220k) | [Qwen2.5-0.5B-instruct"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "Nemotron-MIND",
          "confidence": 0.48,
          "raw_context": "s://huggingface.co/microsoft/phi-4) | | Refreshed [Nemotron-MIND](https://huggingface.co/datasets/nvidia/Nemotron-MIND) from phi-4 | Text | 73B | [C"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "AQUA-RAT",
          "confidence": 0.48,
          "raw_context": "DeepSeek-V3 and DeepSeek-V3-0324 | Text | 4.0B | [AQUA-RAT](https://huggingface.co/datasets/deepmind/aqua_rat); [LogiQA](https://huggingface.c"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "LogiQA",
          "confidence": 0.48,
          "raw_context": "tps://huggingface.co/datasets/deepmind/aqua_rat); [LogiQA](https://huggingface.co/datasets/lucasmccabe/logiqa); [AR-LSAT](https://github.com/"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "OpenMathReasoning",
          "confidence": 0.48,
          "raw_context": "thReasoning from DeepSeek-R1-0528 | Text | 1.5M | [OpenMathReasoning](https://huggingface.co/datasets/nvidia/OpenMathReasoning) | [DeepSeek-R1-0528](htt"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "OpenCodeReasoning",
          "confidence": 0.48,
          "raw_context": "deReasoning from DeepSeek-R1-0528 | Text | 1.1M | [OpenCodeReasoning](https://huggingface.co/datasets/nvidia/OpenCodeReasoning) | [DeepSeek-R1-0528](htt"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "HelpSteer3",
          "confidence": 0.48,
          "raw_context": "ic HelpSteer from Qwen3-235B-A22B | Text | 120K | [HelpSteer3](https://huggingface.co/datasets/nvidia/HelpSteer3); [HelpSteer2](https://huggingfa"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "HelpSteer2",
          "confidence": 0.48,
          "raw_context": "tps://huggingface.co/datasets/nvidia/HelpSteer3); [HelpSteer2](https://huggingface.co/datasets/nvidia/HelpSteer2) | [Qwen3-235B-A22B](https://hug"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "ShareGPT52K",
          "confidence": 0.48,
          "raw_context": "s://huggingface.co/datasets/lmsys/lmsys-chat-1m); [ShareGPT52K](https://huggingface.co/datasets/RyokoAI/ShareGPT52K); [tigerbot-kaggle-leetcodesol"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "WildChat",
          "confidence": 0.48,
          "raw_context": "22B and Gemma 3 Post-Trained models | Text | 5M | [WildChat](https://huggingface.co/datasets/allenai/WildChat-1M) | [Qwen3-235B-A22B](https://h"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "commoncrawl",
          "confidence": 0.48,
          "raw_context": "openai/prm800k) | 4/23/2025 | | [CC-NEWS](https://commoncrawl.org/blog/news-dataset-available) | 4/23/2025 | |"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "Common Crawl",
          "confidence": 0.48,
          "raw_context": "org/blog/news-dataset-available) | 4/23/2025 | | [Common Crawl](https://commoncrawl.org/) | 4/23/2025 | | [Wikim"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "FineWeb",
          "confidence": 0.48,
          "raw_context": "/github.com/mandyyyyii/scibench) | 4/23/2025 | | [FineWeb-2](https://huggingface.co/datasets/HuggingFaceFW/"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "OpenWebText",
          "confidence": 0.48,
          "raw_context": "nih.gov/tools/openftlist/) | Legacy Download | | [OpenWebText2](https://openwebtext2.readthedocs.io/en/latest/)"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "The Stack",
          "confidence": 0.48,
          "raw_context": "mmary-of-dataset-versions) | Legacy Download | | [The Stack](https://huggingface.co/datasets/bigcode/the-stac"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "lmsys-chat",
          "confidence": 0.5599999999999999,
          "raw_context": "force/xlam-function-calling-60k) | 4/23/2025 | | [LMSYS-Chat-1M](https://huggingface.co/datasets/lmsys/lmsys-c"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "fineweb",
          "confidence": 0.5599999999999999,
          "raw_context": "/github.com/mandyyyyii/scibench) | 4/23/2025 | | [FineWeb-2](https://huggingface.co/datasets/HuggingFaceFW/"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "common crawl",
          "confidence": 0.5599999999999999,
          "raw_context": "org/blog/news-dataset-available) | 4/23/2025 | | [Common Crawl](https://commoncrawl.org/) | 4/23/2025 | | [Wikim"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "mc4",
          "confidence": 0.5599999999999999,
          "raw_context": "atasets/bigcode/the-stack) | Legacy Download | | [mC4](https://huggingface.co/datasets/legacy-datasets/"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "sharegpt",
          "confidence": 0.5599999999999999,
          "raw_context": "://huggingface.co/datasets/lmsys/lmsys-chat-1m); [ShareGPT52K](https://huggingface.co/datasets/RyokoAI/Share"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "openwebtext",
          "confidence": 0.5599999999999999,
          "raw_context": "nih.gov/tools/openftlist/) | Legacy Download | | [OpenWebText2](https://openwebtext2.readthedocs.io/en/latest/)"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "the stack",
          "confidence": 0.5599999999999999,
          "raw_context": "mmary-of-dataset-versions) | Legacy Download | | [The Stack](https://huggingface.co/datasets/bigcode/the-stac"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "pubmed",
          "confidence": 0.5599999999999999,
          "raw_context": "org/details/stackexchange) | Legacy Download | | [PubMed Abstracts](https://github.com/thoppe/The-Pile-Pub"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "c4",
          "confidence": 0.5599999999999999,
          "raw_context": "etionMessageToolCall(id='chatcmpl-tool-e341c6954d2c48c2a0e9071c7bdefd8b', function=Function(arguments="
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "ase refer to the [Nemotron-H tech report](https://arxiv.org/abs/2504.03624). The model was trained using"
        }
      ],
      "declared_datasets": [
        "nvidia/Nemotron-Instruction-Following-Chat-v1",
        "nvidia/Nemotron-CC-v2.1",
        "nvidia/Nemotron-Pretraining-Specialized-v1",
        "globis-university/aozorabunko-clean",
        "HuggingFaceFW/fineweb-2",
        "nvidia/Nemotron-Personas-Japan",
        "nvidia/Nemotron-Agentic-v1"
      ],
      "inferred_datasets": [
        "wikipedia",
        "Bespoke-Stratos-17k",
        "peS2o",
        "Big-Math-RL-Verified",
        "Nemotron-MIND",
        "HelpSteer2",
        "lmsys-chat",
        "OpenMathReasoning",
        "MCTest",
        "fineweb",
        "tigerbot-kaggle-leetcodesolutions-en-2k",
        "common crawl",
        "AQUA-RAT",
        "MegaMath",
        "mc4",
        "LogiQA",
        "sharegpt",
        "WildChat",
        "HelpSteer3",
        "commoncrawl",
        "openwebtext",
        "glaive-function-calling-v2",
        "LMSYS-Chat-1M",
        "OpenCodeReasoning",
        "The Stack",
        "Nemotron-PrismMath",
        "the stack",
        "MedMCQA",
        "social-chemestry-101",
        "Common Crawl",
        "ShareGPT52K",
        "WikiTableQuestions",
        "pubmed",
        "c4",
        "arxiv",
        "OpenR1-Math-220k",
        "FineMath",
        "FineWeb",
        "OpenWebMath",
        "FineWeb-2",
        "mC4",
        "OpenWebText"
      ],
      "base_model": "nvidia/NVIDIA-Nemotron-Nano-9B-v2",
      "base_model_chain": [
        "nvidia/NVIDIA-Nemotron-Nano-9B-v2",
        "nvidia/NVIDIA-Nemotron-Nano-12B-v2",
        "nvidia/NVIDIA-Nemotron-Nano-12B-v2-Base"
      ],
      "training_section_present": true,
      "license": "other",
      "provenance_score": 1.0,
      "provenance_hash": "32a6a81157edce77000c7ad9aef3c20ab7fcc312fee02f79f0f49cd6455dab33"
    },
    {
      "model_id": "nvidia/NVIDIA-Nemotron-Nano-9B-v2-NVFP4",
      "scanned_at": "2026-09-15T02:36:32.929319Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/Nemotron-Post-Training-Dataset-v1",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/Nemotron-Post-Training-Dataset-v1"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/Nemotron-Post-Training-Dataset-v2",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/Nemotron-Post-Training-Dataset-v2"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/Nemotron-Pretraining-Dataset-sample",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/Nemotron-Pretraining-Dataset-sample"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/Nemotron-CC-v2",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/Nemotron-CC-v2"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/Nemotron-CC-Math-v1",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/Nemotron-CC-Math-v1"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/Nemotron-Pretraining-SFT-v1",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/Nemotron-Pretraining-SFT-v1"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:nvidia/NVIDIA-Nemotron-Nano-9B-v2"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Bespoke-Stratos-17k",
          "confidence": 0.6,
          "raw_context": "ia](https://dumps.wikimedia.org/) | 4/23/2025 | | [Bespoke-Stratos-17k](https://huggingface.co/datasets/bespokelabs/Bespoke-Stratos-17k) | 4/23/2025 | | ["
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "tigerbot-kaggle-leetcodesolutions-en-2k",
          "confidence": 0.6,
          "raw_context": "/bespokelabs/Bespoke-Stratos-17k) | 4/23/2025 | | [tigerbot-kaggle-leetcodesolutions-en-2k](https://huggingface.co/datasets/TigerResearch/tigerbot-kaggle-leetcodesolutions-en"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "glaive-function-calling-v2",
          "confidence": 0.6,
          "raw_context": "t-kaggle-leetcodesolutions-en-2k) | 4/23/2025 | | [glaive-function-calling-v2](https://huggingface.co/datasets/glaiveai/glaive-function-calling-v2) | 4/23/2025 |"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "LMSYS-Chat-1M",
          "confidence": 0.6,
          "raw_context": "sforce/xlam-function-calling-60k) | 4/23/2025 | | [LMSYS-Chat-1M](https://huggingface.co/datasets/lmsys/lmsys-chat-1m) | 4/23/2025 | | [Open Textboo"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "FineWeb-2",
          "confidence": 0.6,
          "raw_context": "//github.com/mandyyyyii/scibench) | 4/23/2025 | | [FineWeb-2](https://huggingface.co/datasets/HuggingFaceFW/fineweb-2) | 4/23/2025 | | [Court Li"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "peS2o",
          "confidence": 0.6,
          "raw_context": "er.com/help/api/bulk-data/) | Legacy Download | | [peS2o](https://huggingface.co/datasets/allenai/peS2o) | Legacy Download | | [OpenWebMath]"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "OpenWebMath",
          "confidence": 0.6,
          "raw_context": ".co/datasets/allenai/peS2o) | Legacy Download | | [OpenWebMath](https://huggingface.co/datasets/open-web-math/open-web-math) | Legacy Download | |"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "mC4",
          "confidence": 0.6,
          "raw_context": "datasets/bigcode/the-stack) | Legacy Download | | [mC4](https://huggingface.co/datasets/legacy-datasets/mc4) | Legacy Download | | [Advanc"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "WikiTableQuestions",
          "confidence": 0.6,
          "raw_context": "ub.com/mandyyyyii/scibench) | Legacy Download | | [WikiTableQuestions](https://huggingface.co/datasets/wikitablequestions) | Legacy Download | | [FinQA]("
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "MedMCQA",
          "confidence": 0.6,
          "raw_context": "ematicsForHomeStudyMir1982) | Legacy Download | | [MedMCQA](https://huggingface.co/datasets/openlifescienceai/medmcqa) | Legacy Download | | ["
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "MCTest",
          "confidence": 0.6,
          "raw_context": "datasets/allenai/cosmos_qa) | Legacy Download | | [MCTest](https://huggingface.co/datasets/sagnikrayc/mctest) | Legacy Download | | [AI2's Re"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "social-chemestry-101",
          "confidence": 0.6,
          "raw_context": "viewer/all/auxiliary_train) | Legacy Download | | [social-chemestry-101](https://huggingface.co/datasets/tasksource/social-chemestry-101) | Legacy Download"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "FineMath",
          "confidence": 0.6,
          "raw_context": "huggingface.co/common-pile) | Legacy Download | | [FineMath](https://huggingface.co/datasets/HuggingFaceTB/finemath) | Legacy Download | | [Meg"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "MegaMath",
          "confidence": 0.6,
          "raw_context": "ets/HuggingFaceTB/finemath) | Legacy Download | | [MegaMath](https://huggingface.co/datasets/LLM360/MegaMath) | Legacy Download | | [FastChat]("
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Nemotron-PrismMath",
          "confidence": 0.6,
          "raw_context": "72B](https://huggingface.co/Qwen/Qwen2.5-72B) | | [Nemotron-PrismMath](https://huggingface.co/datasets/nvidia/Nemotron-PrismMath) | Text | 4.6B | [Big-Ma"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Big-Math-RL-Verified",
          "confidence": 0.6,
          "raw_context": "tasets/nvidia/Nemotron-PrismMath) | Text | 4.6B | [Big-Math-RL-Verified](https://huggingface.co/datasets/SynthLabsAI/Big-Math-RL-Verified); [OpenR1-Math-22"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "OpenR1-Math-220k",
          "confidence": 0.6,
          "raw_context": "ce.co/datasets/SynthLabsAI/Big-Math-RL-Verified); [OpenR1-Math-220k](https://huggingface.co/datasets/open-r1/OpenR1-Math-220k) | [Qwen2.5-0.5B-instruct"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Nemotron-MIND",
          "confidence": 0.6,
          "raw_context": "s://huggingface.co/microsoft/phi-4) | | Refreshed [Nemotron-MIND](https://huggingface.co/datasets/nvidia/Nemotron-MIND) from phi-4 | Text | 73B | [C"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "AQUA-RAT",
          "confidence": 0.6,
          "raw_context": "DeepSeek-V3 and DeepSeek-V3-0324 | Text | 4.0B | [AQUA-RAT](https://huggingface.co/datasets/deepmind/aqua_rat); [LogiQA](https://huggingface.c"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "LogiQA",
          "confidence": 0.6,
          "raw_context": "tps://huggingface.co/datasets/deepmind/aqua_rat); [LogiQA](https://huggingface.co/datasets/lucasmccabe/logiqa); [AR-LSAT](https://github.com/"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "OpenMathReasoning",
          "confidence": 0.6,
          "raw_context": "thReasoning from DeepSeek-R1-0528 | Text | 1.5M | [OpenMathReasoning](https://huggingface.co/datasets/nvidia/OpenMathReasoning) | [DeepSeek-R1-0528](htt"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "OpenCodeReasoning",
          "confidence": 0.6,
          "raw_context": "deReasoning from DeepSeek-R1-0528 | Text | 1.1M | [OpenCodeReasoning](https://huggingface.co/datasets/nvidia/OpenCodeReasoning) | [DeepSeek-R1-0528](htt"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "HelpSteer3",
          "confidence": 0.6,
          "raw_context": "ic HelpSteer from Qwen3-235B-A22B | Text | 120K | [HelpSteer3](https://huggingface.co/datasets/nvidia/HelpSteer3); [HelpSteer2](https://huggingfa"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "HelpSteer2",
          "confidence": 0.6,
          "raw_context": "tps://huggingface.co/datasets/nvidia/HelpSteer3); [HelpSteer2](https://huggingface.co/datasets/nvidia/HelpSteer2) | [Qwen3-235B-A22B](https://hug"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "ShareGPT52K",
          "confidence": 0.6,
          "raw_context": "s://huggingface.co/datasets/lmsys/lmsys-chat-1m); [ShareGPT52K](https://huggingface.co/datasets/RyokoAI/ShareGPT52K); [tigerbot-kaggle-leetcodesol"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "WildChat",
          "confidence": 0.6,
          "raw_context": "22B and Gemma 3 Post-Trained models | Text | 5M | [WildChat](https://huggingface.co/datasets/allenai/WildChat-1M) | [Qwen3-235B-A22B](https://h"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "commoncrawl",
          "confidence": 0.6,
          "raw_context": "openai/prm800k) | 4/23/2025 | | [CC-NEWS](https://commoncrawl.org/blog/news-dataset-available) | 4/23/2025 | |"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Common Crawl",
          "confidence": 0.6,
          "raw_context": "org/blog/news-dataset-available) | 4/23/2025 | | [Common Crawl](https://commoncrawl.org/) | 4/23/2025 | | [Wikim"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "FineWeb",
          "confidence": 0.6,
          "raw_context": "/github.com/mandyyyyii/scibench) | 4/23/2025 | | [FineWeb-2](https://huggingface.co/datasets/HuggingFaceFW/"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "OpenWebText",
          "confidence": 0.6,
          "raw_context": "nih.gov/tools/openftlist/) | Legacy Download | | [OpenWebText2](https://openwebtext2.readthedocs.io/en/latest/)"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "The Stack",
          "confidence": 0.6,
          "raw_context": "mmary-of-dataset-versions) | Legacy Download | | [The Stack](https://huggingface.co/datasets/bigcode/the-stac"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "lmsys-chat",
          "confidence": 0.7,
          "raw_context": "force/xlam-function-calling-60k) | 4/23/2025 | | [LMSYS-Chat-1M](https://huggingface.co/datasets/lmsys/lmsys-c"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "fineweb",
          "confidence": 0.7,
          "raw_context": "/github.com/mandyyyyii/scibench) | 4/23/2025 | | [FineWeb-2](https://huggingface.co/datasets/HuggingFaceFW/"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "common crawl",
          "confidence": 0.7,
          "raw_context": "org/blog/news-dataset-available) | 4/23/2025 | | [Common Crawl](https://commoncrawl.org/) | 4/23/2025 | | [Wikim"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "mc4",
          "confidence": 0.7,
          "raw_context": "atasets/bigcode/the-stack) | Legacy Download | | [mC4](https://huggingface.co/datasets/legacy-datasets/"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "sharegpt",
          "confidence": 0.7,
          "raw_context": "://huggingface.co/datasets/lmsys/lmsys-chat-1m); [ShareGPT52K](https://huggingface.co/datasets/RyokoAI/Share"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "openwebtext",
          "confidence": 0.7,
          "raw_context": "nih.gov/tools/openftlist/) | Legacy Download | | [OpenWebText2](https://openwebtext2.readthedocs.io/en/latest/)"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "the stack",
          "confidence": 0.7,
          "raw_context": "mmary-of-dataset-versions) | Legacy Download | | [The Stack](https://huggingface.co/datasets/bigcode/the-stac"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "pubmed",
          "confidence": 0.7,
          "raw_context": "org/details/stackexchange) | Legacy Download | | [PubMed Abstracts](https://github.com/thoppe/The-Pile-Pub"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "c4",
          "confidence": 0.7,
          "raw_context": "etionMessageToolCall(id='chatcmpl-tool-e341c6954d2c48c2a0e9071c7bdefd8b', function=Function(arguments="
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "ase refer to the [Nemotron-H tech report](https://arxiv.org/abs/2504.03624).  Nano 9B v2 has 56 layers in"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "nemotron_h",
          "confidence": 0.5,
          "raw_context": "model_type: nemotron_h"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "Bespoke-Stratos-17k",
          "confidence": 0.48,
          "raw_context": "ia](https://dumps.wikimedia.org/) | 4/23/2025 | | [Bespoke-Stratos-17k](https://huggingface.co/datasets/bespokelabs/Bespoke-Stratos-17k) | 4/23/2025 | | ["
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "tigerbot-kaggle-leetcodesolutions-en-2k",
          "confidence": 0.48,
          "raw_context": "/bespokelabs/Bespoke-Stratos-17k) | 4/23/2025 | | [tigerbot-kaggle-leetcodesolutions-en-2k](https://huggingface.co/datasets/TigerResearch/tigerbot-kaggle-leetcodesolutions-en"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "glaive-function-calling-v2",
          "confidence": 0.48,
          "raw_context": "t-kaggle-leetcodesolutions-en-2k) | 4/23/2025 | | [glaive-function-calling-v2](https://huggingface.co/datasets/glaiveai/glaive-function-calling-v2) | 4/23/2025 |"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "LMSYS-Chat-1M",
          "confidence": 0.48,
          "raw_context": "sforce/xlam-function-calling-60k) | 4/23/2025 | | [LMSYS-Chat-1M](https://huggingface.co/datasets/lmsys/lmsys-chat-1m) | 4/23/2025 | | [Open Textboo"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "FineWeb-2",
          "confidence": 0.48,
          "raw_context": "//github.com/mandyyyyii/scibench) | 4/23/2025 | | [FineWeb-2](https://huggingface.co/datasets/HuggingFaceFW/fineweb-2) | 4/23/2025 | | [Court Li"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "peS2o",
          "confidence": 0.48,
          "raw_context": "er.com/help/api/bulk-data/) | Legacy Download | | [peS2o](https://huggingface.co/datasets/allenai/peS2o) | Legacy Download | | [OpenWebMath]"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "OpenWebMath",
          "confidence": 0.48,
          "raw_context": ".co/datasets/allenai/peS2o) | Legacy Download | | [OpenWebMath](https://huggingface.co/datasets/open-web-math/open-web-math) | Legacy Download | |"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "mC4",
          "confidence": 0.48,
          "raw_context": "datasets/bigcode/the-stack) | Legacy Download | | [mC4](https://huggingface.co/datasets/legacy-datasets/mc4) | Legacy Download | | [Advanc"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "WikiTableQuestions",
          "confidence": 0.48,
          "raw_context": "ub.com/mandyyyyii/scibench) | Legacy Download | | [WikiTableQuestions](https://huggingface.co/datasets/wikitablequestions) | Legacy Download | | [FinQA]("
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "MedMCQA",
          "confidence": 0.48,
          "raw_context": "ematicsForHomeStudyMir1982) | Legacy Download | | [MedMCQA](https://huggingface.co/datasets/openlifescienceai/medmcqa) | Legacy Download | | ["
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "MCTest",
          "confidence": 0.48,
          "raw_context": "datasets/allenai/cosmos_qa) | Legacy Download | | [MCTest](https://huggingface.co/datasets/sagnikrayc/mctest) | Legacy Download | | [AI2's Re"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "social-chemestry-101",
          "confidence": 0.48,
          "raw_context": "viewer/all/auxiliary_train) | Legacy Download | | [social-chemestry-101](https://huggingface.co/datasets/tasksource/social-chemestry-101) | Legacy Download"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "FineMath",
          "confidence": 0.48,
          "raw_context": "huggingface.co/common-pile) | Legacy Download | | [FineMath](https://huggingface.co/datasets/HuggingFaceTB/finemath) | Legacy Download | | [Meg"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "MegaMath",
          "confidence": 0.48,
          "raw_context": "ets/HuggingFaceTB/finemath) | Legacy Download | | [MegaMath](https://huggingface.co/datasets/LLM360/MegaMath) | Legacy Download | | [FastChat]("
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "Nemotron-PrismMath",
          "confidence": 0.48,
          "raw_context": "72B](https://huggingface.co/Qwen/Qwen2.5-72B) | | [Nemotron-PrismMath](https://huggingface.co/datasets/nvidia/Nemotron-PrismMath) | Text | 4.6B | [Big-Ma"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "Big-Math-RL-Verified",
          "confidence": 0.48,
          "raw_context": "tasets/nvidia/Nemotron-PrismMath) | Text | 4.6B | [Big-Math-RL-Verified](https://huggingface.co/datasets/SynthLabsAI/Big-Math-RL-Verified); [OpenR1-Math-22"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "OpenR1-Math-220k",
          "confidence": 0.48,
          "raw_context": "ce.co/datasets/SynthLabsAI/Big-Math-RL-Verified); [OpenR1-Math-220k](https://huggingface.co/datasets/open-r1/OpenR1-Math-220k) | [Qwen2.5-0.5B-instruct"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "Nemotron-MIND",
          "confidence": 0.48,
          "raw_context": "s://huggingface.co/microsoft/phi-4) | | Refreshed [Nemotron-MIND](https://huggingface.co/datasets/nvidia/Nemotron-MIND) from phi-4 | Text | 73B | [C"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "AQUA-RAT",
          "confidence": 0.48,
          "raw_context": "DeepSeek-V3 and DeepSeek-V3-0324 | Text | 4.0B | [AQUA-RAT](https://huggingface.co/datasets/deepmind/aqua_rat); [LogiQA](https://huggingface.c"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "LogiQA",
          "confidence": 0.48,
          "raw_context": "tps://huggingface.co/datasets/deepmind/aqua_rat); [LogiQA](https://huggingface.co/datasets/lucasmccabe/logiqa); [AR-LSAT](https://github.com/"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "OpenMathReasoning",
          "confidence": 0.48,
          "raw_context": "thReasoning from DeepSeek-R1-0528 | Text | 1.5M | [OpenMathReasoning](https://huggingface.co/datasets/nvidia/OpenMathReasoning) | [DeepSeek-R1-0528](htt"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "OpenCodeReasoning",
          "confidence": 0.48,
          "raw_context": "deReasoning from DeepSeek-R1-0528 | Text | 1.1M | [OpenCodeReasoning](https://huggingface.co/datasets/nvidia/OpenCodeReasoning) | [DeepSeek-R1-0528](htt"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "HelpSteer3",
          "confidence": 0.48,
          "raw_context": "ic HelpSteer from Qwen3-235B-A22B | Text | 120K | [HelpSteer3](https://huggingface.co/datasets/nvidia/HelpSteer3); [HelpSteer2](https://huggingfa"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "HelpSteer2",
          "confidence": 0.48,
          "raw_context": "tps://huggingface.co/datasets/nvidia/HelpSteer3); [HelpSteer2](https://huggingface.co/datasets/nvidia/HelpSteer2) | [Qwen3-235B-A22B](https://hug"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "ShareGPT52K",
          "confidence": 0.48,
          "raw_context": "s://huggingface.co/datasets/lmsys/lmsys-chat-1m); [ShareGPT52K](https://huggingface.co/datasets/RyokoAI/ShareGPT52K); [tigerbot-kaggle-leetcodesol"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "WildChat",
          "confidence": 0.48,
          "raw_context": "22B and Gemma 3 Post-Trained models | Text | 5M | [WildChat](https://huggingface.co/datasets/allenai/WildChat-1M) | [Qwen3-235B-A22B](https://h"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "commoncrawl",
          "confidence": 0.48,
          "raw_context": "openai/prm800k) | 4/23/2025 | | [CC-NEWS](https://commoncrawl.org/blog/news-dataset-available) | 4/23/2025 | |"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "Common Crawl",
          "confidence": 0.48,
          "raw_context": "org/blog/news-dataset-available) | 4/23/2025 | | [Common Crawl](https://commoncrawl.org/) | 4/23/2025 | | [Wikim"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "FineWeb",
          "confidence": 0.48,
          "raw_context": "/github.com/mandyyyyii/scibench) | 4/23/2025 | | [FineWeb-2](https://huggingface.co/datasets/HuggingFaceFW/"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "OpenWebText",
          "confidence": 0.48,
          "raw_context": "nih.gov/tools/openftlist/) | Legacy Download | | [OpenWebText2](https://openwebtext2.readthedocs.io/en/latest/)"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "The Stack",
          "confidence": 0.48,
          "raw_context": "mmary-of-dataset-versions) | Legacy Download | | [The Stack](https://huggingface.co/datasets/bigcode/the-stac"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "lmsys-chat",
          "confidence": 0.5599999999999999,
          "raw_context": "force/xlam-function-calling-60k) | 4/23/2025 | | [LMSYS-Chat-1M](https://huggingface.co/datasets/lmsys/lmsys-c"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "fineweb",
          "confidence": 0.5599999999999999,
          "raw_context": "/github.com/mandyyyyii/scibench) | 4/23/2025 | | [FineWeb-2](https://huggingface.co/datasets/HuggingFaceFW/"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "common crawl",
          "confidence": 0.5599999999999999,
          "raw_context": "org/blog/news-dataset-available) | 4/23/2025 | | [Common Crawl](https://commoncrawl.org/) | 4/23/2025 | | [Wikim"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "mc4",
          "confidence": 0.5599999999999999,
          "raw_context": "atasets/bigcode/the-stack) | Legacy Download | | [mC4](https://huggingface.co/datasets/legacy-datasets/"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "sharegpt",
          "confidence": 0.5599999999999999,
          "raw_context": "://huggingface.co/datasets/lmsys/lmsys-chat-1m); [ShareGPT52K](https://huggingface.co/datasets/RyokoAI/Share"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "openwebtext",
          "confidence": 0.5599999999999999,
          "raw_context": "nih.gov/tools/openftlist/) | Legacy Download | | [OpenWebText2](https://openwebtext2.readthedocs.io/en/latest/)"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "the stack",
          "confidence": 0.5599999999999999,
          "raw_context": "mmary-of-dataset-versions) | Legacy Download | | [The Stack](https://huggingface.co/datasets/bigcode/the-stac"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "pubmed",
          "confidence": 0.5599999999999999,
          "raw_context": "org/details/stackexchange) | Legacy Download | | [PubMed Abstracts](https://github.com/thoppe/The-Pile-Pub"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "c4",
          "confidence": 0.5599999999999999,
          "raw_context": "etionMessageToolCall(id='chatcmpl-tool-e341c6954d2c48c2a0e9071c7bdefd8b', function=Function(arguments="
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:nvidia/NVIDIA-Nemotron-Nano-9B-v2",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "ase refer to the [Nemotron-H tech report](https://arxiv.org/abs/2504.03624). The model was trained using"
        }
      ],
      "declared_datasets": [
        "nvidia/Nemotron-Post-Training-Dataset-v2",
        "nvidia/Nemotron-Pretraining-Dataset-sample",
        "nvidia/Nemotron-CC-Math-v1",
        "nvidia/Nemotron-Post-Training-Dataset-v1",
        "nvidia/Nemotron-CC-v2",
        "nvidia/Nemotron-Pretraining-SFT-v1"
      ],
      "inferred_datasets": [
        "Bespoke-Stratos-17k",
        "peS2o",
        "Big-Math-RL-Verified",
        "Nemotron-MIND",
        "HelpSteer2",
        "lmsys-chat",
        "OpenMathReasoning",
        "MCTest",
        "fineweb",
        "tigerbot-kaggle-leetcodesolutions-en-2k",
        "common crawl",
        "AQUA-RAT",
        "MegaMath",
        "mc4",
        "LogiQA",
        "sharegpt",
        "WildChat",
        "HelpSteer3",
        "commoncrawl",
        "openwebtext",
        "glaive-function-calling-v2",
        "LMSYS-Chat-1M",
        "OpenCodeReasoning",
        "The Stack",
        "the stack",
        "Nemotron-PrismMath",
        "MedMCQA",
        "social-chemestry-101",
        "Common Crawl",
        "ShareGPT52K",
        "WikiTableQuestions",
        "pubmed",
        "c4",
        "arxiv",
        "OpenR1-Math-220k",
        "FineMath",
        "FineWeb",
        "OpenWebMath",
        "FineWeb-2",
        "mC4",
        "OpenWebText"
      ],
      "base_model": "nvidia/NVIDIA-Nemotron-Nano-9B-v2",
      "base_model_chain": [
        "nvidia/NVIDIA-Nemotron-Nano-9B-v2",
        "nvidia/NVIDIA-Nemotron-Nano-12B-v2",
        "nvidia/NVIDIA-Nemotron-Nano-12B-v2-Base"
      ],
      "training_section_present": true,
      "license": "other",
      "provenance_score": 1.0,
      "provenance_hash": "41543fb4cc0b06671cb0e8978872f50179bf790c89d712031d35a306aaa8a22a"
    },
    {
      "model_id": "nvidia/Nemotron-4-Mini-Hindi-4B-Instruct",
      "scanned_at": "2026-09-15T02:36:35.758950Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "nvidia/Nemotron-4-Mini-Hindi-4B-Base",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:nvidia/Nemotron-4-Mini-Hindi-4B-Base"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:nvidia/Nemotron-4-Mini-Hindi-4B-Base",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:nvidia/Nemotron-4-Mini-Hindi-4B-Base"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "AEGIS",
          "confidence": 0.6,
          "raw_context": ", including prompt injection and data leakage.  - [AEGIS](https://huggingface.co/datasets/nvidia/Aegis-AI-Content-Safety-Dataset-1.0), is a"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "nvidia/Nemotron-4-Mini-Hindi-4B-Base",
          "confidence": 0.85,
          "raw_context": "cense-agreement-june-2024.pdf language: - en - hi base_model: nvidia/Nemotron-4-Mini-Hindi-4B-Base library_name: nemo --- # Nemotron-4-Mini-Hindi-4B"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "is ready for commercial use. Please refer to our [arXiv paper](https://arxiv.org/abs/2410.14815) for more"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "nvidia/nemotron-4-mini-hindi-4b-instruct",
          "confidence": 0.9,
          "raw_context": "_name_or_path: nvidia/nemotron-4-mini-hindi-4b-instruct"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "nemotron",
          "confidence": 0.5,
          "raw_context": "model_type: nemotron"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/Nemotron-4-Mini-Hindi-4B-Base",
          "value": "Hindi and English",
          "confidence": 0.48,
          "raw_context": "ew  Nemotron-4-Mini-Hindi-4B-Base is a base model pre-trained on Hindi and English corpus. The Nemotron-Mini-4B-Base (Minitron-4B) is subje"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:nvidia/Nemotron-4-Mini-Hindi-4B-Base",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "d and on-device deployment.  Please refer to our [arXiv paper](https://arxiv.org/abs/2410.14815) for more"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "Hindi and English",
        "arxiv"
      ],
      "base_model": "nvidia/Nemotron-4-Mini-Hindi-4B-Base",
      "base_model_chain": [
        "nvidia/Nemotron-4-Mini-Hindi-4B-Base",
        "nvidia/Minitron-4B-Base"
      ],
      "training_section_present": false,
      "license": "other",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "7e565510831243138bbd00b0ca860dca7998d93d8e5d5d0152b094d88c967a3c"
    },
    {
      "model_id": "nvidia/Nemotron-Cascade-8B",
      "scanned_at": "2026-09-15T02:36:41.248694Z",
      "signals": [
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "/badge/2512.13607-Technical_Report-blue)](https://arxiv.org/abs/2512.13607) [![SFT Dataset](https://img.s"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "qwen3",
          "confidence": 0.5,
          "raw_context": "model_type: qwen3"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "other",
      "provenance_score": 0.45,
      "provenance_hash": "6c3885b141184d44b36ff4737d9cfbae2bf897458339d0694be986710cb52ee1"
    },
    {
      "model_id": "nvidia/Nemotron-Flash-3B",
      "scanned_at": "2026-09-15T02:36:44.007979Z",
      "signals": [
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "e Model  <p align=\"center\">   🗞️ <a href=\"https://arxiv.org/pdf/2511.18890\">Paper</a>&nbsp&nbsp| &nbsp&nb"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "nemotron_flash",
          "confidence": 0.5,
          "raw_context": "model_type: nemotron_flash"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "other",
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "4d8bc3f439046b757514d63b5d4e3756c460be8a1f984ced47fd46b66a9ea9e3"
    },
    {
      "model_id": "nvidia/Nemotron-H-4B-Base-8K",
      "scanned_at": "2026-09-15T02:36:46.773997Z",
      "signals": [
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Dataset",
          "confidence": 0.6,
          "raw_context": "ss question answering ability of language models. [Dataset](https://huggingface.co/datasets/allenai/ai2_arc)  Hellaswag - Tests the ability of"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "more details, please refer to the [paper](https://arxiv.org/abs/2504.11409).  The paper has been accepted"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "nemotron_h",
          "confidence": 0.5,
          "raw_context": "model_type: nemotron_h"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "other",
      "provenance_score": 0.45,
      "provenance_hash": "fafde036778fe55a61d1597eaeeeb3ab966b5b7604c187367385036f51635307"
    },
    {
      "model_id": "nvidia/Nemotron-H-4B-Instruct-128K",
      "scanned_at": "2026-09-15T02:36:49.525531Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "nvidia/Nemotron-H-4B-Base-8K",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:nvidia/Nemotron-H-4B-Base-8K"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:nvidia/Nemotron-H-4B-Base-8K",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:nvidia/Nemotron-H-4B-Base-8K"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Dataset",
          "confidence": 0.6,
          "raw_context": "instruction level scores in the strict category. [Dataset](https://huggingface.co/datasets/google/IFEval)  Prompt: ``` <SPECIAL_10>System  <S"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "more details, please refer to the [paper](https://arxiv.org/abs/2504.11409).  The paper has been accepted"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "nvidia/Nemotron-H-4B-Instruct",
          "confidence": 0.9,
          "raw_context": "_name_or_path: nvidia/Nemotron-H-4B-Instruct"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "nemotron_h",
          "confidence": 0.5,
          "raw_context": "model_type: nemotron_h"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:nvidia/Nemotron-H-4B-Base-8K",
          "value": "Dataset",
          "confidence": 0.48,
          "raw_context": "ss question answering ability of language models. [Dataset](https://huggingface.co/datasets/allenai/ai2_arc)  Hellaswag - Tests the ability of"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:nvidia/Nemotron-H-4B-Base-8K",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "more details, please refer to the [paper](https://arxiv.org/abs/2504.11409).  The paper has been accepted"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "Dataset",
        "arxiv"
      ],
      "base_model": "nvidia/Nemotron-H-4B-Base-8K",
      "base_model_chain": [
        "nvidia/Nemotron-H-4B-Base-8K"
      ],
      "training_section_present": true,
      "license": "other",
      "provenance_score": 0.6,
      "provenance_hash": "17a0141e071d469dc8d219eda2eff4d1bcc40cad92c06c1dc6806ef7323e2c86"
    },
    {
      "model_id": "nvidia/Nemotron-H-56B-Base-8K",
      "scanned_at": "2026-09-15T02:36:52.290998Z",
      "signals": [
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Dataset",
          "confidence": 0.6,
          "raw_context": "ss question answering ability of language models. [Dataset](https://huggingface.co/datasets/allenai/ai2_arc) - Hellaswag - Tests the ability o"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "lr/nemotronh/) and the [technical report](https://arxiv.org/abs/2504.03624).  For best performance on a g"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "nemotron_h",
          "confidence": 0.5,
          "raw_context": "model_type: nemotron_h"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "other",
      "provenance_score": 0.45,
      "provenance_hash": "1721154ed4e30b4beef4d654f2828267d85f6c2d30f4311d89b795f370396330"
    },
    {
      "model_id": "nvidia/Nemotron-H-8B-Base-8K",
      "scanned_at": "2026-09-15T02:36:55.077521Z",
      "signals": [
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Dataset",
          "confidence": 0.6,
          "raw_context": "ss question answering ability of language models. [Dataset](https://huggingface.co/datasets/allenai/ai2_arc) - Hellaswag - Tests the ability o"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "lr/nemotronh/) and the [technical report](https://arxiv.org/abs/2504.03624).  For best performance on a g"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "nemotron_h",
          "confidence": 0.5,
          "raw_context": "model_type: nemotron_h"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "other",
      "provenance_score": 0.45,
      "provenance_hash": "35353dce37700afd3389b295e258dabea720dcdddd718f321b755397aac9203f"
    },
    {
      "model_id": "nvidia/Nemotron-Mini-4B-Instruct",
      "scanned_at": "2026-09-15T02:36:57.825479Z",
      "signals": [
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "AEGIS",
          "confidence": 0.6,
          "raw_context": ", including prompt injection and data leakage.  - [AEGIS](https://huggingface.co/datasets/nvidia/Aegis-AI-Content-Safety-Dataset-1.0), is a"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "runed and distilled from [Nemotron-4 15B](https://arxiv.org/abs/2402.16819) using [our LLM compression te"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "nvidia/Minitron-4B-Instruct",
          "confidence": 0.9,
          "raw_context": "_name_or_path: nvidia/Minitron-4B-Instruct"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "nemotron",
          "confidence": 0.5,
          "raw_context": "model_type: nemotron"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "other",
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "70d0b5069d2a71c4e003a174ec93924ff267e8eafedbd0e561b76ab7596accd2"
    },
    {
      "model_id": "nvidia/Nemotron-Orchestrator-8B",
      "scanned_at": "2026-09-15T02:37:00.575111Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Qwen/Qwen3-8B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Qwen/Qwen3-8B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:Qwen/Qwen3-8B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:Qwen/Qwen3-8B"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Link",
          "confidence": 0.6,
          "raw_context": "-----------------------| | GeneralThought-430K  | [Link](https://huggingface.co/datasets/natolambert/GeneralThought-430K-filtered)"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "estration  [![Paper](https://img.shields.io/badge/ArXiv-Paper-brown)](https://arxiv.org/abs/2511.21689) ["
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "qwen3",
          "confidence": 0.5,
          "raw_context": "model_type: qwen3"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Qwen/Qwen3-8B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "of up to 131,072 tokens using the [YaRN](https://arxiv.org/abs/2309.00071) method.  YaRN is currently su"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": "Qwen/Qwen3-8B",
      "base_model_chain": [
        "Qwen/Qwen3-8B",
        "Qwen/Qwen3-8B-Base"
      ],
      "training_section_present": true,
      "license": null,
      "provenance_score": 0.45,
      "provenance_hash": "37f31bf4a4a8ad19654c09bdd4fc85d71f1b1ca3093fdf7163b8be9e77c47871"
    },
    {
      "model_id": "nvidia/Phi-4-multimodal-instruct-FP8",
      "scanned_at": "2026-09-15T02:37:04.237467Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "microsoft/Phi-4-multimodal-instruct",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:microsoft/Phi-4-multimodal-instruct"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:microsoft/Phi-4-multimodal-instruct",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:microsoft/Phi-4-multimodal-instruct"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "cnn_dailymail",
          "confidence": 0.6,
          "raw_context": "ge-text Tokens] ## Calibration Dataset:  ** Link: [cnn_dailymail](https://huggingface.co/datasets/abisee/cnn_dailymail) <br> ** Data collection meth"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "ldwide, non-exclusive, no-charge, royalty-free, revocable (as stated in Section 2.1) license to publicl"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "/models/microsoft/Phi-4-multimodal-instruct",
          "confidence": 0.9,
          "raw_context": "_name_or_path: /models/microsoft/Phi-4-multimodal-instruct"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "phi4mm",
          "confidence": 0.5,
          "raw_context": "model_type: phi4mm"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:microsoft/Phi-4-multimodal-instruct",
          "value": "offline",
          "confidence": 0.48,
          "raw_context": "ary 2025<br> + **Status:** This is a static model trained on offline datasets with the cutoff date of June 2024 for publicly a"
        },
        {
          "signal_type": "inherited_readme_dataset",
          "source": "base_model:microsoft/Phi-4-multimodal-instruct",
          "value": "wikipedia",
          "confidence": 0.48,
          "raw_context": "G ---\") audio_url = \"https://upload.wikimedia.org/wikipedia/commons/b/b0/Barbara_Sahakian_BBC_Radio4_The_Life"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:microsoft/Phi-4-multimodal-instruct",
          "value": "wikipedia",
          "confidence": 0.5599999999999999,
          "raw_context": "G ---\") audio_url = \"https://upload.wikimedia.org/wikipedia/commons/b/b0/Barbara_Sahakian_BBC_Radio4_The_Life"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:microsoft/Phi-4-multimodal-instruct",
          "value": "voc",
          "confidence": 0.5599999999999999,
          "raw_context": "ork. The model  employed new architecture, larger vocabulary for efficiency, multilingual, and multimod"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:microsoft/Phi-4-multimodal-instruct",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "lation. library_name: transformers paper: https://arxiv.org/abs/2503.01743 --- 🎉**Phi-4**: [[mini-reasoni"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "wikipedia",
        "offline",
        "arxiv",
        "voc"
      ],
      "base_model": "microsoft/Phi-4-multimodal-instruct",
      "base_model_chain": [
        "microsoft/Phi-4-multimodal-instruct"
      ],
      "training_section_present": true,
      "license": "other",
      "provenance_score": 0.7,
      "provenance_hash": "acc83fd9d8f6c9c1f8d1597ba1357ab090e75ed6d6633557411a95c086418506"
    },
    {
      "model_id": "nvidia/Qwen3-14B-NVFP4",
      "scanned_at": "2026-09-15T02:37:08.864278Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Qwen/Qwen3-14B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Qwen/Qwen3-14B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Qwen/Qwen3-14B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Qwen/Qwen3-14B"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "cnn_dailymail",
          "confidence": 0.6,
          "raw_context": "dality [Text]   ## Calibration Dataset:  ** Link: [cnn_dailymail](https://huggingface.co/datasets/abisee/cnn_dailymail) <br> ** Data collection meth"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "qwen3",
          "confidence": 0.5,
          "raw_context": "model_type: qwen3"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Qwen/Qwen3-14B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "of up to 131,072 tokens using the [YaRN](https://arxiv.org/abs/2309.00071) method.  YaRN is currently su"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": "Qwen/Qwen3-14B",
      "base_model_chain": [
        "Qwen/Qwen3-14B",
        "Qwen/Qwen3-14B-Base"
      ],
      "training_section_present": true,
      "license": "apache-2.0",
      "provenance_score": 0.55,
      "provenance_hash": "80b7b76128ead7438f31cd2a94122735777faaf42f92877ced4859a9d562c078"
    },
    {
      "model_id": "nvidia/Qwen3-30B-A3B-NVFP4",
      "scanned_at": "2026-09-15T02:37:12.580737Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Qwen/Qwen3-30B-A3B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Qwen/Qwen3-30B-A3B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Qwen/Qwen3-30B-A3B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Qwen/Qwen3-30B-A3B"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "cnn_dailymail",
          "confidence": 0.6,
          "raw_context": "on Datasets:    ## Calibration Dataset:  ** Link: [cnn_dailymail](https://huggingface.co/datasets/abisee/cnn_dailymail) <br> ** Data collection meth"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "qwen3_moe",
          "confidence": 0.5,
          "raw_context": "model_type: qwen3_moe"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Qwen/Qwen3-30B-A3B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "of up to 131,072 tokens using the [YaRN](https://arxiv.org/abs/2309.00071) method.  YaRN is currently su"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": "Qwen/Qwen3-30B-A3B",
      "base_model_chain": [
        "Qwen/Qwen3-30B-A3B",
        "Qwen/Qwen3-30B-A3B-Base"
      ],
      "training_section_present": true,
      "license": "apache-2.0",
      "provenance_score": 0.55,
      "provenance_hash": "97df2346b4bd00f1ff74b6f92d647fe83c833959991d4199ce91855eb06fd141"
    },
    {
      "model_id": "nvidia/Qwen3-32B-NVFP4",
      "scanned_at": "2026-09-15T02:37:18.066089Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Qwen/Qwen3-32B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Qwen/Qwen3-32B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Qwen/Qwen3-32B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Qwen/Qwen3-32B"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "cnn_dailymail",
          "confidence": 0.6,
          "raw_context": "lity * [Text]   ## Calibration Dataset:  ** Link: [cnn_dailymail](https://huggingface.co/datasets/abisee/cnn_dailymail) <br> ** Data collection meth"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "qwen3",
          "confidence": 0.5,
          "raw_context": "model_type: qwen3"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Qwen/Qwen3-32B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "of up to 131,072 tokens using the [YaRN](https://arxiv.org/abs/2309.00071) method.  YaRN is currently su"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": "Qwen/Qwen3-32B",
      "base_model_chain": [
        "Qwen/Qwen3-32B"
      ],
      "training_section_present": true,
      "license": "apache-2.0",
      "provenance_score": 0.55,
      "provenance_hash": "8e348dd98c43bb05f1e4ea664443249f18dcb68d16920891f00eeb2791d3159a"
    },
    {
      "model_id": "nvidia/Qwen3-8B-NVFP4",
      "scanned_at": "2026-09-15T02:37:21.748546Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Qwen/Qwen3-8B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Qwen/Qwen3-8B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Qwen/Qwen3-8B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Qwen/Qwen3-8B"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "cnn_dailymail",
          "confidence": 0.6,
          "raw_context": "ality * [Text]  ## Calibration Dataset:  ** Link: [cnn_dailymail](https://huggingface.co/datasets/abisee/cnn_dailymail) <br> ** Data collection meth"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "qwen3",
          "confidence": 0.5,
          "raw_context": "model_type: qwen3"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Qwen/Qwen3-8B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "of up to 131,072 tokens using the [YaRN](https://arxiv.org/abs/2309.00071) method.  YaRN is currently su"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": "Qwen/Qwen3-8B",
      "base_model_chain": [
        "Qwen/Qwen3-8B",
        "Qwen/Qwen3-8B-Base"
      ],
      "training_section_present": true,
      "license": "apache-2.0",
      "provenance_score": 0.55,
      "provenance_hash": "deb34d6abb4dfed25c2786eef0ee5fb7ebbeb4f1299b151ad68a15e4537e1fe3"
    },
    {
      "model_id": "nvidia/Qwen3-Next-80B-A3B-Instruct-NVFP4",
      "scanned_at": "2026-09-15T02:37:24.494218Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Qwen/Qwen3-Next-80B-A3B-Instruct",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Qwen/Qwen3-Next-80B-A3B-Instruct"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Qwen/Qwen3-Next-80B-A3B-Instruct",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Qwen/Qwen3-Next-80B-A3B-Instruct"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "cnn_dailymail",
          "confidence": 0.6,
          "raw_context": "tion Datasets:  ## Calibration Dataset:  ** Link: [cnn_dailymail](https://huggingface.co/datasets/abisee/cnn_dailymail), [Nemotron-Post-Training-Dat"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Nemotron-Post-Training-Dataset-v2",
          "confidence": 0.6,
          "raw_context": "://huggingface.co/datasets/abisee/cnn_dailymail), [Nemotron-Post-Training-Dataset-v2](https://huggingface.co/datasets/nvidia/Nemotron-Post-Training-Dataset-v2) <br> **"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "qwen3_next",
          "confidence": 0.5,
          "raw_context": "model_type: qwen3_next"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Qwen/Qwen3-Next-80B-A3B-Instruct",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "f up to 1 million tokens using the [YaRN](https://arxiv.org/abs/2309.00071) method.  YaRN is currently su"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": "Qwen/Qwen3-Next-80B-A3B-Instruct",
      "base_model_chain": [
        "Qwen/Qwen3-Next-80B-A3B-Instruct"
      ],
      "training_section_present": true,
      "license": "apache-2.0",
      "provenance_score": 0.55,
      "provenance_hash": "8051b64bc1e34ce03a88440eeeb0346141908436af7d8556eafaf6f1ae850323"
    },
    {
      "model_id": "nvidia/Qwen3-Next-80B-A3B-Thinking-NVFP4",
      "scanned_at": "2026-09-15T02:37:29.126311Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Qwen/Qwen3-Next-80B-A3B-Thinking",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Qwen/Qwen3-Next-80B-A3B-Thinking"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Qwen/Qwen3-Next-80B-A3B-Thinking",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Qwen/Qwen3-Next-80B-A3B-Thinking"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "cnn_dailymail",
          "confidence": 0.6,
          "raw_context": "tion Datasets:  ## Calibration Dataset:  ** Link: [cnn_dailymail](https://huggingface.co/datasets/abisee/cnn_dailymail), [Nemotron-Post-Training-Dat"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Nemotron-Post-Training-Dataset-v2",
          "confidence": 0.6,
          "raw_context": "://huggingface.co/datasets/abisee/cnn_dailymail), [Nemotron-Post-Training-Dataset-v2](https://huggingface.co/datasets/nvidia/Nemotron-Post-Training-Dataset-v2) <br> **"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "qwen3_next",
          "confidence": 0.5,
          "raw_context": "model_type: qwen3_next"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Qwen/Qwen3-Next-80B-A3B-Thinking",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "f up to 1 million tokens using the [YaRN](https://arxiv.org/abs/2309.00071) method.  YaRN is currently su"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": "Qwen/Qwen3-Next-80B-A3B-Thinking",
      "base_model_chain": [
        "Qwen/Qwen3-Next-80B-A3B-Thinking"
      ],
      "training_section_present": true,
      "license": "apache-2.0",
      "provenance_score": 0.55,
      "provenance_hash": "9ba138dabcb79d7549f57032bf25ea53c545858de6908657b8332c9b78f07484"
    },
    {
      "model_id": "nvidia/Qwen3-VL-235B-A22B-Instruct-NVFP4-MLPerf-Inference-Closed-V6.0",
      "scanned_at": "2026-09-15T02:37:32.898247Z",
      "signals": [
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "qwen3_vl_moe",
          "confidence": 0.5,
          "raw_context": "model_type: qwen3_vl_moe"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "31983a71588326799ccdf0605e937790c5088c7597d0ab38e4b7df1ec53355e3"
    },
    {
      "model_id": "nvidia/Qwen3.5-397B-A17B-NVFP4",
      "scanned_at": "2026-09-15T02:37:35.649466Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Qwen/Qwen3.5-397B-A17B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Qwen/Qwen3.5-397B-A17B"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:Qwen/Qwen3.5-397B-A17B",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:Qwen/Qwen3.5-397B-A17B"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "cnn_dailymail",
          "confidence": 0.6,
          "raw_context": "ation Datasets:  ## Calibration Dataset: ** Link: [cnn_dailymail](https://huggingface.co/datasets/abisee/cnn_dailymail), [Nemotron-Post-Training-Dat"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Nemotron-Post-Training-Dataset-v2",
          "confidence": 0.6,
          "raw_context": "://huggingface.co/datasets/abisee/cnn_dailymail), [Nemotron-Post-Training-Dataset-v2](https://huggingface.co/datasets/nvidia/Nemotron-Post-Training-Dataset-v2) <br> **"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "qwen3_5_moe",
          "confidence": 0.5,
          "raw_context": "model_type: qwen3_5_moe"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Qwen/Qwen3.5-397B-A17B",
          "value": "coco",
          "confidence": 0.5599999999999999,
          "raw_context": "r-bottom:1px solid rgba(128, 128, 128, 0.15);\">RefCOCO(avg)</td> <td style=\"padding:7px 12px;text-align:"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Qwen/Qwen3.5-397B-A17B",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "er-bottom:1px solid rgba(128, 128, 128, 0.15);\">CharXiv(RQ)</td> <td style=\"padding:7px 12px;text-align:c"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "coco",
        "arxiv"
      ],
      "base_model": "Qwen/Qwen3.5-397B-A17B",
      "base_model_chain": [
        "Qwen/Qwen3.5-397B-A17B"
      ],
      "training_section_present": true,
      "license": "apache-2.0",
      "provenance_score": 0.6,
      "provenance_hash": "5a7b431aa243998401c884cce0559fcdb84a266cc262a3694e72e5db0144fc46"
    },
    {
      "model_id": "nvidia/RADIO-L",
      "scanned_at": "2026-09-15T02:37:40.278939Z",
      "signals": [
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": ".com/en-us/research/)  \\[[AM-RADIO Paper](https://arxiv.org/abs/2312.06709)\\] \\[[PHI-S Paper](https://arx"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "other",
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "e06946c11e478c3f7beb99b2fabf19a34319031471911b2c2a28ee3746ec6b6b"
    },
    {
      "model_id": "nvidia/audio-flamingo-3-hf",
      "scanned_at": "2026-09-15T02:37:43.030477Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/AudioSkills",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/AudioSkills"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/AF-Chat",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/AF-Chat"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/AF-Think",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/AF-Think"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/LongAudio",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/LongAudio"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "MusicBench",
          "confidence": 0.6,
          "raw_context": "ttps://gewu-lab.github.io/MUSIC-AVQA/)  (Human) * [MusicBench](https://huggingface.co/datasets/amaai-lab/MusicBench)  (Automated) * [Mu-LLAMA](ht"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "VoiceAssistant-400K",
          "confidence": 0.6,
          "raw_context": "nf.ed.ac.uk/ami/corpus/)  (Human)   #### Voice: * [VoiceAssistant-400K](https://huggingface.co/datasets/gpt-omni/VoiceAssistant-400K)  (Automated)  #### M"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "MuchoMusic",
          "confidence": 0.6,
          "raw_context": "(https://github.com/Sreyan88/GAMA)  (Automated) * [MuchoMusic](https://huggingface.co/datasets/yongyizang/RUListening)  (Automated) * [Open-AQA]("
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "MusicInstruct",
          "confidence": 0.6,
          "raw_context": "m/YuanGongND/ltu?tab=readme-ov-file)(Automated) * [MusicInstruct](https://huggingface.co/datasets/m-a-p/Music-Instruct)  (Automated) * [MusicQA](htt"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "MusicQA",
          "confidence": 0.6,
          "raw_context": ".co/datasets/m-a-p/Music-Instruct)  (Automated) * [MusicQA](https://huggingface.co/datasets/mu-llama/MusicQA)  (Automated) * [CMM Hallucinatio"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "OpenAudioBench",
          "confidence": 0.6,
          "raw_context": "://github.com/MatthewCYM/VoiceBench)  (Human)   * [OpenAudioBench](https://huggingface.co/datasets/baichuan-inc/OpenAudioBench) (Human)   * [SEED](ht"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "c4",
          "confidence": 0.7,
          "raw_context": "tps://zenodo.org/records/3338373)  (Human) * [Music4All](https://sites.google.com/view/contact4music4a"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "--- license: other language: - en arxiv: 2507.08128 tags: - audio - reasoning - audio und"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "audioflamingo3",
          "confidence": 0.5,
          "raw_context": "model_type: audioflamingo3"
        }
      ],
      "declared_datasets": [
        "nvidia/AudioSkills",
        "nvidia/AF-Think",
        "nvidia/AF-Chat",
        "nvidia/LongAudio"
      ],
      "inferred_datasets": [
        "c4",
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "other",
      "provenance_score": 0.7999999999999999,
      "provenance_hash": "300a3f27f124555e625302322c42c4024efa4753bb7d7679a828f79aecfaadde"
    },
    {
      "model_id": "nvidia/bigvgan_v2_24khz_100band_256x",
      "scanned_at": "2026-09-15T02:37:45.781527Z",
      "signals": [
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "o/nvidia/BigVGAN/blob/main/LICENSE tags: - neural-vocoder - audio-generation library_name: PyTorch pipe"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "c4",
          "confidence": 0.7,
          "raw_context": "om/15963413/218609148-881e39df-33af-4af9-ab95-1427c4ebf062.png\" width=\"800\"></center>  ## News - **Jul"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "Bryan Catanzaro, Sungroh Yoon  [[Paper]](https://arxiv.org/abs/2206.04658) - [[Code]](https://github.com"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "c4",
        "arxiv",
        "voc"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "mit",
      "provenance_score": 0.25,
      "provenance_hash": "2ab69f524d7a4a9a4d13282134296f8ecc967c95aeff6d599be3a867603ce9ce"
    },
    {
      "model_id": "nvidia/diar_streaming_sortformer_4spk-v2",
      "scanned_at": "2026-09-15T02:37:48.565743Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "fisher_english",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:fisher_english"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "NIST_SRE_2004-2010",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:NIST_SRE_2004-2010"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "librispeech",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:librispeech"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "ami_meeting_corpus",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:ami_meeting_corpus"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "voxconverse_v0.3",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:voxconverse_v0.3"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "icsi",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:icsi"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "aishell4",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:aishell4"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "dihard_challenge-3-dev",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:dihard_challenge-3-dev"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "NIST_SRE_2000-Disc8_split1",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:NIST_SRE_2000-Disc8_split1"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "Alimeeting-train",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:Alimeeting-train"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "DiPCo",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:DiPCo"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "publicly available speech",
          "confidence": 0.6,
          "raw_context": "degrade on very long recordings. - The model was trained on publicly available speech datasets, primarily in English. As a result:     * Perfor"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "proprietary",
          "confidence": 0.6,
          "raw_context": "the most common languages with model checkpoints trained on proprietary data with hundreds of thousands of GPU-compute hours"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "c4",
          "confidence": 0.7,
          "raw_context": "s://github.com/NVIDIA-NeMo/NeMo/blob/316aea20fc2aac4e41bc08123cc77118a9f0b82a/examples/voice_agent/ser"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "sion of Sortformer diarizer. [Sortformer](https://arxiv.org/abs/2409.06656)[1] is a novel end-to-end neur"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        }
      ],
      "declared_datasets": [
        "aishell4",
        "NIST_SRE_2004-2010",
        "fisher_english",
        "librispeech",
        "ami_meeting_corpus",
        "DiPCo",
        "Alimeeting-train",
        "icsi",
        "voxconverse_v0.3",
        "dihard_challenge-3-dev",
        "NIST_SRE_2000-Disc8_split1"
      ],
      "inferred_datasets": [
        "c4",
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "cc-by-4.0",
      "provenance_score": 0.7999999999999999,
      "provenance_hash": "d4e956435e914b8f76a7259a40004131c3ba15ff2b1568de12dffa6092b99c83"
    },
    {
      "model_id": "nvidia/difix",
      "scanned_at": "2026-09-15T02:37:51.326625Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "DL3DV/DL3DV-10K-Sample",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:DL3DV/DL3DV-10K-Sample"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "m/labs/toronto-ai/difix3d/) | [**Paper**](https://arxiv.org/abs/2503.01774)  ## 📣📣 The commercially avail"
        }
      ],
      "declared_datasets": [
        "DL3DV/DL3DV-10K-Sample"
      ],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "df3e2706d059e633f8ee3a6783856a9a10eea81fa76390879618e6b9a5f94f25"
    },
    {
      "model_id": "nvidia/difix_ref",
      "scanned_at": "2026-09-15T02:37:54.088895Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "DL3DV/DL3DV-10K-Sample",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:DL3DV/DL3DV-10K-Sample"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "m/labs/toronto-ai/difix3d/) | [**Paper**](https://arxiv.org/abs/2503.01774)  ## Description:  Difix is a"
        }
      ],
      "declared_datasets": [
        "DL3DV/DL3DV-10K-Sample"
      ],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "49c5e55dac924c9bd9f83e88d5163e8be7e1f2ea2238b65608d387336cbcbdf6"
    },
    {
      "model_id": "nvidia/domain-classifier",
      "scanned_at": "2026-09-15T02:37:56.839291Z",
      "signals": [
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Common Crawl",
          "confidence": 0.6,
          "raw_context": "# Training Details ## Training data: - 1 million Common Crawl samples, labeled using Google Cloud’s Natural Lan"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Wikipedia",
          "confidence": 0.6,
          "raw_context": "ing-text - 500k Wikepedia articles, curated using Wikipedia-API: https://pypi.org/project/Wikipedia-API/  ##"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "wikipedia",
          "confidence": 0.7,
          "raw_context": "ing-text - 500k Wikepedia articles, curated using Wikipedia-API: https://pypi.org/project/Wikipedia-API/  ##"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "common crawl",
          "confidence": 0.7,
          "raw_context": "# Training Details ## Training data: - 1 million Common Crawl samples, labeled using Google Cloud’s Natural Lan"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "| 0.9873 |  # References - https://arxiv.org/abs/2111.09543 - https://github.com/microsoft"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "deberta-v2",
          "confidence": 0.5,
          "raw_context": "model_type: deberta-v2"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "wikipedia",
        "common crawl",
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "apache-2.0",
      "provenance_score": 0.55,
      "provenance_hash": "5d7b0d05ca380addca33dc50c48edff81d0d84ee8fa7818242b6f4bac9c8bd92"
    },
    {
      "model_id": "nvidia/gpt-oss-120b-Eagle3-long-context",
      "scanned_at": "2026-09-15T02:37:59.581831Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "openai/gpt-oss-120b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:openai/gpt-oss-120b"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:openai/gpt-oss-120b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:openai/gpt-oss-120b"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "ultrachat_200k",
          "confidence": 0.6,
          "raw_context": "100%<br>\r \r \r ## Training Dataset:\r \r **Link:** [ultrachat_200k](https://huggingface.co/datasets/HuggingFaceH4/ultrachat_200k) and [Magpie-Llama-3."
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "ultrachat",
          "confidence": 0.7,
          "raw_context": "100%<br>\r \r \r ## Training Dataset:\r \r **Link:** [ultrachat_200k](https://huggingface.co/datasets/HuggingFace"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "llama",
          "confidence": 0.5,
          "raw_context": "model_type: llama"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:openai/gpt-oss-120b",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "><strong>Guides</strong></a> ·   <a href=\"https://arxiv.org/abs/2508.10925\"><strong>Model card</strong></"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "ultrachat"
      ],
      "base_model": "openai/gpt-oss-120b",
      "base_model_chain": [
        "openai/gpt-oss-120b"
      ],
      "training_section_present": true,
      "license": "other",
      "provenance_score": 0.6,
      "provenance_hash": "d3ab76a3d118daefcfeae68279df0cbca5e686b5b2d7d3c7d5acc47026a6dfee"
    },
    {
      "model_id": "nvidia/gpt-oss-120b-Eagle3-short-context",
      "scanned_at": "2026-09-15T02:38:04.152796Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "openai/gpt-oss-120b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:openai/gpt-oss-120b"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:openai/gpt-oss-120b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:openai/gpt-oss-120b"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "ultrachat_200k",
          "confidence": 0.6,
          "raw_context": "ining  100%<br>   ## Training Dataset:  **Link:** [ultrachat_200k](https://huggingface.co/datasets/HuggingFaceH4/ultrachat_200k) and [Magpie-Llama-3."
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "ultrachat",
          "confidence": 0.7,
          "raw_context": "ning  100%<br>   ## Training Dataset:  **Link:** [ultrachat_200k](https://huggingface.co/datasets/HuggingFace"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "llama",
          "confidence": 0.5,
          "raw_context": "model_type: llama"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:openai/gpt-oss-120b",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "><strong>Guides</strong></a> ·   <a href=\"https://arxiv.org/abs/2508.10925\"><strong>Model card</strong></"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "ultrachat"
      ],
      "base_model": "openai/gpt-oss-120b",
      "base_model_chain": [
        "openai/gpt-oss-120b"
      ],
      "training_section_present": true,
      "license": "other",
      "provenance_score": 0.6,
      "provenance_hash": "fcf80ce7a22aced3d5e6c126793b0fdd163e3988dcaf6e29ea2b07e7538e655d"
    },
    {
      "model_id": "nvidia/llama-nemoretriever-colembed-1b-v1",
      "scanned_at": "2026-09-15T02:38:06.965908Z",
      "signals": [
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "HotpotQA",
          "confidence": 0.6,
          "raw_context": "trained on publicly available datasets, including [HotpotQA](https://huggingface.co/datasets/hotpotqa/hotpot_qa), [MIRACL](https://huggingface."
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "MIRACL",
          "confidence": 0.6,
          "raw_context": "ps://huggingface.co/datasets/hotpotqa/hotpot_qa), [MIRACL](https://huggingface.co/datasets/SEACrowd/miracl), [Natural Questions (NQ)](https:/"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "SQuAD",
          "confidence": 0.6,
          "raw_context": "tasets/HuggingFaceH4/stack-exchange-preferences), [SQuAD](https://huggingface.co/datasets/squad), [Tiger Math/Stack](https://huggingface.co/"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "DocMatix-IR",
          "confidence": 0.6,
          "raw_context": "uggingface.co/datasets/TIGER-Lab/WebInstructSub), [DocMatix-IR](https://huggingface.co/datasets/Tevatron/docmatix-ir), [VDR](https://huggingface.c"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "VDR",
          "confidence": 0.6,
          "raw_context": "://huggingface.co/datasets/Tevatron/docmatix-ir), [VDR](https://huggingface.co/datasets/vdr-multilingual-train), [Vidore-ColPali-Training]"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Vidore-ColPali-Training",
          "confidence": 0.6,
          "raw_context": "/huggingface.co/datasets/vdr-multilingual-train), [Vidore-ColPali-Training](https://huggingface.co/datasets/vidore/colpali_train_set), [VisRAG-Ret-Train-Synth"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "VisRAG-Ret-Train-Synthetic-data",
          "confidence": 0.6,
          "raw_context": "uggingface.co/datasets/vidore/colpali_train_set), [VisRAG-Ret-Train-Synthetic-data](https://huggingface.co/datasets/openbmb/VisRAG-Ret-Train-Synthetic-data), [VisRAG-"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "VisRAG-Ret-Train-In-domain-data",
          "confidence": 0.6,
          "raw_context": "atasets/openbmb/VisRAG-Ret-Train-Synthetic-data), [VisRAG-Ret-Train-In-domain-data](https://huggingface.co/datasets/openbmb/VisRAG-Ret-Train-In-domain-data), and [Wik"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Wiki-SS-NQ",
          "confidence": 0.6,
          "raw_context": "ets/openbmb/VisRAG-Ret-Train-In-domain-data), and [Wiki-SS-NQ](https://huggingface.co/datasets/Tevatron/wiki-ss-nq).  - **Data Collection Method"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "publicly available",
          "confidence": 0.6,
          "raw_context": "or evaluation.  ## Training Dataset The model was trained on publicly available datasets, including [HotpotQA](https://huggingface.co/dat"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "wikipedia",
          "confidence": 0.6,
          "raw_context": "nts image_urls = [ \t'https://upload.wikimedia.org/wikipedia/commons/3/35/Human_losses_of_world_war_two_by_cou"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "google/siglip2-giant-opt-patch16-384",
          "confidence": 0.85,
          "raw_context": "multimodal embedding model built on top of a VLM based on google/siglip2-giant-opt-patch16-384 and meta-llama/Llama-3.2-1B.   ## Input  | Proper"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "wikipedia",
          "confidence": 0.7,
          "raw_context": "nts image_urls = [ \t'https://upload.wikimedia.org/wikipedia/commons/3/35/Human_losses_of_world_war_two_by_cou"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "erforming Text-Image Retrieval Model](https://www.arxiv.org/abs/2507.05513)  This model is for non-commer"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "squad",
          "confidence": 0.7,
          "raw_context": "asets/HuggingFaceH4/stack-exchange-preferences), [SQuAD](https://huggingface.co/datasets/squad), [Tiger M"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "llama_nemoretrievercolembed",
          "confidence": 0.5,
          "raw_context": "model_type: llama_nemoretrievercolembed"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "wikipedia",
        "squad",
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "other",
      "provenance_score": 0.55,
      "provenance_hash": "b8162db3135e1e1e5abd2cb9249e5b2f64304f988ac9f0599b189ab7253eb1f3"
    },
    {
      "model_id": "nvidia/llama-nemotron-colembed-vl-3b-v2",
      "scanned_at": "2026-09-15T02:38:09.726298Z",
      "signals": [
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "HotpotQA",
          "confidence": 0.6,
          "raw_context": "trained on publicly available datasets, including [HotpotQA](https://huggingface.co/datasets/hotpotqa/hotpot_qa), [MIRACL](https://huggingface."
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "MIRACL",
          "confidence": 0.6,
          "raw_context": "ps://huggingface.co/datasets/hotpotqa/hotpot_qa), [MIRACL](https://huggingface.co/datasets/SEACrowd/miracl), [Natural Questions (NQ)](https:/"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "SQuAD",
          "confidence": 0.6,
          "raw_context": "tasets/HuggingFaceH4/stack-exchange-preferences), [SQuAD](https://huggingface.co/datasets/squad), [Tiger Math/Stack](https://huggingface.co/"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "DocMatix-IR",
          "confidence": 0.6,
          "raw_context": "uggingface.co/datasets/TIGER-Lab/WebInstructSub), [DocMatix-IR](https://huggingface.co/datasets/Tevatron/docmatix-ir), [VDR](https://huggingface.c"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "VDR",
          "confidence": 0.6,
          "raw_context": "://huggingface.co/datasets/Tevatron/docmatix-ir), [VDR](https://huggingface.co/datasets/vdr-multilingual-train), [Vidore-ColPali-Training]"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Vidore-ColPali-Training",
          "confidence": 0.6,
          "raw_context": "/huggingface.co/datasets/vdr-multilingual-train), [Vidore-ColPali-Training](https://huggingface.co/datasets/vidore/colpali_train_set), [VisRAG-Ret-Train-Synth"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "VisRAG-Ret-Train-Synthetic-data",
          "confidence": 0.6,
          "raw_context": "uggingface.co/datasets/vidore/colpali_train_set), [VisRAG-Ret-Train-Synthetic-data](https://huggingface.co/datasets/openbmb/VisRAG-Ret-Train-Synthetic-data), [VisRAG-"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "VisRAG-Ret-Train-In-domain-data",
          "confidence": 0.6,
          "raw_context": "atasets/openbmb/VisRAG-Ret-Train-Synthetic-data), [VisRAG-Ret-Train-In-domain-data](https://huggingface.co/datasets/openbmb/VisRAG-Ret-Train-In-domain-data), and [Wik"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Wiki-SS-NQ",
          "confidence": 0.6,
          "raw_context": "ets/openbmb/VisRAG-Ret-Train-In-domain-data), and [Wiki-SS-NQ](https://huggingface.co/datasets/Tevatron/wiki-ss-nq).  **Data Modality**: Text and"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "publicly available",
          "confidence": 0.6,
          "raw_context": "tion Datasets  ## Training Dataset  The model was trained on publicly available datasets, including [HotpotQA](https://huggingface.co/dat"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "google/siglip2-giant-opt-patch16-384",
          "confidence": 0.85,
          "raw_context": "multimodal embedding model built on top of a VLM based on google/siglip2-giant-opt-patch16-384 and meta-llama/Llama-3.2-3B. It has approximately"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "Check the Nemotron ColEmbed v2 [paper](https://arxiv.org/abs/2602.03992) for more details.  ### Licens"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "squad",
          "confidence": 0.7,
          "raw_context": "asets/HuggingFaceH4/stack-exchange-preferences), [SQuAD](https://huggingface.co/datasets/squad), [Tiger M"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "nvidia/llama-nemotron-colembed-vl-3b-v2",
          "confidence": 0.9,
          "raw_context": "_name_or_path: nvidia/llama-nemotron-colembed-vl-3b-v2"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "llama_nemotron_vl",
          "confidence": 0.5,
          "raw_context": "model_type: llama_nemotron_vl"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "squad",
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "other",
      "provenance_score": 0.5,
      "provenance_hash": "12992efdb624fd727129f8bd9870197a710b261617606a984881c55553f0c1e1"
    },
    {
      "model_id": "nvidia/llama-nemotron-embed-1b-v2",
      "scanned_at": "2026-09-15T02:38:12.494693Z",
      "signals": [
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "HotpotQA",
          "confidence": 0.6,
          "raw_context": "- [NQ](https://huggingface.co/datasets/BeIR/nq), [HotpotQA](https://huggingface.co/datasets/hotpot_qa) and [FiQA (Finance Q\\&A)](https://huggi"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "MLDR",
          "confidence": 0.6,
          "raw_context": "A](https://github.com/facebookresearch/MLQA), and [MLDR](https://huggingface.co/datasets/Shitao/MLDR). The size ranges between 10,000s up t"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "public",
          "confidence": 0.6,
          "raw_context": "16 layers and an embedding size of 2048, which is trained on public datasets. The AdamW optimizer is employed incorporating 1"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Wikipedia",
          "confidence": 0.6,
          "raw_context": "s://huggingface.co/datasets/Shitao/MLDR) built on Wikipedia and mC4, covering 12 typologically diverse langua"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "MTEB/BEIR",
          "confidence": 0.85,
          "raw_context": "nown  **Properties:** The evaluation datasets are based on [MTEB/BEIR](https://github.com/beir-cellar/beir), TextQA, Te"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "wikipedia",
          "confidence": 0.7,
          "raw_context": "s://huggingface.co/datasets/Shitao/MLDR) built on Wikipedia and mC4, covering 12 typologically diverse langua"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "mc4",
          "confidence": 0.7,
          "raw_context": "e.co/datasets/Shitao/MLDR) built on Wikipedia and mC4, covering 12 typologically diverse languages. The"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "c4",
          "confidence": 0.7,
          "raw_context": ".co/datasets/Shitao/MLDR) built on Wikipedia and mC4, covering 12 typologically diverse languages. The"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "ifferer, Benedikt and Oldridge, Even},   journal={arXiv preprint arXiv:2407.15831},   year={2024} } ```"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "nvidia/llama-3.2-nv-embedqa-1b-v2",
          "confidence": 0.9,
          "raw_context": "_name_or_path: nvidia/llama-3.2-nv-embedqa-1b-v2"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "llama_bidirec",
          "confidence": 0.5,
          "raw_context": "model_type: llama_bidirec"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "wikipedia",
        "mc4",
        "arxiv",
        "c4"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "other",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "aad9f1cf00df9c0684b0757e0d0293dce19cbf956190f845a9e77a80318b4235"
    },
    {
      "model_id": "nvidia/llama-nemotron-rerank-1b-v2",
      "scanned_at": "2026-09-15T02:38:15.254958Z",
      "signals": [
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "HotpotQA",
          "confidence": 0.6,
          "raw_context": "\\- [NQ](https://huggingface.co/datasets/BeIR/nq), [HotpotQA](https://huggingface.co/datasets/hotpot_qa) and [FiQA (Finance Q\\&A)](https://huggi"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Wikipedia",
          "confidence": 0.6,
          "raw_context": "s://huggingface.co/datasets/Shitao/MLDR) built on Wikipedia and mC4, covering 12 typologically diverse langua"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "wikipedia",
          "confidence": 0.7,
          "raw_context": "s://huggingface.co/datasets/Shitao/MLDR) built on Wikipedia and mC4, covering 12 typologically diverse langua"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "mc4",
          "confidence": 0.7,
          "raw_context": "e.co/datasets/Shitao/MLDR) built on Wikipedia and mC4, covering 12 typologically diverse languages . Th"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "c4",
          "confidence": 0.7,
          "raw_context": ".co/datasets/Shitao/MLDR) built on Wikipedia and mC4, covering 12 typologically diverse languages . Th"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "nvidia/llama-3.2-nv-rerankqa-1b-v2",
          "confidence": 0.9,
          "raw_context": "_name_or_path: nvidia/llama-3.2-nv-rerankqa-1b-v2"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "llama_bidirec",
          "confidence": 0.5,
          "raw_context": "model_type: llama_bidirec"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "wikipedia",
        "mc4",
        "c4"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "other",
      "provenance_score": 0.25,
      "provenance_hash": "b2e800cdd0354d230efa55453cc456c3b45df0b7d48823bdfbb269f63592a7ba"
    },
    {
      "model_id": "nvidia/mit-b1",
      "scanned_at": "2026-09-15T02:38:18.008375Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "imagenet_1k",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:imagenet_1k"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "imagenet",
          "confidence": 0.7,
          "raw_context": "--- license: other tags: - vision datasets: - imagenet_1k widget: - src: https://huggingface.co/datasets"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "coco",
          "confidence": 0.7,
          "raw_context": "how to use this model to classify an image of the COCO 2017 dataset into one of the 1,000 ImageNet class"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "Semantic Segmentation with Transformers](https://arxiv.org/abs/2105.15203) by Xie et al. and first relea"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "segformer",
          "confidence": 0.5,
          "raw_context": "model_type: segformer"
        }
      ],
      "declared_datasets": [
        "imagenet_1k"
      ],
      "inferred_datasets": [
        "arxiv",
        "coco",
        "imagenet"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "other",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "c11b4fef14d0fd3ed08ae21860aa0c2de353448529befd72b190330953f14795"
    },
    {
      "model_id": "nvidia/music-flamingo-2601-hf",
      "scanned_at": "2026-09-15T02:38:20.849977Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nvidia/MF-Skills",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nvidia/MF-Skills"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "MusicBench",
          "confidence": 0.6,
          "raw_context": "ttps://gewu-lab.github.io/MUSIC-AVQA/)  (Human) * [MusicBench](https://huggingface.co/datasets/amaai-lab/MusicBench)  (Automated) * [Mu-LLAMA](ht"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "MuchoMusic",
          "confidence": 0.6,
          "raw_context": "MAR](https://arxiv.org/abs/2505.13032)  (Human) * [MuchoMusic](https://huggingface.co/datasets/yongyizang/RUListening)  (Automated) * [MusicInstr"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "MusicInstruct",
          "confidence": 0.6,
          "raw_context": "o/datasets/yongyizang/RUListening)  (Automated) * [MusicInstruct](https://huggingface.co/datasets/m-a-p/Music-Instruct)  (Automated) * [MusicQA](htt"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "MusicQA",
          "confidence": 0.6,
          "raw_context": ".co/datasets/m-a-p/Music-Instruct)  (Automated) * [MusicQA](https://huggingface.co/datasets/mu-llama/MusicQA)  (Automated) * [SongCaps (ours)]"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "-the-floor kick pattern, and a mezzo-soprano lead vocal with bright timbre. Dynamically, the track buil"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "c4",
          "confidence": 0.7,
          "raw_context": "tps://zenodo.org/records/3338373)  (Human) * [Music4All](https://sites.google.com/view/contact4music4a"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "--- license: other language: - en arxiv: 2511.10289 tags: - music/songs - music understan"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "musicflamingo",
          "confidence": 0.5,
          "raw_context": "model_type: musicflamingo"
        }
      ],
      "declared_datasets": [
        "nvidia/MF-Skills"
      ],
      "inferred_datasets": [
        "c4",
        "arxiv",
        "voc"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "other",
      "provenance_score": 0.65,
      "provenance_hash": "343862dd6b33094ec80563d75d91c02a38c83c744b0865a8523499b6265a069c"
    },
    {
      "model_id": "nvidia/nemotron-colembed-vl-4b-v2",
      "scanned_at": "2026-09-15T02:38:23.597957Z",
      "signals": [
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "DocMatix-IR",
          "confidence": 0.6,
          "raw_context": "trained on publicly available datasets, including [DocMatix-IR](https://huggingface.co/datasets/Tevatron/docmatix-ir), [VDR](https://huggingface.c"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "VDR",
          "confidence": 0.6,
          "raw_context": "://huggingface.co/datasets/Tevatron/docmatix-ir), [VDR](https://huggingface.co/datasets/vdr-multilingual-train), [Vidore-ColPali-Training]"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Vidore-ColPali-Training",
          "confidence": 0.6,
          "raw_context": "/huggingface.co/datasets/vdr-multilingual-train), [Vidore-ColPali-Training](https://huggingface.co/datasets/vidore/colpali_train_set), [VisRAG-Ret-Train-Synth"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "VisRAG-Ret-Train-Synthetic-data",
          "confidence": 0.6,
          "raw_context": "uggingface.co/datasets/vidore/colpali_train_set), [VisRAG-Ret-Train-Synthetic-data](https://huggingface.co/datasets/openbmb/VisRAG-Ret-Train-Synthetic-data), [VisRAG-"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "VisRAG-Ret-Train-In-domain-data",
          "confidence": 0.6,
          "raw_context": "atasets/openbmb/VisRAG-Ret-Train-Synthetic-data), [VisRAG-Ret-Train-In-domain-data](https://huggingface.co/datasets/openbmb/VisRAG-Ret-Train-In-domain-data), and [Wik"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Wiki-SS-NQ",
          "confidence": 0.6,
          "raw_context": "ets/openbmb/VisRAG-Ret-Train-In-domain-data), and [Wiki-SS-NQ](https://huggingface.co/datasets/Tevatron/wiki-ss-nq).  **Data Modality**: Image  *"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "publicly available",
          "confidence": 0.6,
          "raw_context": "tion Datasets  ## Training Dataset  The model was trained on publicly available datasets, including [DocMatix-IR](https://huggingface.co/"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "y.   See the Nemotron ColEmbed v2 [paper](https://arxiv.org/abs/2602.03992) for more details about its ar"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "qwen3_vl_nemotron_embed",
          "confidence": 0.5,
          "raw_context": "model_type: qwen3_vl_nemotron_embed"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "cc-by-nc-4.0",
      "provenance_score": 0.45,
      "provenance_hash": "52a05098f1a4cf9a58e71c64637911d8b63c52af50f6f5cd7a4745f972eda82e"
    },
    {
      "model_id": "nvidia/parakeet-ctc-0.6b",
      "scanned_at": "2026-09-15T02:38:26.363965Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "librispeech_asr",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:librispeech_asr"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "fisher_corpus",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:fisher_corpus"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "Switchboard-1",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:Switchboard-1"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "WSJ-0",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:WSJ-0"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "WSJ-1",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:WSJ-1"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "National-Singapore-Corpus-Part-1",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:National-Singapore-Corpus-Part-1"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "National-Singapore-Corpus-Part-6",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:National-Singapore-Corpus-Part-6"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "vctk",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:vctk"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "voxpopuli",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:voxpopuli"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "europarl",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:europarl"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "multilingual_librispeech",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:multilingual_librispeech"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "mozilla-foundation/common_voice_8_0",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:mozilla-foundation/common_voice_8_0"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "MLCommons/peoples_speech",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:MLCommons/peoples_speech"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "proprietary",
          "confidence": 0.6,
          "raw_context": "the most common languages with model checkpoints trained on proprietary data with hundreds of thousands of GPU-compute hours"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "h greedy decoding.   |**Version**|**Tokenizer**|**Vocabulary Size**|**AMI**|**Earnings-22**|**Giga Spee"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "tention for Efficient Speech Recognition](https://arxiv.org/abs/2305.05084)  [2] [Google Sentencepiece To"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "parakeet_ctc",
          "confidence": 0.5,
          "raw_context": "model_type: parakeet_ctc"
        }
      ],
      "declared_datasets": [
        "librispeech_asr",
        "Switchboard-1",
        "WSJ-0",
        "MLCommons/peoples_speech",
        "WSJ-1",
        "mozilla-foundation/common_voice_8_0",
        "fisher_corpus",
        "vctk",
        "europarl",
        "multilingual_librispeech",
        "National-Singapore-Corpus-Part-6",
        "National-Singapore-Corpus-Part-1",
        "voxpopuli"
      ],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "cc-by-4.0",
      "provenance_score": 0.7999999999999999,
      "provenance_hash": "52f171ff448d6fa10a2be75392334dda0533a7f070905a1db804ab911bd88a47"
    },
    {
      "model_id": "nvidia/parakeet-rnnt-0.6b",
      "scanned_at": "2026-09-15T02:38:29.119387Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "librispeech_asr",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:librispeech_asr"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "fisher_corpus",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:fisher_corpus"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "Switchboard-1",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:Switchboard-1"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "WSJ-0",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:WSJ-0"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "WSJ-1",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:WSJ-1"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "National-Singapore-Corpus-Part-1",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:National-Singapore-Corpus-Part-1"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "National-Singapore-Corpus-Part-6",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:National-Singapore-Corpus-Part-6"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "vctk",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:vctk"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "voxpopuli",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:voxpopuli"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "europarl",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:europarl"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "multilingual_librispeech",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:multilingual_librispeech"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "mozilla-foundation/common_voice_8_0",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:mozilla-foundation/common_voice_8_0"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "MLCommons/peoples_speech",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:MLCommons/peoples_speech"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "proprietary",
          "confidence": 0.6,
          "raw_context": "the most common languages with model checkpoints trained on proprietary data with hundreds of thousands of GPU-compute hours"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "h greedy decoding.   |**Version**|**Tokenizer**|**Vocabulary Size**|**AMI**|**Earnings-22**|**Giga Spee"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "tention for Efficient Speech Recognition](https://arxiv.org/abs/2305.05084)  [2] [Google Sentencepiece To"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "parakeet_rnnt",
          "confidence": 0.5,
          "raw_context": "model_type: parakeet_rnnt"
        }
      ],
      "declared_datasets": [
        "librispeech_asr",
        "Switchboard-1",
        "WSJ-0",
        "MLCommons/peoples_speech",
        "WSJ-1",
        "mozilla-foundation/common_voice_8_0",
        "fisher_corpus",
        "vctk",
        "europarl",
        "multilingual_librispeech",
        "National-Singapore-Corpus-Part-6",
        "National-Singapore-Corpus-Part-1",
        "voxpopuli"
      ],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "cc-by-4.0",
      "provenance_score": 0.7999999999999999,
      "provenance_hash": "b5ab514f2c95d79a1668005a4a064c4bf5c5d275789d89714391aa7e8a10ec02"
    },
    {
      "model_id": "nvidia/prompt-task-and-complexity-classifier",
      "scanned_at": "2026-09-15T02:38:31.871345Z",
      "signals": [
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "text/data",
          "confidence": 0.85,
          "raw_context": "dge * Closed QA: A question where the response is based on text/data provided with the prompt * Summarization * Text G"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "Gradient-Disentangled Embedding Sharing](https://arxiv.org/abs/2111.09543) * [DeBERTa: Decoding-enhanced"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "other",
      "provenance_score": 0.45,
      "provenance_hash": "22bb607825a1090308a9e63dc0b67d919f2769185e7a4cb9ca8251c0635869fa"
    },
    {
      "model_id": "nvidia/segformer-b0-finetuned-cityscapes-1024-1024",
      "scanned_at": "2026-09-15T02:38:34.635809Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "cityscapes",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:cityscapes"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "imagenet",
          "confidence": 0.7,
          "raw_context": "hierarchical Transformer is first pre-trained on ImageNet-1k, after which a decode head is added and fine-t"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "coco",
          "confidence": 0.7,
          "raw_context": "how to use this model to classify an image of the COCO 2017 dataset into one of the 1,000 ImageNet class"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "Semantic Segmentation with Transformers](https://arxiv.org/abs/2105.15203) by Xie et al. and first relea"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "segformer",
          "confidence": 0.5,
          "raw_context": "model_type: segformer"
        }
      ],
      "declared_datasets": [
        "cityscapes"
      ],
      "inferred_datasets": [
        "arxiv",
        "coco",
        "imagenet"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "other",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "0fbabb107b79690ed064aa1cd3fa7eeb8a6f73f668717a18193b51855898d8b9"
    },
    {
      "model_id": "nvidia/segformer-b0-finetuned-cityscapes-512-1024",
      "scanned_at": "2026-09-15T02:38:37.399509Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "cityscapes",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:cityscapes"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "imagenet",
          "confidence": 0.7,
          "raw_context": "hierarchical Transformer is first pre-trained on ImageNet-1k, after which a decode head is added and fine-t"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "coco",
          "confidence": 0.7,
          "raw_context": "how to use this model to classify an image of the COCO 2017 dataset into one of the 1,000 ImageNet class"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "Semantic Segmentation with Transformers](https://arxiv.org/abs/2105.15203) by Xie et al. and first relea"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "segformer",
          "confidence": 0.5,
          "raw_context": "model_type: segformer"
        }
      ],
      "declared_datasets": [
        "cityscapes"
      ],
      "inferred_datasets": [
        "arxiv",
        "coco",
        "imagenet"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "other",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "15d8c0524502fd4c7f3e90c2de6d17daed8e8b77048c45d564dc03e9a5657ee7"
    },
    {
      "model_id": "nvidia/segformer-b1-finetuned-cityscapes-1024-1024",
      "scanned_at": "2026-09-15T02:38:40.237955Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "cityscapes",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:cityscapes"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "imagenet",
          "confidence": 0.7,
          "raw_context": "hierarchical Transformer is first pre-trained on ImageNet-1k, after which a decode head is added and fine-t"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "coco",
          "confidence": 0.7,
          "raw_context": "how to use this model to classify an image of the COCO 2017 dataset into one of the 1,000 ImageNet class"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "Semantic Segmentation with Transformers](https://arxiv.org/abs/2105.15203) by Xie et al. and first relea"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "segformer",
          "confidence": 0.5,
          "raw_context": "model_type: segformer"
        }
      ],
      "declared_datasets": [
        "cityscapes"
      ],
      "inferred_datasets": [
        "arxiv",
        "coco",
        "imagenet"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "other",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "bc2293167607082c5492e9a3d41e6c0de2b6a4b0078f0895063e093103ef1435"
    },
    {
      "model_id": "nvidia/segformer-b2-finetuned-ade-512-512",
      "scanned_at": "2026-09-15T02:38:42.988624Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "scene_parse_150",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:scene_parse_150"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "imagenet",
          "confidence": 0.7,
          "raw_context": "hierarchical Transformer is first pre-trained on ImageNet-1k, after which a decode head is added and fine-t"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "coco",
          "confidence": 0.7,
          "raw_context": "how to use this model to classify an image of the COCO 2017 dataset into one of the 1,000 ImageNet class"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "Semantic Segmentation with Transformers](https://arxiv.org/abs/2105.15203) by Xie et al. and first relea"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "segformer",
          "confidence": 0.5,
          "raw_context": "model_type: segformer"
        }
      ],
      "declared_datasets": [
        "scene_parse_150"
      ],
      "inferred_datasets": [
        "arxiv",
        "coco",
        "imagenet"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "other",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "3e6d3a7969ba6a74b926c4c1979a2c499c9f6357f894616868b62c59ce184711"
    },
    {
      "model_id": "nvidia/segformer-b2-finetuned-cityscapes-1024-1024",
      "scanned_at": "2026-09-15T02:38:45.730282Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "cityscapes",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:cityscapes"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "imagenet",
          "confidence": 0.7,
          "raw_context": "hierarchical Transformer is first pre-trained on ImageNet-1k, after which a decode head is added and fine-t"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "coco",
          "confidence": 0.7,
          "raw_context": "how to use this model to classify an image of the COCO 2017 dataset into one of the 1,000 ImageNet class"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "Semantic Segmentation with Transformers](https://arxiv.org/abs/2105.15203) by Xie et al. and first relea"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "segformer",
          "confidence": 0.5,
          "raw_context": "model_type: segformer"
        }
      ],
      "declared_datasets": [
        "cityscapes"
      ],
      "inferred_datasets": [
        "arxiv",
        "coco",
        "imagenet"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "other",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "b54228adb4a67a7ea4ea8ed046fc6f8a5967cca352b4c4379116259231d9e2e4"
    },
    {
      "model_id": "nvidia/segformer-b3-finetuned-ade-512-512",
      "scanned_at": "2026-09-15T02:38:48.514224Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "scene_parse_150",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:scene_parse_150"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "imagenet",
          "confidence": 0.7,
          "raw_context": "hierarchical Transformer is first pre-trained on ImageNet-1k, after which a decode head is added and fine-t"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "coco",
          "confidence": 0.7,
          "raw_context": "how to use this model to classify an image of the COCO 2017 dataset into one of the 1,000 ImageNet class"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "Semantic Segmentation with Transformers](https://arxiv.org/abs/2105.15203) by Xie et al. and first relea"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "segformer",
          "confidence": 0.5,
          "raw_context": "model_type: segformer"
        }
      ],
      "declared_datasets": [
        "scene_parse_150"
      ],
      "inferred_datasets": [
        "arxiv",
        "coco",
        "imagenet"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "other",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "d269f93b3f7346c8dc99b8af0c5e2db91985118a946b8e80e4ffc831172d1ef1"
    },
    {
      "model_id": "nvidia/segformer-b3-finetuned-cityscapes-1024-1024",
      "scanned_at": "2026-09-15T02:38:51.263340Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "cityscapes",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:cityscapes"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "imagenet",
          "confidence": 0.7,
          "raw_context": "hierarchical Transformer is first pre-trained on ImageNet-1k, after which a decode head is added and fine-t"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "coco",
          "confidence": 0.7,
          "raw_context": "how to use this model to classify an image of the COCO 2017 dataset into one of the 1,000 ImageNet class"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "Semantic Segmentation with Transformers](https://arxiv.org/abs/2105.15203) by Xie et al. and first relea"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "segformer",
          "confidence": 0.5,
          "raw_context": "model_type: segformer"
        }
      ],
      "declared_datasets": [
        "cityscapes"
      ],
      "inferred_datasets": [
        "arxiv",
        "coco",
        "imagenet"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "other",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "7c6933f535425b0260a0fb45de4dc3c0d8b0342f463d079c93c73ac76bcf8d67"
    },
    {
      "model_id": "nvidia/segformer-b4-finetuned-ade-512-512",
      "scanned_at": "2026-09-15T02:38:54.051760Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "scene_parse_150",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:scene_parse_150"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "imagenet",
          "confidence": 0.7,
          "raw_context": "hierarchical Transformer is first pre-trained on ImageNet-1k, after which a decode head is added and fine-t"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "coco",
          "confidence": 0.7,
          "raw_context": "how to use this model to classify an image of the COCO 2017 dataset into one of the 1,000 ImageNet class"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "Semantic Segmentation with Transformers](https://arxiv.org/abs/2105.15203) by Xie et al. and first relea"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "segformer",
          "confidence": 0.5,
          "raw_context": "model_type: segformer"
        }
      ],
      "declared_datasets": [
        "scene_parse_150"
      ],
      "inferred_datasets": [
        "arxiv",
        "coco",
        "imagenet"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "other",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "58382ed069b1ddad5ee6e3e5b484584fac42d3c5c9de5f7a501a47d8392205b6"
    },
    {
      "model_id": "nvidia/segformer-b4-finetuned-cityscapes-1024-1024",
      "scanned_at": "2026-09-15T02:38:56.799791Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "cityscapes",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:cityscapes"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "imagenet",
          "confidence": 0.7,
          "raw_context": "hierarchical Transformer is first pre-trained on ImageNet-1k, after which a decode head is added and fine-t"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "coco",
          "confidence": 0.7,
          "raw_context": "how to use this model to classify an image of the COCO 2017 dataset into one of the 1,000 ImageNet class"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "Semantic Segmentation with Transformers](https://arxiv.org/abs/2105.15203) by Xie et al. and first relea"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "segformer",
          "confidence": 0.5,
          "raw_context": "model_type: segformer"
        }
      ],
      "declared_datasets": [
        "cityscapes"
      ],
      "inferred_datasets": [
        "arxiv",
        "coco",
        "imagenet"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "other",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "28910f5b4b0243f16b1151ce05686307ba6a7def477858a43bc248a5fa500ebb"
    },
    {
      "model_id": "nvidia/segformer-b5-finetuned-cityscapes-1024-1024",
      "scanned_at": "2026-09-15T02:38:59.681344Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "cityscapes",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:cityscapes"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "imagenet",
          "confidence": 0.7,
          "raw_context": "hierarchical Transformer is first pre-trained on ImageNet-1k, after which a decode head is added and fine-t"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "coco",
          "confidence": 0.7,
          "raw_context": "how to use this model to classify an image of the COCO 2017 dataset into one of the 1,000 ImageNet class"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "Semantic Segmentation with Transformers](https://arxiv.org/abs/2105.15203) by Xie et al. and first relea"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "segformer",
          "confidence": 0.5,
          "raw_context": "model_type: segformer"
        }
      ],
      "declared_datasets": [
        "cityscapes"
      ],
      "inferred_datasets": [
        "arxiv",
        "coco",
        "imagenet"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "other",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "d2ec1e967ebec6a95bb342aeb50631fbd06eb84f3e025691f2b3f4594010b321"
    },
    {
      "model_id": "nvidia/speakerverification_en_titanet_large",
      "scanned_at": "2026-09-15T02:39:02.479277Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "VOXCELEB-1",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:VOXCELEB-1"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "VOXCELEB-2",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:VOXCELEB-2"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "FISHER",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:FISHER"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "switchboard",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:switchboard"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "librispeech_asr",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:librispeech_asr"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "SRE",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:SRE"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "both telephonic and non-telephonic speech from voxceleb",
          "confidence": 0.6,
          "raw_context": "89        |  1.63 |  ## Limitations This model is trained on both telephonic and non-telephonic speech from voxceleb datasets, Fisher and switch board. If your domain of data"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "proprietary",
          "confidence": 0.6,
          "raw_context": "the most common languages with model checkpoints trained on proprietary data with hundreds of thousands of GPU-compute hours"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        }
      ],
      "declared_datasets": [
        "librispeech_asr",
        "switchboard",
        "VOXCELEB-1",
        "SRE",
        "FISHER",
        "VOXCELEB-2"
      ],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "cc-by-4.0",
      "provenance_score": 0.7,
      "provenance_hash": "85fbb0969e44f75f3227ec3fa88d3e0a279c950bd7dd96d9460ac74bcf4d8897"
    },
    {
      "model_id": "nvidia/stt_ar_fastconformer_hybrid_large_pc_v1.0",
      "scanned_at": "2026-09-15T02:39:05.276291Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "mozilla-foundation/common_voice_17_0",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:mozilla-foundation/common_voice_17_0"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "google/fleurs",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:google/fleurs"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "MASC",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:MASC"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "publicly available speech",
          "confidence": 0.6,
          "raw_context": "ype, and context of speech). Since this model was trained on publicly available speech datasets, the performance of this model might degrade for"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "composite",
          "confidence": 0.6,
          "raw_context": "ation Datasets ### Training Datasets The model is trained on composite dataset comprising of around 760 hours of Arabic speech:"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "proprietary",
          "confidence": 0.6,
          "raw_context": "the most common languages with model checkpoints trained on proprietary data with hundreds of thousands of GPU-compute hours"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "ub.com/google/sentencepiece) [2] tokenizer with a vocabulary size of 1024.  ### Input   - **Input Type:"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "tention for Efficient Speech Recognition](https://arxiv.org/abs/2305.05084)  [2] [Google Sentencepiece To"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        }
      ],
      "declared_datasets": [
        "MASC",
        "mozilla-foundation/common_voice_17_0",
        "google/fleurs"
      ],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "cc-by-4.0",
      "provenance_score": 0.7999999999999999,
      "provenance_hash": "620c47c5937110b61e393c5a8708639f5e10aca257d0d220ab6c2cce07704462"
    },
    {
      "model_id": "nvidia/stt_de_conformer_transducer_large",
      "scanned_at": "2026-09-15T02:39:08.048237Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "VoxPopuli",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:VoxPopuli"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "multilingual_librispeech",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:multilingual_librispeech"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "mozilla-foundation/common_voice_7_0",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:mozilla-foundation/common_voice_7_0"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "smaller set of",
          "confidence": 0.6,
          "raw_context": "v7.0)  Note: older versions of the model may have trained on smaller set of datasets.  ## Performance  The list of the available mode"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "publicly available speech",
          "confidence": 0.6,
          "raw_context": ".04 | 8.85 |  ## Limitations Since this model was trained on publicly available speech datasets, the performance of this model might degrade for"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "proprietary",
          "confidence": 0.6,
          "raw_context": "the most common languages with model checkpoints trained on proprietary data with hundreds of thousands of GPU-compute hours"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "%) with greedy decoding.  | Version | Tokenizer | Vocabulary Size | MCV7.0 dev | MCV7.0 test | MLS dev"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "ented Transformer for Speech Recognition](https://arxiv.org/abs/2005.08100) [2] [Google Sentencepiece Tok"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        }
      ],
      "declared_datasets": [
        "mozilla-foundation/common_voice_7_0",
        "multilingual_librispeech",
        "VoxPopuli"
      ],
      "inferred_datasets": [
        "arxiv",
        "voc"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "cc-by-4.0",
      "provenance_score": 0.7999999999999999,
      "provenance_hash": "16da0431e856e208c92978b90002ad36492fda124dcc38427ed2ddd99b9c4ae5"
    },
    {
      "model_id": "nyanpoko/public",
      "scanned_at": "2026-09-15T02:39:10.804100Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "unknown",
      "provenance_score": 0.1,
      "provenance_hash": "f2553bee0e678aad994c800438e9ae2445334badb2bbd9b957f8abc6c3b1a3c6"
    },
    {
      "model_id": "nyrahealth/CrisperWhisper",
      "scanned_at": "2026-09-15T02:39:13.561784Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "openai/whisper-large-v3",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:openai/whisper-large-v3"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:openai/whisper-large-v3",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:openai/whisper-large-v3"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "AMI",
          "confidence": 0.6,
          "raw_context": "----------|:--------------:|:----------------:| | [AMI](https://huggingface.co/datasets/edinburghcstr/ami)                 | **8.72**"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Earnings22",
          "confidence": 0.6,
          "raw_context": "| **8.72**       | 16.01            |     | [Earnings22](https://huggingface.co/datasets/revdotcom/earnings22)           | 12.37          |"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "GigaSpeech",
          "confidence": 0.6,
          "raw_context": "| 12.37          | **11.3**        |  | [GigaSpeech](https://huggingface.co/datasets/speechcolab/gigaspeech)         | 10.27          |"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "SPGISpeech",
          "confidence": 0.6,
          "raw_context": ")   | 3.97           | **3.91**         |       | [SPGISpeech](https://huggingface.co/datasets/kensho/spgispeech)          | **2.71**           |"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "TED-LIUM",
          "confidence": 0.6,
          "raw_context": "| **2.71**           | 2.95        |      | [TED-LIUM](https://huggingface.co/datasets/LIUM/tedlium)             | **3.35**          | 3."
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "VoxPopuli",
          "confidence": 0.6,
          "raw_context": "| **3.35**          | 3.9        |     | [VoxPopuli](https://huggingface.co/datasets/facebook/voxpopuli)           | **8.61**"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "CommonVoice",
          "confidence": 0.6,
          "raw_context": "| **8.61**           | 9.52         |   | [CommonVoice](https://huggingface.co/datasets/mozilla-foundation/common_voice_9_0)       | **8.1"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "openai/whisper-large-v3",
          "confidence": 0.85,
          "raw_context": "--- license: cc-by-nc-4.0 language: - de - en base_model: openai/whisper-large-v3 metrics: - cer - wer pipeline_tag: automatic-spee"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "c4",
          "confidence": 0.7,
          "raw_context": "github.com/user-attachments/assets/c8608ca8-5e02-4c4a-afd3-8f7c5bff75d5) | Er war kein Genie, aber doc"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "- 📄 **Paper Drop**: Check out our [paper](https://arxiv.org/abs/2408.16589) for details and reasoning beh"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "squad",
          "confidence": 0.7,
          "raw_context": "en doing also. So, yeah, I was in the little geek squad. You were in the little geek squad. Yeah. | you k"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "/home/azureuser/data2/models/crisper_whisper_verbatim_finetuned_de_en_swiss",
          "confidence": 0.9,
          "raw_context": "_name_or_path: /home/azureuser/data2/models/crisper_whisper_verbatim_finetuned_de_en_swiss"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "whisper",
          "confidence": 0.5,
          "raw_context": "model_type: whisper"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:openai/whisper-large-v3",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "ibtex @misc{radford2022whisper,   doi = {10.48550/ARXIV.2212.04356},   url = {https://arxiv.org/abs/2212."
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "c4",
        "squad",
        "arxiv"
      ],
      "base_model": "openai/whisper-large-v3",
      "base_model_chain": [
        "openai/whisper-large-v3"
      ],
      "training_section_present": false,
      "license": "cc-by-nc-4.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "c4214bc7d05c939b9a55321e879964f654f0ab022d0e452f6751b65b458a399a"
    },
    {
      "model_id": "nyu-visionx/Cambrian-S-3B",
      "scanned_at": "2026-09-15T02:39:16.684126Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nyu-visionx/VSI-590K",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nyu-visionx/VSI-590K"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Qwen/Qwen2.5-3B-Instruct",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Qwen/Qwen2.5-3B-Instruct"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:Qwen/Qwen2.5-3B-Instruct",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:Qwen/Qwen2.5-3B-Instruct"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "VSI-590K",
          "confidence": 0.6,
          "raw_context": "IT → spatial IT) - **Training Data**: Trained on [VSI-590K](https://huggingface.co/datasets/nyu-visionx/VSI-590K) (spatial reasoning) + genera"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Qwen/Qwen2.5-3B-Instruct",
          "confidence": 0.85,
          "raw_context": "--- license: apache-2.0 base_model: Qwen/Qwen2.5-3B-Instruct library_name: transformers pipeline_tag: image-to"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "b.io/cambrian-s.github.io/)** | **[Paper](https://arxiv.org/abs/2025)** | **[GitHub](https://github.com/c"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "Qwen/Qwen2.5-3B-Instruct",
          "confidence": 0.9,
          "raw_context": "_name_or_path: Qwen/Qwen2.5-3B-Instruct"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "cambrian_qwen",
          "confidence": 0.5,
          "raw_context": "model_type: cambrian_qwen"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Qwen/Qwen2.5-3B-Instruct",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "and Zhenru Zhang and Zhihao Fan},       journal={arXiv preprint arXiv:2407.10671},       year={2024} } `"
        }
      ],
      "declared_datasets": [
        "nyu-visionx/VSI-590K"
      ],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": "Qwen/Qwen2.5-3B-Instruct",
      "base_model_chain": [
        "Qwen/Qwen2.5-3B-Instruct",
        "Qwen/Qwen2.5-3B"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "e1e9f4b59aa2d00f3cdcaa039339b1443a66daa3c4ba94442ca62090b3e0ba4b"
    },
    {
      "model_id": "nyu-visionx/Cambrian-S-7B",
      "scanned_at": "2026-09-15T02:39:22.184905Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "nyu-visionx/VSI-590K",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:nyu-visionx/VSI-590K"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Qwen/Qwen2.5-7B-Instruct",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Qwen/Qwen2.5-7B-Instruct"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:Qwen/Qwen2.5-7B-Instruct",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:Qwen/Qwen2.5-7B-Instruct"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "VSI-590K",
          "confidence": 0.6,
          "raw_context": "IT → spatial IT) - **Training Data**: Trained on [VSI-590K](https://huggingface.co/datasets/nyu-visionx/VSI-590K) (spatial reasoning) + genera"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "Qwen/Qwen2.5-7B-Instruct",
          "confidence": 0.85,
          "raw_context": "--- license: apache-2.0 base_model: Qwen/Qwen2.5-7B-Instruct library_name: transformers pipeline_tag: image-to"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "mllm.github.io/cambrian-s/)** | **[Paper](https://arxiv.org/abs/2511.04670)** | **[GitHub](https://github"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "Qwen/Qwen2.5-7B-Instruct",
          "confidence": 0.9,
          "raw_context": "_name_or_path: Qwen/Qwen2.5-7B-Instruct"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "cambrian_qwen",
          "confidence": 0.5,
          "raw_context": "model_type: cambrian_qwen"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Qwen/Qwen2.5-7B-Instruct",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "xceeding 32,768 tokens, we utilize [YaRN](https://arxiv.org/abs/2309.00071), a technique for enhancing mo"
        }
      ],
      "declared_datasets": [
        "nyu-visionx/VSI-590K"
      ],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": "Qwen/Qwen2.5-7B-Instruct",
      "base_model_chain": [
        "Qwen/Qwen2.5-7B-Instruct",
        "Qwen/Qwen2.5-7B"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "d94322e2faa30e23beb4160a4faaa44e6deecae70d0ee11d813e7d8957c43e4c"
    },
    {
      "model_id": "nyu-visionx/siglip2_decoder",
      "scanned_at": "2026-09-15T02:39:24.975044Z",
      "signals": [
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "ergus and Yann LeCun and Saining Xie},   journal={arXiv preprint arXiv:2601.16208},   year={2026} } ```"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "facebook/vit-mae-base",
          "confidence": 0.9,
          "raw_context": "_name_or_path: facebook/vit-mae-base"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "vit_mae",
          "confidence": 0.5,
          "raw_context": "model_type: vit_mae"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "mit",
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "75f7ce2eea7f1fee70bcc7fd17aeba784996ee851149a467375bab44bd8adcc7"
    },
    {
      "model_id": "o-ckun/qwen2_5-7b-agent-lora-sft-v35_47C2",
      "scanned_at": "2026-09-15T02:39:27.733067Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "u-10bei/dbbench_sft_dataset_react",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:u-10bei/dbbench_sft_dataset_react"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "u-10bei/dbbench_sft_dataset_react_v2",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:u-10bei/dbbench_sft_dataset_react_v2"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "u-10bei/dbbench_sft_dataset_react_v3",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:u-10bei/dbbench_sft_dataset_react_v3"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "u-10bei/dbbench_sft_dataset_react_v4",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:u-10bei/dbbench_sft_dataset_react_v4"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "u-10bei/sft_alfworld_trajectory_dataset",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:u-10bei/sft_alfworld_trajectory_dataset"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "u-10bei/sft_alfworld_trajectory_dataset_v2",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:u-10bei/sft_alfworld_trajectory_dataset_v2"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "openai/gsm8k",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:openai/gsm8k"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "unsloth/Qwen2.5-7B-Instruct",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:unsloth/Qwen2.5-7B-Instruct"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "adapter:unsloth/Qwen2.5-7B-Instruct",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:adapter:unsloth/Qwen2.5-7B-Instruct"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "u-10bei/dbbench_sft_dataset_react",
          "confidence": 0.8,
          "raw_context": ")  ```  ## Sources & Terms (IMPORTANT)  Training data: u-10bei/dbbench_sft_dataset_react;u-10bei/dbbench_sft_dataset_react_v2;u-10bei/dbbe"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "unsloth/Qwen2.5-7B-Instruct",
          "confidence": 0.85,
          "raw_context": "--- base_model: unsloth/Qwen2.5-7B-Instruct datasets: - u-10bei/dbbench_sft_dataset_react - u"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "unsloth/Qwen2.5-7B-Instruct",
          "confidence": 0.85,
          "raw_context": "covery from errors.  ## Training Configuration  - Base model: unsloth/Qwen2.5-7B-Instruct - Method: LoRA (full precision base) - Max sequen"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "qwen2",
          "confidence": 0.5,
          "raw_context": "model_type: qwen2"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:unsloth/Qwen2.5-7B-Instruct",
          "value": "sharegpt",
          "confidence": 0.5599999999999999,
          "raw_context": "KQ-98h69CCu1UJcvIBLmy2?usp=sharing) is useful for ShareGPT ChatML / Vicuna templates.\r - This [text completi"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:unsloth/Qwen2.5-7B-Instruct",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "xceeding 32,768 tokens, we utilize [YaRN](https://arxiv.org/abs/2309.00071), a technique for enhancing mo"
        }
      ],
      "declared_datasets": [
        "u-10bei/dbbench_sft_dataset_react_v2",
        "u-10bei/dbbench_sft_dataset_react_v4",
        "u-10bei/sft_alfworld_trajectory_dataset_v2",
        "u-10bei/dbbench_sft_dataset_react_v3",
        "u-10bei/dbbench_sft_dataset_react",
        "openai/gsm8k",
        "u-10bei/sft_alfworld_trajectory_dataset"
      ],
      "inferred_datasets": [
        "arxiv",
        "sharegpt"
      ],
      "base_model": "unsloth/Qwen2.5-7B-Instruct",
      "base_model_chain": [
        "unsloth/Qwen2.5-7B-Instruct",
        "Qwen/Qwen2.5-7B-Instruct",
        "Qwen/Qwen2.5-7B"
      ],
      "training_section_present": true,
      "license": "apache-2.0",
      "provenance_score": 0.8999999999999999,
      "provenance_hash": "69fd32f8b73e5416bd03d97cbac7d0eb99b03fc616b12db25a65b08b3f3541f7"
    },
    {
      "model_id": "oblacjodd/Alicon",
      "scanned_at": "2026-09-15T02:39:32.360412Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "436fef35e339a224e6f6bbc21f8a57c4df756e01c3f7eac539553203e1fbcad7"
    },
    {
      "model_id": "oblacjodd/Tasker",
      "scanned_at": "2026-09-15T02:39:35.120830Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "8436b3dff0c0d7a7e983eeebb919a6d31660fb4a036e7a05c36841745669d6d3"
    },
    {
      "model_id": "obsessedggg/mara",
      "scanned_at": "2026-09-15T02:39:37.877077Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "dfecbac85d3f8e32c69f493a4ef1b47989bf58a7a39cbdd8156b4589af370115"
    },
    {
      "model_id": "ogmatrixllm/glyph-v1.1",
      "scanned_at": "2026-09-15T02:39:40.640534Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "liamdugan/raid",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:liamdugan/raid"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "artem9k/ai-text-detection-pile",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:artem9k/ai-text-detection-pile"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "gsingh1-py/train",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:gsingh1-py/train"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "cc_news",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:cc_news"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "blog_authorship_corpus",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:blog_authorship_corpus"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "webis/tldr-17",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:webis/tldr-17"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "ChristophSchuhmann/essays-with-instructions",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:ChristophSchuhmann/essays-with-instructions"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "HuggingFaceH4/stack-exchange-preferences",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:HuggingFaceH4/stack-exchange-preferences"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "pile-of-law/pile-of-law",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:pile-of-law/pile-of-law"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "liamdugan/raid",
          "confidence": 0.8,
          "raw_context": "istral-7B-v0.1, Mixtral-8x7B, MPT-30B, GPT-2-XL | [liamdugan/raid](https://huggingface.co/datasets/liamdugan/raid) | | AI Text Detection Pile | GPT-2"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "artem9k/ai-text-detection-pile",
          "confidence": 0.8,
          "raw_context": "Text Detection Pile | GPT-2/3/J/ChatGPT (mixed) | [artem9k/ai-text-detection-pile](https://huggingface.co/datasets/artem9k/ai-text-detection-pile) | | NYT Multi-Mode"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "gsingh1-py/train",
          "confidence": 0.8,
          "raw_context": "Qwen-2-72B, Llama-3-8B, Gemma-2-9B, Mistral-7B | [gsingh1-py/train](https://huggingface.co/datasets/gsingh1-py/train) |  This combination ensures cove"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "Wikipedia",
          "confidence": 0.6,
          "raw_context": "s, blog posts, Reddit discussions, legal filings, Wikipedia, student essays, and technical Q&A on the human s"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "wikipedia",
          "confidence": 0.7,
          "raw_context": "s, blog posts, Reddit discussions, legal filings, Wikipedia, student essays, and technical Q&A on the human s"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "pubmed",
          "confidence": 0.7,
          "raw_context": "| Accuracy | Confidence | |---|---|---|---|---| | PubMed Abstracts | Biomedical research | 300 | **100.0%*"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "C-News | Journalism | 392 | **99.5%** | 0.981 | | arXiv Abstracts | Academic / scientific | 444 | **90.8%"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "deberta-v2",
          "confidence": 0.5,
          "raw_context": "model_type: deberta-v2"
        }
      ],
      "declared_datasets": [
        "pile-of-law/pile-of-law",
        "cc_news",
        "artem9k/ai-text-detection-pile",
        "blog_authorship_corpus",
        "ChristophSchuhmann/essays-with-instructions",
        "liamdugan/raid",
        "HuggingFaceH4/stack-exchange-preferences",
        "webis/tldr-17",
        "gsingh1-py/train"
      ],
      "inferred_datasets": [
        "wikipedia",
        "arxiv",
        "pubmed"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "mit",
      "provenance_score": 0.85,
      "provenance_hash": "9f327da5c6ba38e7a813daacac7193157f00fe3768de227ab42e3d2c7d4bcdbe"
    },
    {
      "model_id": "ogwata/exp33-fullrecipe-merged",
      "scanned_at": "2026-09-15T02:39:43.407316Z",
      "signals": [
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "unsloth/qwen3-4b-instruct-2507-unsloth-bnb-4bit",
          "confidence": 0.85,
          "raw_context": "--- base_model: unsloth/qwen3-4b-instruct-2507-unsloth-bnb-4bit tags: - text-generation-inference - transformers"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "qwen3",
          "confidence": 0.5,
          "raw_context": "model_type: qwen3"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:unsloth/qwen3-4b-instruct-2507-unsloth-bnb-4bit",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": ",       eprint={2505.09388},       archivePrefix={arXiv},       primaryClass={cs.CL},       url={https://"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": "unsloth/qwen3-4b-instruct-2507-unsloth-bnb-4bit",
      "base_model_chain": [
        "unsloth/qwen3-4b-instruct-2507-unsloth-bnb-4bit",
        "Qwen/Qwen3-4B-Instruct-2507"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "5025e7d16c4aa9051fb32cd3d3dbd4ed9343289187c5d92187a1756b8287a0e3"
    },
    {
      "model_id": "ohsuz/koreapas-finetuned-korquad",
      "scanned_at": "2026-09-15T02:39:48.247330Z",
      "signals": [
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "tapas",
          "confidence": 0.5,
          "raw_context": "model_type: tapas"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "f8373f6264bab071b11e285071c8851d22ee946b693b2643ca702e4d0b21569b"
    },
    {
      "model_id": "ohsuz/koreapas-finetuned-korwikitq",
      "scanned_at": "2026-09-15T02:39:50.993058Z",
      "signals": [
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "tapas",
          "confidence": 0.5,
          "raw_context": "model_type: tapas"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "9562e406b14aba075cc0a933bbc9f1797ef18cc7f2f45cdb3732491697c51ff9"
    },
    {
      "model_id": "omar-arif/dapt-roberta-financial",
      "scanned_at": "2026-09-15T02:39:53.747095Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "c8ab2725992230318e2d07ba2321b07ca74235af5d68e6cd395d0767f6ae2bcb"
    },
    {
      "model_id": "omlab/VLM-FO1_Qwen2.5-VL-3B-v01",
      "scanned_at": "2026-09-15T02:39:56.474594Z",
      "signals": [
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "thub.com/om-ai-lab/VLM-FO1] - **Paper:** [https://arxiv.org/pdf/2509.25916]    ## Citation  ```bibtex @ar"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "omchat_qwen2_5_vl",
          "confidence": 0.5,
          "raw_context": "model_type: omchat_qwen2_5_vl"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "6cb93c01a19e7960e1215de342cb41143d5cb6a947b581343dace333c4877e75"
    },
    {
      "model_id": "onestrength571/firmware-gen-qwen-v2",
      "scanned_at": "2026-09-15T02:39:59.549671Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "adapter:unsloth/Qwen2.5-Coder-1.5B-Instruct-bnb-4bit",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:adapter:unsloth/Qwen2.5-Coder-1.5B-Instruct-bnb-4bit"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "unsloth/Qwen2.5-Coder-1.5B-Instruct-bnb-4bit",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:unsloth/Qwen2.5-Coder-1.5B-Instruct-bnb-4bit"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "unsloth/Qwen2.5-Coder-1.5B-Instruct-bnb-4bit",
          "confidence": 0.85,
          "raw_context": "--- base_model: unsloth/Qwen2.5-Coder-1.5B-Instruct-bnb-4bit library_name: peft pipeline_tag: text-generation"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "ute) presented in [Lacoste et al. (2019)](https://arxiv.org/abs/1910.09700).  - **Hardware Type:** [More"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": "adapter:unsloth/Qwen2.5-Coder-1.5B-Instruct-bnb-4bit",
      "base_model_chain": [
        "adapter:unsloth/Qwen2.5-Coder-1.5B-Instruct-bnb-4bit"
      ],
      "training_section_present": true,
      "license": null,
      "provenance_score": 0.45,
      "provenance_hash": "6dbf26c1c0dfb8875d205f2fc73b6ae1655843b74355b6288e87ed3d78ea5d78"
    },
    {
      "model_id": "onnx-community/BEN2-ONNX",
      "scanned_at": "2026-09-15T02:40:04.128345Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "PramaLLC/BEN2",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:PramaLLC/BEN2"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:PramaLLC/BEN2",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:PramaLLC/BEN2"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "c4",
          "confidence": 0.7,
          "raw_context": ".com/user-attachments/assets/90d4507e-74e0-4a75-9fc4-2c9d6d3cfaa5) |"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "ben",
          "confidence": 0.5,
          "raw_context": "model_type: ben"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:PramaLLC/BEN2",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "removal ---  # BEN2: Background Erase Network  [![arXiv](https://img.shields.io/badge/arXiv-2501.06230-b3"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "c4",
        "arxiv"
      ],
      "base_model": "PramaLLC/BEN2",
      "base_model_chain": [
        "PramaLLC/BEN2"
      ],
      "training_section_present": false,
      "license": "mit",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "98ff4d48b31e71bb635a41f252ac8524deefc32dff1b936b547ce48c54c095e0"
    },
    {
      "model_id": "onnx-community/DepthPro-ONNX",
      "scanned_at": "2026-09-15T02:40:08.711415Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "apple/DepthPro",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:apple/DepthPro"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:apple/DepthPro",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:apple/DepthPro"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "depth_pro",
          "confidence": 0.5,
          "raw_context": "model_type: depth_pro"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:apple/DepthPro",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "cular Metric Depth in Less Than a Second](https://arxiv.org/abs/2410.02073)**, by *Aleksei Bochkovskii, A"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": "apple/DepthPro",
      "base_model_chain": [
        "apple/DepthPro"
      ],
      "training_section_present": false,
      "license": "apple-ascl",
      "provenance_score": 0.25,
      "provenance_hash": "6de2b1719c537a12d14558e2eccf3e63338039b28bd47f5e450e08e8df1f0f52"
    },
    {
      "model_id": "onnx-community/Kokoro-82M-ONNX",
      "scanned_at": "2026-09-15T02:40:13.309615Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "hexgrad/Kokoro-82M",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:hexgrad/Kokoro-82M"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:hexgrad/Kokoro-82M",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:hexgrad/Kokoro-82M"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "style_text_to_speech_2",
          "confidence": 0.5,
          "raw_context": "model_type: style_text_to_speech_2"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:hexgrad/Kokoro-82M",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "el Facts  **Architecture:** - StyleTTS 2: https://arxiv.org/abs/2306.07691 - ISTFTNet: https://arxiv.org/"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": "hexgrad/Kokoro-82M",
      "base_model_chain": [
        "hexgrad/Kokoro-82M",
        "yl4579/StyleTTS2-LJSpeech"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "8450c13c946b57f34bdb0095dee7b5d408e0053f4528c46bef06443a331f14b7"
    },
    {
      "model_id": "onnx-community/Kokoro-82M-v1.0-ONNX",
      "scanned_at": "2026-09-15T02:40:18.800719Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "hexgrad/Kokoro-82M",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:hexgrad/Kokoro-82M"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:hexgrad/Kokoro-82M",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:hexgrad/Kokoro-82M"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "style_text_to_speech_2",
          "confidence": 0.5,
          "raw_context": "model_type: style_text_to_speech_2"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:hexgrad/Kokoro-82M",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "el Facts  **Architecture:** - StyleTTS 2: https://arxiv.org/abs/2306.07691 - ISTFTNet: https://arxiv.org/"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": "hexgrad/Kokoro-82M",
      "base_model_chain": [
        "hexgrad/Kokoro-82M",
        "yl4579/StyleTTS2-LJSpeech"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "a5f4c24fd5a60da06e653ea9e4affb2b92fce0a4fd8b35935c090556a50ad86b"
    },
    {
      "model_id": "onnx-community/depth-anything-v2-base",
      "scanned_at": "2026-09-15T02:40:21.547837Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "depth-anything/Depth-Anything-V2-Base",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:depth-anything/Depth-Anything-V2-Base"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:depth-anything/Depth-Anything-V2-Base",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:depth-anything/Depth-Anything-V2-Base"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "depth-anything/Depth-Anything-V2-Base",
          "confidence": 0.85,
          "raw_context": "--- base_model: depth-anything/Depth-Anything-V2-Base library_name: transformers.js license: cc-by-nc-4"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "depth_anything",
          "confidence": 0.5,
          "raw_context": "model_type: depth_anything"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:depth-anything/Depth-Anything-V2-Base",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "nd Feng, Jiashi and Zhao, Hengshuang},   journal={arXiv:2406.09414},   year={2024} }  @inproceedings{dept"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": "depth-anything/Depth-Anything-V2-Base",
      "base_model_chain": [
        "depth-anything/Depth-Anything-V2-Base"
      ],
      "training_section_present": false,
      "license": "cc-by-nc-4.0",
      "provenance_score": 0.25,
      "provenance_hash": "59800d4a849300d6383eeac0774b3f3fc68dd0b6d93c25abc46ae0101f25bb12"
    },
    {
      "model_id": "onnx-community/depth-anything-v2-large",
      "scanned_at": "2026-09-15T02:40:26.120206Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "depth-anything/Depth-Anything-V2-Large",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:depth-anything/Depth-Anything-V2-Large"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:depth-anything/Depth-Anything-V2-Large",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:depth-anything/Depth-Anything-V2-Large"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "depth-anything/Depth-Anything-V2-Large",
          "confidence": 0.85,
          "raw_context": "--- base_model: depth-anything/Depth-Anything-V2-Large library_name: transformers.js license: cc-by-nc-4"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "depth_anything",
          "confidence": 0.5,
          "raw_context": "model_type: depth_anything"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:depth-anything/Depth-Anything-V2-Large",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "nd Feng, Jiashi and Zhao, Hengshuang},   journal={arXiv:2406.09414},   year={2024} }  @inproceedings{dept"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": "depth-anything/Depth-Anything-V2-Large",
      "base_model_chain": [
        "depth-anything/Depth-Anything-V2-Large"
      ],
      "training_section_present": false,
      "license": "cc-by-nc-4.0",
      "provenance_score": 0.25,
      "provenance_hash": "039c7a19ff99d2052ce9e7b1c1fbf3b13cfb6cfe3a391c07f02577957f4bd446"
    },
    {
      "model_id": "onnx-community/depth-anything-v2-small",
      "scanned_at": "2026-09-15T02:40:30.699179Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "depth-anything/Depth-Anything-V2-Small",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:depth-anything/Depth-Anything-V2-Small"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:depth-anything/Depth-Anything-V2-Small",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:depth-anything/Depth-Anything-V2-Small"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "depth-anything/Depth-Anything-V2-Small",
          "confidence": 0.85,
          "raw_context": "--- base_model: depth-anything/Depth-Anything-V2-Small library_name: transformers.js license: apache-2.0"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "depth_anything",
          "confidence": 0.5,
          "raw_context": "model_type: depth_anything"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:depth-anything/Depth-Anything-V2-Small",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "nd Feng, Jiashi and Zhao, Hengshuang},   journal={arXiv:2406.09414},   year={2024} }  @inproceedings{dept"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": "depth-anything/Depth-Anything-V2-Small",
      "base_model_chain": [
        "depth-anything/Depth-Anything-V2-Small"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "e7b7dceb627f4338b65f89ef2e081a2782b293b86de9324799522786b0d37893"
    },
    {
      "model_id": "onnx-community/ormbg-ONNX",
      "scanned_at": "2026-09-15T02:40:35.271765Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "schirrmacher/ormbg",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:schirrmacher/ormbg"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:schirrmacher/ormbg",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:schirrmacher/ormbg"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "isnet",
          "confidence": 0.5,
          "raw_context": "model_type: isnet"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:schirrmacher/ormbg",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "for Human-Centric Computer Vision (2022)](https://arxiv.org/pdf/2112.09290).  ### Next steps:  - Expand d"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": "schirrmacher/ormbg",
      "base_model_chain": [
        "schirrmacher/ormbg"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "ef772d957dee71760d67d5c54ff899d8ca74ac69d11372d78afb2c3506a8d61b"
    },
    {
      "model_id": "onnx-community/rfdetr_medium-ONNX",
      "scanned_at": "2026-09-15T02:40:39.844772Z",
      "signals": [
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "rf_detr",
          "confidence": 0.5,
          "raw_context": "model_type: rf_detr"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.1,
      "provenance_hash": "3410b9aeec120cf99748e2f2f8beb133cf58c04846058fa60d757b7dae192f45"
    },
    {
      "model_id": "openai/circuit-sparsity",
      "scanned_at": "2026-09-15T02:40:42.597327Z",
      "signals": [
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "circuitgpt",
          "confidence": 0.5,
          "raw_context": "model_type: circuitgpt"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.1,
      "provenance_hash": "2785043350f060933f169fa5878b4c7685585a137ce53dc0f9abe9d184320926"
    },
    {
      "model_id": "openai/consistency-decoder",
      "scanned_at": "2026-09-15T02:40:45.342551Z",
      "signals": [
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "openai/consistency-decoder",
          "confidence": 0.9,
          "raw_context": "_name_or_path: openai/consistency-decoder"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "mit",
      "provenance_score": 0.1,
      "provenance_hash": "8e9c46334e36bb58a960e8955087dcbb8c2436ed324820947026125a237db160"
    },
    {
      "model_id": "openai/diffusers-cd_bedroom256_l2",
      "scanned_at": "2026-09-15T02:40:48.110329Z",
      "signals": [
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "same ImageNet",
          "confidence": 0.6,
          "raw_context": "al networks (the Inception network in particular) pre-trained on the same ImageNet dataset. Although these two convolutional neural networks"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "wikipedia",
          "confidence": 0.6,
          "raw_context": "6x256 dataset, using the [L2 distance](https://en.wikipedia.org/wiki/Norm_(mathematics)#Euclidean_norm) as th"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "wikipedia",
          "confidence": 0.7,
          "raw_context": "6x256 dataset, using the [L2 distance](https://en.wikipedia.org/wiki/Norm_(mathematics)#Euclidean_norm) as th"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "imagenet",
          "confidence": 0.7,
          "raw_context": "te-of-the-art FID of 3.55 on CIFAR-10 and 6.20 on ImageNet 64 x 64 for one-step generation. When trained in"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "cifar",
          "confidence": 0.7,
          "raw_context": "achieving the new state-of-the-art FID of 3.55 on CIFAR-10 and 6.20 on ImageNet 64 x 64 for one-step gene"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "dels introduced in [\"Consistency Models\"](https://arxiv.org/abs/2303.01469) ([paper](https://arxiv.org/pd"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "wikipedia",
        "arxiv",
        "cifar",
        "imagenet"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "mit",
      "provenance_score": 0.6000000000000001,
      "provenance_hash": "43341ee9733e841da12863de38dec49462a22dc78840e74c97028a3b3240a105"
    },
    {
      "model_id": "openai/diffusers-cd_bedroom256_lpips",
      "scanned_at": "2026-09-15T02:40:50.884814Z",
      "signals": [
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "same ImageNet",
          "confidence": 0.6,
          "raw_context": "al networks (the Inception network in particular) pre-trained on the same ImageNet dataset. Although these two convolutional neural networks"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "imagenet",
          "confidence": 0.7,
          "raw_context": "te-of-the-art FID of 3.55 on CIFAR-10 and 6.20 on ImageNet 64 x 64 for one-step generation. When trained in"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "cifar",
          "confidence": 0.7,
          "raw_context": "achieving the new state-of-the-art FID of 3.55 on CIFAR-10 and 6.20 on ImageNet 64 x 64 for one-step gene"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "dels introduced in [\"Consistency Models\"](https://arxiv.org/abs/2303.01469) ([paper](https://arxiv.org/pd"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "cifar",
        "imagenet"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "mit",
      "provenance_score": 0.55,
      "provenance_hash": "c8d0fdedccc43331825a61722510d52bbb708ad52b4df0582be5deea284893c7"
    },
    {
      "model_id": "openai/diffusers-cd_cat256_l2",
      "scanned_at": "2026-09-15T02:40:53.650927Z",
      "signals": [
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "same ImageNet",
          "confidence": 0.6,
          "raw_context": "al networks (the Inception network in particular) pre-trained on the same ImageNet dataset. Although these two convolutional neural networks"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "wikipedia",
          "confidence": 0.6,
          "raw_context": "6x256 dataset, using the [L2 distance](https://en.wikipedia.org/wiki/Norm_(mathematics)#Euclidean_norm) as th"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "wikipedia",
          "confidence": 0.7,
          "raw_context": "6x256 dataset, using the [L2 distance](https://en.wikipedia.org/wiki/Norm_(mathematics)#Euclidean_norm) as th"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "imagenet",
          "confidence": 0.7,
          "raw_context": "te-of-the-art FID of 3.55 on CIFAR-10 and 6.20 on ImageNet 64 x 64 for one-step generation. When trained in"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "cifar",
          "confidence": 0.7,
          "raw_context": "achieving the new state-of-the-art FID of 3.55 on CIFAR-10 and 6.20 on ImageNet 64 x 64 for one-step gene"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "dels introduced in [\"Consistency Models\"](https://arxiv.org/abs/2303.01469) ([paper](https://arxiv.org/pd"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "wikipedia",
        "arxiv",
        "cifar",
        "imagenet"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "mit",
      "provenance_score": 0.6000000000000001,
      "provenance_hash": "aa6b7ff4e0847e034b6cc2ac1567a06361416b743b6099fb9c9190759954053e"
    },
    {
      "model_id": "openai/diffusers-cd_cat256_lpips",
      "scanned_at": "2026-09-15T02:40:56.405949Z",
      "signals": [
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "same ImageNet",
          "confidence": 0.6,
          "raw_context": "al networks (the Inception network in particular) pre-trained on the same ImageNet dataset. Although these two convolutional neural networks"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "imagenet",
          "confidence": 0.7,
          "raw_context": "te-of-the-art FID of 3.55 on CIFAR-10 and 6.20 on ImageNet 64 x 64 for one-step generation. When trained in"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "cifar",
          "confidence": 0.7,
          "raw_context": "achieving the new state-of-the-art FID of 3.55 on CIFAR-10 and 6.20 on ImageNet 64 x 64 for one-step gene"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "dels introduced in [\"Consistency Models\"](https://arxiv.org/abs/2303.01469) ([paper](https://arxiv.org/pd"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "cifar",
        "imagenet"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "mit",
      "provenance_score": 0.55,
      "provenance_hash": "1dc08d03084ad3035da43e4375a540ae69ccc112242d95c8520baa4829b34cff"
    },
    {
      "model_id": "openai/diffusers-cd_imagenet64_l2",
      "scanned_at": "2026-09-15T02:40:59.188306Z",
      "signals": [
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "same ImageNet",
          "confidence": 0.6,
          "raw_context": "al networks (the Inception network in particular) pre-trained on the same ImageNet dataset. Although these two convolutional neural networks"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "wikipedia",
          "confidence": 0.6,
          "raw_context": "64x64 dataset, using the [L2 distance](https://en.wikipedia.org/wiki/Norm_(mathematics)#Euclidean_norm) as th"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "wikipedia",
          "confidence": 0.7,
          "raw_context": "64x64 dataset, using the [L2 distance](https://en.wikipedia.org/wiki/Norm_(mathematics)#Euclidean_norm) as th"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "imagenet",
          "confidence": 0.7,
          "raw_context": "te-of-the-art FID of 3.55 on CIFAR-10 and 6.20 on ImageNet 64 x 64 for one-step generation. When trained in"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "cifar",
          "confidence": 0.7,
          "raw_context": "achieving the new state-of-the-art FID of 3.55 on CIFAR-10 and 6.20 on ImageNet 64 x 64 for one-step gene"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "dels introduced in [\"Consistency Models\"](https://arxiv.org/abs/2303.01469) ([paper](https://arxiv.org/pd"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "wikipedia",
        "arxiv",
        "cifar",
        "imagenet"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "mit",
      "provenance_score": 0.6000000000000001,
      "provenance_hash": "6b5d2e7d8537c04ec6def4072018803ffe37bf9947ab6d11c346b0628d9a823a"
    },
    {
      "model_id": "openai/diffusers-cd_imagenet64_lpips",
      "scanned_at": "2026-09-15T02:41:01.940859Z",
      "signals": [
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "same ImageNet",
          "confidence": 0.6,
          "raw_context": "al networks (the Inception network in particular) pre-trained on the same ImageNet dataset. Although these two convolutional neural networks"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "imagenet",
          "confidence": 0.7,
          "raw_context": "te-of-the-art FID of 3.55 on CIFAR-10 and 6.20 on ImageNet 64 x 64 for one-step generation. When trained in"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "cifar",
          "confidence": 0.7,
          "raw_context": "achieving the new state-of-the-art FID of 3.55 on CIFAR-10 and 6.20 on ImageNet 64 x 64 for one-step gene"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "dels introduced in [\"Consistency Models\"](https://arxiv.org/abs/2303.01469) ([paper](https://arxiv.org/pd"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "cifar",
        "imagenet"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "mit",
      "provenance_score": 0.55,
      "provenance_hash": "7aa7c3f40ac0e5aff416ea35c5930d852d94f4efd9fd27b57c59fe67c8e1d1c5"
    },
    {
      "model_id": "openai/diffusers-ct_bedroom256",
      "scanned_at": "2026-09-15T02:41:04.687625Z",
      "signals": [
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "same ImageNet",
          "confidence": 0.6,
          "raw_context": "al networks (the Inception network in particular) pre-trained on the same ImageNet dataset. Although these two convolutional neural networks"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "imagenet",
          "confidence": 0.7,
          "raw_context": "te-of-the-art FID of 3.55 on CIFAR-10 and 6.20 on ImageNet 64 x 64 for one-step generation. When trained in"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "cifar",
          "confidence": 0.7,
          "raw_context": "achieving the new state-of-the-art FID of 3.55 on CIFAR-10 and 6.20 on ImageNet 64 x 64 for one-step gene"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "dels introduced in [\"Consistency Models\"](https://arxiv.org/abs/2303.01469) ([paper](https://arxiv.org/pd"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "cifar",
        "imagenet"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "mit",
      "provenance_score": 0.55,
      "provenance_hash": "e4b489c4d30dfd19d112f7081409e84160280431ebc4fd851d5265dc43c6f6ba"
    },
    {
      "model_id": "openai/diffusers-ct_cat256",
      "scanned_at": "2026-09-15T02:41:07.432178Z",
      "signals": [
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "same ImageNet",
          "confidence": 0.6,
          "raw_context": "al networks (the Inception network in particular) pre-trained on the same ImageNet dataset. Although these two convolutional neural networks"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "imagenet",
          "confidence": 0.7,
          "raw_context": "te-of-the-art FID of 3.55 on CIFAR-10 and 6.20 on ImageNet 64 x 64 for one-step generation. When trained in"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "cifar",
          "confidence": 0.7,
          "raw_context": "achieving the new state-of-the-art FID of 3.55 on CIFAR-10 and 6.20 on ImageNet 64 x 64 for one-step gene"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "dels introduced in [\"Consistency Models\"](https://arxiv.org/abs/2303.01469) ([paper](https://arxiv.org/pd"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "cifar",
        "imagenet"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "mit",
      "provenance_score": 0.55,
      "provenance_hash": "0c657f8efc7792cc8b8aee6965f1530bdcf5ad67f7b98faa49942a6a6ee92b89"
    },
    {
      "model_id": "openai/diffusers-ct_imagenet64",
      "scanned_at": "2026-09-15T02:41:10.179276Z",
      "signals": [
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "same ImageNet",
          "confidence": 0.6,
          "raw_context": "al networks (the Inception network in particular) pre-trained on the same ImageNet dataset. Although these two convolutional neural networks"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "imagenet",
          "confidence": 0.7,
          "raw_context": "te-of-the-art FID of 3.55 on CIFAR-10 and 6.20 on ImageNet 64 x 64 for one-step generation. When trained in"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "cifar",
          "confidence": 0.7,
          "raw_context": "achieving the new state-of-the-art FID of 3.55 on CIFAR-10 and 6.20 on ImageNet 64 x 64 for one-step gene"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "dels introduced in [\"Consistency Models\"](https://arxiv.org/abs/2303.01469) ([paper](https://arxiv.org/pd"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv",
        "cifar",
        "imagenet"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "mit",
      "provenance_score": 0.55,
      "provenance_hash": "82b2544e17c355de0ea5a55971748ed4e7bcc330dc443a82bb8bb14b9cba4816"
    },
    {
      "model_id": "openai/gpt-oss-safeguard-120b",
      "scanned_at": "2026-09-15T02:41:12.932776Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "openai/gpt-oss-120b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:openai/gpt-oss-120b"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:openai/gpt-oss-120b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:openai/gpt-oss-120b"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "\"><strong>Guide</strong></a> ·   <a href=\"https://arxiv.org/abs/2508.10925\"><strong>Model card</strong></"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "gpt_oss",
          "confidence": 0.5,
          "raw_context": "model_type: gpt_oss"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:openai/gpt-oss-120b",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "><strong>Guides</strong></a> ·   <a href=\"https://arxiv.org/abs/2508.10925\"><strong>Model card</strong></"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": "openai/gpt-oss-120b",
      "base_model_chain": [
        "openai/gpt-oss-120b"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "210aa12b3bdeba44ad2a432b7070c6618fecb94aeb7ff09721f90f5cbfd66caf"
    },
    {
      "model_id": "openai/gpt-oss-safeguard-20b",
      "scanned_at": "2026-09-15T02:41:15.844021Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "openai/gpt-oss-20b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:openai/gpt-oss-20b"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:openai/gpt-oss-20b",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:openai/gpt-oss-20b"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "\"><strong>Guide</strong></a> ·   <a href=\"https://arxiv.org/abs/2508.10925\"><strong>Model card</strong></"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "gpt_oss",
          "confidence": 0.5,
          "raw_context": "model_type: gpt_oss"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:openai/gpt-oss-20b",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "><strong>Guides</strong></a> ·   <a href=\"https://arxiv.org/abs/2508.10925\"><strong>Model card</strong></"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": "openai/gpt-oss-20b",
      "base_model_chain": [
        "openai/gpt-oss-20b"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "b8b37e4415f4239dca21244efc173935b85a6aa9f9337b2e5cdffa8d82cc3668"
    },
    {
      "model_id": "openai/imagegpt-large",
      "scanned_at": "2026-09-15T02:41:20.423259Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "imagenet-21k",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:imagenet-21k"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "imagenet",
          "confidence": 0.7,
          "raw_context": "-- license: apache-2.0 tags: - vision datasets: - imagenet-21k ---  # ImageGPT (large-sized model)   ImageGP"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "ontext = torch.full((batch_size, 1), model.config.vocab_size - 1) #initialize with SOS token context ="
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "imagegpt",
          "confidence": 0.5,
          "raw_context": "model_type: imagegpt"
        }
      ],
      "declared_datasets": [
        "imagenet-21k"
      ],
      "inferred_datasets": [
        "voc",
        "imagenet"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "apache-2.0",
      "provenance_score": 0.6,
      "provenance_hash": "1863c350e1c05def094243faf5fd8ae2f30c42cb7fc8341149a49ff3f0b3eeb2"
    },
    {
      "model_id": "openai/imagegpt-medium",
      "scanned_at": "2026-09-15T02:41:23.276394Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "imagenet-21k",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:imagenet-21k"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "imagenet",
          "confidence": 0.7,
          "raw_context": "-- license: apache-2.0 tags: - vision datasets: - imagenet-21k ---  # ImageGPT (medium-sized model)   ImageG"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "ontext = torch.full((batch_size, 1), model.config.vocab_size - 1) #initialize with SOS token context ="
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "imagegpt",
          "confidence": 0.5,
          "raw_context": "model_type: imagegpt"
        }
      ],
      "declared_datasets": [
        "imagenet-21k"
      ],
      "inferred_datasets": [
        "voc",
        "imagenet"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "apache-2.0",
      "provenance_score": 0.6,
      "provenance_hash": "c4cf76c9df6e150aabe03e1212187768d9062aad798e437a9630b3990d07fb9c"
    },
    {
      "model_id": "openai/imagegpt-small",
      "scanned_at": "2026-09-15T02:41:26.057044Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "imagenet-21k",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:imagenet-21k"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "imagenet",
          "confidence": 0.7,
          "raw_context": "-- license: apache-2.0 tags: - vision datasets: - imagenet-21k ---  # ImageGPT (small-sized model)   ImageGP"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "ontext = torch.full((batch_size, 1), model.config.vocab_size - 1) #initialize with SOS token context ="
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "imagegpt",
          "confidence": 0.5,
          "raw_context": "model_type: imagegpt"
        }
      ],
      "declared_datasets": [
        "imagenet-21k"
      ],
      "inferred_datasets": [
        "voc",
        "imagenet"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "apache-2.0",
      "provenance_score": 0.6,
      "provenance_hash": "8e0ea4fed63d88a9c3c8024d52c46440870ec588f849fa20220bad9766431524"
    },
    {
      "model_id": "openai/jukebox-1b-lyrics",
      "scanned_at": "2026-09-15T02:41:28.872913Z",
      "signals": [
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "jukebox",
          "confidence": 0.5,
          "raw_context": "model_type: jukebox"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "8f4a295176fa6985de661edaf06728aeff9f325eb807b1f1de48e950864ad537"
    },
    {
      "model_id": "openai/jukebox-5b-lyrics",
      "scanned_at": "2026-09-15T02:41:31.616011Z",
      "signals": [
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "jukebox",
          "confidence": 0.5,
          "raw_context": "model_type: jukebox"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "4e1b8d875494f12894c6f89aaf292cec103be3d07172a4d29dbfe4588518bd66"
    },
    {
      "model_id": "openai/shap-e",
      "scanned_at": "2026-09-15T02:41:34.362600Z",
      "signals": [
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "rating Conditional 3D Implicit Functions](https://arxiv.org/abs/2305.02463) by Heewoo Jun and Alex Nichol"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "mit",
      "provenance_score": 0.45,
      "provenance_hash": "5b1b06724edaea39e4a7a6caa11d95d39db77386c18e1b9eb6fcac1361182fdf"
    },
    {
      "model_id": "openai/shap-e-img2img",
      "scanned_at": "2026-09-15T02:41:37.115192Z",
      "signals": [
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "rating Conditional 3D Implicit Functions](https://arxiv.org/abs/2305.02463) by Heewoo Jun and Alex Nichol"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "mit",
      "provenance_score": 0.45,
      "provenance_hash": "d9c3d8302e0d90c6139040546bb589f7b3bbd483ed5b66510cdbe596a6a41db9"
    },
    {
      "model_id": "openai/whisper-base.en",
      "scanned_at": "2026-09-15T02:41:39.863109Z",
      "signals": [
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "either English-only data or multilingual",
          "confidence": 0.6,
          "raw_context": "g large-scale weak supervision.   The models were trained on either English-only data or multilingual data. The English-only models were trained  on the tas"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "either English-only or multilingual",
          "confidence": 0.6,
          "raw_context": "ons of varying model sizes. The smallest four are trained on either English-only or multilingual data. The largest checkpoints are multilingual only. A"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "gnition via Large-Scale Weak Supervision](https://arxiv.org/abs/2212.04356)  by Alec Radford et al. from"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "openai/whisper-base.en",
          "confidence": 0.9,
          "raw_context": "_name_or_path: openai/whisper-base.en"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "whisper",
          "confidence": 0.5,
          "raw_context": "model_type: whisper"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "apache-2.0",
      "provenance_score": 0.45,
      "provenance_hash": "19d95f5b258eeee379a275d5d8616c35cafa9b27c4719ca28b46217911bf0dc8"
    },
    {
      "model_id": "openai/whisper-large",
      "scanned_at": "2026-09-15T02:41:42.615314Z",
      "signals": [
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "either English-only data or multilingual",
          "confidence": 0.6,
          "raw_context": "g large-scale weak supervision.   The models were trained on either English-only data or multilingual data. The English-only models were trained  on the tas"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "either English-only or multilingual",
          "confidence": 0.6,
          "raw_context": "ons of varying model sizes. The smallest four are trained on either English-only or multilingual data. The largest checkpoints are multilingual only. A"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "gnition via Large-Scale Weak Supervision](https://arxiv.org/abs/2212.04356)  by Alec Radford et al from O"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "openai/whisper-large",
          "confidence": 0.9,
          "raw_context": "_name_or_path: openai/whisper-large"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "whisper",
          "confidence": 0.5,
          "raw_context": "model_type: whisper"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "apache-2.0",
      "provenance_score": 0.45,
      "provenance_hash": "b62aa15ef519f724f83ae76ecb99eb0bf0d908f954920d093648216dd549dada"
    },
    {
      "model_id": "openai/whisper-medium.en",
      "scanned_at": "2026-09-15T02:41:45.370622Z",
      "signals": [
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "either English-only data or multilingual",
          "confidence": 0.6,
          "raw_context": "g large-scale weak supervision.   The models were trained on either English-only data or multilingual data. The English-only models were trained  on the tas"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "either English-only or multilingual",
          "confidence": 0.6,
          "raw_context": "ons of varying model sizes. The smallest four are trained on either English-only or multilingual data. The largest checkpoints are multilingual only. A"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "gnition via Large-Scale Weak Supervision](https://arxiv.org/abs/2212.04356)  by Alec Radford et al. from"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "openai/whisper-medium.en",
          "confidence": 0.9,
          "raw_context": "_name_or_path: openai/whisper-medium.en"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "whisper",
          "confidence": 0.5,
          "raw_context": "model_type: whisper"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "apache-2.0",
      "provenance_score": 0.45,
      "provenance_hash": "f61497b048a31e149eb04033aa5694b557b4e5d67db34b2ed1351d7e0168978f"
    },
    {
      "model_id": "openai/whisper-small.en",
      "scanned_at": "2026-09-15T02:41:48.121681Z",
      "signals": [
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "either English-only data or multilingual",
          "confidence": 0.6,
          "raw_context": "g large-scale weak supervision.   The models were trained on either English-only data or multilingual data. The English-only models were trained  on the tas"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "either English-only or multilingual",
          "confidence": 0.6,
          "raw_context": "ons of varying model sizes. The smallest four are trained on either English-only or multilingual data. The largest checkpoints are multilingual only. A"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "gnition via Large-Scale Weak Supervision](https://arxiv.org/abs/2212.04356)  by Alec Radford et al. from"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "openai/whisper-small.en",
          "confidence": 0.9,
          "raw_context": "_name_or_path: openai/whisper-small.en"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "whisper",
          "confidence": 0.5,
          "raw_context": "model_type: whisper"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "apache-2.0",
      "provenance_score": 0.45,
      "provenance_hash": "6e368b1ad8f49761bd333ab569ce1c74df2e425f88cba1f0d4c9d2479cc96b4b"
    },
    {
      "model_id": "openai/whisper-tiny.en",
      "scanned_at": "2026-09-15T02:41:50.873623Z",
      "signals": [
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "either English-only data or multilingual",
          "confidence": 0.6,
          "raw_context": "g large-scale weak supervision.   The models were trained on either English-only data or multilingual data. The English-only models were trained  on the tas"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "either English-only or multilingual",
          "confidence": 0.6,
          "raw_context": "ons of varying model sizes. The smallest four are trained on either English-only or multilingual data. The largest checkpoints are multilingual only. A"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "gnition via Large-Scale Weak Supervision](https://arxiv.org/abs/2212.04356)  by Alec Radford et al. from"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "openai/whisper-tiny.en",
          "confidence": 0.9,
          "raw_context": "_name_or_path: openai/whisper-tiny.en"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "whisper",
          "confidence": 0.5,
          "raw_context": "model_type: whisper"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "apache-2.0",
      "provenance_score": 0.45,
      "provenance_hash": "9fd8a36f10bb82c9ad3f50e4203235ba15ae1fff9cbedfa870c156257136d2bf"
    },
    {
      "model_id": "openbmb/AgentCPM-Explore",
      "scanned_at": "2026-09-15T02:41:53.619727Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Qwen/Qwen3-4B-Thinking-2507",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Qwen/Qwen3-4B-Thinking-2507"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:Qwen/Qwen3-4B-Thinking-2507",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:Qwen/Qwen3-4B-Thinking-2507"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "qwen3",
          "confidence": 0.5,
          "raw_context": "model_type: qwen3"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Qwen/Qwen3-4B-Thinking-2507",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": ",       eprint={2505.09388},       archivePrefix={arXiv},       primaryClass={cs.CL},       url={https://"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": "Qwen/Qwen3-4B-Thinking-2507",
      "base_model_chain": [
        "Qwen/Qwen3-4B-Thinking-2507"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.25,
      "provenance_hash": "69fa04ed928e9cde9a9778ee42c4d8595c3e0331c7982dce14ffecc05f540413"
    },
    {
      "model_id": "openbmb/AgentCPM-Explore-GGUF",
      "scanned_at": "2026-09-15T02:41:57.304928Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.1,
      "provenance_hash": "41b03fbcb9705ff7acb8478e253da6843128773d91338c18957729b0cb7da191"
    },
    {
      "model_id": "openbmb/AgentCPM-GUI",
      "scanned_at": "2026-09-15T02:42:00.058287Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "openbmb/MiniCPM-V-2_6",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:openbmb/MiniCPM-V-2_6"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:openbmb/MiniCPM-V-2_6",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:openbmb/MiniCPM-V-2_6"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "image/jpeg",
          "confidence": 0.8,
          "raw_context": "{\"type\": \"image_url\", \"image_url\": {\"url\": f\"data:image/jpeg;base64,{encode_image(image)}\"}}         ]}     ]"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "penBMB/AgentCPM-GUI) | [Technical Report](https://arxiv.org/abs/2506.01391)  ## News  * [2025-06-03] 📄📄📄"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "openbmb/AgentCPM-GUI",
          "confidence": 0.9,
          "raw_context": "_name_or_path: openbmb/AgentCPM-GUI"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "minicpmv",
          "confidence": 0.5,
          "raw_context": "model_type: minicpmv"
        }
      ],
      "declared_datasets": [
        "image/jpeg"
      ],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": "openbmb/MiniCPM-V-2_6",
      "base_model_chain": [
        "openbmb/MiniCPM-V-2_6"
      ],
      "training_section_present": true,
      "license": "apache-2.0",
      "provenance_score": 0.65,
      "provenance_hash": "36f622fc8cfc5acadbe133b2c325b76522321d13aaaf644798ee6fe2a32d643b"
    },
    {
      "model_id": "openbmb/AgentCPM-Report",
      "scanned_at": "2026-09-15T02:42:04.628437Z",
      "signals": [
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "tHub-UltraRAG-blue?logo=github'> <a href='https://arxiv.org/abs/2602.06540'><img src='https://img.shields"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "minicpm",
          "confidence": 0.5,
          "raw_context": "model_type: minicpm"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "c12f6039909f676507217a746467b9f9cdb2aff461609f951eaf574f8b4c33e9"
    },
    {
      "model_id": "openbmb/AgentCPM-Report-GGUF",
      "scanned_at": "2026-09-15T02:42:07.375538Z",
      "signals": [
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "tHub-UltraRAG-blue?logo=github'> <a href='https://arxiv.org/abs/2602.06540'><img src='https://img.shields"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "ca25797ae583f027bd0cf9f0e84c40f519395c759c06cb77c007700457e4ef9c"
    },
    {
      "model_id": "openbmb/BitCPM4-0.5B",
      "scanned_at": "2026-09-15T02:42:10.134124Z",
      "signals": [
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "openbmb/MiniCPM4-0.5B",
          "confidence": 0.9,
          "raw_context": "_name_or_path: openbmb/MiniCPM4-0.5B"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.1,
      "provenance_hash": "82dfcf2f01c557501072a90c824f6b0e0ab1243dcce64de2f040e9e3f2027be8"
    },
    {
      "model_id": "openbmb/BitCPM4-0.5B-GGUF",
      "scanned_at": "2026-09-15T02:42:12.873941Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.1,
      "provenance_hash": "0b49ac9e0506094ab8ccd0c30fc37d208730eacdcebe0164ef47baf98bf7fa9a"
    },
    {
      "model_id": "openbmb/BitCPM4-1B",
      "scanned_at": "2026-09-15T02:42:15.683218Z",
      "signals": [
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "openbmb/MiniCPM4-0.5B",
          "confidence": 0.9,
          "raw_context": "_name_or_path: openbmb/MiniCPM4-0.5B"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.1,
      "provenance_hash": "bb337342f3a7d1bf986f53bdac9e601b7fa87cf97ac1092e6ff669d9eb51d442"
    },
    {
      "model_id": "openbmb/BitCPM4-1B-GGUF",
      "scanned_at": "2026-09-15T02:42:18.439617Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.1,
      "provenance_hash": "ccd769ee9b339e3c9d4dfb92a8834c3533f70051005c8b11ef2625df63eb4eae"
    },
    {
      "model_id": "openbmb/EVisRAG-3B",
      "scanned_at": "2026-09-15T02:42:21.212360Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "openbmb/EVisRAG-Train",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:openbmb/EVisRAG-Train"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Qwen/Qwen2.5-VL-3B-Instruct",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Qwen/Qwen2.5-VL-3B-Instruct"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:Qwen/Qwen2.5-VL-3B-Instruct",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:Qwen/Qwen2.5-VL-3B-Instruct"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "lor=white)](https://github.com/OpenBMB/VisRAG) [![arXiv](https://img.shields.io/badge/arXiv-2510.09733-ff"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "qwen2_5_vl",
          "confidence": 0.5,
          "raw_context": "model_type: qwen2_5_vl"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Qwen/Qwen2.5-VL-3B-Instruct",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "xceeding 32,768 tokens, we utilize [YaRN](https://arxiv.org/abs/2309.00071), a technique for enhancing mo"
        }
      ],
      "declared_datasets": [
        "openbmb/EVisRAG-Train"
      ],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": "Qwen/Qwen2.5-VL-3B-Instruct",
      "base_model_chain": [
        "Qwen/Qwen2.5-VL-3B-Instruct"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "92811dfe92c211776d6b951417312c9e062856b5c319df64e186b017757ec10e"
    },
    {
      "model_id": "openbmb/EVisRAG-7B",
      "scanned_at": "2026-09-15T02:42:23.965221Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "openbmb/EVisRAG-Train",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:openbmb/EVisRAG-Train"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "Qwen/Qwen2.5-VL-7B-Instruct",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:Qwen/Qwen2.5-VL-7B-Instruct"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:Qwen/Qwen2.5-VL-7B-Instruct",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:Qwen/Qwen2.5-VL-7B-Instruct"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "visual_haystacks",
          "confidence": 0.6,
          "raw_context": "EVisRAG-7B** model, added natural images from the [visual_haystacks](https://huggingface.co/datasets/tsunghanwu/visual_haystacks) dataset to the traini"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "lor=white)](https://github.com/OpenBMB/VisRAG) [![arXiv](https://img.shields.io/badge/arXiv-2510.09733-ff"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "qwen2_5_vl",
          "confidence": 0.5,
          "raw_context": "model_type: qwen2_5_vl"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:Qwen/Qwen2.5-VL-7B-Instruct",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "xceeding 32,768 tokens, we utilize [YaRN](https://arxiv.org/abs/2309.00071), a technique for enhancing mo"
        }
      ],
      "declared_datasets": [
        "openbmb/EVisRAG-Train"
      ],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": "Qwen/Qwen2.5-VL-7B-Instruct",
      "base_model_chain": [
        "Qwen/Qwen2.5-VL-7B-Instruct"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.35000000000000003,
      "provenance_hash": "cd755fe23cff65aba45c50d7d1daaccaba5b14c8869287d62a34e0c915cbfbef"
    },
    {
      "model_id": "openbmb/Eurus-70b-nca",
      "scanned_at": "2026-09-15T02:42:26.766798Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "openbmb/UltraInteract_pair",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:openbmb/UltraInteract_pair"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "openbmb/UltraFeedback",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:openbmb/UltraFeedback"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "SFT",
          "confidence": 0.6,
          "raw_context": "s-660bc40bec5376b3adc9d1c5) - 🤗 UltraInteract   - [SFT](https://huggingface.co/datasets/openbmb/UltraInteract_sft)   - [Preference Learnin"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "c4",
          "confidence": 0.7,
          "raw_context": "ps://huggingface.co/collections/openbmb/eurus-660bc40bec5376b3adc9d1c5) - 🤗 UltraInteract   - [SFT](ht"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "n</a> </p>   </div>  # Links  - 📜 [Paper](https://arxiv.org/abs/2404.02078) - 🤗 [Eurus Collection](https:"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "openbmb/Eurus-70b-nca",
          "confidence": 0.9,
          "raw_context": "_name_or_path: openbmb/Eurus-70b-nca"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "llama",
          "confidence": 0.5,
          "raw_context": "model_type: llama"
        }
      ],
      "declared_datasets": [
        "openbmb/UltraFeedback",
        "openbmb/UltraInteract_pair"
      ],
      "inferred_datasets": [
        "c4",
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.4,
      "provenance_hash": "c4ec9b3b8319ee898497ed2e2d4649f42b2c66b06b12f0ed9ecbf53693832c8d"
    },
    {
      "model_id": "openbmb/Eurus-70b-sft",
      "scanned_at": "2026-09-15T02:42:29.517996Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "openbmb/UltraInteract_sft",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:openbmb/UltraInteract_sft"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "stingning/ultrachat",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:stingning/ultrachat"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "openchat/openchat_sharegpt4_dataset",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:openchat/openchat_sharegpt4_dataset"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "Open-Orca/OpenOrca",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:Open-Orca/OpenOrca"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "SFT",
          "confidence": 0.6,
          "raw_context": "s-660bc40bec5376b3adc9d1c5) - 🤗 UltraInteract   - [SFT](https://huggingface.co/datasets/openbmb/UltraInteract_sft)   - [Preference Learnin"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "open-orca",
          "confidence": 0.7,
          "raw_context": "ultrachat - openchat/openchat_sharegpt4_dataset - Open-Orca/OpenOrca tags: - reasoning pipeline_tag: text-gen"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "sharegpt",
          "confidence": 0.7,
          "raw_context": "act_sft - stingning/ultrachat - openchat/openchat_sharegpt4_dataset - Open-Orca/OpenOrca tags: - reasoning p"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "ultrachat",
          "confidence": 0.7,
          "raw_context": "datasets: - openbmb/UltraInteract_sft - stingning/ultrachat - openchat/openchat_sharegpt4_dataset - Open-Orca"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "c4",
          "confidence": 0.7,
          "raw_context": "ps://huggingface.co/collections/openbmb/eurus-660bc40bec5376b3adc9d1c5) - 🤗 UltraInteract   - [SFT](ht"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "n</a> </p>   </div>  # Links  - 📜 [Paper](https://arxiv.org/abs/2404.02078) - 🤗 [Eurus Collection](https:"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "openbmb/Eurus-70b-sft",
          "confidence": 0.9,
          "raw_context": "_name_or_path: openbmb/Eurus-70b-sft"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "llama",
          "confidence": 0.5,
          "raw_context": "model_type: llama"
        }
      ],
      "declared_datasets": [
        "openbmb/UltraInteract_sft",
        "stingning/ultrachat",
        "Open-Orca/OpenOrca",
        "openchat/openchat_sharegpt4_dataset"
      ],
      "inferred_datasets": [
        "c4",
        "arxiv",
        "open-orca",
        "sharegpt",
        "ultrachat"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.6000000000000001,
      "provenance_hash": "95ca7a7158af338332ae48d5967fe2254f262b6314a1c58943501a518df46d3c"
    },
    {
      "model_id": "openbmb/Eurus-7b-kto",
      "scanned_at": "2026-09-15T02:42:32.314247Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "openbmb/UltraFeedback",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:openbmb/UltraFeedback"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "openbmb/UltraInteract_pair",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:openbmb/UltraInteract_pair"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "SFT",
          "confidence": 0.6,
          "raw_context": "s-660bc40bec5376b3adc9d1c5) - 🤗 UltraInteract   - [SFT](https://huggingface.co/datasets/openbmb/UltraInteract_sft)   - [Preference Learnin"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "c4",
          "confidence": 0.7,
          "raw_context": "ps://huggingface.co/collections/openbmb/eurus-660bc40bec5376b3adc9d1c5) - 🤗 UltraInteract   - [SFT](ht"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "n</a> </p>   </div>  # Links  - 📜 [Paper](https://arxiv.org/abs/2404.02078) - 🤗 [Eurus Collection](https:"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "openbmb/Eurus-7b-kto",
          "confidence": 0.9,
          "raw_context": "_name_or_path: openbmb/Eurus-7b-kto"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "mistral",
          "confidence": 0.5,
          "raw_context": "model_type: mistral"
        }
      ],
      "declared_datasets": [
        "openbmb/UltraFeedback",
        "openbmb/UltraInteract_pair"
      ],
      "inferred_datasets": [
        "c4",
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.4,
      "provenance_hash": "75486eca6bc26f57809e4eff82474a278c9bbaab56206dcef2abdf75b12492ed"
    },
    {
      "model_id": "openbmb/Eurus-7b-sft",
      "scanned_at": "2026-09-15T02:42:35.072036Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "openbmb/UltraInteract_sft",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:openbmb/UltraInteract_sft"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "stingning/ultrachat",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:stingning/ultrachat"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "openchat/openchat_sharegpt4_dataset",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:openchat/openchat_sharegpt4_dataset"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "Open-Orca/OpenOrca",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:Open-Orca/OpenOrca"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "SFT",
          "confidence": 0.6,
          "raw_context": "s-660bc40bec5376b3adc9d1c5) - 🤗 UltraInteract   - [SFT](https://huggingface.co/datasets/openbmb/UltraInteract_sft)   - [Preference Learnin"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "open-orca",
          "confidence": 0.7,
          "raw_context": "ultrachat - openchat/openchat_sharegpt4_dataset - Open-Orca/OpenOrca tags: - reasoning pipeline_tag: text-gen"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "sharegpt",
          "confidence": 0.7,
          "raw_context": "act_sft - stingning/ultrachat - openchat/openchat_sharegpt4_dataset - Open-Orca/OpenOrca tags: - reasoning p"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "ultrachat",
          "confidence": 0.7,
          "raw_context": "datasets: - openbmb/UltraInteract_sft - stingning/ultrachat - openchat/openchat_sharegpt4_dataset - Open-Orca"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "c4",
          "confidence": 0.7,
          "raw_context": "ps://huggingface.co/collections/openbmb/eurus-660bc40bec5376b3adc9d1c5) - 🤗 UltraInteract   - [SFT](ht"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "</a> </p>   </div>   # Links  - 📜 [Paper](https://arxiv.org/abs/2404.02078) - 🤗 [Eurus Collection](https:"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "openbmb/Eurus-7b-sft",
          "confidence": 0.9,
          "raw_context": "_name_or_path: openbmb/Eurus-7b-sft"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "mistral",
          "confidence": 0.5,
          "raw_context": "model_type: mistral"
        }
      ],
      "declared_datasets": [
        "openbmb/UltraInteract_sft",
        "stingning/ultrachat",
        "Open-Orca/OpenOrca",
        "openchat/openchat_sharegpt4_dataset"
      ],
      "inferred_datasets": [
        "c4",
        "arxiv",
        "open-orca",
        "sharegpt",
        "ultrachat"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.6000000000000001,
      "provenance_hash": "16240b0bf3991b7574d194f81825aa39f256f2719d3533def97b6f6d83fc1937"
    },
    {
      "model_id": "openbmb/Eurus-RM-7b",
      "scanned_at": "2026-09-15T02:42:37.819500Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "openbmb/UltraFeedback",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:openbmb/UltraFeedback"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "openbmb/UltraInteract_pair",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:openbmb/UltraInteract_pair"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "openbmb/UltraSafety",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:openbmb/UltraSafety"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "SFT",
          "confidence": 0.6,
          "raw_context": "s-660bc40bec5376b3adc9d1c5) - 🤗 UltraInteract   - [SFT](https://huggingface.co/datasets/openbmb/UltraInteract_sft)   - [Preference Learnin"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "UltraInteract",
          "confidence": 0.6,
          "raw_context": "roduction  Eurus-RM-7B is trained on a mixture of [UltraInteract](https://huggingface.co/datasets/openbmb/UltraInteract), [UltraFeedback](https://hu"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "UltraFeedback",
          "confidence": 0.6,
          "raw_context": "//huggingface.co/datasets/openbmb/UltraInteract), [UltraFeedback](https://huggingface.co/datasets/openbmb/UltraFeedback), and [UltraSafety](https://"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "UltraSafety",
          "confidence": 0.6,
          "raw_context": "ggingface.co/datasets/openbmb/UltraFeedback), and [UltraSafety](https://huggingface.co/datasets/openbmb/UltraSafety), with a specifically designed"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "c4",
          "confidence": 0.7,
          "raw_context": "ps://huggingface.co/collections/openbmb/eurus-660bc40bec5376b3adc9d1c5) - 🤗 UltraInteract   - [SFT](ht"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "classification ---   # Links  - 📜 [Paper](https://arxiv.org/abs/2404.02078) - 🤗 [Eurus Collection](https:"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "openbmb/Eurus-RM-7b",
          "confidence": 0.9,
          "raw_context": "_name_or_path: openbmb/Eurus-RM-7b"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "mistral",
          "confidence": 0.5,
          "raw_context": "model_type: mistral"
        }
      ],
      "declared_datasets": [
        "openbmb/UltraSafety",
        "openbmb/UltraFeedback",
        "openbmb/UltraInteract_pair"
      ],
      "inferred_datasets": [
        "c4",
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.5,
      "provenance_hash": "60b87bc0045c68c861932241d34fac86a705fc3c749a917ebcf7edd1ff17e216"
    },
    {
      "model_id": "openbmb/Eurux-8x22b-kto",
      "scanned_at": "2026-09-15T02:42:40.563453Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "openbmb/UltraInteract_sft",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:openbmb/UltraInteract_sft"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "openbmb/UltraInteract_pair",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:openbmb/UltraInteract_pair"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "openbmb/UltraFeedback",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:openbmb/UltraFeedback"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "SFT",
          "confidence": 0.6,
          "raw_context": "s-660bc40bec5376b3adc9d1c5) - 🤗 UltraInteract   - [SFT](https://huggingface.co/datasets/openbmb/UltraInteract_sft)   - [Preference Learnin"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "c4",
          "confidence": 0.7,
          "raw_context": "ps://huggingface.co/collections/openbmb/eurus-660bc40bec5376b3adc9d1c5) - 🤗 UltraInteract   - [SFT](ht"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "n</a> </p>   </div>  # Links  - 📜 [Paper](https://arxiv.org/abs/2404.02078) - 🤗 [Eurus Collection](https:"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "mixtral",
          "confidence": 0.5,
          "raw_context": "model_type: mixtral"
        }
      ],
      "declared_datasets": [
        "openbmb/UltraInteract_sft",
        "openbmb/UltraFeedback",
        "openbmb/UltraInteract_pair"
      ],
      "inferred_datasets": [
        "c4",
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.5,
      "provenance_hash": "8ddaa4993620a4d9d399ad2a119df4e8b9611122b53948080636a7276e4e5137"
    },
    {
      "model_id": "openbmb/Eurux-8x22b-nca",
      "scanned_at": "2026-09-15T02:42:43.318688Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "openbmb/UltraInteract_sft",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:openbmb/UltraInteract_sft"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "openbmb/UltraInteract_pair",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:openbmb/UltraInteract_pair"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "openbmb/UltraFeedback",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:openbmb/UltraFeedback"
        },
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "SFT",
          "confidence": 0.6,
          "raw_context": "s-660bc40bec5376b3adc9d1c5) - 🤗 UltraInteract   - [SFT](https://huggingface.co/datasets/openbmb/UltraInteract_sft)   - [Preference Learnin"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "c4",
          "confidence": 0.7,
          "raw_context": "ps://huggingface.co/collections/openbmb/eurus-660bc40bec5376b3adc9d1c5) - 🤗 UltraInteract   - [SFT](ht"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "n</a> </p>   </div>  # Links  - 📜 [Paper](https://arxiv.org/abs/2404.02078) - 🤗 [Eurus Collection](https:"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "openbmb/Eurux-8x22b-nca",
          "confidence": 0.9,
          "raw_context": "_name_or_path: openbmb/Eurux-8x22b-nca"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "mixtral",
          "confidence": 0.5,
          "raw_context": "model_type: mixtral"
        }
      ],
      "declared_datasets": [
        "openbmb/UltraInteract_sft",
        "openbmb/UltraFeedback",
        "openbmb/UltraInteract_pair"
      ],
      "inferred_datasets": [
        "c4",
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.5,
      "provenance_hash": "cb2ccf10989bc40e9a55f8cc3277717e4b8353b274f766b496106b8f404200f1"
    },
    {
      "model_id": "openbmb/MiniCPM-1B-sft-bf16",
      "scanned_at": "2026-09-15T02:42:46.206117Z",
      "signals": [
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "MiniCPM-2B-SFT/DPO",
          "confidence": 0.85,
          "raw_context": "NT4 quantized version **MiniCPM-2B-SFT/DPO-Int4** based on MiniCPM-2B-SFT/DPO - Mobile phone application based on MLC-LLM and L"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "sharegpt",
          "confidence": 0.7,
          "raw_context": "代改进； - 为了保证在学术研究用途上模型的通用性，我们未对模型进行任何身份认同训练。同时由于我们用ShareGPT开源语料作为部分训练数据，模型可能会输出类似GPT系列模型的身份认同信息； - 受限于模型规模，模型"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "c4",
          "confidence": 0.7,
          "raw_context": "Potential-of-End-side-Large-Language-Models-d4d3a8c426424654a4e80e42a711cb20?pvs=4\" target=\"_blank\"> T"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "openbmb/CPM-2B",
          "confidence": 0.9,
          "raw_context": "_name_or_path: openbmb/CPM-2B"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "c4",
        "sharegpt"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.1,
      "provenance_hash": "9238b99171904f9b339a670afea1540c4bd8cd9821f07aa65284e5bbb0458f6a"
    },
    {
      "model_id": "openbmb/MiniCPM-2B-128k",
      "scanned_at": "2026-09-15T02:42:49.000767Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "stingning/ultrachat",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:stingning/ultrachat"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "voc",
          "confidence": 0.7,
          "raw_context": "quirement, removed tie_embedding and expanded the vocabulary to 127660.  For more details, please refer"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "sharegpt",
          "confidence": 0.7,
          "raw_context": "ntity training on the model. Meanwhile, as we use ShareGPT open-source corpus as part of the training data,"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "ultrachat",
          "confidence": 0.7,
          "raw_context": "--- datasets: - stingning/ultrachat language: - zh - en library_name: transformers pi"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "openbmb/CPM-2B",
          "confidence": 0.9,
          "raw_context": "_name_or_path: openbmb/CPM-2B"
        }
      ],
      "declared_datasets": [
        "stingning/ultrachat"
      ],
      "inferred_datasets": [
        "ultrachat",
        "voc",
        "sharegpt"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.25,
      "provenance_hash": "5aade5e3a3fa5d9b2614c29906e9dc11a7afb886b1fbfb1ed50d0da198ea37d8"
    },
    {
      "model_id": "openbmb/MiniCPM-2B-dpo-bf16",
      "scanned_at": "2026-09-15T02:42:51.749024Z",
      "signals": [
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "MiniCPM-2B-SFT/DPO",
          "confidence": 0.85,
          "raw_context": "NT4 quantized version **MiniCPM-2B-SFT/DPO-Int4** based on MiniCPM-2B-SFT/DPO - Mobile phone application based on MLC-LLM and L"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "sharegpt",
          "confidence": 0.7,
          "raw_context": "代改进； - 为了保证在学术研究用途上模型的通用性，我们未对模型进行任何身份认同训练。同时由于我们用ShareGPT开源语料作为部分训练数据，模型可能会输出类似GPT系列模型的身份认同信息； - 受限于模型规模，模型"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "c4",
          "confidence": 0.7,
          "raw_context": "Potential-of-End-side-Large-Language-Models-d4d3a8c426424654a4e80e42a711cb20?pvs=4\" target=\"_blank\"> T"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "openbmb/CPM-2B",
          "confidence": 0.9,
          "raw_context": "_name_or_path: openbmb/CPM-2B"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "c4",
        "sharegpt"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.1,
      "provenance_hash": "41a7fce527ec101df7f8bf0427ecc640adf22cfea79f9dc7451ee17cc1b76803"
    },
    {
      "model_id": "openbmb/MiniCPM-2B-dpo-bf16-llama-format",
      "scanned_at": "2026-09-15T02:42:54.546951Z",
      "signals": [
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "MiniCPM-2B-SFT/DPO",
          "confidence": 0.85,
          "raw_context": "NT4 quantized version **MiniCPM-2B-SFT/DPO-Int4** based on MiniCPM-2B-SFT/DPO - Mobile phone application based on MLC-LLM and L"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "sharegpt",
          "confidence": 0.7,
          "raw_context": "代改进； - 为了保证在学术研究用途上模型的通用性，我们未对模型进行任何身份认同训练。同时由于我们用ShareGPT开源语料作为部分训练数据，模型可能会输出类似GPT系列模型的身份认同信息； - 受限于模型规模，模型"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "c4",
          "confidence": 0.7,
          "raw_context": "Potential-of-End-side-Large-Language-Models-d4d3a8c426424654a4e80e42a711cb20?pvs=4\" target=\"_blank\"> T"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "openbmb/MiniCPM-2B-dpo-bf16-llama-format",
          "confidence": 0.9,
          "raw_context": "_name_or_path: openbmb/MiniCPM-2B-dpo-bf16-llama-format"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "llama",
          "confidence": 0.5,
          "raw_context": "model_type: llama"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "c4",
        "sharegpt"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "other",
      "provenance_score": 0.2,
      "provenance_hash": "705b10067f1210d5f2f54771d636cfe2a219528a90a8237ec05e55a1fb47cb2b"
    },
    {
      "model_id": "openbmb/MiniCPM-2B-dpo-fp16",
      "scanned_at": "2026-09-15T02:42:57.383140Z",
      "signals": [
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "MiniCPM-2B-SFT/DPO",
          "confidence": 0.85,
          "raw_context": "NT4 quantized version **MiniCPM-2B-SFT/DPO-Int4** based on MiniCPM-2B-SFT/DPO - Mobile phone application based on MLC-LLM and L"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "sharegpt",
          "confidence": 0.7,
          "raw_context": "代改进； - 为了保证在学术研究用途上模型的通用性，我们未对模型进行任何身份认同训练。同时由于我们用ShareGPT开源语料作为部分训练数据，模型可能会输出类似GPT系列模型的身份认同信息； - 受限于模型规模，模型"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "c4",
          "confidence": 0.7,
          "raw_context": "Potential-of-End-side-Large-Language-Models-d4d3a8c426424654a4e80e42a711cb20?pvs=4\" target=\"_blank\"> T"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "openbmb/CPM-2B",
          "confidence": 0.9,
          "raw_context": "_name_or_path: openbmb/CPM-2B"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "c4",
        "sharegpt"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.1,
      "provenance_hash": "742fdb6dea7f41d939ea95dd58cddac3470062bc739af4a28ef1215a68b40864"
    },
    {
      "model_id": "openbmb/MiniCPM-2B-dpo-fp32",
      "scanned_at": "2026-09-15T02:43:00.245860Z",
      "signals": [
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "MiniCPM-2B-SFT/DPO",
          "confidence": 0.85,
          "raw_context": "NT4 quantized version **MiniCPM-2B-SFT/DPO-Int4** based on MiniCPM-2B-SFT/DPO - Mobile phone application based on MLC-LLM and L"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "sharegpt",
          "confidence": 0.7,
          "raw_context": "代改进； - 为了保证在学术研究用途上模型的通用性，我们未对模型进行任何身份认同训练。同时由于我们用ShareGPT开源语料作为部分训练数据，模型可能会输出类似GPT系列模型的身份认同信息； - 受限于模型规模，模型"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "c4",
          "confidence": 0.7,
          "raw_context": "Potential-of-End-side-Large-Language-Models-d4d3a8c426424654a4e80e42a711cb20?pvs=4\" target=\"_blank\"> T"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "openbmb/CPM-2B",
          "confidence": 0.9,
          "raw_context": "_name_or_path: openbmb/CPM-2B"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "c4",
        "sharegpt"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.1,
      "provenance_hash": "cf8765d48f7961bb19e1d37525141d70fdec2297299b86a37a420d7149cf86e8"
    },
    {
      "model_id": "openbmb/MiniCPM-2B-history",
      "scanned_at": "2026-09-15T02:43:03.066294Z",
      "signals": [
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "MiniCPM-2B-SFT/DPO",
          "confidence": 0.85,
          "raw_context": "NT4 quantized version **MiniCPM-2B-SFT/DPO-Int4** based on MiniCPM-2B-SFT/DPO - Mobile phone application based on MLC-LLM and L"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "sharegpt",
          "confidence": 0.7,
          "raw_context": "代改进； - 为了保证在学术研究用途上模型的通用性，我们未对模型进行任何身份认同训练。同时由于我们用ShareGPT开源语料作为部分训练数据，模型可能会输出类似GPT系列模型的身份认同信息； - 受限于模型规模，模型"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "c4",
          "confidence": 0.7,
          "raw_context": "Potential-of-End-side-Large-Language-Models-d4d3a8c426424654a4e80e42a711cb20?pvs=4\" target=\"_blank\"> T"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "openbmb/CPM-2B",
          "confidence": 0.9,
          "raw_context": "_name_or_path: openbmb/CPM-2B"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "c4",
        "sharegpt"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.1,
      "provenance_hash": "b1ca3570a1b57767a6bdc0d672255432fb97d6a6ba21ddb717bf020458368556"
    },
    {
      "model_id": "openbmb/MiniCPM-2B-sft-bf16",
      "scanned_at": "2026-09-15T02:43:05.822359Z",
      "signals": [
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "MiniCPM-2B-SFT/DPO",
          "confidence": 0.85,
          "raw_context": "NT4 quantized version **MiniCPM-2B-SFT/DPO-Int4** based on MiniCPM-2B-SFT/DPO - Mobile phone application based on MLC-LLM and L"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "sharegpt",
          "confidence": 0.7,
          "raw_context": "代改进； - 为了保证在学术研究用途上模型的通用性，我们未对模型进行任何身份认同训练。同时由于我们用ShareGPT开源语料作为部分训练数据，模型可能会输出类似GPT系列模型的身份认同信息； - 受限于模型规模，模型"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "c4",
          "confidence": 0.7,
          "raw_context": "Potential-of-End-side-Large-Language-Models-d4d3a8c426424654a4e80e42a711cb20?pvs=4\" target=\"_blank\"> T"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "openbmb/CPM-2B",
          "confidence": 0.9,
          "raw_context": "_name_or_path: openbmb/CPM-2B"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "c4",
        "sharegpt"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.1,
      "provenance_hash": "904ce1b53840b8521cd5b6ce992e61a8b2a001d13549b0edd732df930950dab6"
    },
    {
      "model_id": "openbmb/MiniCPM-2B-sft-fp32",
      "scanned_at": "2026-09-15T02:43:08.570877Z",
      "signals": [
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "MiniCPM-2B-SFT/DPO",
          "confidence": 0.85,
          "raw_context": "NT4 quantized version **MiniCPM-2B-SFT/DPO-Int4** based on MiniCPM-2B-SFT/DPO - Mobile phone application based on MLC-LLM and L"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "sharegpt",
          "confidence": 0.7,
          "raw_context": "代改进； - 为了保证在学术研究用途上模型的通用性，我们未对模型进行任何身份认同训练。同时由于我们用ShareGPT开源语料作为部分训练数据，模型可能会输出类似GPT系列模型的身份认同信息； - 受限于模型规模，模型"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "c4",
          "confidence": 0.7,
          "raw_context": "Potential-of-End-side-Large-Language-Models-d4d3a8c426424654a4e80e42a711cb20?pvs=4\" target=\"_blank\"> T"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "openbmb/CPM-2B",
          "confidence": 0.9,
          "raw_context": "_name_or_path: openbmb/CPM-2B"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "c4",
        "sharegpt"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "other",
      "provenance_score": 0.2,
      "provenance_hash": "fe433d8aa6971fc8e6c757195c6dcc7830ee2843cdfc4f1966675d39a46eb9db"
    },
    {
      "model_id": "openbmb/MiniCPM-2B-sft-int4",
      "scanned_at": "2026-09-15T02:43:11.409252Z",
      "signals": [
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "openbmb/CPM-2B",
          "confidence": 0.9,
          "raw_context": "_name_or_path: openbmb/CPM-2B"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "7f2969b1c3ab7a26f1aa400fb328b077e04cbda06199d3a77e2086d7809b246e"
    },
    {
      "model_id": "openbmb/MiniCPM-Embedding",
      "scanned_at": "2026-09-15T02:43:14.160702Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "openbmb/MiniCPM-2B-sft-bf16",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:openbmb/MiniCPM-2B-sft-bf16"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:openbmb/MiniCPM-2B-sft-bf16",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:openbmb/MiniCPM-2B-sft-bf16"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "openbmb/MiniCPM-2B-sft-bf16",
          "confidence": 0.85,
          "raw_context": "--- language: - zh - en base_model: openbmb/MiniCPM-2B-sft-bf16 model-index: - name: MiniCPM-Embedding   results:"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "c4",
          "confidence": 0.7,
          "raw_context": "revision: 4ffe81d471b1924886b33c7567bfb200e9eec5c4     metrics:     - type: ndcg_at_10       value:"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "gpt: Gpt sentence embeddings for semantic search. arXiv preprint arXiv:2202.08904.  ## 模型信息 Model Informa"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "openbmb/MiniCPM-Embedding",
          "confidence": 0.9,
          "raw_context": "_name_or_path: openbmb/MiniCPM-Embedding"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:openbmb/MiniCPM-2B-sft-bf16",
          "value": "sharegpt",
          "confidence": 0.5599999999999999,
          "raw_context": "代改进； - 为了保证在学术研究用途上模型的通用性，我们未对模型进行任何身份认同训练。同时由于我们用ShareGPT开源语料作为部分训练数据，模型可能会输出类似GPT系列模型的身份认同信息； - 受限于模型规模，模型"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:openbmb/MiniCPM-2B-sft-bf16",
          "value": "c4",
          "confidence": 0.5599999999999999,
          "raw_context": "Potential-of-End-side-Large-Language-Models-d4d3a8c426424654a4e80e42a711cb20?pvs=4\" target=\"_blank\"> T"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "c4",
        "arxiv",
        "sharegpt"
      ],
      "base_model": "openbmb/MiniCPM-2B-sft-bf16",
      "base_model_chain": [
        "openbmb/MiniCPM-2B-sft-bf16"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.25,
      "provenance_hash": "e168c29e31f7d68c1395cd4b24ac631f150f15ae2f94ed49c1335bdfe5990b59"
    },
    {
      "model_id": "openbmb/MiniCPM-Embedding-Light",
      "scanned_at": "2026-09-15T02:43:16.923177Z",
      "signals": [
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "c4",
          "confidence": 0.7,
          "raw_context": "revision: b44c3b011063adb25877c13823db83bb193913c4       split: validation       type: C-MTEB/AFQMC"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "- dataset:       config: default       name: MTEB ArxivClusteringP2P (default)       revision: a122ad7f3f"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "openbmb/MiniCPM-Embedding-Light",
          "confidence": 0.9,
          "raw_context": "_name_or_path: openbmb/MiniCPM-Embedding-Light"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "minicpm",
          "confidence": 0.5,
          "raw_context": "model_type: minicpm"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "c4",
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.1,
      "provenance_hash": "ed34ca17e319061742add4664bc7e2d8bf8ac1b5d082348da87a5805a48b441e"
    },
    {
      "model_id": "openbmb/MiniCPM-Llama3-V-2_5",
      "scanned_at": "2026-09-15T02:43:20.073122Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "openbmb/RLAIF-V-Dataset",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:openbmb/RLAIF-V-Dataset"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "c4",
          "confidence": 0.7,
          "raw_context": "cdn-uploads.huggingface.co/production/uploads/64abc4aa6cadc7aca585dddf/v2KE3wqQgM05ZW3dH2wbx.png\" widt"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "nd Liu, Zhiyuan and Sun, Maosong},       journal={arXiv preprint 2408.01800},       year={2024}, } ```"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "openbmb/MiniCPM-Llama3-V-2_5",
          "confidence": 0.9,
          "raw_context": "_name_or_path: openbmb/MiniCPM-Llama3-V-2_5"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "minicpmv",
          "confidence": 0.5,
          "raw_context": "model_type: minicpmv"
        }
      ],
      "declared_datasets": [
        "openbmb/RLAIF-V-Dataset"
      ],
      "inferred_datasets": [
        "c4",
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.2,
      "provenance_hash": "c04669c6c75e418fd8d713b2aa2b1b6f116ccbe08c6aa4215a7f8ca0c1ee67ba"
    },
    {
      "model_id": "openbmb/MiniCPM-Llama3-V-2_5-gguf",
      "scanned_at": "2026-09-15T02:43:22.829000Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "openbmb/MiniCPM-Llama3-V-2_5",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:openbmb/MiniCPM-Llama3-V-2_5"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:openbmb/MiniCPM-Llama3-V-2_5",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:openbmb/MiniCPM-Llama3-V-2_5"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:openbmb/MiniCPM-Llama3-V-2_5",
          "value": "c4",
          "confidence": 0.5599999999999999,
          "raw_context": "cdn-uploads.huggingface.co/production/uploads/64abc4aa6cadc7aca585dddf/v2KE3wqQgM05ZW3dH2wbx.png\" widt"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:openbmb/MiniCPM-Llama3-V-2_5",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "nd Liu, Zhiyuan and Sun, Maosong},       journal={arXiv preprint 2408.01800},       year={2024}, } ```"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "c4",
        "arxiv"
      ],
      "base_model": "openbmb/MiniCPM-Llama3-V-2_5",
      "base_model_chain": [
        "openbmb/MiniCPM-Llama3-V-2_5"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.2,
      "provenance_hash": "b433abb6193fe2b587d145d0e5e9614b493997d3dd2d2c7ace9034295dc9231e"
    },
    {
      "model_id": "openbmb/MiniCPM-Llama3-V-2_5-int4",
      "scanned_at": "2026-09-15T02:43:25.578611Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "openbmb/MiniCPM-Llama3-V-2_5",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:openbmb/MiniCPM-Llama3-V-2_5"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:openbmb/MiniCPM-Llama3-V-2_5",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:openbmb/MiniCPM-Llama3-V-2_5"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "openbmb/MiniCPM-Llama3-V-2_5-int4",
          "confidence": 0.9,
          "raw_context": "_name_or_path: openbmb/MiniCPM-Llama3-V-2_5-int4"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "minicpmv",
          "confidence": 0.5,
          "raw_context": "model_type: minicpmv"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:openbmb/MiniCPM-Llama3-V-2_5",
          "value": "c4",
          "confidence": 0.5599999999999999,
          "raw_context": "cdn-uploads.huggingface.co/production/uploads/64abc4aa6cadc7aca585dddf/v2KE3wqQgM05ZW3dH2wbx.png\" widt"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:openbmb/MiniCPM-Llama3-V-2_5",
          "value": "arxiv",
          "confidence": 0.5599999999999999,
          "raw_context": "nd Liu, Zhiyuan and Sun, Maosong},       journal={arXiv preprint 2408.01800},       year={2024}, } ```"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "c4",
        "arxiv"
      ],
      "base_model": "openbmb/MiniCPM-Llama3-V-2_5",
      "base_model_chain": [
        "openbmb/MiniCPM-Llama3-V-2_5"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.2,
      "provenance_hash": "d78504fd4cb2f76beae6a54b972f5933d0efeb93b968e3c11744e986ce4504d5"
    },
    {
      "model_id": "openbmb/MiniCPM-MoE-8x2B",
      "scanned_at": "2026-09-15T02:43:28.336063Z",
      "signals": [
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "openbmb/CPM-2B",
          "confidence": 0.9,
          "raw_context": "_name_or_path: openbmb/CPM-2B"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "c6061d83f286fc1d593e20de81cd0f636076e0c3b677ae5882a056df1ae2984a"
    },
    {
      "model_id": "openbmb/MiniCPM-Reranker",
      "scanned_at": "2026-09-15T02:43:31.202548Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "openbmb/MiniCPM-2B-sft-bf16",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:openbmb/MiniCPM-2B-sft-bf16"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:openbmb/MiniCPM-2B-sft-bf16",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:openbmb/MiniCPM-2B-sft-bf16"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "openbmb/MiniCPM-2B-sft-bf16",
          "confidence": 0.85,
          "raw_context": "--- language: - zh - en base_model: openbmb/MiniCPM-2B-sft-bf16 pipeline_tag: text-classification library_name: t"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "openbmb/MiniCPM-Reranker",
          "confidence": 0.9,
          "raw_context": "_name_or_path: openbmb/MiniCPM-Reranker"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:openbmb/MiniCPM-2B-sft-bf16",
          "value": "sharegpt",
          "confidence": 0.5599999999999999,
          "raw_context": "代改进； - 为了保证在学术研究用途上模型的通用性，我们未对模型进行任何身份认同训练。同时由于我们用ShareGPT开源语料作为部分训练数据，模型可能会输出类似GPT系列模型的身份认同信息； - 受限于模型规模，模型"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:openbmb/MiniCPM-2B-sft-bf16",
          "value": "c4",
          "confidence": 0.5599999999999999,
          "raw_context": "Potential-of-End-side-Large-Language-Models-d4d3a8c426424654a4e80e42a711cb20?pvs=4\" target=\"_blank\"> T"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "c4",
        "sharegpt"
      ],
      "base_model": "openbmb/MiniCPM-2B-sft-bf16",
      "base_model_chain": [
        "openbmb/MiniCPM-2B-sft-bf16"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.2,
      "provenance_hash": "3856b71ddf3f6469b0db0f709035b2f6689bc2cf7632ca9752ac89edbdf2b8a9"
    },
    {
      "model_id": "openbmb/MiniCPM-Reranker-Light",
      "scanned_at": "2026-09-15T02:43:33.968974Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "openbmb/MiniCPM-1B-sft-bf16",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:openbmb/MiniCPM-1B-sft-bf16"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "finetune:openbmb/MiniCPM-1B-sft-bf16",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:finetune:openbmb/MiniCPM-1B-sft-bf16"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "openbmb/MiniCPM-1B-sft-bf16",
          "confidence": 0.85,
          "raw_context": "--- language: - zh - en base_model: openbmb/MiniCPM-1B-sft-bf16 pipeline_tag: text-ranking tags: - sentence-trans"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "openbmb/MiniCPM-Reranker-Light",
          "confidence": 0.9,
          "raw_context": "_name_or_path: openbmb/MiniCPM-Reranker-Light"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "minicpm",
          "confidence": 0.5,
          "raw_context": "model_type: minicpm"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:openbmb/MiniCPM-1B-sft-bf16",
          "value": "sharegpt",
          "confidence": 0.5599999999999999,
          "raw_context": "代改进； - 为了保证在学术研究用途上模型的通用性，我们未对模型进行任何身份认同训练。同时由于我们用ShareGPT开源语料作为部分训练数据，模型可能会输出类似GPT系列模型的身份认同信息； - 受限于模型规模，模型"
        },
        {
          "signal_type": "inherited_known_dataset",
          "source": "base_model:openbmb/MiniCPM-1B-sft-bf16",
          "value": "c4",
          "confidence": 0.5599999999999999,
          "raw_context": "Potential-of-End-side-Large-Language-Models-d4d3a8c426424654a4e80e42a711cb20?pvs=4\" target=\"_blank\"> T"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "c4",
        "sharegpt"
      ],
      "base_model": "openbmb/MiniCPM-1B-sft-bf16",
      "base_model_chain": [
        "openbmb/MiniCPM-1B-sft-bf16"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.2,
      "provenance_hash": "bc4134d3db9cc5d09a4905fb0d750b6d899120effd4da4cb468baedf5d71f5fd"
    },
    {
      "model_id": "openbmb/MiniCPM-S-1B-sft",
      "scanned_at": "2026-09-15T02:43:36.879010Z",
      "signals": [
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "same number of tokens on the same mixed",
          "confidence": 0.6,
          "raw_context": "d LLaMA2. Note that models under all settings are trained with the same number of tokens on the same mixed dataset. Our evaluation is based on the framework [UltraE"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "lp.csai.tsinghua.edu.cn/) - Paper: [link](https://arxiv.org/pdf/2402.13516.pdf) (Note: `MiniCPM-S-1B` is"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "openbmb/ProSparse-MiniCPM-1B-sft",
          "confidence": 0.9,
          "raw_context": "_name_or_path: openbmb/ProSparse-MiniCPM-1B-sft"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "apache-2.0",
      "provenance_score": 0.45,
      "provenance_hash": "e1110ed8d643e4c8c45406629cd1283bcd8fdce68ff4dc7042e033856581b890"
    },
    {
      "model_id": "openbmb/MiniCPM-S-1B-sft-gguf",
      "scanned_at": "2026-09-15T02:43:39.643548Z",
      "signals": [
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "same number of tokens on the same mixed",
          "confidence": 0.6,
          "raw_context": "d LLaMA2. Note that models under all settings are trained with the same number of tokens on the same mixed dataset. Our evaluation is based on the framework [UltraE"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "lp.csai.tsinghua.edu.cn/) - Paper: [link](https://arxiv.org/pdf/2402.13516.pdf) (Note: `MiniCPM-S-1B` is"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "apache-2.0",
      "provenance_score": 0.45,
      "provenance_hash": "be1fca90a6358ce9711f53182afe1d249f01b206312a06de98c0eac05c5ba495"
    },
    {
      "model_id": "openbmb/MiniCPM-S-1B-sft-llama-format",
      "scanned_at": "2026-09-15T02:43:42.405352Z",
      "signals": [
        {
          "signal_type": "readme_dataset",
          "source": "model_card",
          "value": "same number of tokens on the same mixed",
          "confidence": 0.6,
          "raw_context": "d LLaMA2. Note that models under all settings are trained with the same number of tokens on the same mixed dataset. Our evaluation is based on the framework [UltraE"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "lp.csai.tsinghua.edu.cn/) - Paper: [link](https://arxiv.org/pdf/2402.13516.pdf) (Note: `MiniCPM-S-1B` is"
        },
        {
          "signal_type": "training_section",
          "source": "model_card",
          "value": "present",
          "confidence": 1.0,
          "raw_context": "Training section found in README"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "openbmb/ProSparse-MiniCPM-1B-sft-llama-format",
          "confidence": 0.9,
          "raw_context": "_name_or_path: openbmb/ProSparse-MiniCPM-1B-sft-llama-format"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "llama",
          "confidence": 0.5,
          "raw_context": "model_type: llama"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": true,
      "license": "apache-2.0",
      "provenance_score": 0.45,
      "provenance_hash": "16de371079046f6848a976083ba264eb54bb8256c8d311fc967b5dfcec51ac03"
    },
    {
      "model_id": "openbmb/MiniCPM-SALA",
      "scanned_at": "2026-09-15T02:43:45.164084Z",
      "signals": [
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "which 25% of the layers adopt [InfLLM-V2](https://arxiv.org/abs/2509.24663) and the remaining 75% utilize"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "openbmb/MiniCPM-SALA",
          "confidence": 0.9,
          "raw_context": "_name_or_path: openbmb/MiniCPM-SALA"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "minicpm_sala",
          "confidence": 0.5,
          "raw_context": "model_type: minicpm_sala"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.15000000000000002,
      "provenance_hash": "22d1c6fe571c0acc7a1a7acfa46dd5e1f6b4a1af20772415c4aac9527ffdf9a5"
    },
    {
      "model_id": "openbmb/MiniCPM-V",
      "scanned_at": "2026-09-15T02:43:47.919694Z",
      "signals": [
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "ique from the ICLR 2024 spotlight [paper](https://arxiv.org/abs/2308.12038).  ### Evaluation  <div align="
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "openbmb/MiniCPM-V",
          "confidence": 0.9,
          "raw_context": "_name_or_path: openbmb/MiniCPM-V"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "minicpmv",
          "confidence": 0.5,
          "raw_context": "model_type: minicpmv"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.05,
      "provenance_hash": "52abadc5d5ea842fa6a46dab220557d24c1fef32b9d42096750675afddf4f774"
    },
    {
      "model_id": "openbmb/MiniCPM-V-2",
      "scanned_at": "2026-09-15T02:43:50.669364Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "HaoyeZhang/RLHF-V-Dataset",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:HaoyeZhang/RLHF-V-Dataset"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "Yirany/UniMM-Chat",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:Yirany/UniMM-Chat"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "HuggingFaceM4/VQAv2",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:HuggingFaceM4/VQAv2"
        },
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "liuhaotian/LLaVA-Instruct-150K",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:liuhaotian/LLaVA-Instruct-150K"
        },
        {
          "signal_type": "known_dataset",
          "source": "model_card",
          "value": "arxiv",
          "confidence": 0.7,
          "raw_context": "d via a recent technique from [LLaVA-UHD](https://arxiv.org/pdf/2403.11703.pdf).  - ⚡️ **High Efficiency."
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "openbmb/MiniCPM-V-2",
          "confidence": 0.9,
          "raw_context": "_name_or_path: openbmb/MiniCPM-V-2"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "minicpmv",
          "confidence": 0.5,
          "raw_context": "model_type: minicpmv"
        }
      ],
      "declared_datasets": [
        "Yirany/UniMM-Chat",
        "HaoyeZhang/RLHF-V-Dataset",
        "liuhaotian/LLaVA-Instruct-150K",
        "HuggingFaceM4/VQAv2"
      ],
      "inferred_datasets": [
        "arxiv"
      ],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.35,
      "provenance_hash": "3513c1023d9bad698b6f735cf7a768db3a00325f962f4ac7313779667f6c89e1"
    },
    {
      "model_id": "openbmb/MiniCPM-V-2-gguf",
      "scanned_at": "2026-09-15T02:43:53.476658Z",
      "signals": [],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.0,
      "provenance_hash": "1ade665836b5f96c1093c3301de10c6ddb8517437e40b4ee3fce39aad8573da2"
    },
    {
      "model_id": "openbmb/MiniCPM-V-2_6",
      "scanned_at": "2026-09-15T02:43:56.247531Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "openbmb/RLAIF-V-Dataset",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:openbmb/RLAIF-V-Dataset"
        }
      ],
      "declared_datasets": [
        "openbmb/RLAIF-V-Dataset"
      ],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.1,
      "provenance_hash": "6073803be965d5300761c8dd470a9b8b088f9d42dcb631b65040964cb11a3a4c"
    },
    {
      "model_id": "openbmb/MiniCPM-V-2_6-gguf",
      "scanned_at": "2026-09-15T02:43:57.157441Z",
      "signals": [
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "openbmb/MiniCPM-V-2_6",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:openbmb/MiniCPM-V-2_6"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:openbmb/MiniCPM-V-2_6",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:openbmb/MiniCPM-V-2_6"
        }
      ],
      "declared_datasets": [],
      "inferred_datasets": [],
      "base_model": "openbmb/MiniCPM-V-2_6",
      "base_model_chain": [
        "openbmb/MiniCPM-V-2_6"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.1,
      "provenance_hash": "72e909fbaa63fd89fb833a59f7be686c199e3fbafbf299720b43d131bcf68a25"
    },
    {
      "model_id": "openbmb/MiniCPM-V-2_6-int4",
      "scanned_at": "2026-09-15T02:43:59.911035Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "openbmb/RLAIF-V-Dataset",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:openbmb/RLAIF-V-Dataset"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "openbmb/MiniCPM-V-2_6",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:openbmb/MiniCPM-V-2_6"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:openbmb/MiniCPM-V-2_6",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:openbmb/MiniCPM-V-2_6"
        },
        {
          "signal_type": "config_base",
          "source": "config.json",
          "value": "openbmb/MiniCPM-V-2_6",
          "confidence": 0.9,
          "raw_context": "_name_or_path: openbmb/MiniCPM-V-2_6"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "minicpmv",
          "confidence": 0.5,
          "raw_context": "model_type: minicpmv"
        }
      ],
      "declared_datasets": [
        "openbmb/RLAIF-V-Dataset"
      ],
      "inferred_datasets": [],
      "base_model": "openbmb/MiniCPM-V-2_6",
      "base_model_chain": [
        "openbmb/MiniCPM-V-2_6"
      ],
      "training_section_present": false,
      "license": null,
      "provenance_score": 0.2,
      "provenance_hash": "b53b73a44dd119e9707e73a40add50a6ccf663e310f2e49608fdedf587336e6d"
    },
    {
      "model_id": "openbmb/MiniCPM-V-4",
      "scanned_at": "2026-09-15T02:44:02.662805Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "openbmb/RLAIF-V-Dataset",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:openbmb/RLAIF-V-Dataset"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "minicpmv",
          "confidence": 0.5,
          "raw_context": "model_type: minicpmv"
        }
      ],
      "declared_datasets": [
        "openbmb/RLAIF-V-Dataset"
      ],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.2,
      "provenance_hash": "62794e5e5abe3172bee4361bd5951ef8e0b87dcc9c128b98a0fe726d9ef10807"
    },
    {
      "model_id": "openbmb/MiniCPM-V-4-AWQ",
      "scanned_at": "2026-09-15T02:44:06.955947Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "openbmb/RLAIF-V-Dataset",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:openbmb/RLAIF-V-Dataset"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "openbmb/MiniCPM-V-4",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:openbmb/MiniCPM-V-4"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:openbmb/MiniCPM-V-4",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:openbmb/MiniCPM-V-4"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "openbmb/MiniCPM-V-4",
          "confidence": 0.85,
          "raw_context": "i-image - video - custom_code license: apache-2.0 base_model: openbmb/MiniCPM-V-4 base_model_relation: quantized ---  <h1>A GPT-4V"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "minicpmv",
          "confidence": 0.5,
          "raw_context": "model_type: minicpmv"
        }
      ],
      "declared_datasets": [
        "openbmb/RLAIF-V-Dataset"
      ],
      "inferred_datasets": [],
      "base_model": "openbmb/MiniCPM-V-4",
      "base_model_chain": [
        "openbmb/MiniCPM-V-4"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "981b2c909ae43bb34f6e8bfe0c41afa956f3feb4168a7c68755cb2cb5d37e72a"
    },
    {
      "model_id": "openbmb/MiniCPM-V-4-gguf",
      "scanned_at": "2026-09-15T02:44:09.871250Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "openbmb/RLAIF-V-Dataset",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:openbmb/RLAIF-V-Dataset"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "openbmb/MiniCPM-V-4",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:openbmb/MiniCPM-V-4"
        },
        {
          "signal_type": "base_model_tag",
          "source": "hf_api_tags",
          "value": "quantized:openbmb/MiniCPM-V-4",
          "confidence": 0.99,
          "raw_context": "Tag: base_model:quantized:openbmb/MiniCPM-V-4"
        },
        {
          "signal_type": "readme_base_model",
          "source": "model_card",
          "value": "openbmb/MiniCPM-V-4",
          "confidence": 0.85,
          "raw_context": "i-image - video - custom_code license: apache-2.0 base_model: openbmb/MiniCPM-V-4 base_model_relation: quantized ---  <h1>A GPT-4V"
        }
      ],
      "declared_datasets": [
        "openbmb/RLAIF-V-Dataset"
      ],
      "inferred_datasets": [],
      "base_model": "openbmb/MiniCPM-V-4",
      "base_model_chain": [
        "openbmb/MiniCPM-V-4"
      ],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.30000000000000004,
      "provenance_hash": "198da3b5a3b059e27e0dcf810d11779f233cf90c427bd0d27d506d59cabbaf3c"
    },
    {
      "model_id": "openbmb/MiniCPM-V-4-int4",
      "scanned_at": "2026-09-15T02:44:12.677689Z",
      "signals": [
        {
          "signal_type": "tag",
          "source": "hf_api_tags",
          "value": "openbmb/RLAIF-V-Dataset",
          "confidence": 0.95,
          "raw_context": "Tag: dataset:openbmb/RLAIF-V-Dataset"
        },
        {
          "signal_type": "model_type",
          "source": "config.json",
          "value": "minicpmv",
          "confidence": 0.5,
          "raw_context": "model_type: minicpmv"
        }
      ],
      "declared_datasets": [
        "openbmb/RLAIF-V-Dataset"
      ],
      "inferred_datasets": [],
      "base_model": null,
      "base_model_chain": [],
      "training_section_present": false,
      "license": "apache-2.0",
      "provenance_score": 0.2,
      "provenance_hash": "47f5103b748d4ab31b64a154cc22fa9e4c6b47d8c11684c9b490efe30b47ad39"
    }
  ]
}