1,854,286 packages matching “training data”
@polyglot-bundles/gu-minimal-pairs
v0.5.2 · 3 months ago
Gujarati minimal pairs - phoneme contrast training data
No known vulnerabilities
@polyglot-bundles/ne-minimal-pairs
v0.5.2 · 3 months ago
Nepali minimal pairs - phoneme contrast training data
No known vulnerabilities
@bnol/aws-lambda-tesseract
v3.0.2 · 6 years ago
6 MB Tesseract 4.1 (with English training data) to fit inside AWS Lambda
No known vulnerabilities
@polyglot-bundles/pt-br-minimal-pairs
v0.5.2 · 3 months ago
Portuguese (Brazil) minimal pairs - phoneme contrast training data
No known vulnerabilities
@polyglot-bundles/bn-minimal-pairs
v0.5.2 · 3 months ago
Bengali minimal pairs - phoneme contrast training data
No known vulnerabilities
puzldai
v0.2.95 · 8 months ago
Multi-LLM orchestration framework with agentic execution, memory/RAG, and training data generation
No known vulnerabilities
n8n-nodes-ai-training-scraper
v1.0.2 · 7 months ago
Scrape and chunk websites into AI-ready training data for RAG, LLM fine-tuning, and vector databases
No known vulnerabilities
@mcwalrus/fresh-data
v0.1.0 · 2 months ago
Force live data sourcing. Never cite facts from training data without a live lookup. Pi extension, skills.sh package, Claude Code plugin.
No known vulnerabilities
@polyglot-bundles/am-minimal-pairs
v0.6.0 · 3 months ago
Amharic minimal pairs - phoneme contrast training data
No known vulnerabilities
@gymtempo/mcp
v0.1.1 · 3 months ago
GymTempo MCP server — connect AI assistants to your training data
No known vulnerabilities
ultraship
v2.13.2 · 2 months ago
Claude Code plugin with a Currency Guard that keeps Claude on current docs (not stale training data), elite SEO strategy (GSC + Bing + GA4 keyword intelligence, index doctor, AI traffic tracking, IndexNow, cross-reference, CTR anomalies, brand filtering),
No known vulnerabilities
glove-env-ocr
v1.1.0 · 11 days ago
OCR stdlib adapter for glove-working-environment. Turns a scanned PDF or a photo of a document into text inside the agent's virtual filesystem as env:ocr — bundled Tesseract WASM plus bundled English training data, so it works with no host wiring and no n
No known vulnerabilities
@polyglot-bundles/es-419-minimal-pairs
v0.5.2 · 3 months ago
Spanish (Latin America) minimal pairs - phoneme contrast training data
No known vulnerabilities
burt-logger
v0.1.0 · 9 months ago
A lightweight TypeScript/JavaScript package for collecting LLM training data
No known vulnerabilities
@mcptoolshop/style-dataset-lab
v3.4.0 · 1 month ago
Canon-aligned dataset production and generation workbench — define visual rules, build versioned training data, compile production briefs, run local workflows, batch-produce, select winners, and re-ingest into your corpus
No known vulnerabilities
training-data-gen
v1.0.0 · 8 months ago
Small JS tool for generating training data using OpenAI's API compatible endpoints. Works for local LLMs as well. #localLLAMA
No known vulnerabilities
@agenttool/model-becoming
v0.1.0-dev.0 · 1 month ago
Evidence-scoped model lifecycle dossiers across training, data provenance, weights, runtime, agency, affect, power, and ontology
No known vulnerabilities
neuralgraph
v1.1.5 · 3 years ago
NeuralGraph is an AI training data visualization tool that helps analyze and interpret training data for neural networks. It provides visualizations of loss and accuracy trends over epochs, allowing users to gain insights into the training process and ass
No known vulnerabilities
@abelhn/garmin-connect-mcp
v1.1.1 · 6 months ago
MCP server for Garmin Connect - access fitness, health and training data
No known vulnerabilities
@zanii/train
v0.2.0 · 1 month ago
Training-data provenance: hash a training set into a sorted-Merkle manifest, then PROVE a named subject's data was absent from a real training run - a non-membership proof anyone can check offline. 'It was never used to train a model' becomes a yes, not a
No known vulnerabilities