1,491 packages matching “multimodal”
mixpeek
v0.81.470 · 20 days ago
Official Mixpeek TypeScript/JavaScript SDK for multimodal data processing and retrieval
No known vulnerabilities
@tanstack/ai
v0.54.0 · 6 days ago
Type-safe TypeScript AI SDK for streaming chat, tool calling, agents, structured outputs, and multimodal generation.
No known vulnerabilities
@mixpeek/n8n-nodes-mixpeek
v1.0.486 · 20 days ago
n8n community node for Mixpeek - multimodal data processing and semantic search API
No known vulnerabilities
pi-multimodal-proxy
v1.18.1 · 17 days ago
Automatic image, video and audio description for any model in Pi. Routes media to a multimodal model and injects descriptions into context.
No known vulnerabilities
koishi-plugin-chatluna-multimodal-service
v1.4.0-rc.0 · 8 days ago
multimodal service for chatluna
No known vulnerabilities
opencode-multimodal
v0.1.6 · 2 months ago
Give every opencode model multimodal capabilities by routing attachments to a fallback multimodal model. Configure everything via the /multimodal command.
No known vulnerabilities
pi-gemini-multimodal
v0.1.4 · 9 days ago
Multimodal perception for Pi — image/audio/video/document understanding, transcription & image generation via Gemini (gemini_api or local antigravity CLI).
No known vulnerabilities
@fre4x/openai
v1.1.13 · 5 days ago
OpenAI MCP server providing multimodal analysis, image generation, and transcription.
No known vulnerabilities
@dtmirizzi/pi-openrouter-multimodal
v1.6.0 · 3 months ago
OpenRouter multimodal tools for Pi — search, fetch, image gen, vision, video, PDF, TTS, STT
No known vulnerabilities
@jsonzx/opencode-multimodal-attachments
v0.1.4 · 28 days ago
Give text-only OpenCode models multimodal attachment analysis through Gemini.
No known vulnerabilities
dsh-gemini-multimodal
v0.1.2 · 28 days ago
DeepSeek Harness plugin: multimodal tools (image/audio/video/document understanding, transcription, image generation) via Gemini API or the local Antigravity CLI.
No known vulnerabilities
@crewhaus/grader-multimodal
v0.6.0 · 8 days ago
Multimodal graders: image_similarity (perceptual hash + DSSIM), image_ocr_then_grade, audio_transcript_match (Section 38)
No known vulnerabilities
@omni-tars/mcp-agent
v0.3.0 · 10 months ago
@multimodal/seed-mcp-agent
No known vulnerabilities
@hzttt/multimodal-rag
v0.5.3 · 4 months ago
OpenClaw plugin for multimodal RAG - semantic indexing and time-aware search for images and audio using local AI models
No known vulnerabilities
@open-gitagent/gitagent
v2.2.0 · 27 days ago
A universal git-native multimodal always learning AI Agent (TinyHuman)
No known vulnerabilities
@tarko/agent-server
v0.3.0 · 10 months ago
Server for Multimodal Agent.
No known vulnerabilities
@goodandready/dsh-vision-bridge
v0.5.37 · 3 days ago
Flagship multimodal vision hub for DeepSeek Harness: ~40 tools, PDF drag-and-drop, LaTeX formulas, complex tables, QR codes, UI flow diagrams, and multi-model consensus.
No known vulnerabilities
@neta-art/generation
v0.1.30 · 23 hours ago
A lightweight multimodal generation SDK with built-in model presets and adapter-based provider calls.
No known vulnerabilities
@tanstack/ai-cohere
v0.4.2 · 6 days ago
Cohere adapter for TanStack AI — multimodal embeddings and document reranking.
No known vulnerabilities
@mrgoonie/multix
v0.5.2 · 1 month ago
AI multimodal CLI — OpenAI, Gemini, MiniMax, OpenRouter, Leonardo, BytePlus, ElevenLabs, ffmpeg, ImageMagick, doc-to-md
No known vulnerabilities