55,653 packages matching “speech generation”
@ai-sdk/elevenlabs
v3.0.46 · 2 days ago
The **[ElevenLabs provider](https://ai-sdk.dev/providers/ai-sdk-providers/elevenlabs)** for the [AI SDK](https://ai-sdk.dev/docs) contains speech generation plus batch and realtime transcription support for the ElevenLabs APIs.
No known vulnerabilities
@ai-sdk/fish-audio
v3.0.23 · 2 days ago
The **[Fish Audio provider](https://ai-sdk.dev/providers/ai-sdk-providers/fish-audio)** for the [AI SDK](https://ai-sdk.dev/docs) contains speech generation (S1 and S2 models) and speech-to-text transcription support.
No known vulnerabilities
@launchmaniac/dsh-media-tools
v0.2.1 · 28 days ago
OpenRouter image, video, and speech generation as dsh tools, shipped as an out-of-tree profile bundle
No known vulnerabilities
@ai-sdk/cartesia
v3.0.40 · 2 days ago
The **[Cartesia provider](https://ai-sdk.dev/providers/ai-sdk-providers/cartesia)** for the [AI SDK](https://ai-sdk.dev/docs) contains Sonic 3.5 speech generation, Ink-Whisper batch transcription, and Ink 2 realtime and streaming transcription support.
No known vulnerabilities
@guanghechen/kit-tts
v0.1.7 · 2 months ago
Text-to-speech generation CLI
No known vulnerabilities
@felores/kie-ai-mcp-server
v5.0.0 · 28 days ago
MCP server for Kie.ai APIs: image, video, music and speech generation across Nano Banana, Veo3, Suno, ElevenLabs, ByteDance, Qwen, Runway, Midjourney, Wan, MiniMax H3, Kling, GPT Image 2, Flux Kontext, Recraft, Ideogram, Topaz, HappyHorse and more.
No known vulnerabilities
egaki
v0.10.0 · 1 month ago
AI image, video, and speech generation CLI with MDX-to-video framework
No known vulnerabilities
@runapi.ai/gemini-tts
v0.1.3 · 1 month ago
RunAPI Gemini TTS SDK for multi-speaker speech generation in JavaScript, Python, Ruby, Go, Java, and PHP
No known vulnerabilities
@imagent/cli
v0.3.2 · 2 months ago
Local-first image, video, and speech generation CLI for imagent.
No known vulnerabilities
node-red-contrib-gemini
v1.0.3 · 9 months ago
Node-RED nodes for Google Gemini AI integration including text generation, chat, vision, image generation, speech generation, and audio understanding capabilities
No known vulnerabilities
@mokuyoaxis/dsh-iris
v0.1.4 · 11 days ago
Multi-provider image, video, and speech generation, transcription, visual understanding, and prompt optimization with an integrated Iris workbench for DeepSeek Harness.
No known vulnerabilities
@runapi.ai/fish-audio
v0.3.0 · 1 month ago
RunAPI Fish Audio SDK for account-owned voice resources and speech generation in JavaScript, Python, Ruby, Go, Java, and PHP
No known vulnerabilities
speak-mcp
v0.1.0 · 4 months ago
MCP server for text-to-speech generation with Gemini TTS
No known vulnerabilities
expo-speech-recognition
v57.1.0 · 5 days ago
Speech Recognition for React Native Expo projects
No known vulnerabilities
microsoft-cognitiveservices-speech-sdk
v1.51.0 · 2 months ago
Microsoft Cognitive Services Speech SDK for JavaScript
No known vulnerabilities
@google-cloud/speech
v8.1.0 · 13 days ago
Cloud Speech Client Library for Node.js
No known vulnerabilities
react-speech-recognition
v4.0.1 · 1 year ago
Speech recognition for your React app
No known vulnerabilities
@hmanlab/hl-plugins
v0.5.3 · 2 months ago
One-command installer for curated OpenCode plugins. Adds image, video, music, and speech generation to your coding agent without leaving the chat. MIT, no telemetry.
No known vulnerabilities
node-edge-tts
v1.2.10 · 7 months ago
node-edge-tts is a module that using Microsoft Edge's online TTS (Text-to-Speech) service on the Node.js
No known vulnerabilities
@andy-toolforge/tts-generator
v0.5.0 · 2 months ago
Toolforge domain: text-to-speech generation using Gemini TTS models — script segmentation, multi-voice, batch/stream/single output
No known vulnerabilities