mirror of
https://github.com/Nezumi-2711/9router.git
synced 2026-09-22 20:00:47 +00:00
- 71 registry files: flat `media.*Config.models` → `models[]` with `kind` field - `media` wrapper removed → serviceKinds, *Config fields promoted top-level - `type` field renamed to `kind` (llm/image/tts/stt/embedding/embedding/video/music) - providers/index.js: PROVIDER_MEDIA now built from flat top-level media fields - shared/constants/providers.js: buildProviderEntry reads flat top-level media fields - route /v1/models: modelKind() uses kind||type; removed subConfig merge block - models/info route: removed sub-config fallback lookup (all models in PROVIDER_MODELS) - ttsProviders/index.js: synthesizeViaConfig reads tts models from PROVIDER_MODELS - test-models route, helpers.js, validate route: kind||type compat - Baselines: PROVIDERS 62/62 ✅, Alias 90/90 ✅ Co-authored-by: Cursor <cursoragent@cursor.com>
53 lines
2.0 KiB
JavaScript
53 lines
2.0 KiB
JavaScript
// TTS provider registry
|
|
import googleTts from "./googleTts.js";
|
|
import edgeTts, { fetchEdgeTtsVoices } from "./edgeTts.js";
|
|
import localDevice, { fetchLocalDeviceVoices } from "./localDevice.js";
|
|
import elevenlabs, { fetchElevenLabsVoices } from "./elevenlabs.js";
|
|
import openai from "./openai.js";
|
|
import openrouter from "./openrouter.js";
|
|
import gemini, { fetchGeminiVoices } from "./gemini.js";
|
|
import { FORMAT_HANDLERS } from "./genericFormats.js";
|
|
import { parseModelVoice } from "./_base.js";
|
|
|
|
// Special providers with custom synthesize() logic
|
|
const SPECIAL_ADAPTERS = {
|
|
"google-tts": googleTts,
|
|
"edge-tts": edgeTts,
|
|
"local-device": localDevice,
|
|
elevenlabs,
|
|
openai,
|
|
openrouter,
|
|
gemini,
|
|
};
|
|
|
|
export function getTtsAdapter(provider) {
|
|
return SPECIAL_ADAPTERS[provider] || null;
|
|
}
|
|
|
|
// Generic config-driven dispatcher (uses ttsConfig.format)
|
|
export async function synthesizeViaConfig(provider, text, model, credentials) {
|
|
const { AI_PROVIDERS } = await import("@/shared/constants/providers");
|
|
const cfg = AI_PROVIDERS[provider]?.ttsConfig;
|
|
if (!cfg) return null;
|
|
const handler = FORMAT_HANDLERS[cfg.format];
|
|
if (!handler) return null;
|
|
const apiKey = credentials?.apiKey;
|
|
if (cfg.authType !== "none" && !apiKey) throw new Error(`${provider} API key required`);
|
|
const { PROVIDER_MODELS } = await import("open-sse/config/providerModels.js");
|
|
const ttsModels = (PROVIDER_MODELS[provider] || []).filter(m => (m.kind || m.type) === "tts");
|
|
const defaultModel = ttsModels[0]?.id || "";
|
|
const { modelId, voiceId } = parseModelVoice(model, defaultModel, "", ttsModels);
|
|
return handler({ baseUrl: cfg.baseUrl, apiKey, text, modelId, voiceId });
|
|
}
|
|
|
|
// Voice fetchers (used by /api/media-providers/tts/voices route)
|
|
export const VOICE_FETCHERS = {
|
|
"edge-tts": fetchEdgeTtsVoices,
|
|
"local-device": fetchLocalDeviceVoices,
|
|
elevenlabs: fetchElevenLabsVoices,
|
|
gemini: fetchGeminiVoices,
|
|
};
|
|
|
|
// Re-export for backward compat
|
|
export { fetchEdgeTtsVoices, fetchLocalDeviceVoices, fetchElevenLabsVoices, fetchGeminiVoices };
|