NEWS / ARCHIVE · 多模态与端侧

AIHOT ARCHIVE

Launch HN:Speko(YC S26)——面向语音 AI 的 OpenRouter。

AIHOT 于 2026-08-18 收录了“Launch HN:Speko(YC S26)——面向语音 AI 的 OpenRouter”这一公开动态。以下先呈现从来源页面抓取的正文,再给出 AIHOT 摘要与 TopoReduce 编辑解读。

PUBLIC SOURCE CONTENT

公开原文内容

已抓取公开正文

The router for voice models | Speko

Backed by Y CombinatorBacked by Y CombinatorBacked by Y Combinator→The Router for Voice AI
Every speech model, benchmarked language by language, wired into one API.
Get API keyCompare models

Router
Which model to call, per language and per objective, decided from published measurements instead of a vendor's English leaderboard.

Benchmark coverage by language
Speech-to-textSpeech-to-text
Text-to-speechText-to-speech

ModelENARFRDEHINBESTATE
Nova-3

stt-rt-v5

GPT-4o Transcribe

GPT-4o-mini Transcribe

Qwen3-ASR

Chirp 3

Ink-Whisper

Pulse Pro

Whisper-1

Nova-2

Gradium ASR

Grok STT

Ink-2

Pulse

Realtime STT-1bench

Scribe v2 Realtime

Solaria-1

Universal-3.5 Pro

Velma 2

Flux

GPT Live Transcribe

Show all 21 models↓

Score against cost, per stage
Speech-to-textSpeech-to-text
LLMLLM
Text-to-speechText-to-speech
Speech-to-speechSpeech-to-speech

Accuracy (WER)
$0.0010$0.01602.0%11.0%Realtime STT-13.3% · $0.0025
Universal-3.5 Pro2.0% · $0.0075
Velma 24.4% · $0.0010
GPT-4o Transcribe2.3% · $0.0060
GPT-4o-mini Transcribe2.7% · $0.0030

Cost ($/min)

#ModelWER▲batchCost▼/ min
1Universal-3.5 Proassemblyai:universal-3-5-pro
2.0%$0.0075
2GPT-4o Transcribeopenai:gpt-4o-transcribe
2.3%$0.0060
3GPT-4o-mini Transcribeopenai:gpt-4o-mini-transcribe
2.7%$0.0030
4Qwen3-ASRalibaba:qwen3-asr-flash
2.8%$0.0054
5Realtime STT-1inworld:inworld-stt-1
3.3%$0.0025
6Chirp 3google:chirp_3
3.9%$0.0160
7Velma 2modulate:velma-2-stt-streaming-english-v2
4.4%$0.0010
8Grok STTxai:stt
4.8%$0.0033
9Solaria-1gladia:solaria-1
5.0%$0.0125
10Pulsesmallest:pulse
5.1%~$0.0050
11stt-rt-v5soniox:stt-rt-v5
7.5%$0.0020
12Gradium ASRgradium:default
8.4%$0.0104
13Nova-3deepgram:nova-3
9.8%$0.0048
14Ink-2cartesia:ink-2
11.0%$0.0090
—Fluxdeepgram:flux-general-en
—$0.0065
—Scribe v2 Realtimeelevenlabs:scribe_v2_realtime
—$0.0065
—GPT Live Transcribeopenai:gpt-live-transcribe
—$0.0170

Show all 17 models↓

Gateway
One base URL and one key in front of every provider, speaking the API your framework already calls.

Run and observe your voice workers
Speko speaks the OpenAI API, so the frameworks you already use need a hostname and a model string.

- LiveKitTypeScriptPoint the OpenAI plugin at the gateway. The agent code is unchanged.

- PipecatPython

- Claude / CursorMCP
copyimport { defineAgent, voice } from '@livekit/agents';
import * as openai from '@livekit/agents-plugin-openai';

const key = process.env.SPEKO_API_KEY!;
const baseURL = 'https://api.speko.ai/v1';

export default defineAgent({
entry: async (ctx) => {
const session = new voice.AgentSession({
stt: new openai.STT({ apiKey: key, baseURL, model: 'auto' }),
llm: new openai.LLM({ apiKey: key, baseURL, model: 'auto' }),
tts: new openai.TTS({ apiKey: key, baseURL, model: 'auto' }),
});
await session.start({ agent: new voice.Agent({ ... }) });
},
});

Point your agent at Speko

MCPMCPcurlcurl

$claude mcp add --transport http speko https://mcp.speko.ai/mcp

Read the docsGet API key

AIHOT 摘要

Speko(YC S26)推出面向语音 AI 的模型路由服务,覆盖 10 种语言、61 个语音与语言模型。它针对非英语场景进行评测,并将每次会话路由到实际表现最优的模型,弥补现有基准测试仅用英语评估的缺口。

为什么值得关注

语音模型普遍以英语基准评测,Speko 把选型依据从通用榜单转向具体语种表现,对多语言语音产品团队有参考价值。

工程化解读

从 TopoReduce 的工程视角看,这条信息属于“多模态与端侧”主题。它的价值不只在于一个新产品或新观点本身,还在于说明 AI 系统正在如何影响模型接入、智能体协作、研发流程、基础设施和团队决策。实际采用前,应结合原文确认版本、适用范围、价格和运行条件。

  • 发布时间:2026-08-18;AIHOT 分类:多模态与端侧。
  • AIHOT 标签:产品更新评测/基准语音
  • AIHOT 判断:语音模型普遍以英语基准评测,Speko 把选型依据从通用榜单转向具体语种表现,对多语言语音产品团队有参考价值。
  • AIHOT 评分:38;评分用于站内排序,不等同于独立评测结论。

TopoReduce 编辑观察

当 AI 动态进入真实生产环境,团队需要同时关注能力边界、数据来源、调用成本、权限控制和可回滚性。把单条新闻放回完整工程链路中阅读,比只看标题更有助于判断它是否适合自己的产品和工作流。

来源链路AIHOT 条目:Launch HN:Speko(YC S26)——面向语音 AI 的 OpenRouter公开原文:The router for voice models | Speko
← 返回全部文章News 首页 →

把 AI 动态放回工程现场。

了解 TopoReduce 的模型路由、工具集成和研发自动化能力。

建立合作连接