模型
小而专用的模型,在设备端运行,每个任务一个。
可用
逐词时间戳Align
为任意转写文本提供精准的逐词时间戳。

语音增强Clear
录音棚音质,没有云端账单。

片段挑选Clips
生成短视频和高光片段。

口语语种检测Ear
凭 30 秒音频判定语言。

表情符号建议Emo
比你打字还快。

内容主题标注Gist
为帖子和文章生成主题和标签。

内容审核Moderator
上传或展示前标记裸露内容。

PII 脱敏Redact
个人信息,传出去之前就没了。

形状识别Shapes
草草一画,形状完美。

标题与描述Title
为任意文本给出标题和描述。

语言识别Tongue
三个词就能说出是哪种语言。

语气词检测Uhm
一小时音频,12 秒处理完。

语音识别Voz
在 iPhone 上 2 秒转写 10 分钟音频。


