全部模型
audio
text
vision
小而专用的模型,在设备端运行,每个任务一个。
为任意转写文本提供精准的逐词时间戳。
录音棚音质,没有云端账单。
生成短视频和高光片段。
凭 30 秒音频判定语言。
比你打字还快。
为帖子和文章生成主题和标签。
个人信息,传出去之前就没了。
草草一画,形状完美。
为任意文本给出标题和描述。
三个词就能说出是哪种语言。
一小时音频,12 秒处理完。
在 iPhone 上 2 秒转写 10 分钟音频。
连拍四十张,只留一张。
按人搜索,不用服务器。
上传或展示前标记裸露内容。
带类型的 JSON,不用校验层。
仇恨言论,发出去之前就拦下。
一场访谈,拿回来就能剪。