爱答把语音识别与语音合成全部放在手机本地完成,对话内容只在生成时离开设备; 消息发出后由后台独立完成,网络恢复自动补齐。安卓 App 与网页版,同一套体验。
说一句话,爱答就在你的手机上把事做完——打开应用、点按输入、看屏幕、发消息、设闹钟。 动作全部在手机本地执行,为理解界面只把当前屏幕截图用于当次判断。
“帮我打开微信”“调出 WLAN 设置”“打开日历看看最近忙不忙”。系统应用(日历/联系人/时钟…)按手机品牌自动识别,不用告诉它包名。
控件树精确定位 + 截图视觉兜底;中文输入走“无障碍粘贴 / 输入法剪贴板”双通道,微信搜索框这类自定义控件也能把字送进去。
每一步都“看一眼”再动:截图确认点对了才继续,点错/弹窗挡住会自己退回重来,不靠瞎猜坐标。
“打开微信给某某发‘你好’”:找到联系人、写内容、点发送,全程截图可见;中途你随时可以叫停。
搜索商品、选规格、加入购物车,走到订单确认页就停下——付款永远留给你本人,它不会替你付。
“明早 7 点半叫我”“30 分钟后提醒我”:一句话设置好,到点用系统闹钟铃声 + 振动提醒,不用去点时钟界面。
一条语音指令,爱答在手机上自己看屏幕、自己操作,做完回来汇报结果。
“给文件传输助手发一条消息”——打开微信、找到会话、写入文字、点发送、确认气泡,全程自动。
“在京东和拼多多比价机械键盘,选便宜的”——跨应用搜索、看价格、进订单确认页即停,付款永远留给人。
六个真正影响日常使用的亮点,都是别家「云语音」做不到或做不好的地方
语音识别与音频合成全部端侧离线运行,飞机上、地铁里都能用,声音数据不上传。
消息一发出,后台就独立把回答生成完;网络恢复后自动续传,长回答一个字不会重复或缺失。
零样本声音克隆:内置「自然」与「正常」两套音色,设置里一点即换。
拍照、相册、PDF、Word、Excel、PPT 直接丢进来就能总结问答;扫描件也能按图片识别。
自动判断是否需要搜索,实时抓取网页并附来源整理答案;新闻、价格、比分都问得住。
同一套交互:长按输入框说话、短按打字,消息下带复制与重新生成,历史会话侧边栏随手切换。