Skip to content

Latest commit

 

History

History
1085 lines (685 loc) · 41.6 KB

File metadata and controls

1085 lines (685 loc) · 41.6 KB

更新日志 / Changelog

v4.4.0 (2026-08-02)

新增功能

  • 剪贴板附件同步:剪贴板同步新增图片与文件附件拉取;可监听指定文件夹上传新增文件,支持设置附件大小上限
  • 剪贴板文件分享:可将文件通过系统分享进行上传,并增加附件上传/下载通知
  • DashScope 新模型:DashScope 新增 Qwen-Audio-3.0-ASR-Flash 流式与非流式模型,移除旧版模型并优化语义标点处理
  • [Pro] 热词注入控制:新增热词注入控制的开关,可控制是否将热词注入支持的识别引擎

改进优化

  • 使用统计:将使用统计整合为独立的「使用统计」页面,并支持一键生成分享卡片图片
  • 界面设置:将界面风格、按键反馈、键盘布局等设置整合为独立的「UI 设置」入口
  • IME Bridge 错误处理:增强 IME Bridge 的错误处理与用户反馈提示
  • 识别历史UI:优化历史卡片与文本组件的布局与样式
  • [Pro] 畅说模式:尝试优化连续对话的会话管理与音频焦点处理,录音更稳定
  • [Pro] 热词优化:已包含目标的热词不再重复学习;DashScope 热词管理与同步增强

问题修复

  • 优化部分说明文案
  • 尝试修复输入法中出现重复流式预览的问题
  • 修复搜索空状态内容未居中的布局问题

v4.3.0 (2026-07-26)

新增功能

  • 应用快捷方式:长按应用图标可快捷进入识别设置、AI 设置与识别历史
  • Fcitx5 / Trime 剪贴板同步:AIDL 联动的 Fcitx5、Trime 修改版支持接入说点啥的剪贴板同步
  • [Pro] 自动学习热词:语音输入后修正识别结果并发送可自动学习热词;兼容修改版输入法、IME 桥接与无障碍悬浮球场景

改进优化

  • 本地模型下载:支持断点续传与本地缓存,下载更稳、中断后更易恢复
  • 下载源测速:下载源测速改用 HTTP 探测
  • 设置首页搜索:首页搜索入口与搜索栏样式优化
  • 识别历史:优化列表与详情布局
  • 本地非流式识别:长音频按静音分段渐进识别,提升本地非流式识别速度,并修复 Qwen ASR 和 FunASR Nano 的本地非流式识别长音频的报错问题
  • 配套模块更新:LSPosed IME Bridge、Fcitx5 / Trime 修改版同步更新,配合剪贴板同步与(Pro)热词学习等联动能力

问题修复

  • [Pro] AI 助手唤醒词:修复自定义唤醒词被应用语言自动同步强行覆盖的问题
  • 收起键盘停录:返回关闭键盘时正确停止录音,避免残留录音状态

v4.2.1 (2026-07-22)

新增功能

  • 剪贴板实时同步:SyncClipboard「自动接收」在服务端支持时使用 Realtime 实时同步,否则定时拉取;并可选择保持后台实时连接

改进优化

  • Target API 版本:更新 Target API 版本至 36
  • 剪贴板同步运行时:IME Bridge 剪贴板同步改为独立后台服务,不再依赖悬浮球运行
  • IME Hook 模块更新:优化输入法 Hook 模块设置开关与状态说明;录音区域可用性由桥接模块侧控制;新增多种模块设置,并支持模块设置更改实时生效
  • 设置开关说明:更多设置项在开关时展示功能说明

v4.2.0 (2026-07-20)

新增功能

  • 悬浮球长按录音:悬浮球设置新增长按录音模式,按住开始录音、松手停止
  • Cohere ASR:新增 Cohere 语音识别供应商
  • 阿拉伯语界面:应用界面新增阿拉伯语语言选项
  • 识别历史音频与重跑:识别时可缓存音频;历史详情可查看原文与最终结果,并支持重新识别或重新后处理;其他设置可配置音频保留数量
  • IME Bridge 剪贴板同步:剪贴板同步支持通过 IME Bridge,在目标输入法进程存活期间辅助同步

改进优化

  • 录音音频焦点:统一录音会话的音频焦点管理,失去焦点时更可靠地停止录音
  • 设置页交互:优化对话框退出动画,以及多处 UI 细节

问题修复

  • IME Bridge 联动:修复服务关闭时过早取消仍在收尾的会话,避免丢失待交付的识别结果

v4.1.2 (2026-07-13)

新增功能

  • 输入完成后自动回车:新增开关与扩展按键,识别(或 AI 后处理)完成后自动回车或触发发送,便于聊天应用直接发送
  • IME 桥接输入法内录音:可在兼容的第三方键盘中长按录音,并将录音交给说点啥识别(需更新 LSPosed/LSPatch 桥接模块)
  • 火山引擎新版鉴权:火山引擎 ASR 支持使用新版 API Key 鉴权方式
  • 清除剪贴板记录:其他设置支持一键清除应用内全部剪贴板历史(含置顶项)

改进优化

  • 收起后切换输入法:开启「收起后切换」时,切回后的键盘会尝试自动弹出
  • 剪贴板预览:剪贴板预览改为有限行数展示,并优化性能
  • ASR 设置文案:优化静音自动停止、备用引擎、ITN 等相关说明,表述更清晰

v4.1.1 (2026-07-08)

新增功能

  • Fun-ASR-Flash 支持:支持阿里云百炼的 Fun-ASR-Flash语音识别模型

信息更新

  • Pro 版调价:Pro 版价格从 4.49 美元调整为 5.49 美元

v4.1.0 (2026-07-05)

新增功能

  • StepAudio 端点配置:StepAudio 新增请求端点预设,支持按量付费、Coding Plan 与自定义端点
  • MiMo / StepAudio 分端点 API Key:MiMo 与 StepAudio 支持按端点预设分别保存 API Key
  • 本地备用模式:备用引擎设置新增本地备用驻留模式,可在按需加载与保持常驻之间选择
  • [Pro] 悬浮球畅说模式:Pro 版悬浮球支持畅说模式,可在悬浮球场景下持续监听与分段识别
  • [Pro] IME 桥接输入上下文:Pro 版启用 IME 桥接的悬浮球录音也可使用输入框上下文辅助 AI 后处理

改进优化

  • 悬浮球录音视觉反馈:录音时根据音量显示光晕与峰值波纹,处理中视觉同步增强
  • 备用引擎策略重构:重构备用 ASR 仲裁与超时逻辑,本地备用支持懒加载串行策略,并新增启动/识别状态提示,体验更流畅
  • VAD 判停优化:输入音量大小归一化处理,改善各引擎 VAD 表现,判停相关设置文案更清晰
  • 一键设置无障碍检测:优化无障碍服务需求判断,更准确反映悬浮球、音量键与 IME 桥接的实际配置

问题修复

  • 调试日志清理:修复关于页调试日志导出时清理功能不生效的问题
  • 备用引擎容错:空结果不再被视作调用失败,提升备用引擎切换逻辑的容错性

v4.0.3 (2026-07-02)

新增功能

  • 可见时持续录音:键盘或悬浮球可见期间在本机持续录音,按麦后更快开始识别
  • 录音超时停止:新增超时停止录音自动停止模式,并支持配置最长录音时长
  • Soniox 识别模式:Soniox 流式识别新增低延迟到高精度的灵敏度选项

改进优化

  • OpenAI 自定义端点兼容性:自定义服务不再生效非流式压缩
  • 悬浮键盘拖动把手:根据窗口底部间隙自动将拖动把手切换到顶部或底部
  • 麦克风按钮样式:去掉麦克风按钮固定方形限制,支持更灵活的自定义布局比例
  • 自定义键盘布局网格同步:调整任一面板网格大小时同步更新所有面板,并自动过滤越界按钮
  • [Pro] 畅说模式优化:尝试解决了畅说模式下触发录音前的音频被丢弃的问题
  • 优化备份设置页文字样式

问题修复

  • X-ASR 尾部音频:修复 X-ASR 流式识别停止时可能丢失尾部音频的问题
  • [Pro] Pro 备份修复:修复 Pro 版配置备份丢失部分内容的问题

v4.0.2 (2026-06-18)

新增功能

  • IME 桥接模式:新增 IME 桥接模式,通过广播与 LSPosed 模块联动实现键盘状态检测、文字插入、组合文本预览和会话管理
  • 悬浮球录音前台服务:为悬浮球录音添加 Android 14 所需的麦克风前台服务支持
  • AI 编辑系统提示词自定义:允许用户自定义 AI 编辑功能的系统提示词,留空则使用默认值

改进优化

  • Soniox 流式模型升级:升级 Soniox 流式识别模型至 stt-rt-v5
  • 无障碍相关文案优化:优化无障碍兼容性和高级功能相关字符串描述

v4.0.1 (2026-06-14)

新增功能

  • 悬浮键盘模式:支持悬浮键盘和对应控制开关
  • 宽屏优化:横屏及平板设备优化显示,并支持左右停靠
  • 标点位置跳转按钮:键盘新增基于标点位置的前后移动跳转按钮
  • fxliang 小企鹅语音联动:支持 fxliang 版小企鹅输入法通过 AIDL 调用语音识别
  • 句末标点无限制选项:句末标点与 emoji 去除阈值新增“无限制”选项

改进优化

  • Soniox 模型升级:升级 Soniox 非流式识别模型至 v5
  • 触觉反馈重构:重构触觉反馈机制并集中管理
  • 录音测试页优化:优化录音测试页的延迟颜色表现
  • [Pro] AMOLED 独立开关:将 AMOLED 模式重构为独立开关,旧模式配置自动迁移
  • [Pro] 自动更新检测优化:优化自动更新检查,关闭后可以不依赖 Play 服务

问题修复

  • 键盘底部抬高:优化部分场景下的键盘底部抬高间隙
  • ITN 优化:优化 ITN 在部分场景的表现
  • [Pro] 热词统计修复:修复热词命中次数统计与颜色分级

v4.0.0 (2026-06-07)

重大变更

  • 设置页面 Compose 迁移: 将设置页面从传统 XML 布局全面迁移至 Jetpack Compose
  • 键盘和悬浮球 UI 重构: 使用 Compose 重构键盘和悬浮球 UI,提升可维护性与渲染性能
  • 自定义键盘布局:支持在画布中自定义键盘布局和内容
  • [Pro]主题颜色系统重构: 重构主题颜色系统,添加 AMOLED 模式和多种 Monet 动态色支持

新增功能

  • MiMo ASR 在线识别: 新增 MiMo 在线 ASR 供应商支持,多模态模型与 ASR 模型
  • X-ASR 本地流式引擎: 引入 X-ASR 引擎替代 Paraformer,支持本地流式识别
  • 音量键控制录音:支持借助无障碍权限实现音量键控制录音启停
  • 录音测试与分析页面: 新增录音测试和分析页面
  • 录音模式切换拓展按钮: 新增麦克风录音模式切换拓展按钮
  • Miuix 组件库集成: 集成 Miuix 组件库以增强设置页 UI 体验
  • 句末标点去除阈值: 添加去除句末标点与 emoji 的可配置字数阈值
  • OpenAI completions 接口:OpenAI 语音识别渠道支持通过 completions 接口调用多模态模型进行转录
  • [Pro]热词增强模式: 新增基于音素的热词增强模式,基于音素匹配动态替换识别结果
  • [Pro]MiMo 上下文注入: 为 MiMo 多模态模型添加上下文注入支持
  • [Pro]正则后处理顺序选项: 添加正则表达式在 AI 后处理前执行的选项,支持功能说明对话框

改进优化

  • 本地 ITN 算法重构: 重构本地模型中文 ITN 模块,覆盖更多使用场景
  • 升级 sherpa-onnx 至 1.13.2
  • 为本地模型实现哈希完整性检查
  • 改进大量组件 UI 细节和文案
  • 优化无障碍权限检测和处理

问题修复

  • 修复 mimo-v2.5 请求体构建和响应解析
  • 优化无障碍事件处理与设置界面重组性能

v3.16.1 (2026-05-23)

新增功能

  • [Pro]输入框上下文: 在主键盘中使用时,LLM 后处理可获取输入法输入框现有文本作为上下文参考,提升改写的连贯性
  • API 日志页本地 ASR 记录: API 调用日志页新增本地 ASR 调用记录支持

改进优化

  • 空音频过滤默认关闭: 将 VAD 空音频自动取消与静音片段过滤功能默认关闭,用户可根据需求启用
  • 空音频跳过提示优化: 优化空音频跳过时的错误提示文案,区分不同跳过原因
  • 音频过滤器重写: 重写音频过滤器为基于分块的逐段分析与修剪,提升静音检测准确性
  • 本地模型加载优化: 将启动录音时同步加载本地模型的功能覆盖到外部联动场景

问题修复

  • 滑动锁定触摸事件处理: 修复麦克风按钮在滑动锁定模式下触摸事件的响应处理

v3.16.0 (2026-05-17)

新增功能

  • OpenRouter ASR 支持: 新增 OpenRouter 在线 ASR 供应商支持,支持 API Key 与模型配置
  • API 调用日志: 识别记录页新增 API 调用记录与查看页面,支持列表、筛选、搜索和详情查看
  • VAD 空音频过滤: 新增非流式识别前过滤空音频请求与去除静音片段过滤的设置,默认开启
  • 关于页识别统计: 关于页新增近 30 天在线 ASR 渠道失败率统计

改进优化

  • 新增 armv7a 打包: 支持 armv7a,并可按设备 ABI 选择安装包并增加备用下载地址,提升应用内更新下载兼容性
  • [Pro]正则编辑输入框: 将正则规则编辑界面的输入框改为常规文本输入框

问题修复

  • 识别取消处理: 在主键盘使用时,可以在后处理完成后一段时间撤回后处理的处理

v3.15.2 (2026-04-29)

新增功能

  • 非流式上传音频压缩: 新增在线非流式识别上传音频压缩选项,在服务商支持时减少传输体积和网络耗时,默认开启

改进优化

  • Gemini 3 思考配置支持: Gemini ASR 增加 Gemini 3 模型的思考配置支持,并将相关设置文案调整为降低思考强度

v3.15.1 (2026-04-26)

问题修复

  • 前台服务稳定性优化: 前台服务类型与异常处理补强,优化安卓15以上用户体验

v3.15.0 (2026-04-26)

新增功能

  • Qwen3-ASR 本地识别支持: 新增 Qwen3-ASR 0.6B 本地 ASR 供应商
  • Parakeet 本地识别支持: 新增 Parakeet 本地 ASR 引擎支持,V3版本支持多种欧洲语言,V2版本支持英语
  • StepAudio ASR 支持: 新增 StepAudio ASR 在线供应商支持

改进优化

  • 本地模型自动卸载时机: 调整预热启动成功后的自动卸载调度,改善本地模型资源管理
  • [Pro]热词支持扩展: 为 Qwen3ASR、FunASR Nano、StepAudio 增加热词功能

问题修复

  • 识别供应商标识修正: 优化 Qwen3Asr、FireRedAsr 和 Paraformer 的供应商标签
  • 识别时长统计修复: 修复部分 ASR 供应商的识别时长上报问题

v3.14.2 (2026-04-18)

新增功能

  • 阿里云百炼 Qwen3.5-Omni: 为阿里云百炼 ASR 新增 Qwen3.5-Omni Flash/Plus 模型选项

改进优化

  • 录音启动网络预热: 在录音启动阶段增加网络预热,尝试降低首次使用的网络延迟
  • 本地模型超时策略优化: 为不同本地识别引擎根据资源消耗设置不同的超时阈值
  • 保活常驻通知内容优化: 常驻通知中支持显示实时刷新的基本信息

v3.14.1 (2026-03-22)

新增功能

  • OpenAI ASR 多配置支持: 为 OpenAI ASR 添加多配置切换支持
  • FunASR Nano 语言选择: 为 FunASR Nano 添加识别语言选择功能
  • FunASR MLT Nano 模型支持: 新增 FunASR MLT Nano 变体支持

改进优化

  • FunASR Nano 中文处理优化: 启用原生 ITN,改善中文数字等文本格式化效果

v3.14.0 (2025-03-08)

新增功能

  • FireRedASR V2 引擎支持: 替换 TeleSpeech 并新增 FireRedASR V2 引擎支持

改进优化

  • 识别性能优化: 优化本地模型发现与 PCM 转换流程,减少冗余处理开销
  • 界面渲染优化: 减少冗余 UI 更新,提升界面渲染效率
  • 本地识别依赖升级: 升级 sherpa-onnx 至 1.12.28

问题修复

  • 修复悬浮球下录音状态清理问题,提升稳定性

v3.13.4 (2025-02-28)

新增功能

  • OpenAI Realtime 流式识别: 新增 OpenAI Realtime 流式语音识别支持
  • 阿里云百炼模型升级: 阿里云百炼流式识别模型版本升级至 qwen3-asr-flash-realtime-2026-02-10

改进优化

  • 兼容性提升: 降低 minSdk 至 26,支持 Android 8.0 及以上设备

v3.13.3 (2025-02-23)

新增功能

  • 初始配置引导页: 重构首次使用的初始配置引导页
  • 键盘按钮长按提示: 添加键盘按钮长按提示功能
  • 供应商配置分组: 已配置和未配置的 ASR 和 LLM 供应商分开显示
  • 备用ASR引擎超时阈值敏感度设置: 添加备用ASR引擎超时阈值敏感度设置

改进优化

  • SyncClipboard兼容性: 支持新版SyncClipboard(v3.11.1以上)

v3.13.2 (2025-02-17)

新增功能

  • 阿里云百炼 LLM 供应商: 添加阿里云百炼作为新的后处理模型供应商选项
  • [Pro]热词触发频率统计: 在热词管理界面添加热词触发计数,帮助用户优化热词列表

改进优化

  • Shizuku/Root 权限管理器: 重构 Shizuku/Root 权限管理器,提升稳定性和可维护性
  • 键盘面板稳定性: 统一不同 ROM 的输入法底部间距解析逻辑,添加底部间距预热机制以提高键盘面板的稳定性
  • Soniox 模型更新: 更新 Soniox 流式引擎模型版本至 stt-rt-v4

v3.13.1 (2025-02-09)

新增功能

  • Shizuku/Root 增强保活: 添加 Shizuku/Root 增强保活功能,提升后台运行稳定性
  • 内置提示词多语言支持: 实现内置提示词的多语言支持,提升不同语言用户的使用体验
  • LLM 测试取消: LLM 测试时可以取消以打断测试
  • [Pro]新增AI助手功能: 在 Pro 版本中添加 AI 助手功能,通过关键词触发调用
  • [Pro]热词注入优化: 启用热词注入 AI 后处理提示词后,自动基于音素匹配进行热词筛选,通过提升热词注入的准确性来优化模型后处理的效果

改进优化

  • 悬浮球录音动画: 优化悬浮球录音呼吸动画效果
  • LLM 温度设置: 更新默认温度值并简化温度标签显示

v3.13.0 (2025-02-01)

新增功能

  • 设置搜索功能: 新增设置搜索功能
  • 历史记录优化: 在历史记录中新增外部输入来源类别标识,优化处理时间显示
  • AI编辑面板优化: 为AI编辑面板添加信息栏和空格键,优化整体布局
  • Soniox模型升级: 更新Soniox ASR非流式引擎使用的模型版本至v4

改进优化

  • Soniox语言选择器优化: 优化Soniox语言选择器UI
  • UI细节优化: 粘贴板面板图标优化,调整数字键盘面板高度和边距
  • 架构重构优化: 重构键盘核心、ASR设置、悬浮球交互及设置存储模块,提升代码可维护性
  • VAD性能优化: 实现VAD实例池化,提升性能和资源利用率
  • RecognitionService增强: 改进RecognitionService服务的安全性和兼容性
  • 输入法磁贴重构: 重构输入法选择器磁贴逻辑

问题修复

  • 修复悬浮球错误状态动画和视觉效果的清理问题
  • 为流式ASR引擎补齐VAD资源释放逻辑
  • 修复AI处理失败时的识别记录处理问题

变更说明

  • 移除豆包语音双向流式和首字加速的实验性功能

v3.12.1 (2025-01-27)

新增功能

  • 悬浮球图标优化: 优化悬浮球图标和动画效果,常驻模式下贴边半隐时显示箭头把手
  • 历史记录统计增强: 增强历史记录统计信息,新增AI后处理耗时显示
  • 外部输入法联动增强: 改进外部输入法联动指引,新增支持 Trime 输入法

改进优化

  • AI后处理打字机效果: 仅在AI后处理真正生效时使用打字机动画

问题修复

  • 增加贴边锚点系统,解决横竖屏切换时悬浮球位置偏移问题
  • 修复使用安卓导航栏时选项菜单显示不全的问题
  • 修复冷启动时系统 insets 异常导致的布局问题

v3.12.0 (2025-01-20)

新增功能

  • 并行主备双引擎识别: 新增并行主备双引擎识别功能,提升语音识别准确性和可靠性
  • FunASR Nano 独立供应商: 将 FunASR Nano 从 SenseVoice 中剥离,新增为独立的 ASR 供应商
  • FunASR Nano 推理优化: 支持 FunASR Nano 完整版本,提升识别精度
  • 后处理打字机效果: 为流式 AI 后处理结果添加打字机动画效果,提升交互体验
  • 后处理打字机开关: 在后处理设置中新增打字机效果开关选项
  • 切换输入法磁贴: 新系统设置快捷磁贴,方便快速切换输入法
  • 增加供应商标签: 为语音识别供应商增加标签,帮助用户选择合适的供应商
  • [Pro] 一键删除热词: 在热词管理界面添加一键删除所有热词功能
  • [Pro] 正则后处理优化: 内置常用正则表达式模板,支持配置备注说明,优化UI

改进优化

  • 本地模型加载协调器: 引入本地模型加载协调器,优化模型加载流程,提升加载可靠性
  • 优化 ITN 效果: 优化中文数字归一化效果,提升数字识别准确性
  • Soniox 流式引擎重构: 修复 Soniox 流式引擎的若干问题
  • ASR 选项显示名称: 精简多 ASR 选项显示名称,提升界面简洁度

问题修复

  • 尝试修复 Paraformer 句尾丢字的问题
  • 避免本地模型首次加载时误触发超时

v3.11.2 (2025-01-07)

新增功能

  • 触觉反馈强度调节: 新增触觉反馈强度分级调节功能,并补全各场景的触觉反馈
  • 自定义推理参数: 新增自定义思考模式的参数配置功能
  • 前台保活服务: 其他设置页新增前台保活服务及电池优化白名单申请入口
  • 下载源测速: 下载源选择弹窗增加延迟测速显示,方便选择最快的镜像源
  • 自动检查更新: 关于页新增"自动检查更新"开关选项
  • 更新内置后处理模型列表: 为部分渠道新增多个内置后处理模型可供选择
  • [Pro] 快捷添加热词: 在安卓的长按选中文字菜单中加入"添加为热词"选项,方便快速添加热词

改进优化

  • 预置渠道拉取模型: 将拉取模型列表功能扩展到预置渠道,不再仅限于自定义渠道
  • 下载镜像源配置: 统一下载镜像源配置并简化调用逻辑

问题修复

  • 修复本地模型"配置指南"跳转按钮失效的问题
  • 修复同步总字符数时可能丢失已统计 ASR 字符的问题

v3.11.1 (2025-12-30)

新增功能

  • 火山引擎新模型支持: 新增火山引擎 DeepSeek-V3-2-251201 模型支持
  • [Pro] 应用专属 Prompt 设置: 在 AI 后处理设置中添加应用专属 Prompt 配置功能,借助无障碍能力允许为不同应用设置定制化的后处理提示词

改进优化

  • AI 后处理流式输出: 为 AI 后处理增加流式结果输出功能,用户可在等待最终结果时先看到逐步生成的文本片段,提升交互体验
  • 设置选项底部弹窗: 新增设置选项底部弹窗组件并替换原有对话框,提升交互顺畅性
  • 字数统计性能优化: 使用区间判断优化 CJK 字符检测性能,并修复部分极端文本下的统计错误问题

变更说明

  • 移除 Zipformer 引擎: 为精简本地 ASR 方案,下线 Zipformer 流式引擎。现有用户将自动迁移至 Paraformer;需在 ASR 设置中重新确认或切换模型。

v3.11.0 (2025-12-28)

新增功能

  • 应用图标更新: 更新应用图标设计并适配 Monet 动态色系统
  • 悬浮球拖动优化: 支持直接拖动移动悬浮球选项,无需长按进入拖动模式
  • 输入法切换增强: 允许手动指定切回的目标输入法,提升多输入法切换体验
  • 自定义 LLM 增强: 自定义供应商支持无需模型名配置,简化连接验证流程
  • LLM 模型列表: 为自定义后处理渠道新增「拉取模型列表」功能

改进优化

  • 图标资源重构: 重构应用图标资源结构并精简颜色定义
  • 文案优化: 明确 Play Store 兑换流程文案

问题修复

  • 修复伪流式缓冲区处理流程问题

v3.10.1 (2025-12-23)

新增功能

  • VAD 引擎升级: 将语音活动检测引擎由 Silero VAD 替换为 Ten VAD,提升静音检测准确性
  • Gemini 自定义端点: 支持自定义 Gemini API endpoint,方便使用代理或私有部署
  • 非流式降噪功能: 为非流式识别引擎添加降噪功能开关,提升嘈杂环境下的识别准确性

改进优化

  • 伪流式识别架构: 抽离 SenseVoice 与 TeleSpeech 伪流式公共逻辑至独立 Delegate,提升代码可维护性
  • 伪流式预览策略: 改用"定时分片+VAD 过滤"策略进行定时伪流式预览,优化预览效果

问题修复

  • 修复静音自动停止在本地模型伪流式模式下失效的问题
  • 修复火山引擎识别模型版本选择问题
  • 长按录音模式下禁止静音自动停录,避免误操作

v3.10.0 (2025-12-18)

新增功能

  • 本地 ASR 引擎标点功能: 在多个本地 ASR 引擎(FunASR Nano、TeleSpeech、Paraformer、Zipformer)中增加标点功能,提升离线识别的可用性
  • FunASR Nano 模型支持: 添加 FunASR Nano 模型支持
  • 通用标点模型管理: 新增通用标点模型管理系统,支持标点模型的统一管理和版本控制
  • Soniox 语言严格限制模式: 为 Soniox ASR 引擎添加语言严格限制模式选项,提升多语言环境下的识别准确性
  • Dashscope Fun-ASR 语义断句: 为 DashScope Fun-ASR 添加语义断句选项,替代 VAD 断句

改进优化

  • sherpa-onnx 升级: 升级 sherpa-onnx 至 1.12.20 版本
  • SenseVoice 模型版本调用: 优化 SenseVoice Small 模型的版本调用逻辑,确保模型加载的准确性

v3.9.4 (2025-12-16)

新增功能

  • Fun-ASR-Realtime 模型: 为 DashScope 新增 Fun-ASR-Realtime 模型支持,提升实时语音识别性能
  • 优化初始判停延迟: 提高初始判停延迟,提升语音识别的用户体验
  • 官网与文档按钮: 在关于页面新增官网和文档按钮,方便用户获取帮助和了解产品
  • [Pro] Fun-ASR-Realtime 热词适配: 为 DashScope Fun-ASR-Realtime 模型添加热词适配

改进优化

  • DashScope 模型选择器: 重构 DashScope ASR 模型选择器,优化模型管理和切换体验
  • 键盘稳定性: 确保软键盘弹出与启用状态判断的稳定性,提升输入法可靠性

问题修复

  • 本地流式模型稳定性: 修复本地流式模型的识别稳定性问题,提升识别准确性和连续性
  • 更新安装页面: 修复更新安装完成后回到应用又再次弹出安装页面的问题

v3.9.3 (2025-12-13)

新增功能

  • Fireworks AI 支持: 添加 Fireworks AI 模型提供商支持,扩展 AI 后处理能力
  • 小企鹅联动增强: 支持在小企鹅输入法中使用 SenseVoice 和 TeleSpeech 伪流式识别功能
  • 添加 AI 后处理开关: 在后处理设置页增加 AI 后处理开关

改进优化

  • AI 后处理界面优化: 将温度、阈值等数值参数改为滑块控件,提升操作体验
  • 设置界面样式统一: 调整设置可点击选择项样式

问题修复

  • 标点按钮复位: 修复标点按钮点按后不复位的问题
  • SpeechRecognizer 接口状态修复: 增加接口处理超时机制

v3.9.2 (2025-12-12)

新增功能

  • 匿名使用数据采集: 添加匿名使用统计功能,帮助改善产品体验
  • 完整使用文档: 在使用指南弹窗最下方添加完整使用文档按钮,方便用户查看详细说明

改进优化

  • 悬浮框布局优化: 重构多个悬浮框的实现方式,改进布局效果和交互体验
  • 一键设置流程优化: 改进 IME 选择器状态管理,优化轮询逻辑避免不合时宜的提示
  • 悬浮球开关控制: 修复悬浮球开关状态控制逻辑,提升功能稳定性

v3.9.1 (2025-12-11)

新增功能

  • Android 标准语音识别服务: 集成 Android 标准 RecognitionService
  • GLM-ASR 上下文提示: 为智谱 GLM-ASR 添加上下文提示参数支持,升级模型至 glm-asr-2512,提升长文本音频识别连续性
  • 更新检测添加查看历史按钮: 在更新检测对话框中添加查看更新历史按钮,方便用户了解版本变更内容
  • [Pro] 支持 GLM-ASR 热词注入:为智谱 GLM-ASR 添加热词注入功能,提升特定词汇的识别准确率
  • [Pro] 支持将热词插入后处理 Prompt:为 LLM 后处理添加热词插入功能,针对不支持热词注入的 ASR 供应商

v3.9.0 (2025-12-09)

改进优化

  • 回车键增强: 支持更多软件的回车发送消息功能
  • UI 规范化: 适配 Android 15 新 API
  • Pro 版本宣传弹窗: 为规避风险更改应用名称为说点啥(BiBi Keyboard)

v3.8.6 (2025-12-09)

新增功能

  • 智谱 GLM ASR 支持: 新增智谱 GLM 语音识别引擎支持,为下一个版本的 GLM-ASR 做准备
  • 火山引擎模型版本选择: 为火山引擎豆包 ASR 添加模型版本选择功能,支持在不同模型版本间切换
  • Pro 版本宣传弹窗: 添加 Pro 版本功能介绍弹窗,帮助用户了解专业版特性

v3.8.5 (2025-12-06)

新增功能

  • 火山引擎标准版文件识别: 新增火山引擎标准版文件识别支持,包含超时机制和详细错误处理
  • 豆包语音识别模型 2.0: 为火山引擎添加豆包语音识别模型 2.0 支持(暂不支持文件识别极速版),提升识别准确性

改进优化

  • 发布流程改进: 改进发布流程以支持中英文更新日志,提升多语言发布效率

v3.8.4 (2025-12-04)

新增功能

  • 智能超时机制: 新增首 token 超时机制和独立连接超时配置,流式失败时自动回退非流模式

改进优化

  • WebDAV 备份兼容性: 针对坚果云等 WebDAV 服务添加兼容性支持和降级处理,提升备份功能稳定性
  • 配置导入导出扩展: 新增 SiliconFlow ASR、DashScope 地区、Soniox 流式等配置项的导入导出支持

UI 改进

  • 设置页面样式优化: 统一设置页面的下拉选择器样式,采用带边框和下拉箭头的一致性设计
  • 键盘高度选择器: 键盘高度选择改用分段按钮控件,提升操作体验
  • 布局结构简化: 移除冗余的分组标题视图,优化布局间距和圆角样式

v3.8.3 (2025-12-03)

新增功能

  • 多供应商深度思考模式: 新增多供应商 LLM 深度思考模式支持,提升 AI 后处理质量
  • 内置服务提供商: 重构 LLM 供应商架构,支持内置服务提供商,扩展后处理能力

改进优化

  • AI 提示词管理系统: 重构 AI 后处理提示词管理系统,优化提示词的组织和使用,改进预置提示词

v3.8.2 (2025-12-02)

UI 改进

  • 配置指南按钮: 为本地模型设置页添加配置指南按钮
  • 跳过按钮功能: 为模型选择对话框添加跳过按钮功能

问题修复

  • 状态栏图标颜色: 修复状态栏颜色动态切换问题

v3.8.1 (2025-11-29)

UI 改进

  • 应用图标优化: 优化应用图标前景图层尺寸,提升视觉效果
  • 预测性返回动画: 为设置页面添加预测性返回动画,提升交互体验,需要安卓 13 以上版本

改进优化

  • WebDAV 备份重构: 重构 WebDAV 备份实现,提升代码质量和可维护性

v3.8.0 (2025-11-28)

新增功能

  • SiliconFlow 免费服务: 添加 SiliconFlow 免费语音识别和后处理服务支持
  • 动态超时机制: 实现基于录音时长的动态超时计算,优化长时间录音的处理体验
  • 悬浮球设置快捷入口: 为悬浮球浮动菜单添加设置按钮,方便快速访问设置

UI 改进

  • 设置页面重构: 重构设置页面布局为分组卡片设计,提升视觉层次和可读性
  • 悬浮球触摸交互: 改进悬浮球长按移动的触摸交互体验
  • 样式统一优化:
    • 统一各设置页面的文字样式定义和布局结构
    • 统一水平按钮容器的样式定义
    • 通过集中主题资源统一布局样式
  • 按钮文案优化: 优化点按模式录音手势按钮文案
  • 剪贴板同步按钮: 优化悬浮球中剪贴板同步按钮显示逻辑

v3.7.3 (2025-11-25)

新增功能

  • 录音手势控制: 添加录音按钮手势控制功能,支持左滑松手取消录音、右滑直接发送和下滑临时固定为点按录音模式
  • 波形灵敏度调节: 新增音频波形显示灵敏度调节功能,可根据个人喜好调整波形动画的灵敏度
  • DashScope 模型升级: DashScope 流式识别引擎升级为 Qwen3-ASR-Flash-Realtime 模型,提升识别速度和准确性
  • [Pro] 热词管理更新: 为 Qwen3-ASR-Flash-Realtime 模型添加热词管理功能

v3.7.2 (2025-11-23)

新增功能

  • 模型选择引导: 添加模型选择引导功能,帮助新用户快速选择合适的语音识别模型
  • [Pro] 畅说模式: 新增畅说模式支持(Pro 版本)

改进优化

  • 重构构建配置,移除多变体构建,清理开源代码库

文档更新

  • 更新项目 logo 图片资源
  • 更新 README 文档和图片资源

v3.7.1 (2025-11-17)

新增功能

  • TeleSpeech 本地离线识别: 新增基于 sherpa-onnx 的 TeleSpeech 本地 ASR 引擎,支持 int8/fp32 模型,提供完整的模型管理、预加载和自动卸载功能
  • TeleSpeech ITN 支持: 为 TeleSpeech 引擎添加逆文本规范化(Inverse Text Normalization)功能,支持将"一千零一"等口语化表达转换为"1001"等书面形式
  • 本地模型伪流式识别: 为 SenseVoice 和 TeleSpeech 本地模型添加伪流式语音识别支持,通过 VAD 在停顿处分片,先进行小片段识别预览,会话结束后再对整段音频进行最终识别
  • ElevenLabs 流式识别: 新增 ElevenLabs 实时流式语音识别支持,可在设置中选择流式或非流式模式
  • 键盘主题配色优化: 深色模式添加专用按键背景,浅色模式统一使用 colorSurface 提升对比度,键盘容器背景改为 colorSurfaceVariant 增强层次感
  • [Pro] 自定义配色功能: 新增多套预设配色方案,支持系统配色跟随和自定义配色切换
  • 状态文本跑马灯效果: 为长状态消息添加跑马灯滚动效果,确保完整信息可见
  • 错误信息自动复制: 检测到错误信息时自动复制到剪贴板,方便用户反馈问题

问题修复

  • 修复 TeleSpeech 模型下载时缺少进度通知的问题
  • 修复伪流式识别引擎在会话结束后未正确清理预览片段的问题
  • 修复 ElevenLabs WebSocket URL 构建问题并优化转写处理逻辑
  • 修复剪贴板面板背景色不一致的问题

v3.7.0 (2025-11-14)

新增功能

  • 功能说明系统增强: 为 ASR 设置、后处理、悬浮球及其他设置开关添加统一的功能说明弹窗系统
  • 扩展按钮优化:
    • 添加静音判停的扩展按钮功能
    • 添加收起键盘扩展按钮并将粘贴板按钮进行固定
  • 剪贴板功能增强: 添加云端剪贴板文件拉取支持
  • 悬浮球改进: 为识别记录文本面板添加分页加载功能

改进优化

  • 优化默认设置以改善用户体验
  • 将功能说明字符串按类别整理到对应的子字符串文件,便于管理

问题修复

  • 修复悬浮球常驻模式下部分场景不自动半隐的问题
  • 修复部分颜色系统问题
  • 改进 Zipformer XL fp16 本地模型文件解压检测逻辑并修复下载取消功能
  • 修复弹出后处理提示词或供应商选择菜单导致输入法意外收起的问题

v3.6.8 (2025-11-13)

新增功能

  • 本地模型导入: 为所有语音识别模型添加本地文件导入功能
  • 功能说明系统: 添加输入设置的功能说明弹窗系统

改进优化

  • 将模型下载和导入格式从 tar.bz2 迁移到 zip 格式
  • 将"ASR 设置"翻译更新为"语音识别设置"
  • 默认翻译资源改为英文

问题修复

  • 优化 AI 后处理使用状态跟踪

v3.6.7 (2025-11-10)

新增功能

  • 外部联动增强: 添加外部输入法联动使用指引,优化使用指南内容
  • Pro 版本更新: 为 Pro 版本添加专门的更新对话框

问题修复

  • 优化 AI 后处理返回空文本时的回退逻辑

v3.6.6 (2025-11-10)

新增功能

  • AI 后处理优化: 添加按字数阈值自动跳过 AI 后处理功能
  • Pro 双重识别: 为联动时的火山引擎渠道添加双重识别支持
  • 联动功能增强: 联动调用时添加识别统计和历史记录

问题修复

  • 修复语音预设失效问题
  • 修复悬浮球在带系统栏设备上的位置越界问题

v3.6.5 (2025-11-09)

新增功能

  • Pro 正则后处理: 添加正则表达式后处理功能(Pro 版本)

改进优化

  • 优化粘贴功能实现
  • 重构标点按键 UI 并替换供应商切换按钮图标

v3.6.4 (2025-11-09)

新增功能

  • 三级撤销: 支持三级撤销功能
  • 供应商快捷切换: 重构标点按钮布局并添加供应商切换功能
  • 悬浮球位置重置: 新增悬浮球位置重置功能
  • 外部语音服务: 新增外部语音服务 PCM 推送模式支持

改进优化

  • 移除外部语音服务对无障碍权限的依赖
  • 移除外部语音服务对悬浮球功能的依赖
  • 优化软键盘弹出时的界面适配
  • 移除 fcitx5-android-lexi-keyboard 子模块依赖

v3.6.3 (2025-11-08)

新增功能

  • 在一键设置流程中添加通知权限检查

问题修复

  • 修复键盘缩放时麦克风位置偏移和底部裁剪问题
  • 修复 AI 编辑面板的麦克风交互
  • 修复阿里云百炼流式语音识别停止时的资源竞争问题

改进优化

  • 移除冗余的异常捕获并优化代码结构
  • 移除外部语音服务权限声明
  • 更新重要通知以支持小企鹅输入法的语音识别能力

v3.6.2 (2025-11-08)

新增功能

  • AIDL 联动: 添加外部输入法 AIDL 联动支持
  • Pro 更新控制: 为 Pro 渠道添加更新检查禁用支持

改进优化

  • 统一语音识别后处理逻辑
  • 统一外部语音服务配置来源
  • 统一部分动态颜色定义

问题修复

  • 修复反射调用中的类型转换和空安全处理

v3.6.1 (2025-11-07)

新增功能

  • 隐私控制: 新增隐私控制开关,支持禁用识别历史和使用统计
  • LLM 内容过滤: 过滤 LLM 响应中的 think 标签内容

改进优化

  • 优化更新对话框中的发布页面跳转交互
  • 更新剪贴板和撤销按钮图标

v3.6.0 (2025-11-07)

新增功能

  • 剪贴板历史管理: 添加剪贴板历史管理面板功能
  • 自定义键盘按钮: 增加可自定义的键盘按钮
  • 音频波形动画: 添加实时音频波形动画功能
  • 扩展按钮行: 添加键盘扩展按钮行并重构状态显示区域
  • 键盘空格文本: 增加键盘空格文本显示
  • Pro 繁体转换: 添加 Pro 功能-繁体中文转换占位

改进优化

  • 更新扩展按钮默认配置和默认值处理
  • 优化拓展按钮的数字面板按钮返回逻辑和选择模式功能
  • 增强剪贴板同步提示和面板信息预览体验
  • 移除设置页面按钮色块样式
  • 添加 WaveLineView 开源库引用和许可证信息

v3.5.2 (2025-11-06)

改进优化

  • 拆分各语言字段便于管理
  • 为模型解压添加进度显示功能
  • 统一 ASR 供应商显示逻辑

v3.5.1 (2025-11-05)

新增功能

  • Zipformer 引擎: 新增 Zipformer 本地流式语音识别引擎支持
  • Paraformer 引擎: 新增 Paraformer 本地流式语音识别引擎
  • ITN 支持: 为 Paraformer 和 Zipformer 引擎添加 ITN(Inverse Text Normalization)支持

改进优化

  • 移除 SenseVoice 伪流式识别模式
  • 优化英文字符统计
  • 添加 Zipformer 模型信息说明文本

v3.5.0 (2025-11-05)

新增功能

  • Android 15 支持: 升级到 Android 15 targetSDK
  • DashScope 增强:
    • DashScope 流式识别改为使用 Fun-ASR 模型
    • 添加 DashScope 地域选择支持
    • 集成 DashScope Java SDK 实现本地文件直传,优化 Qwen 模型非流式识别速度
  • 双重识别: 为火山引擎流式识别添加双重识别占位支持(Pro)
  • 调试功能:
    • 添加音频采集和 ASR 引擎的调试日志记录
    • 添加非流式识别请求耗时统计与展示
  • 应用内更新: 实现应用内下载安装包和安装功能
  • 键盘功能:
    • 添加键盘面板自动启动录音功能
    • 添加当前版本信息对话框
  • 开源致谢: 添加开源项目致谢与许可证展示
  • Pro 版本 UI: 添加 Pro 版本 UI 注入功能
  • Soniox 增强: 添加 Soniox ASR 引擎的上下文注入功能(Pro)

改进优化

  • 添加压缩混淆规则,优化打包体积
  • 伪流式识别动态处理间隔,尝试降低长录音处理压力
  • 为更新检查添加重要提示样式支持
  • 优化识别记录全选效果
  • 实现统一的颜色管理

问题修复

  • 修复录音时长统计读取方式
  • 修复 APK 安装权限授权后自动继续安装功能
  • 修复悬浮球视图状态管理问题
  • 修复悬浮球错误状态复位问题
  • 修复处理中旋转视图在视图不可见的问题
  • 调整键盘视图按钮与信息栏的间隔
  • 限制粘贴板预览为单行显示避免布局破坏
  • 修复长按模式下快速点按后卡在识别状态的问题

说明: 本更新日志基于 Git 提交记录自动生成,包含版本 v3.5.0 至 v3.6.7 的主要变更内容。