WorkBuddy 是全能 AI 工作台,一人指挥,全行业专家执行,从策略到交付一站搞定
免部署·安装即用 | 多专家·多模型协同 | 全平台·桌面 / 主流 IM / 小程序
安装登录教程:https://share.note.youdao.com/s/XVe6PxNP
折叠
WIN10以上系统适用,支持AI自动裁剪,合并及OCR识别!
使用说明:
1、开启手机传图,微信扫一扫,连续拍摄身份证正反面
2、打印预览-导出单页PDF、导出图片、导出OCR信息
折叠
AI 语音识别助手 (VoiceAssistant)软件简介本软件是一款基于本地化 AI 模型(ONNX Runtime)构建的桌面级高性能语音识别与处理工具,纯CPU运行。它集成了先进的语音活动检测(VAD)、自动语音识别(ASR)以及智能标点预测(PUNC)三大核心模型,致力于为用户提供极低延迟的实时语音输入、沉浸式的会议记录以及高效的音视频批量转写体验。
主要功能 (Core Features)
极速实时语音输入 (全局快捷键)
用户只需按住 F2 键即可随时随地进行录音,松开即刻完成极速识别。 识别结果将通过“闪现注入”技术(模拟 Ctrl+V)自动且无痕地输入到当前激活的软件窗口中,同时完美保护并复原用户的历史剪贴板内容。
沉浸式会议记录模式
开启后,软件将在后台持续拾音,托盘图标会开启红色“呼吸灯”效果提示运行状态。 会议结束后,系统会在桌面自动生成一份带有精准时间戳的会议纪要(TXT格式)以及一份完整的高保真会议原声录音文件(WAV格式),确保信息一字不漏。
音视频批量转写与字幕生成
支持选择单个文件或整个文件夹进行批量离线转写,兼容 mp4、wav、mp3、mkv 等十余种主流音视频格式。 处理完成后,将在原文件同目录下自动生成纯文本(TXT)和带时间轴的标准字幕文件(SRT)。
自动下载模型
内置模型检查下载机制。当首次运行或发现核心文件缺失时,软件会自动通过 ModelScope 拉取所需的 Int8 量化模型(如 Paraformer 和 FSMN),默认下载到model文件夹。
纯本地化与隐私安全
所有核心 AI 算力(ASR、VAD、标点恢复)均依赖本地 ONNX Runtime 引擎独立完成,无需将音频数据上传云端,充分保障用户的隐私数据与会议机密安全。
折叠