独立设计并完成「AI 语音输入助手」桌面端工具的全流程开发与交付。该项目基于 Python 技术栈,核心采用 Faster-Whisper medium 模型实现本地化语音识别,无需联网即可精准将用户语音转换为文字,充分保护隐私。系统通过 sounddevice 进行实时音频采集,结合 pynput 实现全局自定义快捷键(F1-F12)的监听与触发,采用按住说话、松手识别的交互逻辑,零学习成本。识别完成后,通过 pyperclip 与 pyautogui 自动将文字写入剪贴板并模拟粘贴至当前输入窗口,兼容 Chatbox、微信、钉钉等主流沟通工具。前端界面使用 Tkinter 构建,采用卡片式布局,集成实时状态指示灯与识别进度条,视觉反馈清晰。项目最终通过 PyInstaller 打包为独立 exe 文件,可在无 Python 环境的 Windows 设备上双击运行。整个项目从需求分析、技术选型、编码实现到测试打包均由我独立完成,已形成可交付的完整产品。