# LJ_input **Repository Path**: yangchangling/lj_input ## Basic Information - **Project Name**: LJ_input - **Description**: LJ_input:专注于输入法优化与创新的开源项目,提供高效、精准的文本输入解决方案,支持多语言和设备。 - **Primary Language**: Unknown - **License**: Not specified - **Default Branch**: master - **Homepage**: None - **GVP Project**: No ## Statistics - **Stars**: 0 - **Forks**: 0 - **Created**: 2026-04-06 - **Last Updated**: 2026-06-07 ## Categories & Tags **Categories**: Uncategorized **Tags**: None ## README # 智语输入 - 极简版 一个集成语音录制、识别、AI润色和文本输出于一体的智能化语音输入工具。 **版本现状:** 当前版本(1.0)的录音功能仅支持中文语音识别。 **优化方向:** 该功能在以下方面仍有较大提升空间: 1. 输入语音的识别准确率; 2. 识别处理速度; 3. 支持的识别语言类型。 ## 功能特点 - 🎤 **语音录制** - 支持多种录音库(sounddevice / PyAudio) - 🔊 **语音识别** - 使用 Vosk 离线语音识别模型,支持中文 - 🤖 **AI 润色** - 集成 DeepSeek AI,自动优化识别文本 - ⌨️ **智能输出** - 一键将润色后的文本输出到光标位置 - 🖥️ **图形界面** - 简洁易用的 GUI 界面 ## 项目结构 ``` lj_input/ ├── main.py # 主程序入口 ├── .env # 环境变量配置(不提交到 git) ├── .env.example # 环境变量配置示例 ├── config/ │ └── config.py # 配置文件 ├── resources/ │ └── models/ # 语音识别模型目录 │ └── vosk-model-small-cn-0.22/ ├── temp/ # 临时文件目录 ├── requirements.txt # 依赖包列表 └── README.md # 项目说明文档 ``` ## 环境要求 - Python 3.8+ - Windows 操作系统 ## 安装步骤 ### 1. 克隆或下载项目 ```bash cd lj_input ``` ### 2. 安装依赖 ```bash pip install -r requirements.txt ``` ### 3. 配置环境变量 复制 `.env.example` 为 `.env` 并填入您的 DeepSeek API 密钥: ```bash cp .env.example .env ``` 然后编辑 `.env` 文件,填入您的 API 密钥: ```env DEEPSEEK_API_KEY=your_actual_api_key_here DEEPSEEK_BASE_URL=https://api.deepseek.com ``` ### 4. 下载语音识别模型(如未包含) 本项目已包含 Vosk 中文小模型,如需更换或下载其他模型: 1. 访问 [Vosk 模型下载页](https://alphacephei.com/vosk/models) 2. 下载所需模型(推荐 `vosk-model-small-cn-0.22`) 3. 解压到 `resources/models/` 目录下 ## 使用方法 ### 启动程序 ```bash python main.py ``` ### 操作流程 1. **开始录音** - 点击「🎤 开始录音」按钮开始录制语音 2. **结束并识别** - 点击「⏹️ 结束并识别」停止录音并进行识别 3. **AI 润色** - 程序自动使用 DeepSeek AI 优化识别文本 4. **输出文本** - 点击「📤 输出到光标处」将润色后的文本粘贴到当前光标位置 ## 配置说明 ### 环境变量配置(推荐) 通过 `.env` 文件配置敏感信息(API 密钥等),避免硬编码在源码中: | 环境变量 | 说明 | 默认值 | |----------|------|--------| | `DEEPSEEK_API_KEY` | DeepSeek API 密钥 | 无(必填) | | `DEEPSEEK_BASE_URL` | DeepSeek API 地址 | `https://api.deepseek.com` | ### 其他配置 如需修改其他配置,编辑 `config/config.py` 文件: | 配置项 | 说明 | 默认值 | |--------|------|--------| | `VOSK_MODEL_PATH` | Vosk 模型路径 | `resources/models/vosk-model-small-cn-0.22` | | `WINDOW_TITLE` | 窗口标题 | `智语输入 - 极简版` | | `WINDOW_SIZE` | 窗口大小 | `600x500` | ## 技术栈 - **GUI**: tkinter - **录音**: sounddevice / PyAudio - **语音识别**: Vosk - **AI 润色**: DeepSeek API (通过 openai 库) - **键盘模拟**: pynput ## 依赖列表 - `sounddevice>=0.4.6` - 录音库(推荐) - `numpy>=1.24.0` - 数值计算 - `vosk>=0.3.45` - 语音识别 - `openai>=1.0.0` - DeepSeek API 客户端 - `pynput>=1.7.6` - 键盘输入模拟 - `python-dotenv>=1.0.0` - 环境变量加载 ## 注意事项 1. **API 密钥**: 请在 `.env` 文件中配置您的 DeepSeek API 密钥,不要将密钥提交到代码仓库 2. **模型文件**: 确保 Vosk 模型文件存在于指定路径 3. **权限**: 首次运行可能需要麦克风权限 ## 许可证 本项目仅供学习和个人使用。 --- - 开发者:YangCL - 开发时间:2026-04-07 - 联系邮箱:[y819719608@163.com] **智语输入 - 让语音输入更智能!**