| 版本 | 修订日期 | 修改内容 | 备注 |
|---|---|---|---|
| V1.0 | 2025-06-03 | 梳理语音交互套件信息,正式对外 |
1. 概述
语音交互套件SDK文档主要用于用户购买语音交互套件后,可通过该文档快速部署语音交互套件的代码,同时通过该文档可进行TRON1搭载语音交互套件的仿真和真机部署。
2. 仿真与真机部署
提示:
Jetson orin nx(下称开发板) 在出厂时已安装Ubuntu22.04系统,且开发板IP地址固定为:10.192.1.3。
2.1 搭建硬件环境
取出语音交互套件,将电源线插入机器人24V电压输出端口,再将以太网线插入机器人以太网口,机器人开机,等待英伟达开发板网口灯光亮起,可开始进行环境搭建。
2.2 搭建开发板(Jetson orin nx)环境
2.2.1 搭建开发板环境
安装下面环境时,可直接在开发板插上显示器和网线进行环境部署,也可通过用户电脑连接TRON1 WiFi SSH进行环境搭建,这里我们推荐采用无线连接。
-
使用SSH进行环境搭建时,需确保用户电脑与开发板在同一IP网段。
-
打开用户电脑本地终端,输入下指令。
ssh guest@10.192.1.3 #密码:123456
nmcli dev wifi list #开发板安装环境时需连接网络
sudo nmcli dev wifi connect "wifi名称" password "密码" #wifi名称和密码需根据用户自行定义
#连接成功后,会显示 Device 'wlan0' successfully activated with “设备号”
ping www.baidu.com #执行百度可ping通
- 也可同步下载vs code,在vs code中的Remote Exploer中输入命令和密码,便可直接进行代码开发。
2.2.2 搭建Python环境
- 搭建python开发环境:我们推荐使用Ubuntu 22.04的python 3.10环境。为了方便开机自启动,建议在原生环境上进行部署,但是当您在进行调试和开发时,请在conda环境进行,避免破坏ubuntu系统。以下为如何在原生环境中实现部署。
- 在用户电脑终端中输入下命令进行依赖库安装。
ssh guest@10.192.1.3 #密码:123456
sudo su
sudo apt upgrade
sudo apt update
sudo apt dist-upgrade
sudo apt install -y nano cmake curl python3-dev python3-pip libpython3-dev build-essential zlib1g-dev libncurses5-dev libgdbm-dev libnss3-dev libssl-dev libreadline-dev libffi-dev libsqlite3-dev wget libbz2-dev liblzma-dev libncursesw5-dev libreadline6-dev libsqlite3-dev tk-dev uuid-dev python3-dev libncurses5-dev libdb-dev libgdbm-dev libgdbm-compat-dev curl portaudio19-dev libgirepository1.0-dev libopenblas-dev cuda-toolkit nvidia-jetpack libportaudio2 libportaudiocpp0 portaudio19-dev git-lfs tar aptitude sysvinit-utils
- 安装PiP。
mkdir -p /home/guest/tron #需要在sudo环境下
cd /home/guest/tron
curl https://bootstrap.pypa.io/get-pip.py -o get-pip.py
sudo python3 get-pip.py
# 升级 setuptools、packaging 和 pip
pip install --upgrade setuptools packaging pip wheel #升级 setuptools、packaging和pip
- 安装Jetson管理工具jetpack。
- Jetpack是一个NVIDIA按需提供的一体化软件包,捆绑并安装了适用于NVIDIA Jetson 嵌入式平台的所有开发用软件工具。
ssh guest@10.192.1.3 #密码:123456
sudo apt upgrade #需要在sudo环境下
sudo apt update
sudo apt dist-upgrade
sudo apt install nvidia-jetpack
sudo -H pip3 install -U jetson-stats
- 拉取github代码并下载相关Python库。
git clone https://github.com/limxdynamics/tron1-agent.git
cd tron1-agent #需要在sudo环境下
sudo apt-get remove -y python3-blinker
sudo apt-get remove -y python3-sympy
pip install -r requirements.txt -i https://pypi.tuna.tsinghua.edu.cn/simple
mkdir -p /home/guest/tron/tron1-agent/tools/pynini && cd /home/guest/tron/tron1-agent/tools/pynini
wget https://www.openfst.org/twiki/pub/FST/FstDownload/openfst-1.8.2.tar.gz && tar -zxvf openfst-1.8.2.tar.gz && cd openfst-1.8.2
./configure --enable-grm --enable-static --enable-shared --host=arm-linux-gnueabihf && make -j$(nproc) && make install && sudo ldconfig
echo 'export CPLUS_INCLUDE_PATH="/usr/local/include:$CPLUS_INCLUDE_PATH"' >> ~/.bashrc
echo 'export LIBRARY_PATH="/usr/local/lib:$LIBRARY_PATH"' >> ~/.bashrc
echo 'export LD_LIBRARY_PATH="/usr/local/lib:$LD_LIBRARY_PATH"' >> ~/.bashrc
source ~/.bashrc
pip install setuptools==62.3.4
pip install pynini==2.1.5 -i https://pypi.tuna.tsinghua.edu.cn/simple
pip install WeTextProcessing==1.0.3 --no-deps -i https://pypi.tuna.tsinghua.edu.cn/simple
mkdir -p /home/guest/tron/tron1-agent/tools/torch && cd /home/guest/tron/tron1-agent/tools/torch
# jetpack6 and cuda12.6
wget https://github.com/limxdynamics/tron1-agent/releases/download/v1.0.0/torch-2.8.0-cp310-cp310-linux_aarch64.whl
wget https://github.com/limxdynamics/tron1-agent/releases/download/v1.0.0/torchaudio-2.8.0-cp310-cp310-linux_aarch64.whl
wget https://github.com/limxdynamics/tron1-agent/releases/download/v1.0.0/torchvision-0.23.0-cp310-cp310-linux_aarch64.whl
pip install torch-2.8.0-cp310-cp310-linux_aarch64.whl
pip install torchaudio-2.8.0-cp310-cp310-linux_aarch64.whl
pip install torchvision-0.23.0-cp310-cp310-linux_aarch64.whl
mkdir /home/guest/tron/tron1-agent/tools/spacy && cd /home/guest/tron/tron1-agent/tools/spacy
wget https://github.com/limxdynamics/tron1-agent/releases/download/v1.0.0/en_core_web_trf-3.8.0-py3-none-any.whl
wget https://github.com/limxdynamics/tron1-agent/releases/download/v1.0.0/zh_core_web_trf-3.8.0-py3-none-any.whl
pip install en_core_web_trf-3.8.0-py3-none-any.whl
pip install zh_core_web_trf-3.8.0-py3-none-any.whl -i https://pypi.tuna.tsinghua.edu.cn/simple
pip install scipy --upgrade -i https://pypi.tuna.tsinghua.edu.cn/simple
- 拉取模型(只提供默认配置的模型地址,其余自己探索)。
cd /home/guest/tron/tron1-agent/models
modelscope download --model iic/SenseVoiceSmall --local_dir SenseVoiceSmall
modelscope download --model BAAI/bge-small-zh --local_dir rag/bge-small-zh
modelscope download --model BAAI/bge-small-en --local_dir rag/bge-small-en
modelscope download --model iic/speech_fsmn_vad_zh-cn-16k-common-pytorch --local_dir fsmn_vad
git lfs install
sudo apt-get install git-lfs
mkdir -p translation/Helsinki-NLP
cd translation/Helsinki-NLP
git clone https://huggingface.co/Helsinki-NLP/opus-mt-zh-en
git clone https://huggingface.co/Helsinki-NLP/opus-mt-en-zh
cd ../.. && mkdir -p tts/piper && cd tts/piper #退出至models文件夹
#相关模型地址 https://huggingface.co/rhasspy/piper-voices/tree/v1.0.0
wget https://huggingface.co/rhasspy/piper-voices/resolve/v1.0.0/en/en_US/amy/medium/en_US-amy-medium.onnx
wget https://huggingface.co/rhasspy/piper-voices/resolve/v1.0.0/en/en_US/amy/medium/en_US-amy-medium.onnx.json
wget https://huggingface.co/rhasspy/piper-voices/resolve/v1.0.0/zh/zh_CN/huayan/medium/zh_CN-huayan-medium.onnx
wget https://huggingface.co/rhasspy/piper-voices/resolve/v1.0.0/zh/zh_CN/huayan/medium/zh_CN-huayan-medium.onnx.json
2.2.3 下载大模型
- 新打开终端,下载大模型。
ssh guest@10.192.1.3 #密码:123456
sudo su
cd /home/guest/tron
curl -fsSL https://ollama.com/install.sh | sh
#选择合适的模型,例如qanwen3:1.7b
ollama run modelscope.cn/unsloth/Qwen3-1.7B-GGUF
2.2.4 配置拾音模块
- 运行以下程序。
ssh guest@10.192.1.3 #密码:123456
sudo su
nano /etc/asound.conf
- 运用#全部注释下红框内容。
- 检查拾音模块是否已接入开发板,已接入可直接运行以下程序。
ssh guest@10.192.1.3 #密码:123456
ll /dev #执行完指令可看到 ttyACM0
- 查找到 ttyACM0 后可以为拾音模块进行规则配置。
cd /home/guest/tron/tron1-agent/tools/iflytek
sudo chmod +x iflytek.sh
sudo bash iflytek.sh
- 配置完上述指令,断开拾音模块电源3秒,然后重新插上。
ssh guest@10.192.1.3 #密码:123456
ll /dev #执行完指令可看到 wheeltec_mic,表示规则已配置完成
- 配置完成后,运行以下程序。
sudo apt update
sudo apt install libcjson-dev
- 打开/etc/ld.so.conf,在文件末尾添加以下内容。
sudo nano /etc/ld.so.conf
/usr/local/lib #添加内容
- 保存(Ctrl + X)退出,然后执行。
sudo /sbin/ldconfig
- 检查音频设备是否配置成功。
cd /home/guest/tron/tron1-agent/tools/iflytek
python check.py
- 设置唤醒词。
cd /home/guest/tron/tron1-agent/tools/iflytek
python change_wakeup.py --keyword "xiao3 chuang4 xiao3 chuang4" --threshold 500
- 当唤醒词配置完成后,重新将拾音模块插拔断电3秒,然后上电执行下步骤。
2.3 检测环境
- 在终端运行以下程序。
ssh guest@10.192.1.3 #密码:123456
sudo su #输密码
cd /home/guest/tron/tron1-agent
python main.py
- 如果听到播放”你好呀,我是小创!“则程序部署成功。
2.4 搭建仿真环境
提示:
提示
若是语音交互套件已安装至真机上,则无需运行仿真环境,可直接运行自启动程序。
-
下载并解压
-
配置运行环境
- 可以通过以下命令配置运行环境:
# 安装UV 工具
sudo apt install curl libwebsockets-dev
curl -LsSf https://astral.sh/uv/install.sh | sh && bash
# 进入到解压后的目录
cd tron_simulator
# 创建python虚拟环境
uv venv .venv
# 安装python 3.8
source .venv/bin/activate
uv python install 3.8
uv venv --python 3.8
# 安装limxsdk
source .venv/bin/activate
uv pip install limxsdk-3.0.17-py3-none-any.whl
- 运行Tron Simulator
cd tron_simulator
sudo bash start.sh
2.5 开机自启动
- 输入以下命令
chmod +x /home/guest/tron/tron1-agent/start.sh
sudo cp /home/guest/tron/tron1-agent/tools/auto_start/tronagent.service /etc/systemd/system/tronagent.servce
sudo systemctl enable tronagent.service
sudo systemctl daemon-reload
- 关闭终端,重新将机器人开机,等待约1min后,设备出现“你好呀,我是小创”,则表示自启动成功。