- 中文
- EN


智能对讲与情绪识别,长记忆能力,声源定位,多模态识别
智能对讲与情绪识别,长记忆能力,声源定位,多模态识别


一款智能桌面陪伴机器人,适用于玩具、智能音箱、智能中控等需要大模型赋能的语音交互类产品。设备搭载 ESP32-S3-WROOM-1 模组,配备 1.85 寸 QSPI 圆形触摸屏与双麦阵列,支持离线语音唤醒与声源定位算法。结合大模型能力,可实现双向语音交互、多模态识别与智能体控制,为开发者打造完整的端侧 AI 应用体验提供坚实基础。
主动识别用户的意图与情绪变化,基于大模型的语义理解能力,结合语气、词义与上下文语境进行综合判断,并通过拟人化的动态表情与语音反馈进行响应,进一步增强设备的情感表达能力与人格化特征。
支持对用户多轮对话内容的持续记录,能够记住用户的姓名、偏好、常用语句等核心信息,并在后续交互中予以调用,实现更贴近用户使用习惯的个性化体验,提升设备作为"情感陪伴体"的交互价值。
结合电机控制模块与双麦克阵列,可实现 180° 范围内的精准方向跟踪。用户每一次语音唤醒,设备均可自动识别声源方位并配合旋转底座进行视觉对视,使交互过程更具沉浸感与自然感。
支持自定义语音角色,可灵活切换音色与风格,打造属于你的专属 AI 语音形象。支持角色语音 DIY,语音体验更自由、更具个性。
支持 MCP 协议与 Function Call 能力,能够对接本地智能设备,实现远程控制、任务下发及状态反馈等功能。作为智能家居系统中的本地控制中枢,为用户提供稳定高效的边缘控制能力和开放的拓展接口。
深度结合大模型平台,支持 Amazon Nova、OpenAI、小智 AI、Gemini 等多种大模型服务,为开发者提供灵活选择。
结合语音、触摸屏交互,并能通过 IMU 传感器感知设备的姿态变化,实现更丰富的互动方式。
视壮科技是领先的 AI 智能机器人硬件产品及整体解决方案提供商。凭借 14 年 OEM/ODM 服务经验、产品与服务覆盖 60 多个国家和地区、为近 1 亿家庭提供服务,我们提供从产品设计、结构开发、软件定制到量产交付的全链条解决方案。
A: 设备深度结合主流大模型平台,支持 Amazon Nova、OpenAI、小智 AI、Gemini 等多种服务,开发者可根据自身产品灵活选择。
A: 它是基于 ESP32-S3-WROOM-1 模组的开发者就绪平台,为构建完整的端侧语音交互体验提供坚实基础。同时我们支持完整的 OEM/ODM 定制,可将其打造为你的成品产品。
A: 支持。双麦克风阵列支持离线语音唤醒与声源定位,可在 180° 范围内精准跟踪方向,唤醒环节无需联网。
A: 可以。设备支持自定义语音角色,音色与风格可灵活切换。作为一站式 OEM/ODM 合作伙伴,我们可从结构设计到软件集成,为你定制外观、界面与功能。
A: 支持 2.4 GHz Wi-Fi 和 Bluetooth 5 (LE),配备 microSD 卡插槽(最大 32GB)、USB-C(供电/下载),以及磁吸连接器和 Pogo pin 用于功能扩展。
A: 支持。凭借 MCP 协议与 Function Call 能力,可对接本地智能设备,实现远程控制、任务下发与状态反馈,作为智能家居系统中的本地控制中枢。
A: MOQ 视定制程度与配置而定。请将项目详情发送给我们的团队,我们将根据你的目标数量提供定制报价。
ESP32-S3-WROOM-1-N16R16VA(16MB Flash + 16MB PSRAM)
2.4 GHz Wi-Fi 和 Bluetooth 5 (LE)
1.85 英寸 QSPI 圆形触摸屏,分辨率 360×360
内置 3W 单声道扬声器;双 LMA3729T381-OY3S 麦克风阵列,支持离线语音唤醒与声源定位
microSD 卡插槽(最大支持 32GB)
BMI270 6 轴惯性测量单元(IMU),用于姿态感知
USB-C(供电/下载)、磁吸连接器(功能扩展)、Pogo pin
兼容 5V DC 和 3.7V 锂电池供电(典型容量 700mAh),支持通过 USB-C 充电
全双工语音交互、多模态识别、大模型应用支持、旋转底座联动
©2011-2025 视壮科技有限公司粤ICP备17154177号