PUSHI G1 AI+AR 眼镜开源技术方案
在人工智能(AI)与增强现实(AR)技术深度融合的产业浪潮中,深圳企业率先完成从单一硬件供给到全链条系统生态布局的关键跨越,推出 AI+AR 眼镜应用开放平台。该平台打破行业壁垒,兼容不同厂家的 AI/AR 眼镜技术方案,解决当前市场核心痛点——市面上多数 AI/AR 眼镜方案局限于自有品牌闭环,未开放音视频推拉流 SDK 接口,导致开发者难以基于现有硬件二次开发。
作为平台核心支撑,PUSHI G1 AI 眼镜开源技术方案构建'硬件 + 软件+API+SDK'全栈开放体系,覆盖 1 人创业团队、高校科研小组、学生创新创业项目等各类开发者群体,提供低门槛、高自由度、高兼容性的二次开发环境,推动 AI+AR 技术从专业领域走向个体创新。方案深度联动腾讯云、阿里云、高德地图等主流平台 API,形成'硬件适配 - 算法调用 - 场景落地'全链条支撑。

一、PUSHI G1 AI 眼镜开源技术方案核心能力解析
PUSHI G1 AI+AR 眼镜采用瑞芯微专为机器视觉与边缘 AI 应用量身打造的 RockIVA RV1106B 芯片,依托芯片原生 AI 算力与平台开源特性,形成'开放接口 + 核心技术 + 算力支撑'三大核心优势。
(一)核心优势一:开放视频推流 SDK,支持多场景二次开发与多模大模型对接
SDK 开放是个体开发者与中小企业实现创意落地的核心前提,也是方案适配通义、豆包等多模态大模型对接的关键基础。PUSHI G1 方案重点开放视频推流、音频处理相关 SDK 接口,兼容主流传输协议与多模大模型 API(含阿里通义千问多模态 API),降低开发成本,提升场景适配灵活性。
1. 视频推流核心技术与协议规范
视频推流是 AI+AR 眼镜实现'第一视角采集 - 云端分析-AR 反馈'的核心链路,方案支持 RTMP 主流协议与多场景串流技术,兼顾低延迟、高清晰度与带宽适配性。
1.1 RTMP 协议(主流首选方案)
- 协议格式:rtmp://live.example.com/app/your-stream-key(标准化格式,兼容主流云端视频服务平台)
- 关键配置:
- 分辨率:默认 1080p@30fps,移动场景可自适应降至 720p@30fps
- 码率:Wi-Fi 6 环境下 4-6Mbps,移动网络下 800-1200kbps
- 编码方式:支持 H.265 与 H.264 双编码
- 延迟控制:Wi-Fi 6 环境下≤350ms,5G SA 独立组网环境下≤220ms

产业级实现要点:
- 网络配置:需在防火墙中放行 UDP 1935 端口
- 安全规范:Stream Key 单次有效最长 72 小时;所有公开视频流需嵌入不可见数字水印
1.2 串流技术(AI 眼镜与电脑/手机多端协同)
针对多设备协同开发与应用场景,方案支持三种主流无线串流方案:
- Miracast 串流:适配 Windows 系统,适合工业培训、内容创作
- Wi-Fi Direct 串流:通用型方案,兼容 Windows、Android、iOS 多系统
- 第三方软件串流:兼容 Rokid App 等主流 AR 辅助软件
2. 音频处理核心技术
结合 AI+AR 眼镜'解放双手、沉浸式体验'的核心需求,方案整合五大核心音频技术:






