发布时间:2026/8/14 16:48:06
25美元把普通眼镜秒变AI智能眼镜:OpenGlass 保姆级 DIY 全指南 25美元把普通眼镜秒变AI智能眼镜OpenGlass 保姆级 DIY 全指南【免费下载链接】OpenGlassTurn any glasses into AI-powered smart glasses项目地址: https://gitcode.com/GitHub_Trending/op/OpenGlassOpenGlass 是一个开源智能眼镜方案只需不到 25 美元的现成零件——一块 ESP32 S3 开发板、一颗小电池、一个 3D 打印的眼镜支架——就能把任何一副普通眼镜改造成能识别人物、翻译文本、记录生活的 AI 智能终端。它最大的卖点不是贵而是可破解固件、前端、AI 模型全部开源新手能跑通老手能魔改。先算一笔账一副会思考的眼镜凭什么只值 180 块把会思考拆开看其实就是三件事看摄像头采集画面、想AI 模型理解图像、答把结果展示或播报给你。市面上的智能眼镜动辄几千元是因为它把这三件事打包成了封闭硬件。OpenGlass 的做法相反——它只提供神经和骨架零件作用大致成本Seeed Studio XIAO ESP32 S3 Sense集成了摄像头、麦克风、蓝牙的大脑约 20 美元3.7V 250mAh 锂电池供电能撑数小时约 3 美元3D 打印眼镜支架把零件固定在眼镜腿上约 2 美元合计不到 25 美元折合约 180 元人民币——相当于两杯精品咖啡的钱换来的是一副能看懂世界的眼镜。而看懂这件事本身靠的是你口袋里可能已经有的 GPU 或云 API。一个新手的第一天从克隆代码到戴上眼镜的 8 小时下面以时间线的方式记录一个零基础玩家从零跑通 OpenGlass 的全过程。你会发现每一步其实都有明确的目的地。第 1 小时先把说明书拿到手打开终端把项目拉到本地并安装依赖git clone https://gitcode.com/GitHub_Trending/op/OpenGlass cd OpenGlass yarn install # 或 npm install项目是 ExpoReact Native应用依赖不多装起来很快。装完先别急着跑去认两个人——哦不两个角色。第 2 小时认识大脑和脸面两个角色OpenGlass 的软件栈分两层理解之后一切都顺了firmware/firmware.ino神经中枢这是烧录到 ESP32 S3 上的 Arduino 固件负责初始化摄像头、麦克风通过蓝牙BLE把画面和声音流式传给电脑或手机。它内部还预留了三种音频编码Opus / Mulaw / PCM你可以像换挡一样切换注释来适配不同客户端。sources/目录思考中枢前端拿到画面后交给sources/agent/Agent.ts处理——先把照片送进视觉模型生成文字描述再把多张描述汇总让大模型回答你的问题。简单说固件负责采集Agent 负责理解。第 3~5 小时烧录固件最容易翻车的一段用 Arduino IDE 打开firmware/firmware.ino选择XIAO_ESP32S3开发板后必须先做一个关键设置点击顶部菜单 工具 → PSRAM改为OPI PSRAM。这一步不做烧录后大概率直接内存不足崩溃——这是新手踩得最狠的坑之一。如果你习惯命令行也可以用arduino-cli编译上传arduino-cli compile --build-path build --output-dir dist \ -e -u -p COM5 -b esp32:esp32:XIAO_ESP32S3:PSRAMopi其中COM5换成你机器上识别到的端口可用arduino-cli board list查看。烧录成功后开发板会以OpenGlass为名广播蓝牙信号等着被认领。第 6 小时给眼镜准备本地大脑图像理解需要一个视觉模型。OpenGlass 默认支持 Ollama 本地推理拉一个轻量级模型ollama pull moondream:1.8b-v2-fp16moondream 只有 1.8B 参数普通笔记本就能跑是项目默认推荐的开箱模型。想更强还可以换llava-llama3或llava:34b-v1.6——代价是更吃显存。第 7 小时填密钥启动OpenGlass 的 API 密钥统一放在sources/keys.ts它会从环境变量读取// sources/keys.ts —— 三个服务的密钥入口 export const keys { groq: process.env.EXPO_PUBLIC_GROQ_API_KEY ?? , // Groq极快的 LLM 问答 ollama: process.env.EXPO_PUBLIC_OLLAMA_API_URL ?? , // Ollama本地视觉模型地址 openai: process.env.EXPO_PUBLIC_OPENAI_API_KEY ?? , // OpenAI语音/图像增强 };把EXPO_PUBLIC_GROQ_API_KEY等变量写进项目根目录的.env文件或直接改成字面量然后启动yarn start # 或 npm start浏览器会打开一个本地页面点击Connect to the device系统会自动搜索名为OpenGlass的蓝牙设备——这一步由sources/modules/useDevice.ts实现用的是 Web Bluetooth。第 8 小时戴上它向世界提问一切就绪后眼镜看到的每一帧画面都会被描述成文字你可以像聊天一样追问我刚才看到的路牌上写着什么我面前这个人穿的是什么颜色的外套——回答来自 Groq 上的大模型sources/agent/imageDescription.ts里能看到完整的提示词设计。3 分钟定位关键文件OpenGlass 目录导读文件一句话作用你需要改吗README.md项目总览与官方指南必读firmware/firmware.ino摄像头/麦克风初始化 BLE 传输优化时再动sources/keys.tsGroq / Ollama / OpenAI 密钥配置必须配置sources/agent/Agent.ts照片→描述→问答的核心流程想改交互就研究它App.tsxExpo 应用入口连接设备界面基础使用不用碰prompts/generate.ts批量测试各视觉模型效果的脚本选模型时用新手必看3 个高频坑及解法找不到.envAPI 调用一直失败新版项目不再强制.env密钥统一在sources/keys.ts配置——要么直接填字面量要么补一个.env文件声明三个EXPO_PUBLIC_*变量改完重启yarn start。固件上传报端口未找到先确认 USB 线是数据线而非纯充电线Windows 上到设备管理器确认 COM 端口号再用arduino-cli board list核对设备是否被系统识别。若识别正常仍失败换一根线或换一个 USB 口通常能解决。图像识别卡顿、半天没反应大概率是模型太重了。优先使用moondream:1.8b-v2-fp16这类轻量模型并通过prompts/generate.ts在本地跑一轮模型擂台赛用数据决定去留。进阶玩法让 AI 模型打擂台OpenGlass 附赠了一个非常贴心的工具——prompts/generate.ts。它会读取prompts/series_1/下所有测试图片依次用 moondream、llava-llama3、llava:34b 等模型生成描述并输出成同名.md报告yarn prompts相当于给每个模型发同一套考题谁答得准一目了然。下面这张就是官方测试数据集里的真实画面——多人协作测试智能眼镜原型的现场选好模型后把sources/agent/imageDescription.ts里的默认模型名一换你的眼镜就算换了脑子。这就是开源方案的魅力每一次升级都是改一行代码的事。写在最后你的下一副眼镜由你定义从 25 美元零件到一副能看、能想、能答的 AI 眼镜OpenGlass 把智能穿戴的门槛从几千元降到了两杯咖啡。它不完美——蓝牙传输有延迟、模型选择需要折腾但正因为不完美才给了每个 DIY 爱好者参与和改造的空间。如果你也动心了去 clone 一份代码、烧一次固件、戴上它问世界第一个问题吧也欢迎提交 PR让下一版 OpenGlass 有你的签名。【免费下载链接】OpenGlassTurn any glasses into AI-powered smart glasses项目地址: https://gitcode.com/GitHub_Trending/op/OpenGlass创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

相关新闻

2026/8/14 16:48:06

盘点,8 款适合线上线下一体化进销存系统

本文要点:线上线下一体化是零售、批发、电商融合型企业的核心诉求——线上订单要自动扣减线下库存,门店销售要实时同步线上可售数量。本文以轻流的多渠道库存同步能力为参照,盘点 8 款主流进销存系统在线上线下一体化方面的适配差异&#xff…

2026/8/14 16:43:06

现代 CSS 升级,要给旧 WebView 留基础布局

现代 CSS 升级,要给旧 WebView 留基础布局 引入 subgrid、动态视口单位之前,先看目标浏览器与 WebView 覆盖范围。新语法能让代码更干净,但不能拿旧环境的基本可用性换这点整洁。 升级时把现代实现作为渐进增强,并保留能工作的 Gr…

2026/8/14 17:53:20

3分钟上手BilibiliDown:B站视频离线下载与批量保存实战指南

3分钟上手BilibiliDown:B站视频离线下载与批量保存实战指南 【免费下载链接】BilibiliDown (GUI-多平台支持) B站 哔哩哔哩 视频下载器。支持稍后再看、收藏夹、UP主视频批量下载|Bilibili Video Downloader 😳 项目地址: https://gitcode.com/gh_mirr…

2026/8/14 17:53:20

Web命令执行漏洞靶场实战:从原理到利用的攻防演练

这次我们来看一个 Web 命令执行漏洞的靶场环境与实战分析项目。对于从事 Web 安全、渗透测试或 CTF 竞赛的开发者来说,命令执行漏洞是必须掌握的核心攻防点。这个项目提供了一个聚焦于 Web 命令执行漏洞的实战环境,旨在帮助学习者从原理到利用&#xff0…

2026/8/14 17:48:20

ASAP高级应用:细胞核检测与定量分析的 step-by-step 实例

ASAP高级应用:细胞核检测与定量分析的 step-by-step 实例 【免费下载链接】ASAP Program for the analysis and visualization of whole-slide images in digital pathology 项目地址: https://gitcode.com/gh_mirrors/asa/ASAP ASAP(Automated S…

2026/8/14 4:27:24

如何快速生成中国车牌图片:Python开源工具完整指南

如何快速生成中国车牌图片:Python开源工具完整指南 【免费下载链接】chinese_license_plate_generator 中国车牌生成器 项目地址: https://gitcode.com/gh_mirrors/ch/chinese_license_plate_generator 中国车牌生成器是一个基于Python的开源项目&#xff0c…

2026/8/14 4:27:24

当 LLM 遇见大文档:主流开源项目如何处理上下文超限

从 Agentic Loop 到 Repo Map,七种策略与六类陷阱引言:128K vs 10MB 的硬冲突 2026 年的 LLM 上下文窗口已达到 128K ~ 1M token(≈ 0.5MB ~ 4MB 文本),但 LLM 想要处理的真实数据规模远远超过这个量级:真实…

2026/8/14 0:00:09

Flutter与OpenHarmony实现剧本杀组队表单开发实战

1. 项目概述在移动应用开发领域,跨平台框架Flutter因其高效的开发体验和出色的性能表现,已经成为众多开发者的首选。而OpenHarmony作为新兴的操作系统平台,其开放性和灵活性为开发者提供了全新的可能性。本文将聚焦于一个实际应用场景——剧本…

2026/8/14 0:00:09

VSCode高效Git管理:从入门到实战技巧

1. 为什么选择VSCode进行Git代码管理作为微软推出的轻量级代码编辑器,Visual Studio Code(简称VSCode)已经成为全球开发者使用率最高的编辑器之一。根据2023年Stack Overflow开发者调查,VSCode的市场占有率高达74.48%。它内置的Gi…

2026/8/14 4:27:24

实测才敢推 AI论文网站 2026最新测评与推荐

2026年真正好用的AI论文网站,核心看生成的论文质量、低AI味、格式正确、学术适配四大指标。综合实测,千笔AI、ThouPen、豆包、DeepSeek、Grammarly 是当前最值得推荐的梯队,覆盖从免费到付费、从中文到英文、从文科到理工的全场景需求。一、综…

2026/8/14 4:27:24

2026必备!AI论文网站测评:最新推荐与深度对比

2026年真正好用的AI论文网站,核心看生成的论文质量、低AI味、格式正确、学术适配四大指标。综合实测,千笔AI、ThouPen、豆包、DeepSeek、Grammarly 是当前最值得推荐的梯队,覆盖从免费到付费、从中文到英文、从文科到理工的全场景需求。 一、…

2026/8/14 4:27:24

摆脱论文困扰!盘点2026年全网爆红的的AI论文写作工具

一天写完毕业论文在2026年已不再是天方夜谭。2026年最炸裂、实测能大幅提速的AI论文写作工具,覆盖选题构思、文献整理、内容生成、格式排版等核心场景,真正帮你高效搞定论文难题。 一、全流程王者:一站式搞定论文全链路(一天定稿首…