免费获取学习方案
ARTICLE DETAIL

资讯详情

深耕编程基础知识与建站技术分享的一线实战洞察。

会思考的眼镜离你有多远?OpenGlass开源智能眼镜体验手记

会思考的眼镜离你有多远?OpenGlass开源智能眼镜体验手记 会思考的眼镜离你有多远OpenGlass开源智能眼镜体验手记【免费下载链接】OpenGlassTurn any glasses into AI-powered smart glasses项目地址: https://gitcode.com/GitHub_Trending/op/OpenGlass你有没有过这样的瞬间明明和对方聊得很开心转头却忘了对方叫什么走进陌生的街道想查点什么只能掏出手机路过一块招牌字太小看不清。如果这些看见能被一副眼镜悄悄记下来再由AI替你翻译成文字、总结成答案生活会轻松多少这就是 OpenGlass——一个把普通眼镜变成 AI 智能眼镜的开源项目而全部硬件成本还不到 25 美元约25元人民币。它到底解决了什么问题简单说OpenGlass 想做的事是让任何一副眼镜都拥有看见并理解的能力。你戴上它摄像头拍下眼前的画面AI 模型在本地或云端分析图片然后把结果告诉你——眼前是谁、招牌上写了什么、这个场景正在发生什么。市面上不是没有智能眼镜但动辄几千上万的售价加上封闭的系统和厂商牢牢攥在手里的数据让大多数人只能围观。OpenGlass 反着来硬件用现成的开源组件代码全部开源AI 模型随你挑隐私数据可以留在自己手里。它更像一个眼镜改装套件而不是一台被设计好的消费电子产品。你可以把它想成给眼镜装上一台会认东西的小电脑而不是买一台戴在脸上的手机。三个最打动人的细节25元的硬件藏着认真的取舍整套硬件清单极其朴素一块 XIAO ESP32 S3 开发板带摄像头和麦克风十几元、一块 250mAh 的小电池三元上下、一个 3D 打印的眼镜夹。总价控制在 25 美元以内绝大多数零件电商平台都能买到。这块 ESP32 S3 看起来小却集成了摄像头接口、蓝牙、Wi-Fi 和足够跑本地模型的算力。最妙的是固件设计——它通过蓝牙低功耗把拍到的照片和录到的声音传给手机 AppAI 计算在手机或服务器端完成眼镜本体只需负责看和听功耗自然低一天一充都嫌多。这不是为了便宜而便宜而是把每一分钱都花在刀刃上的务实做法30万像素的摄像头对 AI 识别绰绰有余高分辨率反而徒增功耗和延迟。一个场景四种 AI 任你选项目作者在 prompts 目录里做了一件很较真的事他们用同一批实拍照片跑了四个不同的 AI 模型做描述对比。看同一个室内场景Moondream 会老老实实说一个人坐在桌前看手机LLaVA-Llama3 会绘声绘色地补充卷发青年穿着灰衬衫房间里有一根白色管道而 34B 参数的 LLava 甚至会推测这里可能是火车站。同一只眼睛换上不同的大脑看到的世界细节完全不同。这意味着你可以按场景换模型想要快速响应就上轻量级的 Moondream想要细致的场景理解就换 LLaVA想在本地跑保护隐私就在自己电脑上部署 Ollama。OpenGlass 把 AI 的选择权完全交给了你而不是替你决定。上图为 OpenGlass 项目测试集的实拍画面之一四个 AI 模型分别对它生成了不同详略度的场景描述。不仅会看还会答OpenGlass 不止是拍照描述它内置了一个 Agent 智能体你拍的每一张照片都会被自动转成文字描述存档然后你可以直接对它提问——我刚才见到的那个人穿了什么颜色的衣服这个房间里有几个人它会翻遍你积累的视觉记忆给出基于事实的回答而不是凭空想象。换句话说它给了你一副有记忆的眼睛。5分钟快速上手跟着走就行整个上手过程比想象中简单基本是刷固件 装 App 配模型三步准备硬件买一块 XIAO ESP32 S3或任何带摄像头的 ESP32S3 板子打印或找一个能夹在镜腿上的 3D 打印支架接好电池。刷固件用 Arduino IDE 打开仓库里的 firmware/firmware.ino装上 ESP32 开发板支持包选择 XIAO_ESP32S3 板型记得把 PSRAM 设为 OPI PSRAM然后一键上传。固件默认通过蓝牙把照片和音频推给手机代码里还留了 Opus / Mu-law / PCM 三种音频编码的开关按你的 App 需求切换即可。跑软件克隆仓库后用npm install npm start启动 Expo 应用在 keys.ts 里填上你用的 AI 服务密钥Groq / OpenAI 的 API Key或自建 Ollama 的本地地址再执行一次ollama pull moondream:1.8b-v2-fp16拉取默认模型就能在浏览器里看到眼镜传回的实时画面和 AI 描述。如果你不想碰代码项目也开放了预组装套件的预订渠道买来就能直接体验。实测印象以及它还没做好的地方从项目自带的测试数据看这套组合的真实表现相当可靠57 张实拍测试图每个模型都能稳定输出结构化的场景描述即使画面里有遮挡、光线一般描述也基本准确。作者甚至把识别人物翻译文字做成了核心用例Agent 的回答只基于真实拍摄内容不会脑补不存在的细节。不过也要说句公道话它毕竟不是商业产品。没有屏幕AI 结果需要靠手机查看30 万像素的摄像头注定拍不清远处小字本地跑 34B 大模型需要一台配置不错的电脑蓝牙传输偶尔会有延迟。另外任何戴在脸上的摄像头都牵涉隐私边界——拍别人之前请先想想合不合适。这些是它目前的天花板也是它继续进化的空间。戴上它你会看到另一种可能OpenGlass 最迷人的地方是它把AI 眼镜从奢侈品的货架上拿了下来放进了每个人的 DIY 清单里。想象一下学生用它实时翻译课堂板书检修师傅用它识别设备型号旅行者用它记录并搜索沿途所见——这些场景不需要等巨头发布新品现在就能用开源组件拼出来。如果你心动了行动其实很轻去克隆这个仓库看看源码读一读 prompts 目录里那些实拍对比或者干脆把 25 元的零件买齐亲手拼一副。技术民主化从来不靠口号靠的是把门槛降到每个人都能伸手够到。OpenGlass 已经把门槛放在了地上接下来就看你愿不愿意弯腰捡起来。【免费下载链接】OpenGlassTurn any glasses into AI-powered smart glasses项目地址: https://gitcode.com/GitHub_Trending/op/OpenGlass创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表