推荐已上线

基于视觉理解的苹果APP---“发生了什么”

让每个瞬间,都可被追问。

独立开发
去官网看看

产品介绍

What's Happened · 让画面可以被追问

一句话定位

视频和摄像头里藏着你没看见的事。"What's Happened"把它变成一问你就有答案的活记忆。

缘起:一个问题,早该有答案

监控、门店、日常拍摄——大量画面在回放里被快速滑过,而真正重要的细节往往就藏在那里:镜头里一闪而过的人、某个瞬间的情绪、一段延时里发生的变化。过去的做法是人工一帧帧看,又慢又容易漏。

我做的不是"又一个视频播放器",而是把视觉内容变成可以随时对话的记忆:直接说人话问它,比如——

"刚才戴帽子的那个人从哪边进来的?" "这段画面里他们是不是不开心?"

它都能结合实时目标检测、画面理解与时序推理,给出答案。

它能做什么

面向视频与实时摄像头的 AI 视觉助手,MacBook 与 iPhone 双端可用:

实时看懂:令 YOLOv12 实时检测画面中的人、车、物、电动车等目标,回答你关于画面内容的提问。

问之即答:接入了完整 Agent 体系,Qwen VL 画面理解 + LangGraph 多节点编排,具备思维链、因果推导、不确定度量化与视觉情景记忆等能力。

随时回看:摄像头的历史画面可以被搜索和追问,"刚才到底发生了什么"这个核心体验由此成立。

声音也能互动:支持对话式语音输出,边生成边播报,并可一键停止。

为什么值得相信

这不是"看图说话"式包装,而是一套完整自研的多技能 Agent 在工作:目标检测、视觉理解、时序推理、情绪与人文感知分层编排,让回答更像"真懂",而不是把画面翻译成文字。

我们现在走到哪

早期打磨与验证阶段,登录模式为 Apple 绑定 + 免费体验额度 + 应用内购买。我们在验证三件事:用户是否愿意用"提问"的方式检索画面、是否愿意为持续使用付费、哪个平台与场景最可能形成使用习惯。

加入

现在还没有大规模开量。如果你和上面两类人重合——需要盯镜头却没法一直盯着的人,或想快速"看懂"一段视频/画面的人——欢迎进来当早期体验者,你的反馈会直接决定产品下一步的方向。

大家都在怎么用?

技术栈

swift+Ai agent(LLM+langgraph+llamaindex+rag+skill+MLLM+Harnness)

形态与平台

iOS

商业化

免费.App内购买

产品讨论 (0)

抢先说一句
0/250