AWS 用多模态 AI 把卫星图像变可搜
AWS 发布了基于 Amazon Bedrock 和 OpenSearch Serverless 的地理空间语义搜索方案。通过多模态嵌入模型(Amazon Nova Multimodal Embeddings)对航拍影像进行向量化,支持自然语言查询地理空间数据。该方案已演进成商业产品 Vexcel Intelligence。博客详解了嵌入模型对标、融合策略、图像描述、检索方法四大实验设计,给出了地理空间 AI 搜索的工程指引。
①
多模态嵌入对标
通过 OpenStreetMap 地面真值评估,Amazon Nova 多模态嵌入在语义查询上 F1 最高,说明该模型在地理空间理解上的有效性。
②
云原生架构
基于 Bedrock(托管 LLM)+ OpenSearch Serverless(向量数据库)的无服务器设计,降低运维成本同时支持海量影像数据。
③
商业化落地
技术方案已转化为 Vexcel Intelligence 可搜索影像产品,体现 AWS 云服务对地理空间 AI 应用的直接支撑。