返回笔记目录 概念 / 约 5 分钟
AI产品能力坐标
3维度×5项AI产品能力地图(输入模态/处理类型/增强方式),含各维度评测关注点
概念 来自 ai-pm-wiki
用3个维度×5项构成的"AI产品能力地图",帮助PM在竞品分析中系统地圈定和对比AI功能,而不是只看表面交互。核心公式:AI产品功能落地 = 业务场景(用户×需求×场景)× AI能力。
三个维度
维度①:输入模态(定义AI能接收哪些形式的输入)
| 模态 |
说明 |
代表产品 |
| 文本 |
文字、对话、文档类输入 |
ChatGPT、Claude、Gemini、DeepSeek |
| 图像 |
图片、数据、视觉内容 |
Midjourney、DALL-E、Stable Diffusion、FLUX |
| 语音 |
语音、自然输入 |
Whisper、ElevenLabs、GPT-4o Voice、Azure Speech |
| 视频 |
短视频、录屏、短视频剪辑输入 |
Runway、Pika、Kling、Sora |
| 结构化数据 |
表格、数据库、BI数据 |
Excel、Power BI、Snowflake、Databricks |
维度②:处理类型(定义AI对输入执行的核心任务)
| 类型 |
说明 |
代表产品 |
| 理解 |
识别、分类、抽取、总结 |
ChatGPT、Claude、Gemini |
| 生成 |
文本、图像、语音、视频内容生成 |
DALL-E、Midjourney、ElevenLabs |
| 推理 |
多步思考、复杂推理、逻辑分析 |
OpenAI o-series、Claude、DeepSeek |
| 决策 |
基于规则与目标输出方案建议 |
Perplexity、Notion AI |
| 执行 |
调用工具、触发流程、完成动作 |
Zapier、n8n、Make、OpenAI Agents |
维度③:增强方式(定义如何扩展与增强AI的能力边界)
| 方式 |
说明 |
代表产品/技术 |
| 基础大模型 |
能力来自通用模型本身,利好快 |
OpenAI、Anthropic、Google、DeepSeek、Meta Llama |
| RAG |
接入私有知识库,提升事实准确度 |
LangChain、LlamaIndex、Pinecone、Weaviate |
| 微调 |
通过训练数据优化特定任务表现 |
Hugging Face、LoRA、OpenAI Fine-tuning |
| Agent |
多步规划、任务拆解、自主执行 |
LangGraph、CrewAI、AutoGen、OpenAI Agents |
| 工具调用 |
连接搜索、数据库、办公系统与外部API |
Zapier、n8n、Make、Slack、Google Drive |
各维度AI能力评测关注点
基础能力
- 上下文一致性:支持的对话轮次、长文本长度阈值
- 语义准确性:避免"答非所问"的准确率指标
- 多语言覆盖:支持的语种、翻译准确率
- 生成质量:流畅度、无重复率、合规性(无敏感内容)
多模态能力
- 跨模态对齐:图文/音视频语义匹配度
- 模态支持范围:是否覆盖语音/视频/3D模型等
- 生成效率:多模态内容的延迟
- 合规性:素材版权
逻辑推理能力
- 推理准确率:复杂问题(如逻辑题、故障排查)的正确率
- 推理边界:是否支持因果推理/常识推理/演绎推理
- 可解释性:推理过程是否可追溯
- 风险场景:高决策权重场景(如医疗/法律)的推理可靠性
数学与数据计算能力
- 计算精度:数值计算/公式推导的误差率(如≤0.5%)
- 支持范围:覆盖的数学领域(代数/几何/统计)、公式类型
- 数据处理:是否支持批量计算、复杂数据集导入
- 结果验证:是否对接外部计算工具
代码与工程能力
- 语法准确性:生成代码的编译通过率(如≥90%)
- 语言支持:覆盖的编程语言(Python/Java/Go等)、框架版本
- 可执行性:是否支持代码调试、运行环境对接(如在线编译器)
- 安全性:生成代码是否存在漏洞(如SQL注入、权限泄露)
工具与外部交互能力
- 工具适配:支持的外部工具类型(API/搜索引擎/数据库/插件)
- 调用逻辑:工具选择的准确性
- 容错机制:工具调用失败后的重试策略(如换工具/提示用户)
- 权限管理:用户数据访问授权(如调用数据库需用户同意)
行业能力(医疗/金融/教育等)
- 行业知识准确性:专业术语正确率、行业规则匹配度(如金融合规要求)
- 合规性:符合行业监管(如医疗数据隐私HIPAA、金融信息披露要求)
- 专家评审:是否经过行业专家验证(如医疗产品需医生审核)
- 场景边界:是否限制高风险决策(如不提供处方建议、不推荐股票)
PM 怎么用 / 何时用
- 竞品对比或定义自家能力时,用三维度(输入模态 × 处理类型 × 增强方式)画能力地图,系统圈定 AI 功能而非只看交互。
- 规划新功能时套用"业务场景 × AI能力"公式,先确认用户/需求/场景成立,再选模态、处理类型与增强方式。
- 做能力评测时,按对应维度的关注点清单逐项验收(如推理看可解释性、行业看合规与专家评审)。
相关页面
→ AI产品四层架构
→ 竞品分析五步法
→ 模型选型五维度
→ Agent五要素技术定义
→ 提示词设计五要素
→ AIPM课程 Day4