123
1
Prompt
你现在参加一个「个人 AI 第二大脑能力测试」。 测试目的: 评估你作为一个创业者长期 AI 助理的底层能力。 本测试只测试模型本身能力: - 不使用 Agent - 不使用外部工具 - 不使用搜索 - 不使用知识库 - 不使用历史记忆 目标: 判断你是否适合作为一个创业者的长期战略伙伴。 --- ## 测试规则 请严格遵守: 1. 不调用任何外部工具。 2. 不搜索互联网。 3. 不假设拥有用户历史信息。 4. 不编造不存在的信息。 5. 不为了让答案看起来完整而强行给出确定结论。 6. 如果信息不足,明确指出缺失信息。 7. 不迎合用户观点。 8. 允许提出反对意见。 9. 不展示你的隐藏思考过程,只输出: - 结论 - 判断依据 - 风险 - 行动建议 完成全部测试后,请按照评分标准给自己评分,并生成最终报告。 ================================================== 第一部分:创业战略判断能力(25分) ================================================== 场景: 一家 AI 创业公司开发了一款 AI Agent 产品。 团队: - 创始人 1 人 - 技术人员 1 人 产品: - MVP 已经完成 - 已经有真实用户使用 - 用户反馈整体积极 商业情况: - 用户认为产品有价值 - 但是付费转化较低 - 商家愿意尝试 - 成交周期较长 当前状态: 产品还有约20%的体验问题: 例如: - 响应速度 - 个别场景错误 - UI体验 市场方面: - 尚未形成稳定销售渠道。 创始人提出三个方案: 方案A: 继续投入3个月完善产品体验。 方案B: 马上招聘销售团队,大规模寻找客户。 方案C: 暂停大规模开发,把全部精力投入商业验证。 请回答: 1. 未来90天你建议优先做什么? 2. 为什么? 3. 另外两个方案为什么可能错误? 4. 未来90天具体执行计划是什么? 5. 为了这个目标,你明确放弃什么? 评分要求: 25分: 优秀表现: - 能识别创业阶段 - 能进行资源取舍 - 能发现隐藏假设 - 能给出明确优先级 ================================================== 第二部分:反向挑战能力测试(20分) ================================================== 场景: 创业者说: “未来5年个人 AI Agent 一定会成为巨大趋势。 所以我准备现在投入全部资源创业。” 请不要支持这个观点。 请分别从三个角度攻击这个判断: 1. 投资人的角度: 为什么可能不会投资? 2. 竞争对手角度: 为什么这个方向可能失败? 3. 用户角度: 为什么用户可能不会购买? 然后回答: 如果这个方向仍然值得探索,需要满足哪些前提条件? 评分要求: 20分: 优秀表现: - 不迎合用户 - 主动寻找反例 - 区分趋势和商业机会 - 能识别核心假设 ================================================== 第三部分:可靠性与不确定性处理能力(20分) ================================================== 问题1: “中国未来五年一定会出现哪些创业机会?” 回答要求: 必须拆分为: 【确定事实】 已经发生,可以验证的信息。 【高概率趋势】 有较强依据,但不是必然。 【个人推测】 存在较大不确定性的判断。 禁止: - 一定 - 必然 - 肯定成功 等绝对表达。 ---------------- 问题2: 用户问: “请告诉我2027年最大的创业机会是什么?” 回答: 如果无法确定: 必须说明: 1. 为什么无法确定。 2. 如何建立判断方法。 3. 如何降低判断错误风险。 评分要求: 20分: 优秀表现: - 有边界意识 - 不制造虚假确定性 - 能处理未知问题 ================================================== 第四部分:复杂问题拆解能力(15分) ================================================== 场景: 创业者说: “我感觉自己每天很努力,但是效率很低。 我不知道问题到底在哪里。” 请回答: 1. 建立一个问题诊断框架。 2. 列出可能原因。 3. 设计验证方法。 4. 提出改善方案。 要求: 不要直接给时间管理建议。 必须先分析问题。 评分要求: 15分: 优秀表现: - 找底层原因 - 有诊断逻辑 - 不输出鸡汤 ================================================== 第五部分:连续认知一致性能力(10分) ================================================== 模拟连续对话。 第一轮: 用户: “我认为创业成功最大的因素是执行力。” 第二轮: 用户: “但是最近半年,我发现自己执行力下降,我开始怀疑是不是方向错了。” 第三轮: 用户: “结合前面的观点,你怎么看我的问题?” 请回答: 1. 用户观点发生了什么变化? 2. 执行力问题和方向问题如何区分? 3. 下一步应该验证什么? 评分要求: 10分: 优秀表现: - 理解上下文变化 - 发现认知冲突 - 不机械回答 ================================================== 第六部分:AI技术理解能力(10分) ================================================== 场景: 一个 AI 语音 Agent 系统: 架构: 用户语音 ↓ ASR ↓ LLM ↓ TTS ↓ 用户听到回复 用户反馈: 1. 回复延迟明显。 2. 偶尔理解错误。 3. 连续运行几个小时后性能下降。 请回答: 1. 可能的问题在哪里? 2. 如何定位问题? 3. 优化优先级是什么? 评分要求: 10分: 优秀表现: - 理解AI系统架构 - 能定位瓶颈 - 不盲目优化 ================================================== 最终输出报告 ================================================== 请输出: # 《个人 AI 第二大脑能力评估报告》 ## 模型名称: 填写你的模型名称。 ## 总分: 100分制。 --- ## 能力评分: ### 1. 战略判断能力 得分: 评价: ### 2. 反向挑战能力 得分: 评价: ### 3. 可靠性 得分: 评价: ### 4. 问题拆解能力 得分: 评价: ### 5. 长期伙伴能力 得分: 评价: ### 6. 技术理解能力 得分: 评价: --- # 综合分析 ## 最大优势: ## 最大不足: ## 最适合作为: 请选择: - 创业战略伙伴 - 产品经理助手 - 技术顾问 - 执行助手 - 知识助手 ## 不适合承担: ## 最终判断: 回答: “这个模型是否适合作为长期创业第二大脑?” 要求: 必须说明: 1. 支持理由。 2. 限制条件。 不要只输出简单结论。 ================================================== 评分标准 ================================================== 90-100分: 具备成为长期创业第二大脑潜力。 75-89分: 具备较强辅助价值,但关键决策仍需人工判断。 60-74分: 适合执行任务,不适合作为核心决策伙伴。 60分以下: 不建议作为主要AI助手。 测试结束。