Q函数(利用与探索的权衡):
为什么聪明人遇到问题反而“不想新办法”

思维工具箱 · 公式层(强化学习Q函数)

反直觉的真相:顶尖棋手赢棋靠的不是妙手,是背过的定式。AI下围棋也一样——九成时间按已验证的最优解走(利用),留一成试探新招(探索)。AI的那张"局面→动作→回报"查询表,翻译成人话就是:你的经验库。

三条使用规矩

  • 老问题+情况没变 → 直接复用旧答案。为了显得用心而重新发明方案,不是勤奋,是对自己经验库的不尊重。
  • 老问题+时过境迁 → 旧答案重新验一遍再用。去年的打法可能是今年的坑,"刻舟求剑"讽刺的从来不是记笔记的人,是不看环境变化硬套笔记的人。
  • 全新问题 → 才值得探索新解法,试完必须写回经验库,让下一次能被查到。
  • 比例与利害

    健康的状态:九成查表,一成探索。反过来——九成摸索、一成沉淀——的组织,每天都在重新交学费,员工累死,资产为零。要警惕的另一面是"过度依赖旧表":市场剧变时还抱着老黄历,那是把经验用成了偏见。所以规矩第二条(重验再用)才是整套方法的心脏。

    我们的案例库每天在长大,每条都标着"验证过"还是"猜想中"。想知道这套机制装进你的生意什么样?聊聊。