03 投研层 · 只看变化,再去开原件

AI 投资指南 · 03 投研层

只看变化,再去开原件

导读:很多人以为 AI 做投研就是让它「看得更多」。我跑了一年多,结论反过来:信息要分两层——闹钟负责不漏,原件负责不错;中间只有「变化」值得你花注意力。这是 AI 在投资里最成熟、帮我最多的一块:信息降噪和及时梳理。这篇讲我怎么搭这两层、观测哪几个维度、怎么给一件事判断分量(事件势能分级)、强事件为什么要盯得够久,以及怎么让系统平时一句话都不说。适合每天被信息淹没、又怕漏掉大事的投资者。


一、「盯焦虑」vs「系统化观测」

抓分时跳动在技术上一点都不难,随便一个行情接口就能接。但那不是重点。我要的是市场观测与跟踪(Market Observation & Tracking),不是分时盯盘——目标是让我少看屏幕,不是看得更频繁。

❌ 盯焦虑:
   开盘 → 翻自选股 → 看拉升想追、看回调心慌 → 盘后很累,说不清今天到底发生了什么

✅ 系统化观测:
   闹钟层每小时收一轮信息 → 早盘前系统先整理一份市场全景、给每条信号初评分量
   → 够分量的事件去开原件核实、推演 → 只有出现实质变化才需要我看

差别不在工具,在于你有没有提前定义清楚:什么算变化、什么值得看、看完要核什么。定义清楚了,AI 才能替你守着;定义不清,AI 只会帮你把焦虑放得更大声。


二、信息分两层:闹钟负责不漏,原件负责不错

1. 闹钟层:广度和及时

我的系统里大约有近 30 个信源(新闻、RSS、研究平台的公开更新),其中二十多个是媒体,当事方自己发的原文只有一个。这很正常——媒体的价值就是快、广、帮你把事报出来。所以我给它们的定位很简单:闹钟。

闹钟要的是两件事:

  • 及时:我早期的抓取一天只真跑几次,大部分时间读的是缓存。改成每小时真抓一轮之后,从文章发布到进入系统的时间,中位数从约 381 分钟降到约 28 分钟;65 分钟内能进来的比例从 4% 升到 92%。
  • 可靠:每个信源记最近一次成功、连续失败几次,连续失败 3 次就标红。闹钟坏了没人知道,比没有闹钟更危险——你会以为「今天没事」。

一个副作用也要说:闹钟变勤,噪音也跟着变多。改完第一周我就发现,一个批量生成快讯的源一天塞进来上千条,占了全部条目七成,把真正有分量的媒体稀释掉了。闹钟层不只是加源,还要管源。

2. 信源分三级:只回答一个问题——这句话是谁说的

级别 是谁 能怎么用
S · 官方一手 当事方原文:监管机构、央行、统计局、交易所公告、公司 IR、财报、当事人原帖 可以当事实
A · 权威一手媒体 一线财经媒体的独家报道、研究机构自己整理的数据 可以当事实,但写「据 X」
B · 二手 转述、评论、自媒体、研报观点、系统自己的聚合摘要 不当事实,只当「有这个说法」

硬规则跟着分级走:一件事的核心事实只有 B 级来源,这件事最多当 B 级处理;只有 A 级来源,表述必须保留「据 X」。再好的媒体、再深的评论,也是在转述别人的事。

3. 核实层:一件事值得看,就去开原件

闹钟把事报出来以后,凡是我要认真推演的事件,至少回到一份实际打开过的一手原件——监管文件、官方新闻稿、公司公告、财报、法案文本。然后对着原件写清两件事:

  • 原件说了什么:期限、适用对象、上限、条件、是否还在征求意见,这些限定词逐条保留;
  • 原件没说什么:媒体或分析师说的「利好谁」「给谁带来什么」,原件里没有就单独放,戴上帽子「据 X 分析,原件无此表述」。

为什么这么较真?我自己踩过。9 月中旬 SEC 发了一份关于代币化的有条件豁免令。几天后我回头查,发现这件事在我自己的系统里转了四手:原件 → 媒体 → 我的市场全景报告 → 下游报告里的「补充」一行 → 最后我口头说出来变成了「通过了美股代币化」。那几天的报告里,SEC 官网链接一次都没出现过。「有条件豁免」和「批准」差得很远,而每转一手,限定词就掉一层。

所以现在的规矩是:媒体当闹钟,不当货源。开原件分三种情况:

① 有公开原件        → 必须开一次,以原件为准;媒体说法和原件有出入,写一句出入在哪
② 媒体独家、无原件  → 标「媒体独家,无公开原件」,这件事最高按 A 级处理
③ 系统自己算出的信号 → 以原始数据表为准,不用下游的摘要句

第 ③ 条也是教训换来的:有一次我的摘要报告写「AI 板块缺席新高」,但原始新高名单里,当天恰好有一家 AI 属性的公司创了 60 日新高。摘要错了一句,下游两份报告跟着错。AI 写的摘要也是二手。

原件拿不到(被拦、还没发布)就直说「未核到一手」,并降低这件事的确定性,不硬凑。


三、观测什么:四个维度,外加「阶段」

搭观测清单时,我把跟踪对象收敛成四个维度:

┌─────────────────────────────────────────────────────────────┐
│ 1. 宏观与板块                                               │
│ - 全市场量能与流动性水位、利率与波动率档位                  │
│ - 哪些板块在走强、哪些在走弱,主线有没有换                  │
├─────────────────────────────────────────────────────────────┤
│ 2. 基本面拐点                                               │
│ - 财报 / 指引超预期或不及、提价、大订单、扩产               │
│ - 关键原材料价格大幅波动、监管与政策改写                    │
├─────────────────────────────────────────────────────────────┤
│ 3. 催化事件日历                                             │
│ - 确定性事件:议息会议、CPI / 非农、核心公司财报、行业大会  │
│ - 突发事件:关税、制裁清单、平台级产品发布                  │
├─────────────────────────────────────────────────────────────┤
│ 4. 价格行为与趋势阶段                                       │
│ - 新高 / 新低、放量突破、跌破关键位置                       │
│ - 板块或公司在大趋势里处在哪个阶段                          │
└─────────────────────────────────────────────────────────────┘

这一个多月我最大的调整在第 4 条:少讲单日涨跌归因,多看大趋势阶段。

「某天涨 8% 是因为某条消息」这种归因,我以前写得很多,后来发现两个问题:经常归错(同一天可能有三条消息,资金到底在交易哪一条,事后都说不清);就算归对了,几天就失效。现在我更常问的是:这个板块、这家公司在大趋势里处在哪——新高、新低、底部震荡、还是顶部震荡。阶段比单日原因更稳,也更接近我真正要做的决定。

另一个调整是范围:我的投研层现在盯板块和方向,不去每天挖个股。观测维度不变,颗粒度变粗了,噪音少了一大截。


四、事件势能分级:这件事有多大分量

闹钟每天报出几百条,开原件又费时间,那先开哪件?我需要一把尺子,给每件事判断「潜在分量」。

起因是一次真实的错过。上面那份代币化豁免令,我的系统看见了,也开了原件、把事件写清楚了。但当时判断一件事值不值得跟,问的主要是「它跟我的持仓、关注方向、能力圈甜区有没有关系」;这份豁免令没打到我手里的东西,最后被标成「只作观察」。随后一只代币化概念的小票连续大涨,我是看着它涨完的。

复盘下来,缺的是一把不看我持有什么、只看事件本身有多大分量的尺子。(至于看到了为什么没做,是用错了策略尺子,下一篇讲。)

所以我加了一张事件势能分级卡,所有主题通用:

三个维度定级别

维度 问什么 档位
范围 打到多大?谁的生意变了,变了几层 行业 / 跨链(新赛道被承认、规则改写、平台级产品)· 子链(一条产业链的格局变了)· 单公司 · 噪音
触达 多少人会知道,会不会变成共识叙事 出圈(大众媒体、热搜、散户社区大量讨论、普通人开始用)· 圈内(行业媒体、券商研报密集、行业 KOL 在讨论)· 小众(原件发了没人转述)
持续 影响多久 数月(制度改写、平台级产品、资本开支周期)· 数周(订单、财报季、政策落地过程)· 数天(一次性新闻、情绪)

「触达」不用做得很重,查一两个信号就够:短视频平台的搜索联想有没有出现、社区讨论量、新闻条数,写明看了哪个。「持续」看日历上有没有排着后续里程碑(生效日、量产日、财报日)。

级别 条件 例子
S · 行业地震 范围 = 行业 / 跨链,持续 = 数月,触达至少圈内 监管规则改写、核心玩家的路线图级发布、某个个人 Agent 产品出圈带动后面几个月的上下游
A · 强势能 子链级且持续数周以上;或行业级但只持续数周 / 只在小众 龙头大订单、关键设计导入落地、先进封装大扩产
B · 中势能 单公司基本面增量、季度级信号,数天到数周 新产品发布、研报上调预期
C · 噪音 其余,一周内衰减 管理层一般表态、一般新闻

S / A 级事件,就算没打到我任何持仓,也要进推演。这是这张卡最重要的一句。

第四个维度定怎么用:阶段

同样是 S 级,刚起来和已经传完,用法完全不同。我把阶段分成 🌱 刚起 · 🌿 发酵 · 🍂 成熟 · 🧊 退潮,下面是我给自己定的用法:

🌱 刚起 / 发酵早期 🌿 发酵中段 🍂 成熟 🧊 退潮
S / A 当天认真研究:催化真不真、资金认不认、阶段早不早、标的纯不纯、什么情况下算错 找还没传到的那一层,不追已经涨完的 错过第一波可以接受,追高不可以;等回调或第二波 只看不追;对已有的东西是风险提示
B 进研究队列 记一行 记一行 不写
C 不推演

判了「数月」,就要盯数月

这张卡用起来不久,我又在另一件事上栽了一次,栽的方式不一样。

8 月 19 日,Moderna 和默沙东的个体化肿瘤疫苗三期试验达到主要终点,验证的是高危黑色素瘤术后辅助降复发。Moderna 当天涨了约 177%,美股和 A 股的相关公司同步大涨。放到这张卡上,是标准的 S 级:行业级、出圈、影响以数月计。

降噪和梳理这一段,系统和我都做到了位:当天看见;第二天开原件把事件定准(是术后降复发,不是晚期治愈),把笼统的「板块」拆成四条产业链,给 A 股映射列了十个要核的问题,写成帖子第一时间发了出去。

错在后面。系统的时间单位只有「天」:第一波一回落,它把这件事记成「几天的事件,已经闭环」。一周后股价又涨了一段,上游把原因写成「三期数据大超预期」,系统照着把它记成一件「独立的新催化」。后来开原件核实才知道,那天没有任何新数据,有的只是一家原来看空的卖方机构,看完 8 月 19 日的结果上调了评级:市场还在消化同一件事。9 月中旬的医药产业政策、9 月下旬创新药板块的集体启动,又各算一件单日新闻,没有人把它们串成一条线。到 9 月底,它还用「能力圈外」把这个方向挡了一次,这是《04 策略层》里讲的用错尺子,同一个错犯了第二次。10 月 9 日,Moderna 创了 52 周新高。回头看,我们研究了一圈受益链,最该一直盯着的,就是事件的主角本身。

后来补了一条规矩:定评为 S、持续判了「数月」的事件,不只当一条新闻记,要单独立一个「中线主题」。写清最初的催化和后面排着的里程碑;每天把同主题的新消息挂到这条线上,而不是另起一件;定期看主角和最直接受益的载体走成什么样。第一波过去,不等于事情结束;市场不太注意的第二段,往往才是非对称的地方。

冷水:这是事后视角,也只有一个样本。立主题只是让我「盯得够久」,不等于每个主题都有第二段。

两条边界

  • 资金认不认,单列,不进级别。级别说的是事件的「潜在」势能;资金有没有认(相关主题放量、站上中期均线的比例在升、新高名单里出现同主题)是事后确认,标 ✓ / 待看 / ✗。把这两件事混在一起,就会变成「涨了所以重要」的循环论证。
  • 这张卡还在校准期,是假设,不是结论。每个 S / A 事件都登记下来,8 周后回头看:S 级之后 30 / 60 天的表现是不是明显强于 A、A 强于 B,判「数月」的有没有真持续。对不上就改维度或阈值。

在系统里,它落成每条事件开头的一行:

势能:S · 范围 行业 · 触达 圈内→出圈 · 持续 数月 · 阶段 🌱 · 资金 待看

早上整理市场全景时先给每条信号打一个初评,随后的事件推演做定评,改判时写一句为什么。


五、降噪:只有变化才提醒

衡量一个投研系统好不好,不是「每天推了多少条」,而是「替你挡掉了多少条」。我给系统立了几条规矩,让它平时尽量不说话。

1. 只有实质变化才提醒

[新信息流入] ─→ 和上一次记录相比,是否发生实质变化?
       ├─ 否(常规小幅波动 / 研报炒冷饭 / C 级噪音)  ─→ 静默记日志,不打扰人
       └─ 是(S / A 级事件 / 趋势阶段换档 / 关键位置被打破)─→ 进推演,给我看

没有够分量的事件,报告就写「今日无需推演」,不硬凑。

2. 两句话压缩

真要提醒我,也只给两句:

【第一句 · 事实与定性】发生了什么(数据 / 事件 + 来源级别),属于超预期、不及还是预期内。
【第二句 · 关联与下一步】它打到的是哪个变量(估值 / 业绩 / 催化 / 位置),接下来看什么、怎么核、什么时候能确认。

第二句的动词我只允许用 看 / 核 / 等 / 对照。它不是买卖指令,是下一步的研究动作。真要动仓位,走另一套流程(操盘层那篇讲)。

3. 事件层和「对我层」分开写

每条推演我固定拆成两块:

  • 事件层:发生了什么、通过什么管道传到资产价格、数据和来源、接下来怎么核、一句冷水。这里不出现任何「我」——不写我持有什么、盯着什么。
  • 对我层:这件事跟我的持仓、关注方向、仓位框架有什么关系,只有我自己看。

这么拆有个意想不到的好处:事件层写的时候不带立场,事实就不容易被自己的仓位染色。先把事情本身说清楚,再问跟我有什么关系,顺序不能反。

4. 连续剧,不是每天从零开始

每天的推演第一步,是把昨天写下的「接下来怎么核」逐条对真值:有结果的写成今天的一条,没结果的列在末尾「仍待核」。确定性事件(议息、CPI、核心财报)在前一天就先写好三岔口——超预期 / 符合 / 不及,各自看什么——第二天直接比对落在哪一岔。

这样系统盯的永远是「变化」:昨天的假设今天被证实还是被证伪了。


六、跨市场传导:真映射 vs 蹭概念

科技投资有很强的跨市场传导:海外巨头上调资本开支 → 芯片与代工 → 光模块、PCB、散热、电力 → 国内供应链。一件事出来,我让 AI 按四段推:

[1. 原始事件] ─→ [2. 一阶直接影响] ─→ [3. 二阶传导瓶颈] ─→ [4. 可验证的落点]
 是超预期增量      谁最直接收到这笔钱      需求爆发后最缺什么     哪些公司真有订单在兑现
 还是早已定价?    量价关系怎样?          价值量在哪一环提升?   兑现窗口在什么时候?

事件驱动里最常见的亏损,来自「伪映射」——名字沾边、概念相似,实际没有订单。所以第 4 段 AI 必须当裁判,至少核三件事:

  1. 主营收入结构:相关业务、海外业务占收入多少?占比太低的,故事再好也只是故事;
  2. 公告与问答记录:公司有没有正面确认向海外巨头或一阶供应商供货?只有「据传」「接近人士称」不算;
  3. 存货与在建工程:备料、扩产节奏和海外扩张周期对不对得上?

这三条都可以按第二节的分级来核:公司公告和财报是 S 级,媒体报道的供货关系是 A 级,「概念股名单」是 B 级。一个事件推出来的落点,最后要能落回原件。


七、一个例子:自然语言选股

用 AI 调自然语言选股工具(我用的是问财)做动量发现,是我这套观测里最早跑起来的一块,连续跑了几个月。细节我以前单独讲过,这里只留三条到今天还成立的教训:

① 别让 Agent 现编查询。我试过把主动权交给 Agent,让它自己组问句,返回结果非常随机。后来改成:先手动把工具的能力边界测清楚,沉淀一个问句模板库,Agent 只能从库里选,不能自己编。AI 的推理能力 ≠ 数据接口的可靠性。

② 模板要分行情。单一问句适配不了所有市场:连续下跌时新高池是空的,我以为还在观测市场,其实只看到了一部分;反弹时最强的那批根本不在新高池里。所以模板库按趋势延续 / 启动初期 / 修复反弹 / 退潮 / 事件脉冲分场景,先判风格再选模板。

③ 每次查询过「数据六检」:

检查项 查什么 常见陷阱
市场环境 大盘处在什么状态 破位环境里的「逆势突破」很多是假的
语义对齐 工具的指标口径和你的本意一致吗 「净利润增长」有没有含非经常性损益
字段完整 行业、换手、估值字段齐不齐 缺字段导致后面的归因失真
日期有效 抓到的是你要的那一天吗 数据还没更新就去抓,拿到的是昨天
样本完整 是否剔除 ST、退市风险、流动性太差的 掉进流动性陷阱
正反样本 同类形态在当前周期里的成功率 震荡市别机械套用强势市场的打法

这块最值钱的不是每天那份名单,而是数据能复用:今天的池子是明天的输入,谁连续在池、谁第几天掉出去,跑满一两周,资金在交易什么、撤出什么就浮现了。

选出来的结果不等于买点。动量发现只触发一个「值得研究」的任务,进观察和研究队列,不进下单界面。


🎁 可带走资产

① 事件势能分级指令

复制给你的 AI(Claude Code、Codex、豆包电脑版、WorkBuddy 都可以),每天把你看到的重要新闻丢给它:

你是我的事件分级助手。对我给你的每一条新闻 / 事件,按下面口径输出一行,不给买卖建议:

1. 来源级别:S(当事方原文:监管、央行、统计局、交易所、公司公告/财报)/ A(一线媒体独家、机构自有数据)/ B(转述、评论、自媒体、摘要)。
   核心事实只有 B 级来源 → 事件最高按 B 处理;只有 A 级 → 表述保留「据 X」。
2. 范围:行业/跨链 · 子链 · 单公司 · 噪音(说清「谁的生意变了,变了几层」)
3. 触达:出圈 · 圈内 · 小众(写明你依据的是哪一两个信号)
4. 持续:数月 · 数周 · 数天(列出日历上的后续里程碑,没有就写没有)
5. 级别:S = 行业/跨链 + 数月 + 至少圈内;A = 子链 + 至少数周,或行业级但只数周/只小众;B = 单公司、数天到数周;C = 其余
6. 阶段:刚起 / 发酵 / 成熟 / 退潮(依据:相关板块近 20 日走势、是否已大面积报道)
7. 资金认不认:✓ / 待看 / ✗ ——单列,不影响级别
8. 下一步:只用「看 / 核 / 等 / 对照」四个动词写一句

输出格式:
势能:<级别> · 范围 <> · 触达 <> · 持续 <> · 阶段 <> · 资金 <> |来源 <级别> |下一步:<>

判不了的维度写「待看」,不要硬凑。所有判断都是假设,我会定期回头对结果。

② 开原件核实指令

请帮我核实这条新闻:<粘贴新闻或链接>

1. 找到这件事的一手原件(监管文件 / 官方新闻稿 / 公司公告 / 财报 / 法案文本 / 当事人原帖),给出你实际打开过的链接;
   不要凭记忆编链接,打不开就写「未核到一手(原因)」。
2. 对着原件写两栏:
   - 原件说了什么:逐条保留期限、适用对象、上限、条件、是否仍在征求意见等限定词;
   - 原件没说什么:新闻里有、原件里没有的说法,单独列出,标「据 X,原件无此表述」。
3. 如果是媒体独家、没有公开原件,标「媒体独家,无公开原件」,确定性按 A 级处理。
4. 最后用一句话对比:新闻标题的说法和原件之间,差在哪个词。

💡 下一篇阅读建议

信息看清楚之后,最难的是用对尺子:同一件事,用核心资产的尺子去量和用事件波段的尺子去量,结论可能完全相反。下一篇讲怎么把你的投资逻辑写下来,让 AI 帮得上: 👉 《04 策略层 · 把投资逻辑写下来,AI 才帮得上》

这是我自己这一版的做法和样本,不是标准答案。文中提到的公司只是讲商业常识或复盘的例子,不构成任何买卖建议。
想交流:知识星球「勇麦的观察现场」 · 想定制市场监测系统或搭整套投资系统:微信 yongmaixyz