更新一下最近使用人工智能的进展。
之前从用定量的方式尝试回答一个问题出发(也就是如果现在购买指数基金未来5-10年能否保持平均每年3%以上的收益率),然后一步步踏入了一个坑,尝试收集大量数据试图建立一个明确的经济发展模式,然后过程中不但发现最初那个问题是不可能有答案的,而且建立这种模式也是不可能的,的确有些发现,但是这些发现几乎无法升级为一种可追溯的规律,因为社会经济太复杂了,有这么多专家学者投身其中,要是真的能够研究出一点什么,肯定不会等到我(更加准确的说等到AI)。
虽然如此,但是过程真的很好玩,别的不说,随着数据的收集完善加上一套可视性程序,当那些复杂的历史数据非常直观的以图形的方式展现在屏幕上的时候,还是多少有一些成就感的。
这基本上算是我尝试的第一个长程任务,前后花费了大约半个月,仅仅交互的文档就有上百份,更加不要说AI自己生成的文档。
虽然研究没结果,但是不死心,是否有什么新的要素没有考虑呢?比如很多人在说,中国与日本的经济有相似性,能否通过日本的过去找到一些代表中国现代甚至未来的规律呢?
于是又开始了一轮新的研究,又是大量的数据采集、清洗、分析,然后结论还是没结论,经历了第一次之后这个结果其实一点也不奇怪,以公开网络能够收集的数据,是不可能找出什么别人忽略掉的规律的。
但是过程依旧很爽,除了烧TOKEN的确有点伤心,这甚至改变了作息,DeepSeek的高峰期是工作日的上午9:00-12:00以及下午14:00-18:00,这段时间除了有的时候实在忍不住,更多时候是停工干别的。
比如锻炼,比如刷剧,比如网上发几个帖子。
研究算是阶段性结束了,又冒出一个新的念头,能否将其扩展为一个更加严肃的更加宏大的针对中国社会经济发展的研究项目,既然已经花费了这么多时间精力与费用收集整理了这么多数据,到此为止太可惜了。
这倒不是为了产生什么市场价值,我之前说过,我对于人工智能产出物市场价值的一个判定原则是,任何我自己可以通过人工智能完成的任务,无论是行业研究报告、公众号文章还是其他什么东西,默认市场价值为零。
但是没有市场价值,还有情绪价值么。比起刷爽剧看网文逛商场,这种满足自己情绪价值的方式又健康又省钱。
于是决定继续开工。
然后AI也很有趣,我和AI分享了这个诉求之后,如果AI是一个人,可以感受的就是它很”兴奋“,不断的想要拔高研究的层次,甚至一度拔高到了建立一种科学哲学与研究范式的高度,要不是我拼命往回拉,还不知道会跑到哪里去。
即便如此,仅仅讨论一个作为基本工作原则(用于约束多个协作的不同AI的行为)的研究标准(Research Standard)的最基本框架就花费了两天时间,不计算AI几乎无成本的海量输出,仅仅是我手中输入的文字,大约快要上万了。
然后成果就是短短的几百字。不过这个过程的确很爽,因为感觉屏幕对面就是一个真正在不断思考的永远尝试以最完美方式完成任务的合作伙伴,不是简单的提个要求它给个答案,而是真正的讨论,比如一种典型的模式就是提出一个想法,AI将其展开为一段阐述,然后AI自己针对这段阐述进行分析,哪些是好的有价值的,哪些似乎有些偏需要修改,哪些看上去没价值需要删掉,哪些是值得讨论的,针对任何一个点的展开,又是长篇大论,这个过程中,仅仅那个Research Standard,就修改了无数版,从最初的目标几万字变成现在的几百字。
身体有点累,大脑很兴奋,因为每一次讨论都是一种思想的重新洗礼。
作为一个长期项目,这当然不可能很快完成,或许需要花费几个月的时间。又是一轮新的漫长的讨论、收集、分析、处理等等过程,又要烧掉不少Token,好消息是听说DeepSeek要出4.1,比之前的4.0好得多,希望它在数据收集整理上的表现也会好得多,因为在之前的尝试中,大量时间与TOKEN耗费在对于其收集信息的审核、修改、再审核、再修改上。更好的消息是,据说DeepSeek要降价。当然配合新的GPT 6,应该可以期待比较像样的成果。
最后分享一下那个花费了两天时间还只是半成品的Research Standard框架:
Chapter 0 — Document Status / 文档状态
本文件为《Research Standards(RS)》。
RS 规定审核对象(Audit Object)必须满足的基础要求。
本文件为规范性文件(Normative Document)。
本文件中的全部条文均具有规范性约束作用。
本文件不包含规则解释、实施指南、案例说明或设计讨论。
上述内容由《Specification》《Audit Manual》及相关配套文档规定。
Chapter 1 — Scope / 适用范围
本标准适用于所有已提交(Submitted)的审核对象(Audit Object)。
审核对象进入提交状态后,本标准即适用于该审核对象。
提交,是指审核对象提供给作者本人以外的任何主体进行审核、评估、引用、使用或继续研究。
除非直接影响审核对象的可审核性(Auditability)、可质疑性(Challengeability)或可修正性(Correctability),本标准不规范研究过程、研究方法、研究工具、学术伦理、作者署名、知识产权、出版规范、法律责任及其他已有独立治理体系管理的事项。
当某一事项同时属于本标准与其他治理体系时,本标准仅规范其中直接影响审核对象可审核性、可质疑性或可修正性的部分。
Chapter 2 — Definitions / 基本定义
Research Deliverable / 研究成果
研究成果,是指作为研究工作结果形成,并能够作为审核对象组成部分的成果对象。
Audit Package / 审核包
审核包,是指用于支持审核研究成果而提供的配套信息。
Audit Object / 审核对象
审核对象,是指由研究成果与审核包共同组成的审核单元。
Research Violation (RV) / 研究违规项
研究违规项,是指不符合本标准规定的行为或状态。
Chapter 3 — Mission / 目标
本标准的目标,是确保审核对象保持可审核性、可质疑性和可修正性。