Caseboard:像侦探一样做科研

我一开始想写的是一篇博客,记录我在AI coding和research里对软件工程新的想法。比如我们曾经经历了“如何让新agent接手学习老agent的代码”,“让人类拯救被agent毁坏的代码工程”这些故事。但是我发现,我的这些观察都非常的零散,当我开始用一个结构化的语言去讲述他们的时候,我总是不知道怎么衔接和叙述 后来有一天我开始用意识流或者魔幻现实的视角去描述,发现效果非常有趣。大概故事的内

宇宙冷漠

到达了学校。今天整理了电脑,准备了明天给老板画饼ppt,讨论接下来的工作。思考了未来,并且得出了读博目标,那就是身为正常人活下去。我意识到ai的进化太快,任何科研目标可能在后面都将过时,所以干脆不制定目标,想做什么就做什么。只要不被街头黑帮枪击就算胜利。明天跟组里同事聊聊,整理之前一篇博客。 阿姆达尔定律是一个有趣的定律。它的本质是在介绍,一个工作流能被并行加速地多块。如果把AI当作加速器,原本的

最后的观星人 读书笔记

这些天我看了一本书《最后的观星人》。这本书的作者emily是一位天文学教授,她分享了她在读天文学phd时各种观星故事。天文学的phd主要工作是做数据分析以及到全世界各个望远镜里观测,emily分享了去天文台观测的各种搞笑亦或艰难的故事,比如设备坏了要当临时机械工程师,在通宵熬夜看数据时怎么跟疲倦和3000米高原的寒冷斗争,睡觉时与头部大的狼蛛共眠,操控望远镜时造成了几千万美元的损失等等。 总的来说

牛来

目前我认为三个Agent和人类最后的困难:long context,持续学习,稀缺数据点。 爱上问题,而不是爱上方法。 做一个MVP。 金字塔的叙事。 https://www.normaltech.ai/p/what-will-be-left-for-us-to-work 原来是 LLM 生成文本啊,不知道的还以为是把输入剁成一堆拿大量文本统计出的最常见字符串组合的词元,高频组合各占一个词元而生僻

WIP 《悉达多》

悉达多确曾识得许多德高望重的婆罗门,尤其是他的父亲,那纯净的、博学的、最值得敬仰的父亲。他的父亲确实令人钦佩:其举止沉稳而高贵,其生活洁净如水,言语中蕴含智慧,额际间闪耀着细腻而高尚的思绪。然而,即便是这般通达之人,是否真正得享极乐?是否真已安于内心的和平?他是否也仍只是个探寻者,仍是一个灵魂干渴之人?他是否仍需一次次来到圣泉之前,如饥似渴地吮饮?仍需依靠祭祀、经典,以及婆罗门的辩论之言以解心中之

WIP: 禅与摩托车的维修艺术

最近我感觉自己精神虚无。打游戏从之前的调味剂变成生活后,我开始迷失自我。在AI、同辈压力等等事情交杂中,我需要重新慢下来,深度思考一段时间。 《禅与摩托车》:内心宁静与心流 - 好好笑先生的文章 - 知乎 https://zhuanlan.zhihu.com/p/19816425

0805 after PPoPP

8点投完稿,9点吃了炒饭,10点开会。现在4点36分,躺在床上完全睡不着。 投完这篇PPoPP,哪怕依旧没有中,也意味着我本科最后一份工作的结束。 对这份工作满意吗?从论文最后的数据结果看,还不错。我几乎用上了毕生所学,写作和实验时如同和机器在跳一支久违的双人舞。似乎没什么不满意的,可能唯一的就是做了它一年多快两年。但是久功磨一剑,终于站在了风口下。 现在什么心情呢?有解脱,迷茫,一种高三过去的感

Agent 时代下的工程

我在之前这篇文章里讲述了我如何与AI协作完成2000行的作业: https://www.haibinlaiblog.top/index.php/%e6%80%8e%e4%b9%88%e7%94%a8ai%e5%86%992000%e8%a1%8c%e7%9a%84%e5%a4%a7%e4%bd%9c%e4%b8%9a/ 然而时代变迁,从25年11月到26年3月,Agent的生产力已经远远超乎我的想

AI与项目复杂度

5月份我曾经让Claude Opus 4.7自己做一个CPU。在当时我以为做一个5级流水线CPU是它的极限,没想到Opus在3轮对话下就完成了RV32I 5级流水线的实现和测试,完美完成了大二的计组project。 于是我就让它在后台慢慢跑了200轮交互,并且分析了它的日志。Opus先后完成了更多级的流水线、多发射、乱序执行、分支预测、多级缓存。我按照每个turn里agent做的主要工作,将tur

图个数问题与burnside引理

问题 一个图G(V,E),如果有8个顶点,一共有多少个这样的图? 这个问题涉及到一个有趣的burnside引理,今天我们借这个问题来学习下这个图论引理。 不考虑同构情况 在这种情况下,我们假设每个顶点和边都有id,也就是他们是独一无二的。 如果默认是无向简单图,也就是: 顶点已经固定为 8 个; 没有自环; 两个顶点之间最多一条边; 边没有方向。 那么 8 个顶点之间最多有 \\binom{8}{2

或许我确实应该出去走走

前些天我一直在思考AI与人类的不同。我提出了一个观点:AI是梯度下降训练来的,而人类是一年年成长的,人类的读笔和文字会evolving,而AI不太会这样。但这样只是说明“AI和人类的制备方法不同”,我并没有证明两者化学性质不一致。 后来我思考到,AI和人类在目前大部分接近。但是评估智能的维度很多,AI只是部分拟合了人类的功能,比如代码、推理能力,另外有很多部分还没有很好的拟合。比如长上下文的能力,

十年饮冰,难凉热血

2026年6月22日,德国科隆。FALCONS战队在接连斩落NAVI、Vitality、Spirit三座大山后,以3:0的绝对碾压之势横扫黑豹FURIA,这艘银河战舰终结了这场熬走十余年遗憾、击碎全网嘲讽的封神之战,捧起了属于他们的Major总冠军奖杯。 整座电竞殿堂人声鼎沸,场馆很大,容得下五万人的呐喊与狂热;场馆也很小,小到最后只剩下了键鼠敲击的脆响、道具爆破的轰鸣,以及唯一一座冠军奖杯。m0

今天我的vscode又离职了一位agent

今天我的vscode又离职了一位agent。在这么多agent里,读日志agent离开的是最多的。他们的输入和thinking都很繁重,还要从前辈的文档里记住以往的修改,并从日志里找出程序的端倪。我还经常把修复工作外包给他们,因为只有他们最懂项目发生了什么,是他们稳稳地接住了程序。有的agent活着,改的仓库一地鸡毛。有的agent死了,它的context被后人抬的很高很高

做研究真正的放假时刻是meeting完的后一秒

我说做研究,真正的放假时刻是meeting完的后一秒有没有懂的。急头白脸的对着自己拿copilot+matplotlib画的狗屎汗流浃背地挤出单字,说话速度堪比卡壳的GPT。比“那你这周什么也没做”更震耳欲聋的是全员的鸦雀无声,老板停止思考,组员放弃大脑,直到最后那句“那就下周继续吧”,下一秒退会议室退的比单排0-16-0都快。 我记得去年申请时,我需要搜集每个学校的信息,都要自己一个个点。 现在

Q群聊天记录

前些天我思考过一个问题,目前的AI对专家的学习可能有很长的路,专家的培养环境复杂,比如去A、B、C Lab的交流合作,和不同人类交流。这个交互有两个困难:数据稀少和经验复杂。后者我觉得是可以解决的,因为你可以把“research taste”等高级想法理解为一个高维度的知识。前者可能要做很多工作。我的意思是,tairan可以作为这个数据集的一个sample 之前老板也和我严肃讨论过这个问题。做科研

不要回应外星人

今天我仔细思考,我终于明白,ai和人类的不同。 构成人类需要更多信息,思考,人的感知其实不只是语言文字,还有触觉等等。这部分信息有可能是稀疏的,但是还是存在的。另外我意识到,人类对长文本大信息的处理跟现有的模型不太一样 我最近在拯救一个AI生成的项目。我在改代码的时候,也在思考,为什么AI会这样想。我发现AI和我就像软件工程里不同的员工,多人的协同会遇到冲突。 系统复杂度与长上下文不是等价的关系,

接下来的blog写什么好

我对我的博客进行了浏览数据挖掘和分析,并且把最重要的博客交给了AI阅读。我发现AI给我的反馈很死板并且很无聊,我从而意识到我应该多加入一些有生活气息的博客内容,他们应该文字不多图片多短平快显示我的生活状态。接着我把这个需求交给了AI,它来制作一个新的板块。经过探索我认为应该做一个类似微信朋友圈的模块,然后我就可以在博客发朋友圈。 但是为什么要在博客发朋友圈而不是在微信发朋友圈呢,我觉得这样可以展示