第 2 页 · 共 12 篇,本页 4 篇
按年份浏览全部 →
- 看着百花齐放,其实就几个祖宗:主流 Agent 体系对照
上一篇聊了 chatbox 和 Agent 模式的区别,有朋友说:道理懂了,可打开应用商店一看,叫得上名字的 Agent 产品几十个,到底谁跟谁是一家人?
14 min - LLM 的数据清洗是减法,AI 制药的数据清洗是手术
昨天那篇长文里有一节讲数据清洗,只写了九百字。落笔的时候我就知道那一节撑不起这个话题——它是三次迁移里我踩坑最密集、也最能区分"做过"和"没做过"的地方。所以今天单独展开讲一件事:同样叫"数据清洗",大语言模型和 A…
19 min - 训练大模型教会我的事,后来都用在了生物医药上
我的简历里有一行字:训练过语言模型。一行字背后是几百天的时间。从搭数据管线、训到一半 loss 炸了重来、把整套东西搬到华为昇腾 910B 上再踩一遍坑,到后来发现这套"训练语言模型"的思维居然能一路迁移到蛋白质预测…
41 min - 生信工作站的底座之争:滚动内核,还是 LTS 内核
一个反直觉的观察:生信行业早就把软件分发交给了 conda 和容器,但把基底发行版的选择留给了每一台工作站的主人。 你可以在 Docker 里跑任何版本的软件,却逃不掉宿主内核、GLIBC 和显卡驱动三方之间的耦合。…
12 min