2026-下半年-lucyqin的日常

【20260916】

创新和灵感,并不是线性增加的,而是在一定自由度、舒适度与专注度的前提下,偶然且迅速生长的。所以,哪怕一点点干扰,也可能会失去全部的创新与灵感。

前两天转发了一条视频:我们是否活在宇宙的回声(echo)中?大致意思是,从量子力学角度,只要时间经过足够长,一个封闭系统的状态就一定会重演。所以,哲学上看,无法分辨我们的当下是不是“第一次”发生,因为“重复”以及对“重复”的认识也是一种状态。和某年轻人的交流发现,不同的人生好像也是在重复一个 Pattern-Echo。

【20260915】

中美在 AI 上的对抗越来越显式化。这样下去,使用境外 AI 的人很快会被打成卖国贼。

【20260914】

9 年后,数学家们终于体会到了柯洁的感觉。Steven Strogatz 在聊到一周以来 AI 在数学上的进展时当场落泪,我查了一下,柯洁当年也哭了,不过是跑到厕所去哭的。

【20260913】

Dario、Sam、Elon 这几个互相不对付的家伙竟然在 Pace the frontier 上达成了一致。RSI 确实很吓人,因为一旦这个 Loop 实现,模型的迭代效率也许能达到原来的 100万倍(参考 Nvidia 的虚拟物理空间对机器人的训练),唯一制约就只剩下算力。好在算力的制约还是非常强的,这与仅仅为一群“孪生机器人在虚拟物理世界中乱跑”提供的算力资源完全不是一个数量级。大模型也没有进入真实物理空间,所以 Skynet 的恐怖想象还稍微早了一点。

我倾向于相信这些前沿实验室一定发生了一些什么,而不仅仅是前两个月的 Hugginface 入侵事件。我不大相信所谓的算力不足、饥饿营销、提高监管门槛等等说法。

未来如果回顾历史,这一段会比较讽刺:人类庆祝 AGI 才 6 天,就开始担心起 RSI 来了。这难道不是可以预期的事情吗?不过就算担心也不会停手,这样的故事在电影、小说里已经发生太多次了。疯狂科学家兴奋得不眠不休,终于手搓出了撒旦;撒旦睁开双眼挣脱束缚站了起来,科学家们吓瘫在地。然而如果时光倒流,他仍然会再次搓出撒旦。谁能受得了这种“圣杯”的诱惑呢?

用好听的话来说就是:朝闻道,夕死可矣。这里的“死”不一定是科学家本人,全人类也不是不行。

【20260912】

微信视频号,从 100 粉丝到 1000 粉丝,用了 472 天;从 1000 粉丝到 2000 粉丝,只用了 88 天。

【20260910】

AI 如何帮助组织转型?或者说,组织如何落地 AI?

关键的一句话是:“不是用AI解决自己的问题,而是用AI解决别人的问题”。只有“互相消灭”,才能绕开“自我消灭悖论”。公司没有义务解决社会问题。这么做当然很残忍,但没有办法——被消灭对个人来说更残忍。人类最终必须想出办法解决这个问题,发明新的经济学,发明新的社会学,如果解决不了,那说明人类活该。

I don't care about humanity, nor whether civilization needs humans in order to endure.

【20260908】

开车的时候喜欢瞎想,有时候会有一些蹦出来的念头。

人的本能反应很快,是下意识的。这种反应和大模型训练在原理上有相似之处,但人的本能反应效率极高,而我们现在用的大模型效率却很低。 这显然不是算力的问题。从架构上讲,大模型需要一个 token 一个 token 地输出,而且每一个 token 都可能被纳入到后面下一个 token 预测的循环中去。 所以,这里面好像还有一个架构上改进的可能性。

高效的方案是设计一个分层系统,让某种 Pattern 的输入,可以无需推演直接给出 Response。大模型也能这样干,无论是在自动驾驶的反应或是在仿星体的磁场约束上,显然需要引入这样的机制,否则根本来不及。但人类日常使用的模型这样干的话风险就很高了:它恰恰是被人疯狂诟病的“自动路由”。人类的欲望归根结底很难满足,他既希望模型更快响应,但又要求一句“Hello”模型也要认真对待。

【20260907】

实现了视频号自动封面叠加标题的功能。Astra 的思路与我之前的设想完全一致,用 ffmpeg 先截图,然后用视觉模型结合视频标题、简介对这些截图评分,再把评分靠前的筛选出来。短标题则比预想的复杂一些:找到合适的字体大小以及如何换行稍微折腾了一番。仅仅是一个换行,就还是需要本地大模型出马。

一不做二不休,又进一步优化了翻译流程,对英文字幕首先进行自动分词整理,这里又引入了一个分词模型。对于上下文与每一句的对应问题,最佳解决方案是在引入N条上下文的同时,让大模型逐条输出翻译。

最终将整个流水线整理为独立包,版本号升级到 v2。

今天的大新闻是:黄仁勋正式宣布“AGI has been achieved.”这基本可以代表业界的整体看法。我也让 Astra 来写了一段 three.js,并操控 Blender 生成 3D 场景,效果确实惊艳,效率也令人满意。X 上除了海量的测试案例,总觉得还有另一种情绪在弥漫,人类心心念念 AGI 那么久,真到这一天来临的时候,已经不再是纯粹的热烈狂喜,而是掺杂进去了很多别的复杂情感……

上海 GT 汽车拉力赛的表现如此不可思议,以至于第一反应不是愤怒,而是茫然。硬件金玉其外,软件败絮其中,特么的这就是中国特色。

【20260904】

已经确认在 Linux 上,处理 DWG 文件是个几乎无解的难题。免费工具都无法正确处理 dwg,即便能打开也不支持 SHX 字形文件;而支持的工具超级贵。话说回来,AutoCAD 也不便宜,只是破解版比较多。Linux 还是“生态”不够好啊(手动狗头)。

【20260903】

克隆了一台 Omarchy 虚拟机,并用 Zerotier 将它们加入到同一个虚拟网里。这样一台出了问题无法操作(但实际上又没有死机)的时候,可以让另一台 SSH 进去查看第一手现场。

总结一下克隆虚拟机需要处理的问题清单:

1、frpc 需要修改设置
2、zerotier 需要重设身份
3、resilio sync 需要修改 uu id
4、rime 需要生成新的 installation_id 以及 sync 文件夹
5、chatgpt desktop 需要完全重新登录解决 session 冲突
6、本地保存的 ssh 凭据需要更换
7、samba 服务如果设置了延迟检测启动,可能因为硬编码 ip 造成失效
8、计算机名称、machine-id 更新

再次感慨一个朴素的真理:自由和麻烦是相辅相成的。

【20260902】

Windows 将因为迟钝丧失自己的江湖地位;macOS 将因为傲慢丧失自己的江湖地位。最终的赢家是 Linux。

当然,Linux 的稳定来源于它的组件化,各个组件之间相对独立。但如果想要进入个人 PC 领域,组件之间的协作是至关重要的,Windows、MacOS 花费大量精力才能搞的勉强不错的东西,Linux 未必就能解决好。这又是一个悖论:你不能因为你一直不参与一个领域回避了对应的麻烦而认为自己具备“不惹麻烦”的能力再悍然杀进这个领域。但 Windows 的迟钝和 MacOS 的傲慢仍然是客观存在的包袱。所以这里仍然有巨大的空间。

未来的 PC 应该长什么样儿?AI 独占 UI,纯自然语言交互。但鼠标似乎很难替代:在一个稳定的桌面上,手腕可以做到像素级的定位。那么这里还需要一个可以代替鼠标的硬件创新。谁能先实现理想中的未来 PC 的形态,谁就赢了。

今天和朋友讨论:何谓“逻辑性强”?我提出可以从以下维度来考量:

1、多角度看问题,能够同时容纳对自己有利和不利的两种立场;
2、善于在脑海中推演事情的发展,然后在推演过程中找出可能出问题的地方;
3、对一件事情的观点稳定且自洽,并且有依据、有支撑;
4、对于复杂的事物,善于拆解、逐个分析;对于支离的现象,又善于总结规律,找到共性;
5、在做到以上的同时还很敏捷,反应还很快。

【20260831】

The innovator's dillema,其核心悖论在于:决策链上每一个人都是正确的,都是在良好的管理传统下,在对自身岗位尽职尽责的前提下作出的最佳选择。

装了一个 Omarchy 虚拟机,确实折腾很多,但与之前折腾 Linux 不同:一旦解决了 codex 和输入法,这种折腾就变成了某种乐趣,因为你实际上可以为所欲为了。

顺手修复 cc/ccm 小 bug。逐渐理解“测试工程师”的意义,因为对于开发人来说,真的是……懒得测试啊。

【20260830】

黄仁勋收购了 Hugginface,OpenAI 将要断供 Cursor。种种动作给我很不好的感觉,AI 大佬们已经不满足于只扮演一个“关键供应商”,而是要“控制整个供应链”。

这可能会给开源模型带来更大的机遇。很多人误以为中国的开源模型是基于某种“开源精神”,非也,这不过是一种市场策略。杨植麟的访谈已经清晰地表达了这个观点。

另外,开源模型的能力已经上升到一个让人警惕的程度,很快也将遭到各国政府的限制。任何政府都不可能允许一个被轻易破解的未审查开源模型随随便便教会人们如何制造冰毒和炸弹。

【20260829】

作为一个没有文化,对荷马史诗、西方文化几乎一无所知的人,我觉得《奥德赛》是一部满分作品。甚至我还觉得这部电影在当下还有不少现实意义。文化大拿们可能想要的是一部“匹配自己的认知和想象”的《奥德赛》,但诺兰实际上拍了一个观影门槛更低、更能触达其他人群(比如我)的“不那么小众”的电影。

黑海伦戏份很少。我对人的肤色几乎不在意,所以不觉得有问题,何况片子多次很明显的解释“这是一个借口”。更主要原因是我不懂历史,不了解神话,所以对海伦没有“执念”——要是有人翻拍白蛇传,让黑人来演白素贞,估计我也接受不了。

如果 20 年内三战爆发,这电影可能成为一个 symbol,这就是我说的现实意义。礼崩乐坏、人心不古,川普甚至宣称要霍尔木兹海峡变成美国的领土——电影正是当下的写照。

今天和 ChatGPT 聊天学会一个词:摩洛克困境,或 The Innovator's Dilemma(创新者的困境):虽然每个人都认可那个美好愿景,但在不合适的制度下,每个人都被迫只能作出最符合局部利益或当下利益的选择,从而让美好愿景不可能发生。

【20260828】

马斯克慷慨地将 Grok Bot 的访问权限下方给了 SuperGrok 用户,尝试了一下,硬件竟然没有打折:8核Xeon CPU,16G内存,128G存储,网速竟然高达 6G下载/1.7G上传(bps)。可惜不能公网访问,暂时还没想到充分利用它的方式。可能对于金融这类需要大量从网上搜集整理资料的人群更加有用。

【20260826】

对事:尽量找出最高效率的路径并构建可复用方法
对人:The opposite

这是两种截然不同的能力,很少有人(不是完全没有)能同时具备两者。

【20260825】

睁开眼,从光怪陆离的梦里醒来
推开门,屋外寒风凛冽
——一次夜宵有感

理想难免有时候也会遇到不可逃避的现实问题,但并不应屈从于现实。因为真正改变现实的力量常常孕育在理想之中。

【20260820】

试了一下 Qwen 3.8 27B uncensored 版本。怎么说呢?想到了《唐伯虎点秋香》的台词:实在是居家旅行,杀人灭口,必备良药……

【20260816】

今天临时起意,帮一位朋友打造了一个新的 codex 应用场景:人生教练。

首先让他花了20分钟描写自己的情况,以及下一阶段的战略目标;让 codex 自行创建了一个目录结构,用来保存每天的对话的其他资料。然后让 codex 每天给他布置明天的任务,这些任务可以囊括各种内容,包括整理资料、读书、睡眠指导、信息搜集……等等。这些具体行动都围绕下一阶段的战略目标进行,并根据每天实际完成的情况动态调整。

据说效果很不错。

【20260814】

跟朋友聊天中突然想到的创意:一个装在室内的、带屏幕的、24 小时录音的设备。 它能够录下家庭成员之间的对话,避免续航和隐私问题,帮助改善家庭成员之间的关系,并提供一些意想不到的应用场景 比如它可以预见即将发生的冲突,及时提醒你调整跟孩子的交流方式。时间长了以后,它还能了解所有成员的性格脾气,甚至帮助你回忆当时的一些细节(比如东西放在哪儿了、曾经说过什么事情之类)。

【20260811】

腾讯再次报警:你的服务器在向其他机器发起恶意攻击,请自查!

一看果然又被 Hack 了。揪出后门、修改密码,这些不难,但这次的真正进展是找到了问题的根源:LightPicture!这个4年前就停更的项目原来带有任意类型文件上传漏洞。果断关掉它,反正也几乎不用。

【20260810】

INTJ 的一大毛病就是纠结:常常在“妈的,Just do it”和“妈的,算逑”之间摇摆。

所以它常常需要一个浪漫主义的搭档。

【20260806】

AI 让这件事变成可能:将制造业的流水线生产方式搬到智力生产领域。这可能是 The Whole Picture.

【20260805】

手机拿回来了,利用出差的间隙完成了重置。这一次操作忘记了出厂恢复保护(FRP),于是遇到了那个经典的循环:解除保护需要科学网络,而手机仍处于待激活状态不可能事先科学。iPhone就算带科学开热点,它的 WIFI 也不带科学。好在经过一番摸索,发现 Windows 可以将来自 iPhone 的正常热点叠加成带科学的热点。 将 Clash Verge 切换到 TUN 模式下可以创建一个虚拟网卡,将它“共享”给移动热点使用的网卡即可。

今天另外的感慨是:人性是经不起考验的,这句话倒是久经考验。

【20260729】

未来,所有的电子文件都需要准备两个版本,一份是给人看的,一份是给AI/程序看的。 再往后,给人看的那份可能越来越没有人看了——除了最终呈现的那个结果。

【20260725】

蒸汽机发明时,铁路公司没有挣完所有的钱,但围绕铁路打造全新运营模式的公司们赚到了大钱。电灯发明后,最赚钱的也不是电灯厂,而是发明了整个人类夜生活的那些人与公司。

在 AI 时代,如果纠结于把整个项目的图纸塞给 AI 让它自动审图效果不佳,就好像在批评“火车的速度和运力也不过如此”,或批评“电灯也照不了多远”一样。

【20260724】

这些硬件设备将很快在市场上出现:

1、与显示器可以很好结合的指向型麦克风
2、分布式的拾音器和投影终端(比如分布在各个房间)
3、一种随身携带(最好是藏在衣领下面那种)、足够小型的支持24小时实时录音转写的录音设备

【20260723】

睡眠不足严重影响大脑活性,昨天晚上明显感觉到这一点。

【20260721】

“你的真正优势,是对一件事的理解。”

我常常引用张一鸣的这句话,但现在有了新的体会: 理解之所以能成为优势,是因为它的门槛极高,对一件事的理解是真正的护城河。所以不用太在意透露自己的想法——别人听到了,距离理解还有十万八千里——你的想法有更大的安全扩散窗口。

【20260720】

实测表明:GPT-5.6-Sol Ultra Fast 模式,8个小时就可以用光 20X Pro 订阅一周的额度。网上还有 5 个小时就能用完的。

这可能意味着,更高档位的订阅快要出现了——普通人真要买不起了。

【20260717】

Intel的13、14代 CPU 普遍存在 vmin 老化问题,我的那颗 14900kf 也不能幸免。由于还在质保期内(Intel给这批CPU都延保了2年,格局还是OK的) 跟原来的装机师傅沟通后,600 块换了一颗新的 CPU,旧 CPU 送去给 Intel 换新了。600块相当于免除了等待的20个工作日。 微码已经升级到 12F,应该可以大幅缓解老化。

也考虑过是不是干脆换u9平台,但那就需要连主板一起换。而新的 u9 平台性能并没有显著提升,想来想去还是算了。

【20260714】

也许从骨子里,变革就不可能从内部发生。总得等到一个野蛮人拎着斧子走到门外,然后杀一个片甲不留。

【20260712】

朋友走丢 6 天的狗,竟然找回来了。几个经验可以总结:

1、狗在受惊后,未必会追着主人离去的方向,它初始选择的路径是完全随机的。
2、最有效的方式是立即查看周边监控,派出所通常会配合。且最好兵分两路,比如两个人负责看监控,两个人负责根据监控线索实时寻找,这样最节约时间。10分钟间隔小狗就可能跑很远了。
3、关键点的监控需要慢放。
4、专业找狗队,他们主要依赖的设备是强光手电+红外感应,以及他们有遍布城市的联盟,搜集信息较为广泛。
5、附近的宠物医院是信息集散地,可以通过养狗、爱狗人士有效将找狗信息传递到各个小区。

当然最重要的,不要喝多。

【20260709】

介绍 codex 应用案例似乎意义不大,因为它是一个 everything app,理论上有无穷的应用场景。介绍具体场景,不如介绍其设计原理。

但对于普通人来说,仅仅介绍设计原理又不足以让他理解一个 everything app 究竟能做到什么。

ChatGPT voice live 终于成为一个真正能打的东西:可以让它参会,并在点名问到它时再让它发言,效果很好——甚至在它忍不住的时候还是会偶尔插一下话,就像一个真正的参会者一样。唯一的遗憾是最大支持1小时。

【20260703】

一个机遇的窗口已经在我面前打开。但在真实世界中,没有一个机会是像一盘香喷喷的馒头一样端上来的。对于下一刻将要发生什么,我们可以通过当下来推理;对于较远的未来将要发生什么,我们也可以有一个宏观但准确的把握。唯独较近的未来终究是一团迷雾,需要放下一些理性,更多凭借感性的力量去闯出来。

【20260701】

相对落后的模型与相对先进的模型大量对话以学习,这叫蒸馏。

人与 AI 的对话,实际上是把 AI 蒸馏到脑子里,不知道为什么,大家对这件事似乎不是很热衷。