tmux enables AIs to operate servers safely
We’ve all seen plenty of horror stories about AI trashing servers. Yet, there are still tedious tasks we’d love for AI to handle. To keep things safe, you have to manually copy-paste back and forth commands and outputs. Yet the current mainstream solutions usually involve "adding another layer": relay IO, intercepting dangerous commands or even using a small..
更多chat.est.im launches at 3.14
Long over due. But finally, it's here. Last year I saw an interesting thread on V2EX that utilize curl -N to display cool ANSI art, and I wondered how to make it "interactive". After a series of battle with AI coding agents, it's finally done. The project is located at https://chat.est.im/. You can try it with curl -NT. https://chat.est.im/hello. I wrote a b..
更多AI 弑父
大型语言模型(LLM)所谓的涌现能力,一般说成是随着模型规模的增长,突然出现新的技能,而非平滑提升。我对此有个疑惑。gpt1 gpt2 规模也涨了,能力在哪里呢? 秘笈 翻很多材料,提到涌现能力示例: 包括 在上下文中学习 (few-shot) 多步逻辑推理(数学/逻辑题) 推断他人意图(心智理论) 使用工具或编程(生成或使用代码) 我又回忆起 ChatGPT 发布那段时间,聊天窗里那个 Linux终端+Python命令行模拟,当时很惊人。这个连续上下文和逻辑推理一致性不可思议的强。 我让 gemini 和 chatgpt 做了一个deep research,我越来越确认,AI能力爆发,也就是所谓的「涌现」有个关键因素:OpenAI和微软合作 我还记得当时有个新闻说微软要造个 DGX V100 集群超算,..
更多Configurable Intelligence
无聊看了下 Language Model Contains Personality Subnetworks ,刚好A社也最近也写了篇The persona selection model,感觉现在讨论LLM的「人格」比较火 先说下这篇论文,它提出,可以做类似「脑前额叶切除」让AI屏蔽一部分人格,不需要 fine-tune,而且就算prompt指定其它人格也无济于事。 不过它搞出来的分类比较喜剧,用的是 MBTI 。测试集是一堆 YES/NO 二元分类 光说「人格」这种问题比较抽象,有哪些应用呢?很遗憾,我对此脑袋哐当一声没太多想法,还是AI提醒了我: 因为是物理mask,所以 jailbreak 变得不太可能了 可以定向优化某些选项。它甚至在 contra.py 里可以设置 mask_gamma 这个百分比..
更多巴别塔,Vibe Coding和Lisp之咒
西方世界有个「巴别塔」故事,传当年人类强盛至极,统一了语言,上达天听,下释万物,惊动了创世神,创世神就出奸计让人们说不同的语言,人们开始互相不理解,各自为战,世俗的力量就被消减了 当然我说这个版本是去掉神秘学的一个引子。2026年了,全世界都被AI这迷人的玩意给勾引了,数据飞轮使得天下语料大同,似乎人类又可以相互理解,同样的概念embedding有几乎雷同的相似度,可以看成同一个语言又统一了。 在这种统一带来惊人的生产力,甚至可以说是「神力」。 我记得高中大学听闻上古大神编写代码,是拿纸和笔在大脑模拟,然后上机一次性敲入代码,一次性编译成功。膜拜不已 自己写代码,得跟IDE斗智斗勇,遇到编译器警告还急得抓耳挠腮;所以我比较喜欢脚本语言REPL,反正都是试。 以上种种,虽然说是脑力工作者,但是本质上就是一种体力活..
更多Citrini的2028智力危机
感觉有了AI每天都有新的东西可以写一写。Citrini Research 2028 Intelligence Crisis 在朋友圈和各种IT群都讨论遍了。 英文版:https://www.citriniresearch.com/p/2028gic 中文版: 深度丨硅谷疯传的万字宏观预言:智能过剩、中产滑落、信贷违约与消费死结,AI 正在摧毁现代金融体系 2028年全球AI危机 首先必须吐槽下,所谓的“疯传” “深度”,“震惊”,你tmd到底先把单词翻译正确。一会儿 代理,一会儿 智能体,一会儿 中介。其实都是 agent 这个词 然后我觉得这篇报告最有意思的核心就这一段: The next link in the chain was already breaking. Intermediatio..
更多中文不是唯一的意译语言
去年信誓旦旦的 其实,全世界的主要语言里,只有汉语还在坚持“意译”,被打脸了。有了最新发现。为了挽尊,让Gemini 做了一期deep research,还是记录一下 已投降 曾经坚持意译,但是早就投降的,日语、法语、德语。挣扎得更久的的:希伯来语,土耳其语。 日语就不说了,大家都耳熟能详了 德语曾是重要的科学语言,但当代德语在技术术语上表现出高度的开放性。例如,德语直接使用“Cloud Computing”、“Blockchain”、“Streaming”等原词,而不再尝试创造类似“Wolkenrechnen”这样的意译词 。尽管德语中存在诸如“Rechner”这样的词可以指代“Computer”,但在现代语境下,它也更多被作为“Computer”的次选同义词使用。 相比之下,法语表现出更强的制度性抵抗。法国..
更多

自建OpenClaw
Foreword 之前实践了MCP、Skills,最近又出来了OpenClaw,大火了一把,再来看一下OpenClaw又能干些啥吧 OpenClaw 历史 OpenClaw之前叫ClawdBot,是单独对接Claude的,但是由于瞬间爆火,对于谷歌服务大量访问,再加上Logo稍微有点侵权,直接把对应使用者的账号全封禁了,自然也就停止对谷歌系的支持,后续Meta、OpenAI都在大力招揽OpenClaw的团队,对应OpenClaw的创始人Peter,Peter后来直接投奔OpenAI了,站在了Google系的对面。 Peter在OpenClaw之前已经是一个传奇人物了,之前是做PDF相关渲染的组件的,基本上所有移动端使用的都是他的组件,很是牛逼 Peter之前写的代码是那种锱铢必较的风格,反而是到了O..
更多安全的Python3沙箱——eval
很早之前从 reddit 看到过有人吹 eval(expr.replace('__', ''), {'__builtins__': None}, {}) 这个写法其实很安全,当年没人能攻破沙箱。我这个水平肯定是不肯能了,现在有AI了,让 opus-4.6-thinking 试了下 The classic escape chain needs object.__subclasses__() → find a class with __init__.__globals__['os'] → os.system(). Every step past info disclosure is blocked: Vector Why it fails str.format() calling methods Fo..
更多isomorphic-git 实现 sparse checkout & commit
去年9月手搓了套blog评论系统 - req4cmt,可能是全世界很少见通过 git repo 文件本身存储评论内容,而不是 github issue。 git repo 文件 append 内容涉及到一个性能问题:repo作为整体,也就是历史所有全体评论,被 fetch, commit , push 的成本太高。如果只能修改其中的一个文件就好了。这就是 sparse checkout。git底层早就支持了,git 命令在2020年之后2.25.0+支持,但是 Cloudflare Worker 没法执行命令,也没文件系统,于是召唤AI跟我一起折腾。 大概用的这个 prompt: 核心目的是避免 clone 整个repo!! 注意在 cloudflare worker 上跑。和nodejs有点差别。 git..
更多