KVM/QEMU 初探
看过我其他文章的朋友应该能看出来,我一直是一个 self-hosted 爱好者。无论是折腾 PVE、网络,还是各种跑在自己服务器上的服务,虚拟化都是绕不开的一层。平时用起来倒是很自然,但越用越会好奇:一台 VM 到底是怎么被跑起来的?PVE 和 virt-manager 这类工具背后究竟做了什么? 这个学习计划其实搁置过很久。QEMU/KVM 的入口并不算友好,QEMU 参数、libvirt、KVM API、virtio、tap/bridge 每个方向都能展开,之前总觉得需要一整块时间才能系统梳理。现在有了 Codex 这样的 agent,反而终于可以释放一下这部分好奇心了。 当然,Codex 并不能替我理解 KVM/QEMU。它更像是一个可以被反复追问的搭子,真正有价值的还是我能不能问出下一个问题。 这里..
更多使用树莓派 4 和 Moonlight 串流游戏的实践
家庭内网,串流打游戏是真需求,电脑放书房,在客厅电视玩,真的爽。设备清单Windows 11 PC,显卡 RTX5070,安装 Sunshine树莓派 4B,2GB RAM,安装 Lineage OS TV,以及 Moonlight 安卓版XBOX 游戏手柄小米电视 ES55千兆以上的有线家庭内网软件说明Sunshine 在 这里 下载Moonlight 在 这里 下载Lineage OS TV 在 这里 下载小声 bb ,这个开发者很牛逼,但他不允许其他人给他的固件做镜像重分发,必须到他那个满是广告的网页下载为什么我要选这些软硬件PC 不谈,显卡是中端显卡用树莓派和小米电视是因为,我家已经用这套设备很久了,基本上是完美的安卓电视体验,电视仅用作显示,不联网,所以就没有广告konstakang 给树莓派 4 适..
更多GPT‑5.5 Instant 发布
OpenAI官网介绍 GPT‑5.5 Instant 更智能、能提供更准确的答案,更少的筛选工作。Instant 现在更加可靠,在各个方面都显著提升了事实准确性,尤其是在对准确性要求最高的领域,提升最为显著。在内部评估中,GPT-5.5 Instant 在涵盖医学、法律和金融等领域的高风险提示中,产生的虚假陈述比 GPT-5.3 Instant 减少了 52.5%。此外,在用户标记为存在事实错误的高难度对话中,它也减少了 37.3% 的不准确陈述。GPT-5.5 Instant 是一款更智能的模型,在日常任务中表现更出色,包括改进照片和图像上传的分析、回答 STEM 相关问题以及决定何时使用网络搜索来提供更有用的答案。此次更新后,ChatGPT 模型的回复更加简洁明了,重点突出,同时又不失实质内容,并保留了其亲..
更多

DeepSeek近期对API服务进行了大幅降价
DeepSeek近期对API服务进行了大幅降价。新的价格信息,单位是 每100万tokens(约等于70-80万个英文单词) 的价格。具体价格取决于你选择的模型和使用场景:模型版本计费场景最新价格 (每百万tokens)备注DeepSeek-V4-Flash输入 (缓存命中)0.02元价格最低,适合追求高性价比和响应速度的场景。输入 (缓存未命中)1元原价为4元,已同步下调。输出2元原价为8元,已同步下调。DeepSeek-V4-Pro输入 (缓存命中)0.025元限时优惠,截至2026年5月5日。输入 (缓存未命中)3元原价为12元,已同步下调。输出6元原价为24元,已同步下调。全系列模型,输入缓存命中的价格已降至首发价格的 1/10。当前 deepseek-v4-pro 模型限时 2.5 折,优惠期至北京时..
更多浏览器通过WebGPU上做AI推理
先说结论,在2026Q2这个时间点,通过浏览器webgpu 做 AI 不值得。 本来看官方demo跑得好好的,自己搓下来也觉得没啥,就一个小问题,fp32的模型有点大,最好换 q8 的。 q8的不能在 webgpu上跑,wasm也凑合用。原因是缺少一些矩阵乘法算子。开源库嘛,也理解。只是速度就慢了一点。 本来前几个月就这样平安无事,结果 transformers.js 升级到 v4,支持 q8 跑webgpu了,甚至 q4 q2 bitnet 这种高级货都支持了。满心欢喜的切过去,结果 webgpu 跟 wasm 一样慢? 于是就不甘心了。一路折腾,发现这个不仅跟算子有关,还跟硬件有关。甚至老掉牙的硬件不支持 shader-f16 。简单的说其实 GPU 原生支持最好的就 IEEE 754 fp32,f16 i..
更多Amazon 与 Anthropic 达成50亿美元投资和计算协议,进一步加强合作
亚马逊周一表示,将向 Anthropic 追加投资 50 亿美元,这是双方扩大合作关系的一部分,这将使两家科技公司更紧密地合作。亚马逊表示,如果合作达成某些商业里程碑,其总投资额可能高达 250 亿美元。作为协议的一部分,Anthropic 公司同意购买价值超过 1000 亿美元的亚马逊云服务。Anthropic 公司一直受到计算能力不足的困扰,而计算能力不足是其热门人工智能模型运行的瓶颈。Anthropic 公司表示,根据协议,它将使用亚马逊价值5吉瓦的人工智能芯片。亚马逊正在迅速扩大对新建数据中心和芯片设计的投入该公司表示,今年将投入2000亿美元用于资本支出,其中大部分将用于人工智能相关投资,包括新建数据中心。参考:https://www.wsj.com/tech/ai/anthropic-amazon-..
更多

Anthropic 关于近期 Claude Code 质量报告的最新进展
An update on recent Claude Code quality reports部分用户反映 Claude 的响应速度变慢的报告。经查,这些报告源于三项不同的变更,分别影响了 Claude Code、Claude Agent SDK 和 Claude Cowork。API 未受影响。截至 4 月 20 日(v2.1.116),所有三个问题均已解决。三个不同的问题3 月 4 日,我们将 Claude Code 的默认推理难度从 high medium 为中,以减少部分用户在 high 模式下遇到的过长延迟(延迟甚至导致界面卡顿)。但这一调整并不理想。4 月 7 日,在用户反馈他们更倾向于默认使用较高智能级别,并在处理简单任务时选择较低难度后,我们撤销了这一更改。此次调整影响了 Sonnet 4.6 ..
更多Amazon 与 Anthropico 达成50亿美元投资和计算协议,进一步加强合作
亚马逊周一表示,将向 Anthropic 追加投资 50 亿美元,这是双方扩大合作关系的一部分,这将使两家科技公司更紧密地合作。亚马逊表示,如果合作达成某些商业里程碑,其总投资额可能高达 250 亿美元。作为协议的一部分,Anthropic 公司同意购买价值超过 1000 亿美元的亚马逊云服务。Anthropic 公司一直受到计算能力不足的困扰,而计算能力不足是其热门人工智能模型运行的瓶颈。Anthropic 公司表示,根据协议,它将使用亚马逊价值5吉瓦的人工智能芯片。亚马逊正在迅速扩大对新建数据中心和芯片设计的投入该公司表示,今年将投入2000亿美元用于资本支出,其中大部分将用于人工智能相关投资,包括新建数据中心。参考:https://www.wsj.com/tech/ai/anthropic-amazon-..
更多

如何进行站点网络优化
站点的网络访问速度受到用户所在地区、网络运营商等多种因素的影响。针对这些差异,我们可以通过选择合适的 CDN 和机房来有针对性地优化特定地区、特定运营商下的访问速度。与此同时,客户端可以对不同域名进行测速,根据测速结果动态选择延迟最低的线路。网络优化大体上可以分为两个方向:静态资源加速和动态资源加速。静态资源加速方案对比下图对比了三个站点在印度尼西亚不同运营商下的整体耗时、DNS / TCP 耗时,以及平均传输速度,三个站点分别托管于腾讯云、Amazon 和 Cloudflare:从数据来看,DNS 耗时和 TCP 建连耗时在不同方案间差异较大,而传输速度方面腾讯云表现更为突出。因此,针对不同地区与运营商,选择合适的 CDN 组合才能达到最优效果。CloudflareCloudflare CDN 会根据 Cac..
更多

Google宣布Gemini API预付费结算功能逐步启用
Today, we are announcing Prepay Billing in Google AI Studio, a significant update to how you can pay for the Gemini API. This feature offers increased spend predictability and a simplified workflow for both prototyping and scaling applications. Prepay Billing is available in AI Studio for new Google Cloud Billing Accounts in the US that enable the Gemini API..
更多