几分钟前刷到有人说推特私信不通知,错过了商单。。

不通知的问题我是知道的,所以我准备去清理下一堆的黄色私信和币圈诈骗私信。

然后,搞笑的来了,竟然真有一个商单的私信!!核验过了,是真的账号,1月底发的!!我才一千多粉,还能轮得到我喝汤?🤣

我已经回复了,不知道还有机会吗😆

我突然发现,我们玩 OpenClaw 玩 AI 助理的思路是错的啊,比如"手动新建会话省 token"这个方法,这是用程序思维解决问题,治标不治本啊。

既然我们要让 AI 像人一样工作,就该让 AI 学会人的思维方式,而不是让人迁就 AI 的局限。

所以我给 Pi 助理写了一个 skill:自动判断话题是该延续,还是开启新对话,话题切换时自动判断是否要保存上下文,不用手动 /new,对话流转交给 AI 自己决定。

Skill 内容参考:clip.versun.me/p/qTdyXmcC

单单只有 skill 并不能100%保证 AI 能遵守,所以你可以在系统提示词里面强制让 AI 读取这个 skill,或者你的记忆系统和我的一样有重要程度指标,则可以添加为最重要的记忆,这样每次 AI 读取记忆都能读到

Versun
这两天基本上把 Pi 的整体框架搭起来了,同时还实现了几个对我来说非常重要的功能:1. 提供商自动切换模型有时候因为网络问题或者额度用完直接罢工,现在 Pi 会在重试 3 次后自动切到下一个提供商,并通知我一声。不用手动去改配置,如图。2. 多主题并行会话… pic.twitter.com/KrbtXzv4Ho
分享下 Pi 的相关机制哈,你可以发给 pi 或者 openclaw 去实现
1. 提供商切换
注意:我没有使用pi内置的模型接口,而是通过自定义扩展来接入模型接口
2. 并行会话和插话功能
3./new前自动保存会话
感觉 Perplexity 要成为 2026 年第一个倒下的 AI 独角兽了。
之前在 PayPal 薅了一年 Pro 羊毛,结果用了几个月就吃灰。
这几天上去瞅了眼,还是那些功能,界面都没怎么动。
AI 时代这么卷,原地踏步就是在等死啊。。。

挑战用AI做50个应用#2 代码剪贴板Clip

上次发了 LKS 之后,居然真的有人在用——这种"我做的轮子居然还有人用"的感觉还挺奇妙的😂 趁热打铁,第二个应用也上线了:Clip,一个极简代码分享工具。 网址:https://clip.versun.me/ 动机:...

并行处理应该是 AI Agent 的基础能力,这么聊天太爽了!不用等上一个任务完成,尽管发

定制小龙虾 Pi 近况 #1

这两天基本上把 Pi 的整体框架搭起来了,同时还实现了几个对我来说非常重要的功能: 1. 提供商自动切换 模型有时候因为网络问题或者额度用完直接罢工,现在 Pi 会在重试 3 次后自动切到下一个提供商,并通知我一声。不用手动去改配置,如图。 2. 多主题并行会话...

同志们,别再折腾 OpenClaw 全家桶了,直接用它的核心 Pi,从零捏一只专属小龙虾🦞

开局稍微费点功夫,模型配置和 API 密钥那部分得手动填,别的都还好。一旦跑起来,后续所有功能开发全在聊天框里闭环完成。让 AI 自己写扩展自己的功能,这种自举的感觉确实有点不真实。

关键是轻量,要啥装啥,绝不给你硬塞臃肿模块。相比 OpenClaw 那坨黑盒,这种从 0 到 1 的全盘掌控感爽多了。

现在就一个感受:工具链还是要捏在自己手里才踏实。😎

有想折腾的同志不?人多我后续出个踩坑实录,帮你们省点摸黑时间。

试了一天 GPT-5.3 Codex 和 Opus-4.6,结论:GPT-5.3 这啥玩意儿,还不如 5.2 靠谱。 Opus-4.6倒真不错,速度和 debug 能力明显提升。 日常 Kimi + Opus 够用了
Versun
简单分析下凌晨刚发布的 Opus 4.6 在编码方面的能力:1. Agentic terminal coding 是终端交互能力,提升明显,编写脚本、操作文件更顺畅2. Agentic coding 是核心编程能力,降低了0.1,也就是说代码能力和 Opus 4.5 基本一致3. Scaled tool use 是工具调用能力,降低了2.8,不会更积极的调用 MCP… pic.twitter.com/6XNrewGx88

再简单对比下 Opus 4.6 和 GPT 5.3 Codex
我只根据官方的发布文档进行比较,由于双方的基准测试版本不同,所以没法完全对比,其中只有一个指标是同一个版本的:

1. Terminal-Bench 2.0

  • Opus 4.6: 65.4%
  • GPT 5.3: 77.3%

GPT 5.3 Codex 在终端命令行的交互上更好,效率更高

其余的编程指标:

 

2. SWE-Bench(代码库级工程能力)

  • Opus 4.6: 80.8%(Verified 版本,只测 Python)
  • GPT 5.3: 56.8%(Pro 版本,4 种语言,防污染更严格)
这俩不是同一个测试集。Verified 是 Anthropic 常用的 Python 专项测试;Pro 是 OpenAI 新推的多语言版本,难度和评估标准都不同。不过可以确认的是,两家在各自的测试上都刷新了 SOTA

 

3. OSWorld(计算机操作/Agent 能力)

  • Opus 4.6: 72.7%(原版 OSWorld)
  • GPT 5.3: 64.7%(OSWorld-Verified)
看起来 Opus 高,但 Verified 版本修复了原版很多问题,评测更严格可信。人类基线约 72%,所以 GPT 5.3 的 64.7% 实际上更可信,更接近人类水平的表现
 

总结

复杂问题 / Debug / 做计划 / 超长上下文 / 重构 / Python ===> Opus 4.6

OpenClaw / 个人助理 / 依赖终端交互 / 多语言编程 ===> GPT 5.3