VibeCafé
请登录
weng
weng@yizheng·2026-05-28

我做了一个本地面板,统一管理所有 AI API Key 和用量

每次换工具就要重新粘 API Key,账单也不知道花哪去了。
做了个 API Vault——把 Base URL 换成本地代理地址,它自动注入真实 Key、记录每次调用的 token 数、花费、延迟,数据全部加密存本地,不上云。
Docker 一行启动,也支持 Windows 双击运行。
https://github.com/WENGENG-boop/api-vault
还在早期,欢迎 Star 和提 Issue 🙏

API Vault - Local AI API Proxy, Key Manager & Usage Dashboard

评论 6
Weiyang
Weiyang@weiyangzen·2026-05-31

都亮起来吧!

徽章上限再来十倍,我去改自家Infra

评论 4
熠辉
熠辉@yihui·2026-05-29

Forget Vibe Coding. Learn marketing!

昨晚又有$129的订阅!学习蓝星空的,开始Grow in public,从今天开始也会分享更多增长相关的内容。

评论 1
陈万里
陈万里@n1neman·2026-05-28

纪念一下达到10B

终于达到100亿

评论 1
阴明
阴明@kalasoo·2026-05-28

你平时最常和 Claude Code, Codex 等说的话?

评论区补充你最常说的

登录后投票

评论 9
灵山
灵山@nickname4th·2026-05-30

今天撸了个小玩意 —— luma

今天撸了个小玩意 —— luma
背景是这样的
有多个服务器,有的在国内,有的在海外,有的在家里
有已备案的域名,用cloudflare的dns
每次上线小垃圾的时候,都要来回倒腾,不然就是用一些成熟的paas(比较费钱,虽然也不是很费钱,但买了服务器空着也是空着)
所以现在有了luma
配置好之后,让你的agent安装luma skill,帮你写部署yaml
只需要:指定一个域名,比如 doc.example.com,指定一个部署的 region
然后 luma depoly 这个 yaml 即可
luma会自动申请证书、修改 dns,然后用对应 region 的 worker 负载它。
还支持 egress,无论是join node时候开启, 还是 yaml 开启,luma会识别并将流量通过代理转发(也就是说你可以配置✈️订阅,然后luma自动把流量给你走机场,cn 域名 -> cn server -> ✈️)

vibe 1 天还很粗糙~

评论
阴明
阴明@kalasoo·2026-05-30

Vibe Coding 今日梗图

评论
Captain
Captain@captain·2026-05-29

Cursor 发布了一份开发者报告,里面有些数据很有意思

Cursor 发布了一份开发者报告,里面有些数据很有意思

挑几个比较重要的点来说:

头部用户的 AI 代码产出、token 消耗、PR 合并量都远高于中位数,而且差距还在扩大。

AI 写代码前读得越来越多,input/output token ratio 大幅上升。真正贵是理解一个代码库和任务。

缓存变得非常重要,如果每次 agent 都从零读上下文,成本会爆炸。这意味着未来 coding agent 的竞争力很可能在上下文缓存、增量理解、长期记忆这些地方。

放权越来越多,手动 diff acceptance 变少,更多 AI 改动直接进入 commit 流程。

PR 变大,工作颗粒度变大,报告里说单个 PR 的新增行数、1000 行以上的大 PR 占比都在上升。副作用是 review、测试、架构边界会更重要。

Cursor (@cursor_ai) on X

评论
Captain
Captain@captain·2026-05-28

Anthropic 今天正式推出 Claude Opus 4.8,

Anthropic 今天正式推出 Claude Opus 4.8,这是对前代 Opus 4.7 的重大升级,
立即在 claude.ai、Claude Code 和 Claude API 上可用,
价格保持不变(常规模式:输入 $5/M tokens,输出 $25/M tokens;快速模式更便宜)。

主要亮点

性能大幅提升:

在 Super-Agent、Legal Agent、Online-Mind2Web 等多个基准测试中超越 Opus 4.7 及 GPT-5.5 等竞品,是目前唯一能端到端完成所有 Super-Agent 测试的模型,并在 Legal Agent Benchmark 上首次突破 10% 全通过标准。

更强的代理能力(Agentic):

工具调用更高效(步骤更少)、判断更可靠、主动发现输入/输出问题,代码缺陷通过率降低至前代的 1/4。

输出质量更高:

信息密度更大、信噪比更好,长上下文和风格保持能力显著增强。

新功能:

努力程度控制(Effort Control):

默认高努力,可选“extra”或“max”应对复杂任务。

Claude Code 动态工作流:

支持大规模任务。

Messages API 新特性:

支持在消息数组中插入 system prompt,实现中途动态更新。

评论 3
domi
domi@mempaw·2026-05-28

最受欢迎的 20 个 vibe coding 提示词😏

评论 2
ham
ham@aiweb3open·2026-05-29

国外国内模型差距在拉大嘛

刚才看到一个评论 让我大悟,你会选择使用哪个模型?

评论
Captain
Captain@captain·2026-05-29

ai的数据飞轮,某种程度上和很早之前流行的互联网人体蜈蚣有异曲同工 [图片]

ai的数据飞轮,某种程度上和很早之前流行的互联网人体蜈蚣有异曲同工

评论 2
熠辉
熠辉@yihui·2026-05-28

出海新手的困惑:莫名其妙的订单增长

近一个月没推广,前天居然单日破了$100!下个月要开始努力做增长了!

评论 6
飞鱼BH1JSS
飞鱼BH1JSS@bh1jss·2026-05-28

有玩业余无线电(HAM)的么?

HAM FMO Dashboard

评论 1
阴明
阴明@kalasoo·2026-05-28

Vibe Coding 每日梗图

Claude 真的是一骑绝尘了吗?

评论
阴明
阴明@kalasoo·2026-05-28

Cn we have the day off? // 我们能放一天假吗?

所以,显然我们正处在一场变革的临界点:全世界的白领劳动力(进而也包括美国大部分劳动力)即将经历一场生产力的革命。AI 是那种将彻底改变我们工作方式、我们与世界互动方式、我们学习方式、我们社交方式——以及所有这一切——的技术。这听起来很棒。真的,很棒。一切都变得更快、更轻松,对我们所有人的生活来说都将是一份非凡的福利。

那我们能放一天假吗?

如果 AI 要把我们各方面的生产力提高十倍,那就意味着我应该能在周一中午之前就完成在过去要花上一整周才能产出的工作量。

那我能不能干脆周五就休息了?从现在起,我周一、周二、周三、周四工作,然后周五放假。我们甚至可以把周五定为类似"AI 劳动者日"之类的节日;我保证周四会拼命写出色的提示词,然后那些 agent 就能在整个周五埋头处理它们。这样一来,你几乎都不算损失了周五,对吧?

而且,这当然会全面适用。所以你们——董事会成员们、各位高管们——也可以周五休息,去高尔夫球场打完整整 18 洞。那会很美好,你能想象吗?你不必待在办公室,因为我也不会待在办公室。你不必待在办公室,因为 AI agent 们在那儿。而我也不必待在那儿!

就多放一天而已。考虑到这是一场横扫人类生产力每一个领域的彻底的世界革命,这个要求似乎挺合理的,其实也是个相当小的变动。

(喂,Elon:我正在努力提高生育率呢。在我们加州这儿,三个小孩的托育费一个月就要六千美元。我这周非得五天都去办公室不可吗?为什么不能四天?)

Can we have the day off?

评论
阴明
阴明@kalasoo·2026-05-31

Vibe Coding 今日梗图

评论
Captain
Captain@captain·2026-05-31

实测claude 4.8 主观感受

claude 4.8 ~褒贬不一,整体感觉还是提升不大的
先来说说优点
长任务执行能力提升很大,在已有代码库上长时间自主工作的能力增强,继续保持一次性功能、快速执行"的强项
缺点
强于从零开始,弱于收尾;在已有复杂代码库的边缘情况上表现较弱
效果高度依赖 effort 设置
多轮对话效率感觉还是弱于 5.5
你觉得 claude 4.8 更新有变好吗?

登录后投票

评论
ham
ham@aiweb3open·2026-05-30

AI和Web3真的非得搞在一起吗?

说实话,“必然”这词听着就挺忽悠的。没有哪条法律说AI必须上链,也没有物理定律说区块链必须蹭AI。

但为什么现在一堆人吹?因为俩货正好能互相擦屁股:

AI太吃数据和算力,最后全被大厂捏着。Web3的画饼是:算力、数据、模型都分给社区,别让OpenAI一家爽。

Web3的合约是死的,不能判断“这价格合不合理”。AI可以喂实时行情,让合约变得“懂点事”。

用户给AI喂数据,大厂白嫖。Web3想让你自己卖数据,自己收钱。

Web3的体验烂得像上世纪网银。AI帮你翻译成人话:“我要买一个ETH”,后面自动搞定。

逻辑上挺美,但现实是:

链上跑AI贵到死。现在主流是链下算完了,把结果或证明扔链上。

去中心化又慢又便宜不了,AI要的是又快又贵的大集群。两者本质矛盾。

Web3的人开源信仰拉满,AI那边烧了上亿美元的不可能给你白嫖。

万一AI搞出幺蛾子,谁是责任人?DAO?代码?没人背锅的事监管第一个盯上。

所以大概率不会“合体成一个东西”,而是分层:

脏活累活(训练、推理)放链下

关键证据或Zk证明上链

钱和治理用合约跑

真正能成的场景:数据市场、算力市场、AI生成内容确权、AI辅助的DAO治理。

结论:不是必然,但会在几个小圈子里先跑通。别信“革命”,信具体项目。

评论
阴明
阴明@kalasoo·2026-05-30

参加 Vibe Hacks 要给自己附魔一下

评论
阴明
阴明@kalasoo·2026-05-30

Vibe Hacks #04 早安

大家都已经陆续到场

勇夺 Vibe 之剑🗡️

评论 1
阴明
阴明@kalasoo·2026-05-29

Opus 4.8 Day1,体验如何?

登录后投票

评论 2
Captain
Captain@captain·2026-05-28

VibeCafe什么时候也能做这样的硬件?

今年的 GitHub Universe 2025大会上,最吸睛的不是新品,也不是keynote,而是一块看起来很不安分的胸卡。

对,就是那块可以联网、能显示动画、还能被黑客玩坏的小设备,这已经不是胸卡了,是一块能编程的大会纪念品,在多数科技大会里,胸卡只是身份标签,顶多配个 NFC。但GitHub大会这次干了件挺开发者的事:他们做了一块真正意义上的可玩胸卡。

看起来很酷

评论 3
阴明
阴明@kalasoo·2026-05-28

I’m tired of talking to AI // 我厌倦了和 AI 对话

  • 触发点:作者发现一些 GitHub 仓库在传播恶意软件,问 AI 怎么办却得不到有用答案。于是在 GitHub 开了讨论帖求助。

  • 第一次撞见 AI:有人回复了——内容竟和 AI 给他的答案一字不差。他点破后评论被删;接着另一个人回复,又是同一段 AI 答案。

  • 职场经历:当开发者时,他向公司老板问一个业务问题,老板直接甩来一张 ChatGPT 截图。作者指出答案文不对题、全是错的,老板一分钟后又发来另一张截图——他根本没读 AI 的回答,只是截图转发。

  • Reddit 私信:有人就他的帖子私信他,来回聊了几句后,他才意识到对面是个 AI agent。

  • 核心情绪:他厌倦了和 AI 对话,想和真人交流;可即便面对真人,对方也只是把问题转给 AI,再把 AI 的答案发回来。

I’m tired of talking to AI

评论
阴明
阴明@kalasoo·2026-05-28

Anthropic 和 OpenAI 找到了 PMF

  • 核心论点:编程 agent(Claude Code/Cowork、Codex)让两家公司首次找到真正的 PMF——这类工具消耗海量 token,且正成为高薪专业人士的日常工具。

  • 企业现按 API 原价付费:过去六个月,Anthropic 把企业版改为 $20/席位/月 + 按用量计 API 价格;OpenAI 也在 4 月对 Codex 做了同样改动。先前的大幅折扣已取消,企业(通常签年约)被锁定在 API 原价。

  • 作者自己的用量:$100/月 Max + $100/月 Pro 两个订阅,按 API 价折算近 30 天本该花 $2,180(Claude Code $1,200 + Codex $980)——对个人重度用户是超划算的"亏本买卖"。

  • 为什么 ChatGPT 不算 PMF:2 月有 9 亿周活,但仅 5,000 万(5.6%)付费。靠 $10-20/月消费者订阅难以覆盖万亿美元基础设施成本;而企业每用户 $200+/月能快得多。

  • 两家都在扩招销售:OpenAI 703 个岗位中约 32.6% 与企业销售/支持相关,Anthropic 390 个中约 26.9%。讽刺的是 AI 公司选了个高度依赖人力的商业模式。

  • "AI 失败"故事被夸大:Uber"用超全年 AI 预算"主要因 2025 年定的预算没料到 2026 年 Claude Code 的需求;微软取消 Claude Code 许可也部分是财年末的财务决定。作者认为这些反而印证了 PMF——好的定价应让客户"倒吸一口凉气然后点头"。

  • 算力开销惊人:SpaceX 的 S-1 文件显示,Anthropic 承诺到 2029 年每月支付 $12.5 亿购买 Colossus 算力(主要用于推理而非训练),暗示推理预算之庞大。

  • API 收入重要性下降:Anthropic 历史上依赖少数大客户(Cursor、Copilot 曾占 $40 亿营收中的 $12 亿)。转向企业版意味着绕开中间商——Claude Code 直接与 Cursor、Copilot 竞争。Anthropic 传闻 Q2 营收达 $109 亿,或首次盈利。

  • 结论:继 2025 年 11 月"模型变得真正好用"的拐点后,2026 年 4 月是"收入兑现"的新拐点。真相要等 Anthropic 和 OpenAI IPO 的 S-1 审计数据才能确认。

I think Anthropic and OpenAI have found product-market fit

评论