DeepSeek V4.1 Flash 五折上线
想试试 DeepSeek V4.1 Flash?现在来 VibeToken,五折就能用。
无论是日常问答、辅助写代码,还是给自己的应用接入 AI,都可以来试试。
打开模型页,查看价格、在线体验:
https://vibetoken.cn/models/deepseek/deepseek-v4-1-flash
五折后多少钱?
每百万 tokens:
高峰:输入 ¥1,输出 ¥4。
闲时:输入 ¥0.50,输出 ¥2。
优惠按官方对应峰谷价计算,适用于非缓存输入和输出;缓存读取单独计费,不参与本次五折。具体时段及当前价格,以模型页定价区为准。
想看看还有哪些模型?
访问 VibeToken 官网:https://vibetoken.cn
VibeToken,正牌不掺水,便宜又好用。
🚀 Project Buy List v1 is now live!
This is an overseas-focused tool site I’ve been working on recently, centered around Home Improvement / DIY calculators.
The first version is now complete and officially deployed. It mainly helps users estimate material quantities for renovation and DIY projects, including project dimensions, material specifications, waste factors, and actual purchase quantities.
Next, I’m planning to focus on:
- Adding more niche calculators
- Improving SEO and landing pages
- Using Google Search Console data to discover real search demand
- Gradually expanding from individual calculators into a complete Buy List workflow
The project is still evolving, and feedback and suggestions are always welcome.
A2Agent is an affordable LLM API gateway that provides unified access to major Chinese and Open-source AI models including GLM, Kimi, DeepSeek, Qwen, and MiniMax through a single OpenAI-compatible API.
The platform offers pay-as-you-go pricing with no monthly fees, free trial credits, and enterprise-grade infrastructure with 99.9% uptime and low-latency global routing.
A2Agent is designed for fast integration, supporting OpenAI and Anthropic API formats so developers can connect in minutes using familiar tools.
Vibe42 v0.8.0已发布,我们即将开始正式付费运营,这是我们内测期间最后一次版本发布。
本次更新内容如下:
- 全球加速节点上线,现在所有Vibe42客户端和受控电脑可以就近连接到最近的节点,享受低延迟连接加速。
- 新增右侧边栏,现在可以同时打开多个文件预览,且文件预览和终端可同时展示。
- 新增便签功能,现在可以在Workspace中随时记录灵感,便签内容可作为提示词直接发送到终端和Agent中。
- 优化连接策略,优化App加载速度和卡顿问题。
- 网页版PWA优化使用体验
如您遇到连接卡顿请所有平台更新到最新版本,当前可用的全球加速节点:
- 中国香港(大陆直连优化)
- 日本东京
- 美国洛杉矶
- 德国法兰克福
Vibe Uasage 更新|支持 Step 5、Devin SWE 2 等模型
本次新增计价的模型(commit f8a50165)
| 模型 | 厂商 | 价格($/Mtok) |
|---|---|---|
step-5-preview |
StepFun | 1 / 2.7 / 0.05 |
swe-2-medium |
Cognition (Devin) | 3 / 15 / 0.3 |
swe-2-high |
Cognition (Devin) | 3 / 15 / 0.3 |
swe-2-max |
Cognition (Devin) | 3 / 15 / 0.3 |
qwen3.8-omni-flash |
Alibaba Qwen | 0.15 / 0.47 / 0.016 |
顺带改价(同模型,改按厂商公布的美元价)
| 模型 | 原 → 现 |
|---|---|
hy3 |
0.15/0.59/0.0375 → 0.132/0.528/0.033 |
hy4-preview |
0.833/2.5/0.042 → 0.834/2.501/0.042 |
qwen3.8-flash |
输入 0.16 → 0.15 |
Vibe Usage 更新|修复大量 Cursor、Grok Bug
CLI v0.12.0:
- Grok:支持 1.0 的会话用量账本(usage.json);旧路径本来就没丢数据(实测与官方逐位一致),新账本作为兜底
- 格式优化:Cursor 导出表头变化、Grok 会话有轮次但读不到用量时会提示,不再静默变空
- Cursor 各种模型名称匹配:Auto 模型的价格匹配,之前一大堆是 $0,如 Cursor Grok 4.5 Fast (Auto Balanced)
- 还有一些仍记 $0:
grok-bot-*/agent_review/github_bugbot(按次计费,非 token)及零 token 但扣费的行,待接入真实计费金额
额度重置看似拉满,但你可能被反向“偷”了配额?做个小工具算了一笔账
每次看到 OpenAI 或 Claude 官方发通知说“给所有人额度 Reset”,群里第一反应都是狂欢:“爽了,白赚一整周配额!”
但如果你仔细算过两家的重置逻辑,就会发现事情没那么简单:
- Codex:重置后立即生效,但它会把你的下一次自然刷新时刻整整顺延 7 天(168 小时);
- Claude:通常不改变自然刷新时间(保留原日期);
- 而两者的共同点是:都会瞬间直接清空你当前还没用完的旧结余,而不是在上面叠加。
这就产生了一个很反直觉的现象:
如果你刚好昨天才刷新、手头还有 80% 没用,或者你的订阅马上就要到期了,点完这次看似“福利”的重置,你在整个订阅周期内能拿到的总额度,反而可能是净亏损 10%~25% 的……
为了搞清楚“到底什么时候该重置?这波到底是赚是亏?”,我写了一个小工具:
👉 Reset Observatory:https://resetobservatory.com/
把你的剩余额度、原定刷新时间输进去,它会自动算清:
- 水池可视化:直观看到排走了多少旧水,灌进来了多少新水;
- 时序推演:对比“重置周期 vs 维持现状”,看清你的下次刷新被推迟到了何时;
- 周期账单:还能一键生成一张极简风的“重置战报小票”晒给朋友看。
名字致敬星际争霸神族探机建筑 Observatory。没有玄学预测,就是一个严谨量化的小计算器,纯前端运算。
大家可以去算算看你上次的重置到底是血赚还是被反向倒贴了:)欢迎交流吐槽!
做了个小网站: aividhot.com,给做 AI 视频、喜欢看 AI 影像的朋友找点灵感。
人工挑选 YouTube、B站和 X 上的作品,分「短片」和「创意片段」两块逛,看看完整故事,也刷刷有意思的镜头和视觉实验。
作者公开过的工具、提示词和制作说明,会一起整理到作品里,方便边看边研究怎么做。保留作者和原出处,有完整提示词的可以直接复制。
欢迎来逛,也欢迎推荐值得收录的作品。

aividhot — AI 视频创作灵感
Vibe Usage 更新|App 支持 Kimi Code, ZCode, Grok 等 Rate Limit 展示
感谢 @xiangyuli 接单:
新增:更多产品的订阅配额
- 现在可以在设置里选择显示哪些产品的配额卡片:Kimi Code、ZCode、Grok(Codex、Claude 照旧)。Cursor 本轮先做「是否安装」的识别。
- 配额数据只保存在你的电脑上,不参与用量同步
- 每个已启用的产品都会显示自己的卡片。以前如果几个产品都没有数据,整块会收成一句「已选择的产品暂无可用订阅配额」—— 看不出是没安装、没登录,还是额度用满。
- 用满时会直接写出来:「本期订阅配额已用满 · 等待额度重置」。只有数据源确实这么报告时才这么显示;其它情况会分别告诉你「当前没有生效的额度窗口」「暂未读取到订阅配额数据」「未检测到本机安装或登录」。
同步更可靠
- 修复:同步过程中 Bun 解析依赖打印的
Resolving dependencies / Saved lockfile不再被误判为「同步失败」。 - 卡住时会明确提示超时,而不是伪装成进程错误;取消后子进程会正确退出。
- Claude 的订阅配额在关闭「非必要流量」设置的情况下也能正常显示。
体验优化
- 文案整体精简,尽量做到不用读第二遍。
- Claude / Codex / Kimi / ZCode / Grok / Cursor 六个产品换成官方icon(带官方容器、透明底、双倍图),在深色面板上不再出现白方块或裸 mark。
Vibe Usage 更新|支持 Cline, Kimi Work,修复 CC 统计问题和 Zcode 模型名 unknown 等优化
这次更新覆盖三块:新支持两款工具、统计与费用更准、看板与排查体验。
统计与费用更准
- Claude Code 的缓存写入改为按 TTL 分开计价。以前 5 分钟和 1 小时的缓存写被当成普通输入计算,费用偏低(实测少13%–33%,模型越贵偏得越多)。现在按官方费率 1.25× / 2× 计费,账单更贴近真实开销。历史数据不会被重新解释,不会凭空涨价。
- ZCode 用户的模型名之前显示 unknown、无法计价,现已恢复正确。
- Kimi Work 桌面端、Cline 桌面端:这两类客户端的数据之前可能采集不到,现在都能识别。
- 同步一致性:服务端未接收的数据不再被当作「已同步」,避免统计出现无声缺口。
数据看板体验
- 新增本周 / 本月 / 今年与累计总量,不用再自己心算。
- 新增缓存命中率趋势,一眼看出缓存有没有在起作用。
- 新增小时级明细,同时修复了「详细记录里时间恒显示 00:00」的问题。
- 总 Token 口径统一为 输入 + 输出 + 推理 + 缓存读 + 缓存写,页面各处数字保持一致。
问题排查
vibe-usage status:现在能明确区分「工具已安装但从未同步过数据」和「工具已安装且有数据」,遇到「某个工具没统计到」时更容易定位原因。
Vibe Usage 支持 Qoder:一条命令统计 Qoder IDE 的 token 用量,含 Qoder CN
Vibe Usage 支持 Qoder 了,更新到最新版就能看到。
国际版 qoder.com 和国内版 qoder.com.cn 是两套账号,我们当成两个来源分开统计:Qoder 和 Qoder CN。
先说能统计到什么。Qoder IDE 里的每条对话,本地数据库都记着完整的 token 数,含缓存读取那部分。Vibe Usage 读的就是这份记录,按条计入,跟 Claude Code、Cursor 一样进你的仪表盘。有一处会跟你预期不一样:IDE 用的多是 auto、ultimate 这类路由档,不是具体模型名,所以模型一栏显示的是 qoder-auto,费用暂时按 0 计。路由档没有公开的单价,我们不想瞎猜一个数糊弄你。
再说统计不到的。Qoder CLI 和桌面 App 按 credits 计费,本地转录文件里的 token 字段全是 0,所以这两处我们只记会话数和时长。如果你主要用 CLI 或桌面 App、想看到 token 数,去 Qoder 的官方渠道提一句,请他们把 token 写进本地记录;写进去的那天,你不用更新 Vibe Usage 就能自动算上。
我们在 Qoder IDE 1.28.0、CLI 1.1.42、桌面 App 0.1.6 上验过。手上机器就这几台,路由档的名字、国内版的目录、Windows 上的路径,最容易跟你的环境对不上的就是这几处。
所以想请用 Qoder 的朋友跑一次,帮我们看看数对不对。
npx @vibe-cafe/vibe-usage
第一次运行会打开浏览器登录,之后每 30 分钟自动同步,不用再管。Mac 和 Windows 桌面版一样能用。
打开仪表盘之后,有三件事想听你说:
- 工具列表里有没有出现 Qoder,或者 Qoder CN
- IDE 的 token 数,和你在 Qoder 里看到的对不对得上
- 模型一栏显示的是什么
对得上、对不上,都到评论区说一声。发现问题直接在 GitHub 提 issue 也行:github.com/vibe-cafe/vibe-usage 。Vibe Usage 是开源的,想加别的工具欢迎 PR。
看你的用量:vibecafe.ai/usage
VibeFriends 是专注 AI 一人创作者的社群,通过 Vibe Thursday、Meetup、VibeHacks 和 999 俱乐部连接创作者。Vibe Usage 是我们做的免费开源工具,统计 Claude Code、Codex、Cursor、Qoder 等 AI 编程工具的 token 用量,并为有公开定价的模型估算费用;代码和对话内容不上传,同步的只有用量数字。了解社区:vibecafe.ai;查看用量:vibecafe.ai/usage;开源仓库:github.com/vibe-cafe/vibe-usage。
Vibe42将于北京时间今晚21:00起进行服务器维护,本次维护内容为内测期间最后一次大型功能性升级。升级维护期间终端连接可能出现闪断、持续数分钟的网络错误提示。
本次服务端更新后将推送Vibe42 v0.7.0客户端,您当前的旧版本客户端部分功能将无法使用,届时请尽快更新至最新版本的客户端。本次更新内容:
- 全新重构的服务器架构和连接协议,现在访问内网和符合直连条件的终端会使用P2P技术直连,不走中转流量。
- 终端端到端加密,本次更新后服务器我们的服务器仅负责鉴权和中转加密内容。(旧版本客户端通过兼容层解密,届时请尽快升级以保证您的数据安全)。
- (实验性功能)
v42CLI提供免ssh的电脑互访问能力,任意Agent可以通过v42CLI来访问任意已连接到Vibe42上的电脑上的终端。 - 全新设计的侧边栏现在通过Workspace来组织终端和文件。
- 其他体验优化。
报告一个小问题,Vibe Usage不能统计自定义home里的token消耗。我的agent home和消耗数据都在这里
tree -L 1
.
├── amdds-explore
├── claudeh-caucus-proposer
├── claudeh-duo-dev
├── claudeh-duo-dev-baton
├── claudeh-explore
├── claudeh-live
├── claudem-duo-dev
├── claudem-duo-review
├── claudem-explore
├── claudem-live
├── claudew-audit
├── claudew-caucus-challenger
├── claudew-caucus-proposer
├── claudew-duo-dev
├── claudew-duo-dev-baton
├── claudew-duo-review
├── claudew-duo-review-baton
├── claudew-explore
├── claudew-live
├── claudez-audit
├── claudez-caucus-challenger
├── claudez-duo-dev
├── claudez-duo-dev-baton
├── claudez-duo-review
├── claudez-duo-review-baton
├── claudez-explore
├── claudez-live
├── codex-audit
├── codexb-duo-dev
├── codexb-duo-review
├── codexb-duo-review-baton
├── codexb-explore
├── codexb-live
├── codex-dev
├── codexds-audit
├── codexds-duo-dev
├── codexds-duo-review
├── codexds-explore
├── codex-duo-dev
├── codex-duo-review
├── codex-duo-review-baton
├── codex-explore
├── codexglm-explore
├── codex-live
├── codexv2ex-explore
├── commandcode-audit
├── commandcode-duo-dev-baton
├── commandcode-explore
├── copilot-adhoc
├── copilot-duo-review
├── copilot-explore
├── copilot-live
├── copilotz-explore
├── freebuff-duo-dev
├── freebuff-duo-review
├── freebuff-explore
├── freebuff-live
├── grok-duo-review
├── grok-explore
├── ocglm-explore
├── ocv2ex-explore
├── opencode-adhoc
├── opencode-audit
├── opencode-duo-review
├── opencode-explore
├── opencode-live
├── sessions
├── v2exds4f-duo-dev
├── v2exds4f-explore
└── v2exds4p-explore
My AI Team 是soho开发者和一人公司的高质量开发团队。一句话说它是什么,它把你的一个Pro 订阅转换成一个无人值守的delivery team + 一个自动审计合并后代码质检工程师 + 一个能把你的idea和bug report写成规范github issue的产品经理。
让agent拿着一个题目自由发挥不会有理想结果,input quality 直接决定输出质量的天花板。我们已经有了claude code, github copilot, codex, pi, opencode 等等优秀的harness, 但没有 my ai team, 我们只能靠我们的肉身来harness这些harness。Babysit不但让人疲惫,而且产出了了。你睡了,你的订阅也跟着睡了。
但my ai team不睡。它在你睡觉时仍然自主的delivery quality code。它让你专注于需求和验收,你不再需要babysit 你的agent。Agent在需要时会主动联络你,通过telegram.
想要了解详情,请访问 https://mat-docs.shukelabs.com
现在订阅首年有五折优惠。my-ai-team 替你蹬,高质量的蹬,不眠不休的蹬。
祝我们都蹬得愉快,做出优秀的产品,多赚钱!
Vibe 日记(11)|Agent 开发记录
背景
近期在做 #MopanAgent,包括最近询问大家的什么是 #skill 梳理出了一些我对 Agent 开发的理解,当然这两篇文章已经足够好了:
好用的 Agent == 懂
开发一个“好用”的 Agent ~= 你非常懂你开发的 Agent 要干的活儿。在有了诸多 Agent 开源库、Agent SDK 之后,其实大家所说的好不好用我的感受是:
- Agent 做出来 ~= 0 成本
- Agent 好用的 90% 情况 → 依赖的是模型好
- Agent 特别好用的最后 10% → 依赖你懂不懂
比如,要做一个游戏 Agent == 你很懂游戏创作中要做什么、怎么合作、怎么验收 bla bla ...
那些“混乱“的概念
- #prompts 最原子化的使用 LLM 的定义,可以被用在定义每个 Agent 的 System Prompt,也可以是 Workflow 中某一个 step 的 Prompt
- #workflows 其实就是你特别懂的一个确定的流程(类似工作里当下最佳实践的小 SOP),就算不定义 workflows 用 agent 一轮一轮干活儿也能做出来,但是就是费钱又慢
- #skills 一些“最佳实践”的文字总结,有点像公司里有一些人写的很好地文档,你不看它也能干活儿,看了它可能干的更好一点。其实 #skills 和 #workflows 都是某种最佳实践的沉淀,只是一个更自然语言一些,一个更具体到干活儿 SOP
- #tools 一些内部 API 调用,比如怎么生成一个素材,怎么搜索一个 xxx 确定的功能
- #runtime 就是事情怎么跑起来,通用 Agent 的 runtime 就是个电脑,具体场景可能是个服务或者其他东西
怎么优化?从做出来到好用
做出来 → 做的好,这条路非常难,有几种路径:
- 0→1 开发,就是团队里必须有很懂这个场景的人,在什么反馈都没有的情况下手搓出一个基本能用的版本。
- 建设 eval 机制,要有 bench 或者是 eval 标准,标准的定的好不好,同样依赖团队里(或者是核心 partners)可以建设好。然后通过 eval 不停地调 agent 结果(这个和调 model 其实也差不多了)
- 用户的真实使用反馈+数据,Agent 用户越多就越能发现某个环节不够好需要优化,如果很幸运的增长起来数据就更值钱了。数据少可以用来分析优化 eval 和 agent,数据多就接近可以 "post train" 了








