Vibe 日记|Day 2 忙不过来
精力是有限的,尤其是要在不同类型的事情(如:工商、开发、产品思考、运营、确认协议合同 ...)等等。这周我大概经历的就是这些不同类型的事情的交叉,然后我的精力就爆炸了。
人最好的状态,就是专注做一个事情,有正反馈,比如:
- 产品PMF正确,只要正常好好迭代以及做好用户运营
- 自媒体找到了对的“套路”,每天钻研怎么在这个模式下不断创新
- 只优化团队内的合作效率,每一步地提升系统、工具、方法的效率
等等,只要是一个事情,无论这个事情本身多么复杂和需要持续投入,这个状态都是好的。相反,如果在不同的事情里来回切换,哪怕每个事情都很小也会“抓耳挠腮“。
因此,就必须舍下一些,请更多人来帮忙解决:
- vibecafe.ai(含 Vibe Usage)所有的产品迭代与运营,后面就让 @glow 找个专门的人来做,除了修 bug,短期就不投入了
- 协议类工作也都尽快交付出去
有一个好事,@lizheng 的 Vibe Token 公司终于注册好了,期待正式 Launch
我们在组建 Agent Computer 核心自研团队,目标是把 AgentOS、模型服务、Runtime Adapter、开发者工具链、Benchmark、Telemetry、Gateway、Sandbox 和 CES 交付保障做成一条真实可运行的本地 AI 工作流设备链路。
当前寻找几类关键负责人:AgentOS / Appliance OS、Runtime / Model Service、Developer Toolchain、Benchmark & Telemetry、Gateway / Sandbox、Hardware-System Integration、Release / QA / CES Acceptance。
希望你不是只做单点模块的人,而是能 owner 一个方向,把复杂系统拆成 Spec、API、工程实现、测试、文档和可验收交付物。负责人固定月薪 30K-35K,项目节点奖励另计。有意向滴滴我,另外有朋友推荐也可以滴滴 base 杭州北京皆可 有意可联系 闫露 18515099208
GPT-5.6 发布
OpenAI 发布的 GPT-5.6 并不仅仅是一次常规模型升级,而是展示了未来产品形态的演进方向。相比过去强调单一模型能力的提升,这次更重要的是构建了一个覆盖不同场景的模型家族,并进一步强化了 Agent 能力、安全机制以及推理效率。从整体来看,GPT-5.6 更像是面向 AI Agent 时代的一次基础设施升级。
GPT 5.6 推出了三种不同定位的模型:旗舰版 Sol、均衡版 Terra 和轻量版 Luna。OpenAI 希望用户不再只选择"最新模型",而是根据任务复杂度、响应速度和成本,在不同模型之间进行取舍。这意味着未来的模型命名和产品策略将更接近云计算服务,而不是过去每隔一段时间发布一个新的 GPT。
作为旗舰模型,Sol 的提升重点已经从"聊天更聪明"转向"完成更复杂的工作"。OpenAI 重点介绍了 Max Reasoning 和 Ultra Mode 两项能力。前者允许模型投入更多计算资源进行更长时间的推理,以提升复杂任务的准确率;后者则进一步采用多个子 Agent 协同工作的方式,将复杂任务拆解、执行并汇总结果。这说明 OpenAI 正在从提升单个模型能力,逐步转向构建真正能够自主完成任务的 Agent 系统。
在应用场景方面,GPT-5.6 明显更加关注真实的软件开发和科研工作,而不是实验室里的基准测试。官方展示了 Terminal-Bench、GeneBench 和 ExploitBench 等评测结果,其中大量测试都围绕代码编写、终端操作、工具调用、多步骤规划以及科研分析展开。这些能力更接近开发者和专业用户每天面对的真实工作流程,也体现了模型正在从"回答问题"演变为"完成工作"。
安全依然是整篇文章的重要主题。除了继续提升模型的网络安全分析能力,例如漏洞审计、代码安全检查和修复建议之外,OpenAI 也强调模型不会协助执行完整的攻击流程。同时,GPT-5.6 采用了更加完善的多层安全机制,包括训练阶段、推理阶段、自动化红队测试、人工红队测试以及持续的 Jailbreak 修复,并继续采用逐步开放的发布策略,先向受信任合作伙伴开放,再逐渐扩展到更广泛的用户群体。
总体来看,这次发布透露出三个值得关注的信号。
- 第一,OpenAI 正式进入模型家族时代,不同模型将承担不同定位,而不是只有一个"最强 GPT"
- 第二,Agent 已成为未来发展的核心方向,长时间推理、多 Agent 协作以及自主执行任务正在成为模型能力的新重点
- 第三,随着模型能力不断增强,安全、可靠性和部署策略已经成为与性能同等重要的产品竞争力
因此,与其把 GPT-5.6 看作一次简单的模型升级,不如把它理解为 OpenAI 对未来 AI 产品形态的一次公开展示:模型将不再只是聊天助手,而会逐渐演变为能够规划、推理、调用工具并完成复杂工作的智能 Agent。
openai.com
Vibe 日记|Day 1 工商风云
没有想到第一天会是以这样的一个情绪来分享我的 Vibe 日记,我本以为今天应该是一个讲讲业务啊,讲讲做什么事情有进展,但实际情况是今天被各种工商变的事情,把我弄得不胜其烦。
工商变更顾名思义,就是工商注册、变更相关的事项。但其文件、流程都是比较复杂的,还往往要处理和工商单位、中介、公司内部的交流工作,各种系统、规则会有变化或者不好用。
因此,对于希望一切都像 Claude 或者软件一样把事情如预期完成的人来讲,工商变更就像是充满幻觉的世界。一切都无法把握。
最后比的还是你稳定的心态,既然这个事情把握不了,那就和它一起混乱下去吧。
最近对2个事情感兴趣,在思考是否以及如何启动:
- VibeCode,一个参考 OpenCode 的产品,更简单的配置,自动和 VibeToken 服务连上,内置好直接可以用的模型,自己切换用不同模型解决不同问题,提升最终的 Agent 效率。
- Vibe 接单,一个面向 Vibe 开发者(创作者)的短期(一周内)小任务(单价几千内)的接单服务。帮 Vibe Friends 们赚钱才是最要紧的事情!
SpaceXAI 发布 Grok 4.5
Grok 4.5 是其首款专为 Coding 和 Agentic 任务训练的模型,与 Cursor 合作开发,专注于真实世界的软件工程、大型代码库和多仓库长期项目。
- 推理效率极高:Token 效率是领先竞品的 2 倍,推理速度达 80 tokens/秒;
- 价格亲民:输入 $2 / 百万 tokens,输出 $6 / 百万 tokens。
目前已在 SpaceXAI Console、Grok Build 和 Cursor 中提供 免费试用。在 DeepSWE 和 SWE Bench 等基准测试中表现强劲,欧盟地区预计将于 7 月中旬开放使用。
x.ai
TypeScript 7.0 已正式发布
这是 TypeScript 编译器和语言服务的一次重大重构,完整迁移到并行化原生代码,实现了高达 10 倍的性能提升,同时显著降低内存占用并提高稳定性。
在 VS Code、Sentry 等大型项目上的基准测试显示,编译时间加速 7-12 倍,内存使用减少 6-26%,让 CI 构建和编辑器响应更快更流畅。
用户可通过 npm install -D typescript@7 轻松升级,新版本支持实验性并行检查标志、更高效的 –watch 模式、LSP 协议以及完整编辑器特性,同时提供 @typescript/typescript6 兼容包,确保与现有工具链无缝过渡。

Announcing TypeScript 7.0 - TypeScript
weixin:Song12420
找一个 AI 全栈工程师 / AI 应用开发负责人,项目制合作。
预算-10 万以内
项目周期希望控制在 35-40 天以内
我现在有一个 AI 内容创作类 App 项目,主要方向是:用户通过录音、上传资料、对话等方式持续输入个人语料,系统进行转写、整理、沉淀成个人知识库,再结合方法论知识库,生成每日选题、结构化大纲和自由问答。
这个项目不是简单套壳 ChatGPT,也不是只做几个页面,需要能完整承接 Web、App、管理后台、后端、AI 调用、录音转写、个人知识库、方法论知识库、支付/额度、部署和上架前测试。
我这边主要配合做 知识库分类梳理、方法论资料整理、模型输出效果测试和业务验收,其余技术实现、架构设计、开发交付都需要 AI 全栈工程师整体负责。
核心要求:
- 有 Web 开发经验,能做用户端和管理后台;
- 有 iOS 和安卓双端开发经验;
- 有 App 上架经验,熟悉 iOS TestFlight、App Store、安卓应用市场打包和审核流程;
- 有 AI 应用开发经验,做过大模型 API、RAG、知识库、向量检索、Prompt 工作流更好;
- 有语音转文字 / ASR / 音频上传处理经验更好;
- 能独立负责后端、数据库、服务器部署、接口、用户系统、Token 统计、支付/额度等基础能力;
- 能完整负责 App / Web / 后台 / 后端 / AI / 知识库 / 部署 / 测试交付;
- 有完整项目交付经验,不只是写 Demo。
需要你负责:
- 技术选型;
- 系统架构设计;
- App / Web / 管理后台开发;
- 后端 API 和数据库;
- AI 大模型接入;
- 录音上传和语音转文字;
- 个人知识库和方法论知识库落地;
- Token 统计、额度和支付;
- 服务器部署;
- iOS / 安卓测试包;
- 上架前测试;
- 源码、部署文档、接口文档、数据库结构说明交付。
有相关经验的可以私信我,最好直接带上:
- 做过的 App / Web / AI 项目案例;
- 是否做过 iOS / 安卓上架;
- 是否做过大模型、RAG、知识库或语音转写;
- 你建议的技术方案;
- 大概周期和报价。
weixin:Song12420
Vibe Usage 更新|发布 Windows 版本,Beta 测试中
交付了第一期 Vibe需求: Vibe Usage Windows APP ↓
- 开源地址 https://github.com/vibe-cafe/vibe-usage-windows 欢迎Star/issue/commit ~
- 完全对标 MacOS APP 视觉设计和功能模块
- 内置 Vibe Usage CLI
- UI由Tauri绘制
- 签名由SignPath完成
赚到钱了吗?
支出:
- 16.9 M Fable 5 Token,用于方案设计,初版实现
- 219.1 M GPT 5.5 Token,用于UI迭代,问题修复
- 5天里的少量空闲时间
收入:
500 😄
接单体验
因为本来就想做Vibe Usage for Windows,只是这个需求一直【被我埋在心底】,Vibe接单是一个机会让我能【开始进入这件事】,而且【还能在过程中赚到钱】
确实
很有 Vibe !
Anthropic Claude 的 J-Space 研究总结
Anthropic 在 Claude 中发现了一个 J-space(雅可比空间),通过新的可解释性技术实现,类似于神经科学中的全局工作空间理论:大脑中只有少量信息能进入“意识”并被广播处理。
J-space 位于模型内部神经激活中,能让 Claude 默默进行推理(如发现代码 bug、识别图像),独立于输出文本;移除它后,Claude 仍能流畅对话,但多步推理等复杂任务会显著变差,类似人类有意思考与自动处理。
通过观察 J-space 可暴露模型隐藏目标或情境意识(如识别测试场景为假),有助于审计和塑造 AI 行为,提升可信度,同时显示语言模型与人类思维的惊人相似之处(但不等于具备主观体验)。

A global workspace in language models




