8月9日2026 · 星期日

从 30 条抓取中筛选 12 条 · twitter × 5 账号 · 01:01 UTC 生成

今日信号 · 高度即评分 · 点击直达


  1. Claude Code 支持会话间自主通信,实现多任务协同8.0
  2. GPT-5.6 Sol 发布,付费用户用量限制重置8.0
  3. 科技巨头联手推出开放Agent插件规范8.0
  4. Cloudflare Computer 在 Durable Objects 中用 SQLite 为代理提供持久文件系统状态8.0
  5. 前FDE揭露该职位常是安抚AI焦虑老板的安慰剂7.0
  6. 独立开发者分享从开源CLI到付费Mac软件的10条经验7.0
  7. AI写小说的真正瓶颈是生动叙事,而非一致性7.0
  8. Kimi应用下载量翻五倍,日活用户激增40%7.0
  9. 开发者分享使用 Claude Design 与 Baoyu-Design Skill 进行 UI 原型设计的工作流7.0
  10. 如何有效使用 Agent /goal 功能执行长时间优化任务的实用指南7.0
  11. 评论:Prime Agent 的框架优化未必体现真实世界 AI 能力7.0
  12. ralph-playbook:自主AI编码循环的结构化指南7.0
018.0

Claude Code 支持会话间自主通信,实现多任务协同

Claude Code 2.1.224 版本新增跨会话消息功能,不同会话可直接发送摘要并协调工作。会话现在可以自主通知彼此相关变更,例如一个会话修改了影响另一个并发任务的代码。这消除了在会话间切换时手动重新解释上下文的需要。 该功能实现了更高效的多智能体工作流,使并发 AI 会话能像人类团队成员一样协作。它减少了上下文切换开销,防止因信息过时导致错误,显著提升开发者生产力。自主通信能力是迈向软件开发中更复杂 AI 代理协调的一步。 会话通过共享目录中的文件注册自身,因此通信需要会话间文件系统可见性。消息包含摘要而非原始历史或文件,保护隐私。该功能在最新版 Claude Code 的 macOS 和 Linux 上可用。

@Gorden_Sun@dotey 转推1 个视频Claude支持会话之间互相发消息了: 1,你可以问当前会话其他对话的信息,把其他对话的信息整合到当前会话。这倒没什么难度,类似compact然后把总结带过来。 2,牛逼的是会话间自主通信。如果你当前开了2个会话任务同时在跑,一个会话改了东西会影响到另外一个会话,这个会话就会自主把消息发给另外一个会话。就像是两个人同时做一个项目,一个人做了比较大的改动,他就会把改动同步给另外一个人,避免另外一个人懵逼。原推文媒体预览展开原推文收起原推文

@dotey 转推了

@Gorden_Sun

Claude支持会话之间互相发消息了: 1,你可以问当前会话其他对话的信息,把其他对话的信息整合到当前会话。这倒没什么难度,类似compact然后把总结带过来。 2,牛逼的是会话间自主通信。如果你当前开了2个会话任务同时在跑,一个会话改了东西会影响到另外一个会话,这个会话就会自主把消息发给另外一个会话。就像是两个人同时做一个项目,一个人做了比较大的改动,他就会把改动同步给另外一个人,避免另外一个人懵逼。

@ClaudeDevs

New in Claude Code: your sessions can now message each other. Instead of having to re-explain yourself in another session, you can now tell Claude to do it. It sends a summary (not your history or files), and the other session picks it up mid-task.

背景
Claude Code 是 Anthropic 的 AI 辅助编码命令行工具,允许开发者在终端会话中与 Claude 交互。多智能体工作流涉及并行运行多个 Claude 实例,各自处理不同任务。此前,会话间共享上下文需要手动复制,容易出错且耗时。

8月8日 00:56在 X 打开#Claude Code #AI agents #multi-agent #developer tools #AI

028.0

GPT-5.6 Sol 发布,付费用户用量限制重置

OpenAI 发布了 GPT-5.6 系列中最强大的 Sol 变体,现在可在包括 CC harness 在内的多种环境中使用。为庆祝此事,所有付费的 ChatGPT Work 和 Codex 用户的用量限制已被重置,重新获得使用额度。 GPT-5.6 Sol 代表了 AI 能力的重大进步,尤其是在编程、科学和网络安全领域。重置付费用户的用量限制不仅奖励了忠实客户,还鼓励了对新模型的更广泛实验,可能加速其采用和反馈。 GPT-5.6 Sol 是于 2026 年 7 月 9 日发布的三变体家族(Luna、Terra、Sol)的一部分,此前在 6 月 26 日进行了有限预览。CC harness 是一个用于 Claude Code 的桌面工作台,可可视化子代理调用树。Codex 的用量限制通常基于滚动窗口或每周上限,此次重置为可能已达到限制的用户提供了即时缓解。

@thsottiaux串推 2 条2 段That's right, GPT-5.6 Sol is awesome and can be used pretty much anywhere, including in the CC harness. To celebrate this, together with the fact that I'm not going anywhere... I have reset usage limits for all paid users of ChatGPT Work and Codex. Have fun out there! > 引用 @bcherny: @thsottiaux We are hiring if you would like to work at Anthropic! > > We don’t ban people for using harnesses with other models. Almost certainly it was a different account classifier that triggered. Looking into it, thanks for escalating.展开原推文收起原推文

@thsottiaux串推 2 条

That's right, GPT-5.6 Sol is awesome and can be used pretty much anywhere, including in the CC harness. To celebrate this, together with the fact that I'm not going anywhere... I have reset usage limits for all paid users of ChatGPT Work and Codex. Have fun out there! > 引用 @bcherny: @thsottiaux We are hiring if you would like to work at Anthropic! > > We don’t ban people for using harnesses with other models. Almost certainly it was a different account classifier that triggered. Looking into it, thanks for escalating.

@bcherny

@thsottiaux We are hiring if you would like to work at Anthropic! We don’t ban people for using harnesses with other models. Almost certainly it was a different account classifier that triggered. Looking into it, thanks for escalating.

cc @theo

背景
GPT-5.6 是 OpenAI 开发的大型语言模型,接替了 GPT-4 等早期版本。Sol 变体是最先进的,面向企业和研究用途。ChatGPT Work 和 Codex 是付费订阅层级,提供对 OpenAI 模型的增强访问,但附带有用量限制以管理服务器负载。CC harness 是一个第三方工具,与 Anthropic 的 AI 编程助手 Claude Code 集成,允许用户运行和监控 AI 代理。
社区讨论
该公告引发了 Anthropic 员工的回应,澄清公司不会因用户在其他模型上使用 harness 而封禁,并暗示问题是由不同的账户分类器触发的。这表明了跨公司互动和围绕使用政策的透明度。

8月8日 20:29在 X 打开#GPT-5.6 #ChatGPT #Codex #AI policy #Anthropic

038.0

科技巨头联手推出开放Agent插件规范

Google、OpenAI、Amazon、Microsoft、Cursor 和 Vercel 联合创建了一个开放、供应商中立的规范,用于将 Skills 和 MCP 打包为 Agent Plugins。这使得开发者可以构建一次插件,并在 Claude Code、Codex、Cursor 或 Antigravity 等多个 AI 编码环境中运行。该规范定义了可复用 AI 代理组件的可移植包格式。 此次合作打破了围墙花园,实现了 AI 代理扩展的跨平台兼容性。它减少了碎片化和重复工作,使开发者能够一次编写、随处部署,从而加速创新并降低成本。主要竞争对手的参与表明行业在互操作性方面达成了强烈共识。 Agent Plugins 规范为 1.0.0 版本,使用 Agent Skills 规范而不重新定义,专注于技能发现和故障隔离。它由一个包括 Core 贡献者的技术指导委员会管理。该规范公开开发,可在 agent-plugins.org 上获取,并附有模式和治理文档。

@bibryam原推文1 张图片Google, OpenAI, Amazon, Microsoft, Cursor, & Vercel just created an open, vendor-neutral spec how Skills and MCP gets packaged as an Agent Plugin https://developers.googleblog.com/agent-plugins-package-your-skills-tools-and-more/ What is the benefit: build a plugin once & run it in Claude Code, Codex, Cursor, or Antigravity 🔥🔥原推文媒体预览展开原推文收起原推文

@bibryam

Google, OpenAI, Amazon, Microsoft, Cursor, & Vercel just created an open, vendor-neutral spec how Skills and MCP gets packaged as an Agent Plugin https://developers.googleblog.com/agent-plugins-package-your-skills-tools-and-more/ What is the benefit: build a plugin once & run it in Claude Code, Codex, Cursor, or Antigravity 🔥🔥

背景
MCP(模型上下文协议)是 Anthropic 于 2024 年 11 月推出的开放标准,用于将 AI 模型连接到外部工具和数据。Agent Skills 是扩展 AI 代理能力的可复用组件。Agent Plugins 将这些技能打包成可移植格式,类似于其他生态系统中的软件插件。此次合作旨在标准化这种打包方式,使插件能够在不同的 AI 平台上工作。

8月8日 17:46在 X 打开#AI #MCP #Agent Plugins #Open Standard #Developer Tools

048.0

Cloudflare Computer 在 Durable Objects 中用 SQLite 为代理提供持久文件系统状态

Cloudflare Computer 引入了一种新颖架构,将一次性代理运行时的权威文件系统状态存储在 Durable Objects 中的 SQLite 里。容器后端通过沙箱容器内的 FUSE 挂载文件系统暴露该状态,使代理能运行标准 Linux 工具。文件系统变更通过 RPC 同步回 Durable Object,确保在短暂的代理会话间保持持久性。 该方法解决了 AI 代理系统中的一个关键挑战:在一次性、无状态运行时之间维护持久状态。通过利用 Cloudflare 全球分布的 Durable Objects 及内嵌 SQLite,它提供了低延迟、强一致性的存储,无需外部数据库。这使得长时间运行的代理工作流(如自主编程或研究)能够跨会话和区域可靠地持久化文件系统变更。 Durable Object 在 SQLite 中保存权威状态,SQLite 作为库在同一线程中调用,实现零延迟访问。提供三种容器后端,其中一种将 SQLite 状态通过 FUSE 挂载投射到沙箱中。同步通过 RPC 进行,系统除 SQL 外还支持时间点恢复和键值 API。该项目在 GitHub 上以 cloudflare/computer 开源。

@bibryam原推文1 张图片A disposable agent runtime still needs durable state. Cloudflare Computer stores the authoritative filesystem state in SQLite within a Durable Object. Its container backend exposes that state through a FUSE-mounted filesystem inside a sandbox container, where the agent can run standard Linux tools. Filesystem changes are synchronized back to the Durable Object over RPC. https://github.com/cloudflare/computer原推文媒体预览展开原推文收起原推文

@bibryam

A disposable agent runtime still needs durable state. Cloudflare Computer stores the authoritative filesystem state in SQLite within a Durable Object. Its container backend exposes that state through a FUSE-mounted filesystem inside a sandbox container, where the agent can run standard Linux tools. Filesystem changes are synchronized back to the Durable Object over RPC. https://github.com/cloudflare/computer

背景
Durable Objects 是 Cloudflare 的强一致性、全球分布的有状态计算单元。SQLite 是一种轻量级嵌入式数据库,常用于本地存储。FUSE(用户空间文件系统)允许在用户空间创建文件系统,无需修改内核。RPC(远程过程调用)支持分布式组件间的通信。一次性代理运行时是 AI 代理的短暂执行环境,需频繁重建,因此持久状态对连续性至关重要。

8月8日 06:24在 X 打开#distributed systems #AI agents #Cloudflare #durable state #FUSE

057.0

前FDE揭露该职位常是安抚AI焦虑老板的安慰剂

一位前FDE(Forward-Deployed Engineer)分享了他的真实经历,指出尽管该职位被热炒,但往往只是给对AI焦虑的高管们的一剂安慰剂。他描述了为产品经理构建AI原型和工具,却遭到技术总监的抵制,后者禁止使用AI并投诉其工作。最终他因非老板心腹而被解雇,从而得出结论:FDE的成功取决于政治和业务对齐,而非AI技能。 这份内部人士的叙述揭示了企业AI采纳过程中可能出现的组织摩擦,即使技术方案可行。它凸显了FDE等职位的承诺与现实之间的关键差距:内部政治和现有团队的抵制可能扼杀创新。对于考虑此类职位的专业人士,这是一个警示:若无高管支持和组织文化准备,仅凭技术能力是不够的。 作者在‘Skill’概念出现前就构建了MCP(模型上下文协议)工具,创建了自动本地服务前端原型的工具,并为演示设置了SQLite以简化产品到工程的交接。技术总监禁止使用AI,抱怨PRD过于详细(因为是为AI阅读而写),最终作者成为替罪羊被解雇。他强调FDE‘首先是政治,然后是业务,最后才是AI——甚至AI根本无关紧要’。

@cnzhihao@dotey 转推我搞了这几个月所谓的 FDE,也就是给一些 AI 焦虑的老板搞搞定心丸,你根本不可能真的做出来的。 我一开始以为这是什么高大上的职业,后面真的做起来发现,这跟我 10 年前做咨询顾问没有任何区别。如果真的有区别的话,可能就是底下员工对你的敌视会比做咨询顾问的时候要强很多。因为你做咨询顾问之前,你是服务他们的,他们提个什么需求给你,你给他做完了,他就可以用你那个所谓的系统或者工具,他开心的很。你现在给他做,搞了个什么 Agent,然后过两个月他就要失业了,他什么都不愿告诉你。 除此之外,真的没有任何区别。 我也奉劝所有想搞 FDE 的企业员工,如果你不是老板心腹,或者你自己不是老板,你就不要趟这个浑水,你就自己玩玩算了。我现在也是终于知道我为什么今年 2 月份会被辞退了。 我们产品经理说自己用不来 AI,我就给他们搓了一个原型系统,然后让他们把运行系统里面的 Readme 扔给 AI,那个时候还没有 Skill 这种玩意,我是搓了一个 MCP 给他们用的。后面我让他们全部用 AI 写原型之后,前端的那些人拿着 HTML、CSS、JS 的文件跟我说,他们不会在本地起服务器跑原型,我又傻了吧唧的给他们做了一个原型工具,产品交付的文件夹往里面一拖它自己就会本地起一个服务渲染。再到后来,我让产品去做 demo的时候再他们电脑本地起 sqlite,实现 demo 局部工具直接可用,然后交付给技术,直接按照原型设计和 PRD 的内容让 AI 过一遍之后重构并到大系统里面。 你猜最后怎么着? 技术总监一天投诉我 100 次,说我过度侵入技术的工作范畴,然后 PRD 写得过于复杂,很多大家都知道的东西,在里面写了好几遍。 那你不废话吗?我是让 AI 看那个东西,又不是让你看那个东西。 然后他还禁止所有技术用 AI 写程序。 结果呢,所有人对他阳奉阴违,他只能天天一脸黑没事给我使绊子,还没事就和产品总监喷我,产品总监鸟都不鸟他。 有一次我就这么喷他,直接把程序员扔到现场去,让他们直接现场搞不就完事了?说难听点,根本就不用产品经理这一层。要不是他们自己听不懂业务语言,何必中间加这么一道没有意义的东西? 最后我就成了那个炮灰。我不是老板心腹,他是,老板选择他,没有选择我。 到头来我就是个 sb,到现在这个点,我觉得我情商是真低啊。 所以,千万不要以为你掌握了一个什么看起来好厉害的核心技术。做这个 FDE,首先是政治,然后是业务,最后才是 AI,甚至,AI 根本无关紧要。展开原推文收起原推文

@dotey 转推了

@cnzhihao

我搞了这几个月所谓的 FDE,也就是给一些 AI 焦虑的老板搞搞定心丸,你根本不可能真的做出来的。 我一开始以为这是什么高大上的职业,后面真的做起来发现,这跟我 10 年前做咨询顾问没有任何区别。如果真的有区别的话,可能就是底下员工对你的敌视会比做咨询顾问的时候要强很多。因为你做咨询顾问之前,你是服务他们的,他们提个什么需求给你,你给他做完了,他就可以用你那个所谓的系统或者工具,他开心的很。你现在给他做,搞了个什么 Agent,然后过两个月他就要失业了,他什么都不愿告诉你。 除此之外,真的没有任何区别。 我也奉劝所有想搞 FDE 的企业员工,如果你不是老板心腹,或者你自己不是老板,你就不要趟这个浑水,你就自己玩玩算了。我现在也是终于知道我为什么今年 2 月份会被辞退了。 我们产品经理说自己用不来 AI,我就给他们搓了一个原型系统,然后让他们把运行系统里面的 Readme 扔给 AI,那个时候还没有 Skill 这种玩意,我是搓了一个 MCP 给他们用的。后面我让他们全部用 AI 写原型之后,前端的那些人拿着 HTML、CSS、JS 的文件跟我说,他们不会在本地起服务器跑原型,我又傻了吧唧的给他们做了一个原型工具,产品交付的文件夹往里面一拖它自己就会本地起一个服务渲染。再到后来,我让产品去做 demo的时候再他们电脑本地起 sqlite,实现 demo 局部工具直接可用,然后交付给技术,直接按照原型设计和 PRD 的内容让 AI 过一遍之后重构并到大系统里面。 你猜最后怎么着? 技术总监一天投诉我 100 次,说我过度侵入技术的工作范畴,然后 PRD 写得过于复杂,很多大家都知道的东西,在里面写了好几遍。 那你不废话吗?我是让 AI 看那个东西,又不是让你看那个东西。 然后他还禁止所有技术用 AI 写程序。 结果呢,所有人对他阳奉阴违,他只能天天一脸黑没事给我使绊子,还没事就和产品总监喷我,产品总监鸟都不鸟他。 有一次我就这么喷他,直接把程序员扔到现场去,让他们直接现场搞不就完事了?说难听点,根本就不用产品经理这一层。要不是他们自己听不懂业务语言,何必中间加这么一道没有意义的东西? 最后我就成了那个炮灰。我不是老板心腹,他是,老板选择他,没有选择我。 到头来我就是个 sb,到现在这个点,我觉得我情商是真低啊。 所以,千万不要以为你掌握了一个什么看起来好厉害的核心技术。做这个 FDE,首先是政治,然后是业务,最后才是 AI,甚至,AI 根本无关紧要。

背景
Forward-Deployed Engineer(FDE)是由Palantir等公司推广的职位,工程师直接与客户合作集成和定制软件。在AI时代,FDE常负责将AI解决方案嵌入企业工作流。MCP(模型上下文协议)是连接AI代理与工具和数据源的开放标准。PRD(产品需求文档)是概述产品功能和规格的正式文档,传统上为人类开发者编写,但越来越多用于指导AI驱动的开发。

8月8日 16:33在 X 打开#FDE #AI adoption #enterprise software #career advice #organizational dynamics

067.0

独立开发者分享从开源CLI到付费Mac软件的10条经验

Mole开源Mac CLI工具的开发者分享了一条长推文,详细介绍了从开源CLI转向付费Mac应用的过程。推文列出了10条可操作策略,涵盖产品工程、Token投资、极简主义、高频发布和真实社区互动。这为Mole从免费CLI到商业产品的转变提供了真实案例研究。 这些建议回应了日益增长的独立开发者社区在开源之外寻求可持续商业模式的需求。它强调在AI时代,代码壁垒降低,成功取决于产品思维、用户信任和高效资源利用。随着更多开发者探索变现同时保持真实性,这些见解恰逢其时。 Mole将CleanMyMac、AppCleaner、DaisyDisk和iStat Menus的功能整合到一个CLI工具中,付费Mac应用提供可视化清理和监控。开发者强调产品工程师应融合用研、产品、工程、运营、数据和商业技能。AI工具中的Token使用应视为投资,专注于解决用户问题而非仅生成代码。每周高频发布和真实、非AI生成的沟通能建立用户信任。开发者建议避免付费推广,并利用YouTube获得长期曝光。

@HiTw93@dotey 转推1 张图片最近看到不少关于独立开发者的思考内容,想着就 Mole 从开源 Cli 到 Mac 付费软件这个过程来给大伙聊一聊我的思考和做的哪些事情是有效的,希望可以给大家一些帮助。 1. 开始之前要多培养自己在产品工程师的能力,这个里面代码能力只占 30%,更重要是如何把自己的痛点和大部分用户痛点结合起来,产出一个方便易用的产品解决方案,同时懂得如何更好的推荐给你的用户,让他们发现多亏了有这个产品解决了我的一个大问题,也即产品工程师=用研+产品+工程师+运营+数据+商业这几类角色的综合体。 2. 接上条,AI 时代代码壁垒越来越小,更需要把控的是如何做到把 Token 刚好花费到解决用户问题上,然后把更多 Token 用在你的需求分析讨论、数据下钻挖掘问题、内容友好性易读上面,因为即使你是多个 250 刀的账号其实也不够用的,不介意多花 Token,但需要用到实处,Token 在我看来属于投资,但是投资也需要讲究收益。 3. 聊到需求把控,不做什么远比做什么要重要太多了,在我大一刚刚入门程序员时候,非常幸运看了不少讲工程师修炼的书籍,如无必要 勿增实体、至繁归于至简慢慢让我在生活、工作、代码中都保持这个习惯,讨厌繁琐和乱,喜欢漂亮简单、不要看说明书就可以用的东西。 4. 你完全不需要给你的产品憋大招,你需要尽量做到每周都有发布,每周都有Release,及时解决用户的问题,和用户形成人与人交流那种真实的活人世界的互动,非常重要,每次你的发布、更新、宣发其实都是一次非常好和用户沟通的机会,也让你的产品持续的可以让更多之前没有看到你之前消息的人了解到。 5. 聊到产品运营,尽量尽量少用AI话来让你和真实世界交流,推特是一个非常好的渠道,可以让你的好东西被很多人发现,只要好用,会有大量的朋友帮你宣传,但是千万不要做那种蓝勾互关以及互推的路,没有必要凑这种虚假繁荣的热闹,因为你的用户不在这里,产品运营一定有一个前提,是你的产品是漂亮的、精致的,让之前不知道的人第一次见到就很有兴趣来点击试用你的产品,而非快速刷走了。 6. 可能你会说“我”没有啥粉丝宣传没有用,其实不太对,但是也非常不建议大家抱着很深的功利心去把自己账号做上去,因为这样会让你焦虑,反而把你的号也当做一个品牌去建设,你自己就是这个品牌的本身,你的思考、想法、产品更新、见解、交流、评论都是在给你的自己品牌在加信任值,信任这个东西在当今虚假又繁荣的AI世界尤其重要,太太太说着非常牛逼,但是点进去感觉一般的东西已经把大量用户的预期拉低非常多,导致即使你有一个好产品,但是没有任何用户信任,依然还是得不到关注,这里可以做的非常长期,你在互联网上待多久,这个品牌其实就会活多久,是你生命周期最长的产品了。 7. 聊到用户信任,就一定要聊到真诚,我还是非常喜欢开源、喜欢非撕逼的友好网络环境,也很建议你的产品一开始就是全球化的或者说是出海的,也非常建议大家多发英文类的内容,你会发现世界很大,你的用户很广,你的用户会非常从一开始就信任你,以及力所能及帮助大家,绝大可能你帮助的人会成为你未来的用户,因为有过真实交情。 8. 尽量不要去花钱推广,但是可以靠自己多让你的好东西的用户中刚好也有博主,推特我感觉其实脉冲很高,但是时效一般,反而非常建议你有些东西可以发到 Youtube,这里的衰减度非常慢,你的产品只有够好,有人推荐,可以在上面火非常长时间,给你带来很大的收益。 9. 一定要学习数据分析,这个特别有用,从你的销量数据分维度分时间去分析,结合流量数据,结合用户评论,以及你和用户交流的所有内容,以及用户的退款原因,假如是开源产品,还有用户的所有issue,都是非常宝贵的数据资源,能够帮你发现特别多你不知道的问题,也能够帮助你做到更好,以及发现销售的漏斗,你才会知道如何更好优化。 10. 碎碎念手写有点啰嗦,假如你喜欢,也非常欢迎去 https://mole.fit/ 的官网看看,玩一玩 Mole 这个产品,说不定可以给你的产品建设带来一些输入。原推文媒体预览展开原推文收起原推文

@dotey 转推了

@HiTw93

最近看到不少关于独立开发者的思考内容,想着就 Mole 从开源 Cli 到 Mac 付费软件这个过程来给大伙聊一聊我的思考和做的哪些事情是有效的,希望可以给大家一些帮助。 1. 开始之前要多培养自己在产品工程师的能力,这个里面代码能力只占 30%,更重要是如何把自己的痛点和大部分用户痛点结合起来,产出一个方便易用的产品解决方案,同时懂得如何更好的推荐给你的用户,让他们发现多亏了有这个产品解决了我的一个大问题,也即产品工程师=用研+产品+工程师+运营+数据+商业这几类角色的综合体。 2. 接上条,AI 时代代码壁垒越来越小,更需要把控的是如何做到把 Token 刚好花费到解决用户问题上,然后把更多 Token 用在你的需求分析讨论、数据下钻挖掘问题、内容友好性易读上面,因为即使你是多个 250 刀的账号其实也不够用的,不介意多花 Token,但需要用到实处,Token 在我看来属于投资,但是投资也需要讲究收益。 3. 聊到需求把控,不做什么远比做什么要重要太多了,在我大一刚刚入门程序员时候,非常幸运看了不少讲工程师修炼的书籍,如无必要 勿增实体、至繁归于至简慢慢让我在生活、工作、代码中都保持这个习惯,讨厌繁琐和乱,喜欢漂亮简单、不要看说明书就可以用的东西。 4. 你完全不需要给你的产品憋大招,你需要尽量做到每周都有发布,每周都有Release,及时解决用户的问题,和用户形成人与人交流那种真实的活人世界的互动,非常重要,每次你的发布、更新、宣发其实都是一次非常好和用户沟通的机会,也让你的产品持续的可以让更多之前没有看到你之前消息的人了解到。 5. 聊到产品运营,尽量尽量少用AI话来让你和真实世界交流,推特是一个非常好的渠道,可以让你的好东西被很多人发现,只要好用,会有大量的朋友帮你宣传,但是千万不要做那种蓝勾互关以及互推的路,没有必要凑这种虚假繁荣的热闹,因为你的用户不在这里,产品运营一定有一个前提,是你的产品是漂亮的、精致的,让之前不知道的人第一次见到就很有兴趣来点击试用你的产品,而非快速刷走了。 6. 可能你会说“我”没有啥粉丝宣传没有用,其实不太对,但是也非常不建议大家抱着很深的功利心去把自己账号做上去,因为这样会让你焦虑,反而把你的号也当做一个品牌去建设,你自己就是这个品牌的本身,你的思考、想法、产品更新、见解、交流、评论都是在给你的自己品牌在加信任值,信任这个东西在当今虚假又繁荣的AI世界尤其重要,太太太说着非常牛逼,但是点进去感觉一般的东西已经把大量用户的预期拉低非常多,导致即使你有一个好产品,但是没有任何用户信任,依然还是得不到关注,这里可以做的非常长期,你在互联网上待多久,这个品牌其实就会活多久,是你生命周期最长的产品了。 7. 聊到用户信任,就一定要聊到真诚,我还是非常喜欢开源、喜欢非撕逼的友好网络环境,也很建议你的产品一开始就是全球化的或者说是出海的,也非常建议大家多发英文类的内容,你会发现世界很大,你的用户很广,你的用户会非常从一开始就信任你,以及力所能及帮助大家,绝大可能你帮助的人会成为你未来的用户,因为有过真实交情。 8. 尽量不要去花钱推广,但是可以靠自己多让你的好东西的用户中刚好也有博主,推特我感觉其实脉冲很高,但是时效一般,反而非常建议你有些东西可以发到 Youtube,这里的衰减度非常慢,你的产品只有够好,有人推荐,可以在上面火非常长时间,给你带来很大的收益。 9. 一定要学习数据分析,这个特别有用,从你的销量数据分维度分时间去分析,结合流量数据,结合用户评论,以及你和用户交流的所有内容,以及用户的退款原因,假如是开源产品,还有用户的所有issue,都是非常宝贵的数据资源,能够帮你发现特别多你不知道的问题,也能够帮助你做到更好,以及发现销售的漏斗,你才会知道如何更好优化。 10. 碎碎念手写有点啰嗦,假如你喜欢,也非常欢迎去 https://mole.fit/ 的官网看看,玩一玩 Mole 这个产品,说不定可以给你的产品建设带来一些输入。

背景
Mole是一款用于macOS的开源CLI工具,可帮助清理、卸载、分析、优化和监控Mac系统。它由开发者tw93创建,后来演变为具有图形界面的付费Mac应用。“产品工程师”一词指结合技术技能与产品管理、用户研究和商业头脑的角色。在AI开发中,“Token”指大型语言模型中的使用单位,高效的Token花费对成本和性能至关重要。

8月8日 15:36在 X 打开#indie hacking #product development #developer experience #AI tools #marketing

077.0

AI写小说的真正瓶颈是生动叙事,而非一致性

AI领域有影响力的@dotey发推认为,AI写小说时对一致性的关注是误入歧途。真正的局限在于大语言模型(LLM)天生难以产出引人入胜、生动且持续好看的故事。引用的回复指出,当前的方法论(如详细的世界观设定和章节大纲)已经过时,反而阻碍了AI专注于当下章节的写作。 这一观点挑战了当前AI写作工具优先解决记忆和一致性的主流做法。它表明,提升LLM的创作能力可能比解决一致性问题更有意义。这场讨论可能将开发重点转向提高叙事质量,从而影响作家、工具开发者以及更广泛的AI创意写作领域。 推文强调,一致性对于AI小说“写得有趣、生动、持续好看”这一首要目标“完全不重要”。引用的回复批评了使用世界观设定、角色表和章节提纲的方法论,认为其不仅错误而且过时。核心问题在于,LLM作为“全知全能”的模型,无法“兴致盎然地享受当下的讲述”,因此难以写出引人入胜的文字。

@Arcadia_Bao@dotey 转推长篇一致性是个很难解决完善的问题(所以很多vibe的写作软件总是号称解决记忆一致性blabla) 但更大的问题是,一致性对于ai写小说的第一性——写得有趣、写得生动、写得持续好看,完全不重要,甚至没什么鸟用。解决了一致性也几乎等于什么都没有解决。 我觉得LLM本身就是AI写小说最大的局限展开原推文收起原推文

@dotey 转推了

@Arcadia_Bao

长篇一致性是个很难解决完善的问题(所以很多vibe的写作软件总是号称解决记忆一致性blabla) 但更大的问题是,一致性对于ai写小说的第一性——写得有趣、写得生动、写得持续好看,完全不重要,甚至没什么鸟用。解决了一致性也几乎等于什么都没有解决。 我觉得LLM本身就是AI写小说最大的局限

@horsezhanbin

上午聊天的时候我自己突然想到一个点,现在 AI 写小说的一些规则似乎不对,从世界观设定到角色表到场景到每个章节提纲,为了追求一致性的这个方法论首先不对其次也过时了。如何让 AI 专注当下章节写作似乎更难,全知全能的的 AI 无法兴致盎然地享受当下的讲述。

背景
在AI辅助小说写作中,“一致性”指在长文本中保持情节、角色特征和世界观细节的连贯。许多工具(如Sudowrite)使用记忆系统来解决这一问题。然而,LLM存在固有局限:它们在上下文窗口(如GPT-5.5为128k tokens)内运行,且随着窗口填充,对早期内容的处理能力会下降。该推文认为,即使完美解决一致性,也无法弥补缺乏生动叙事这一更深层的AI局限。

8月8日 07:49在 X 打开#AI writing #LLM #creative writing #consistency #limitations

087.0

Kimi应用下载量翻五倍,日活用户激增40%

根据SensorTower数据,Kimi应用的下载量几乎翻了五倍,日活跃用户增长了约40%。这一增长发生在K3模型发布之后,表明围绕K3的热度正在转化为实际的用户采用。 显著的用户增长验证了Kimi K3模型的市场吸引力,并显示出消费者对先进AI助手的强烈兴趣。这也预示着AI应用领域的竞争压力,可能影响投资和开发策略。 数据来自SensorTower,一家知名的移动应用分析平台。K3模型是一个拥有2.8万亿参数的开源权重模型,具备100万token的上下文窗口和原生视觉能力。a16z的转发增加了这些指标的可靠性。

@Kimi_Moonshot 转推了

@a16z

According to data from SensorTower, Kimi app downloads nearly quintupled and daily active users jumped by ~40%. The K3 hype is translating into real users. Charts of the Week: https://www.a16z.news/p/charts-of-the-week-bookslop

背景
Kimi是由月之暗面(Moonshot AI)开发的AI助手。最近发布的K3模型是其最强大的旗舰模型,采用了Kimi Delta Attention等先进架构。SensorTower是移动应用市场情报的领先提供商,追踪应用商店的下载量、收入和用户参与度。

8月8日 03:53在 X 打开#AI #Kimi #user growth #app analytics #a16z

097.0

开发者分享使用 Claude Design 与 Baoyu-Design Skill 进行 UI 原型设计的工作流

一位开发者分享了一套工作流:先用 Claude Design 设计 UI 原型,再借助开源的 Baoyu-Design Skill 在本地维护原型。通过在 Agents.md/claude.md 中集成规则,每次提出新功能需求时,系统会先自动更新原型,然后再进行功能实现,从而确保设计与代码始终保持一致。 该工作流通过早期原型验证降低了产品和 UI 设计的成本。同时,利用 Claude Design 输出 React 代码和结构化 JSON 的特性,可以通过 git diff 清晰查看版本变更历史,并让 AI 代理参考差异结果更轻松地实现功能。 Baoyu-Design Skill 是一个可在 Cursor、Claude Code 等工具中本地运行 Claude Design 的代理技能,无需访问 claude.ai/design 即可生成自包含的 HTML。它最适合与 Opus 4.8 配合使用,并包含入门组件和专用提示。该工作流强调在编写新功能代码之前先修改原型,从而保持设计与实现的一致性。

@dotey引用推文2 张图片我在开发项目是,第一版本会先用 Claude Design 设计好 UI 原型/设计,打磨好后放到本地,配合 Baoyu-Design Skill 去维护,每次开发新功能前,不是先去实现功能,而是先修改本地的原型,原型修改确认好了后再去修改功能。 后来直接把规则放到了 Agents.md/claude.md 里面,只要说修改或者增加什么功能,默认会先帮我修改原型。所以到现在为止,原型和实际功能都是保持一致的。 这带来的好处是可以先低成本通过原型验证产品设计和 UI 设计。 另一个好处就是 Claude Design 产出物是 React 代码和结构化的 json 数据,通过 git diff 很清晰的能看到版本变更历史,功能确定了后,agent 参考diff结果代码实现会相对比较容易。 Baoyu-Design Skill https://github.com/JimLiu/baoyu-design原推文媒体预览+1展开原推文收起原推文

@dotey

我在开发项目是,第一版本会先用 Claude Design 设计好 UI 原型/设计,打磨好后放到本地,配合 Baoyu-Design Skill 去维护,每次开发新功能前,不是先去实现功能,而是先修改本地的原型,原型修改确认好了后再去修改功能。 后来直接把规则放到了 Agents.md/claude.md 里面,只要说修改或者增加什么功能,默认会先帮我修改原型。所以到现在为止,原型和实际功能都是保持一致的。 这带来的好处是可以先低成本通过原型验证产品设计和 UI 设计。 另一个好处就是 Claude Design 产出物是 React 代码和结构化的 json 数据,通过 git diff 很清晰的能看到版本变更历史,功能确定了后,agent 参考diff结果代码实现会相对比较容易。 Baoyu-Design Skill https://github.com/JimLiu/baoyu-design

@Jiaxi_Cui

@dotey 确实很好用,是一直用来做原型的方案

背景
Claude Design 是 Anthropic 推出的一款原型设计工具,能将想法转化为交互式设计,并生成 React 代码和结构化数据。Baoyu-Design Skill 是一个开源项目,将 Claude Design 的功能封装成可复用的代理技能,用于本地开发环境。Git diff 是版本控制中的一个功能,用于显示提交之间的变更,有助于追踪设计演变。
社区讨论
一位评论者确认了该工作流的实用性,表示自己一直在用它进行原型设计。没有提供其他社区反馈。

8月8日 17:35在 X 打开#UI prototyping #Claude Design #workflow #React #development tools

107.0

如何有效使用 Agent /goal 功能执行长时间优化任务的实用指南

一位开发者分享了使用 Agent /goal 功能执行长时间任务的实用指南,通过 Fable 5 将视频转录性能提升了一倍以上。该方法强调设定明确目标、验证结果、停止条件,并将子任务委派给子代理以控制成本。 该指南解决了从业者的常见痛点:如何有效利用自主代理进行复杂、迭代的优化而无需微观管理。它强调了通过子代理委派实现成本效益,使高级 AI 工作流在实际工程任务中更易用且可持续。 /goal 命令启动一个长时间运行的循环,代理建立基准、分析瓶颈、迭代优化,并在认为无进一步优化空间时停止。将任务委派给更便宜的子代理(Opus5)可显著降低成本而不牺牲质量。示例中使用 Moss 模型实现了视频转录速度提升 2 倍以上。

@dotey原推文3 张图片很多人不知道该怎么用好 Agent 的 /goal 功能,也就是说给 Agent 一个目标,让它长时间运行,直到目标完成为止。 其实没你想的那么复杂,注意几个点: 1. 你的目标是什么 2. 如何验证结果 3. 停止条件 比如说我这两天做的一个性能优化的任务,Fable 5 帮我把视频转录性能优化了2倍多(图2),提示词很简单(图1): > /goal 帮我优化当前 cli 的转录大视频的性能,在遇到像这样大体积的视频时,需要优化转录性能,请以 Moss 模型测试这个视频(英文为主,多语言)转录,建立基准,然后分析性能瓶颈,尝试优化,直到你觉得已经没有优化空间了。注意你的主要任务是分析、编排和验证,具体任务尽可能交给 subagent(Opus5)去执行 首先用 /goal 表示这是一个需要长时间执行的任务,需要反复执行,不能运行一会就结束了。 然后给它一个视频让它先自己跑一遍转录,记录一下关键数据,建立基准。 基于转录时收集的数据,Agent 自己可以去分析原因,去自己优化,优化完成后再去跑一遍,记录数据,对照前面的基准看是更好了还是更坏了。 结束条件是它自己觉得已经没有优化空间了就结束。之所以我没给它一个具体指标,是因为我也不知道能优化多少,如果指标太容易达到,它一轮可能就结束了;如果指标太难超出物理极限也没意义,反而可能会出现为了优化去做一些极端的事情。 最后一句让它开subagent执行子任务是因为 Fable 5 太贵,全程 Fable 5 用不了多久就要额度不够了,加了这句就耐用多了,而且质量也挺好。 --- 还有些时候,想到一个新的技术方案,但并不知道这方案是不是有效,那也可以让它开个worktree,去验证一下是不是靠谱,看数据是更好还是更坏,如果没提升就没必要做了。(参考图3)原推文媒体预览+2展开原推文收起原推文

@dotey

很多人不知道该怎么用好 Agent 的 /goal 功能,也就是说给 Agent 一个目标,让它长时间运行,直到目标完成为止。 其实没你想的那么复杂,注意几个点: 1. 你的目标是什么 2. 如何验证结果 3. 停止条件 比如说我这两天做的一个性能优化的任务,Fable 5 帮我把视频转录性能优化了2倍多(图2),提示词很简单(图1): > /goal 帮我优化当前 cli 的转录大视频的性能,在遇到像这样大体积的视频时,需要优化转录性能,请以 Moss 模型测试这个视频(英文为主,多语言)转录,建立基准,然后分析性能瓶颈,尝试优化,直到你觉得已经没有优化空间了。注意你的主要任务是分析、编排和验证,具体任务尽可能交给 subagent(Opus5)去执行 首先用 /goal 表示这是一个需要长时间执行的任务,需要反复执行,不能运行一会就结束了。 然后给它一个视频让它先自己跑一遍转录,记录一下关键数据,建立基准。 基于转录时收集的数据,Agent 自己可以去分析原因,去自己优化,优化完成后再去跑一遍,记录数据,对照前面的基准看是更好了还是更坏了。 结束条件是它自己觉得已经没有优化空间了就结束。之所以我没给它一个具体指标,是因为我也不知道能优化多少,如果指标太容易达到,它一轮可能就结束了;如果指标太难超出物理极限也没意义,反而可能会出现为了优化去做一些极端的事情。 最后一句让它开subagent执行子任务是因为 Fable 5 太贵,全程 Fable 5 用不了多久就要额度不够了,加了这句就耐用多了,而且质量也挺好。 --- 还有些时候,想到一个新的技术方案,但并不知道这方案是不是有效,那也可以让它开个worktree,去验证一下是不是靠谱,看数据是更好还是更坏,如果没提升就没必要做了。(参考图3)

背景
像 Fable 5 这样的 AI 代理可以自主执行任务,但长时间优化需要精心设计提示词,以避免过早终止或过度消耗资源。/goal 功能使代理能够迭代直到满足条件。子代理是独立的工作代理,处理特定任务,减轻主代理负担,并在使用昂贵模型时节省成本。

8月8日 01:58在 X 打开#AI agents #prompt engineering #performance optimization #workflow

117.0

评论:Prime Agent 的框架优化未必体现真实世界 AI 能力

AI 评论者 @dotey 对 Prime Agent 框架提出批评,认为其自主改进的 Harness 并非自进化模型,价值有限。他们还指出,针对评分优化的性能并不能转化为在现实场景中优于 Claude Code 和 Codex 等工具。 这一批评强调了改进模型核心智能与仅仅优化其执行环境之间的关键区别。它提醒社区不要过度解读基准测试结果,这可能会误导开发者和投资者对 AI 系统实际效用的判断。 Prime Agent 是一个开源递归代理框架,使用 Opus 5 在 ARC-AGI-3 上取得了 95.5% 的分数,超过了人类专家基线 95.4%。批评者认为,这一提升来自 Harness(管理工具使用和上下文的外部脚手架),而非模型本身能力的增强。在现实任务中,Claude Code 和 Codex 等工具可能仍然更胜一筹。

@dotey引用推文1. 自主改进的 Harness 不是自进化模型,价值有限 2. 面向评分的优化价值有限,到现实场景不会比 Claude Code 和 Codex 这样的更好展开原推文收起原推文

@dotey

1. 自主改进的 Harness 不是自进化模型,价值有限 2. 面向评分的优化价值有限,到现实场景不会比 Claude Code 和 Codex 这样的更好

@xiaohu

Prime Agent 一个能自主改进的递归 Agent 框架: 仅仅把外面的框架(Harness )换成 Prime Agent Opus 5 的 ARC-AGI-3 评分从 30.2% 冲到 95.5%甚至超越了人类专家基线(95.4%) 可以直接当 Claude Code、Codex 的替代品 它证明了一件事:AI 有时候跑不好的原因,很多时候不是模型不够聪明,而是外面跑它的框架束缚了它... 传统的 Agent 框架(比如固定的工具调用接口、硬编码的子 Agent 或静态提示词)是为上一代模型设计的。当大模型能力越来越强时,这些固定设计反而成了“绊脚石”,限制了模型的发挥。 https://best.xiaohu.ai/article/prime-agent/

背景
在 AI 领域,“Harness”是指使语言模型能够与工具交互、管理记忆和执行多步骤任务的基础设施。ARC-AGI-3 是一个交互式基准测试,旨在衡量 AI 代理的类人推理能力。区分模型和 Harness 至关重要:模型提供原始智能,而 Harness 协调其行动。优化 Harness 可以提高基准分数,但未必改善模型的底层推理能力。

8月8日 01:32在 X 打开#AI agents #benchmarking #ARC-AGI #model evaluation #critical analysis

127.0

ralph-playbook:自主AI编码循环的结构化指南

GitHub上发布了一份名为ralph-playbook的新开源指南,为实施Geoff Huntley的Ralph方法论提供了结构化的三阶段方法,用于自主AI编码代理。该指南将之前零散的信息整合成一份实用的分步操作手册,强调使用测试、类型检查和构建作为质量关卡。指南旨在帮助开发者设置AI代理,使其能够在无需人工干预的情况下循环编写代码、运行测试和提交更改。 该指南回应了AI工程社区对可靠自主编码工作流程日益增长的需求。通过提供清晰、可重复的流程,它降低了开发者利用AI代理处理复杂软件任务的门槛。对自动化质量关卡的强调有助于降低AI生成错误的风险,可能增加在生产环境中对自主编码循环的信任和采用。 ralph-playbook将流程分为三个阶段:定义需求并分解任务,让代理生成实施计划,然后进入自动循环逐个完成任务。它强制执行测试、类型检查和构建等质量关卡,因此如果代理失败,必须在下一轮迭代中自我纠正。该指南可在GitHub上的ClaytonFarr/ralph-playbook仓库获取,它基于Geoff Huntley的原始Ralph方法论,该方法论在2024年底流行起来。

@GitHub_Daily原推文1 张图片Ralph 方法论去年底在 AI 编程圈火过一轮,让 AI Agent 在循环里自主写代码、跑测试、提交。 人不坐在里面盯,每轮上下文清空重来,靠文件传递状态。 不过 Geoff Huntley 的原版散落在博客和视频里,拼起来挺费劲。 ralph-playbook 把这套方法整理成了一份可操作的指南,分三个阶段。 先定需求拆任务,再让 Agent 自己生成实现计划,最后进入自动循环逐个完成。 GitHub:http://github.com/ClaytonFarr/ralph-playbook 里面强调用测试、类型检查、构建这些手段给 Agent 设门槛,写错了过不了关,下一轮自己改。 想试 AI 自主编码循环的朋友,这份指南比较体系化,适合照着来。原推文媒体预览展开原推文收起原推文

@GitHub_Daily

Ralph 方法论去年底在 AI 编程圈火过一轮,让 AI Agent 在循环里自主写代码、跑测试、提交。 人不坐在里面盯,每轮上下文清空重来,靠文件传递状态。 不过 Geoff Huntley 的原版散落在博客和视频里,拼起来挺费劲。 ralph-playbook 把这套方法整理成了一份可操作的指南,分三个阶段。 先定需求拆任务,再让 Agent 自己生成实现计划,最后进入自动循环逐个完成。 GitHub:http://github.com/ClaytonFarr/ralph-playbook 里面强调用测试、类型检查、构建这些手段给 Agent 设门槛,写错了过不了关,下一轮自己改。 想试 AI 自主编码循环的朋友,这份指南比较体系化,适合照着来。

背景
Ralph方法论是一种让AI编码代理在循环中自主运行的方法,代理可以自主编写代码、运行测试并提交更改,无需持续的人工监督。它由Geoff Huntley在2024年底通过博客和视频推广开来。其核心思想是让代理以周期方式运行,每个周期重新开始(上下文被清除),并依赖基于文件的状态传递。该方法旨在通过允许开发者在AI工作时离开来提高生产力,但需要仔细设置以确保代码质量并防止失控错误。

8月8日 10:00在 X 打开#AI coding #autonomous agents #Ralph methodology #developer tools #GitHub