# Muse 新增 X 材料核查：Grok 编号 33–39、45–46

核查日期：2026-09-17。9 个主帖均通过 CUA 后台浏览器直接读取 X 页面正文及当时可见回复，不是仅依据 Grok 摘要。已先按 URL 检查本地 `instinct-analysis/posts.json`，9 个主帖均不在该归档中。帖子中的交易、预订、自动化效果仍是作者自述；本次没有账单、订单后台或原始运行日志的独立验证。附图未逐一查看，33 的视频显示无法播放。

日期口径：下面“日期”采用 UTC；页面使用新加坡本地时间（UTC+8）。UTC 由 X 帖子 ID 的时间字段换算，与页面本地分钟显示一致。若报告按 Instinct 的美国东部日期分桶，38 应归到 9 月 14 日，其余本批主帖 UTC 日期与东部日期相同。

## 本批最重要的纠正

- 39 的作者在同线程发布了带 1b tokens 话术的邀请码。应标“附邀请推广”，不能只写关系未知；不过原文没有明确说明邀请者自己的奖励规则。
- 45 的任务清单包括“这条帖子”。这是 AI 参与撰写的评价，并且作者明说有其他模型、代理和本地硬件参与；不能作为 Muse 单独实现所有能力的独立证据。
- 38 的原始用户只列研究、议价、保险报价、购前检查预约。Meta 关联账号的转述强化为买成汽车及不用参与经销商流程，不能反过来把这层强化写进原始事实。
- 34 的 Southwest 缺失是一次订票体验中助手对当时所用系统的说法，不是已证明 Muse 永久不支持 Southwest。T1 买票是举例式表达，没有出票记录。
- 37 的订阅“发现”不等于已取消；理赔“处理”不等于已获赔；找房“组织”不等于租约成交。

## 33 · Marshall Haas — 提前体验的生活杂务清单

- 原帖：[Marshall Haas @marshal](https://x.com/marshal/status/2097414842844151842)。日期：2026-09-08 20:00 UTC；页面 9/9 04:00 SGT。
- 访问：**X 原文直接可读**；页面视频显示 Unable to play media，本次未核验视频内容。
- 具体任务：称获 Meta 提前使用 Muse 的机会，处理业务和个人事务，列举付账单、买花、预订约会晚餐。
- 完成阶段：**用户声称完成**。没有逐项过程、金额、商家订单或支付回执。可支持“对日常代办的一揽子主观满意”，不能支持任务成功率或无人干预率。
- 体验：整体十分满意，认为它符合自己对 OpenClaw 的期待。未列自身失败。
- 关系：**提前访问已明确披露**。可见 [Peter Lohmann 追问对价](https://x.com/pslohmann/status/2097426186183835727) 和 [Vijar Kohli 追问赞助](https://x.com/VijarKohli/status/2097426290047357079)，均未见作者解释报酬。[官方 Muse 互动](https://x.com/Muse/status/2097452758395707538) 只是一句宣传回复。不能把提问当成已证明有赞助。
- Grok 校正：内容大体一致；保留“提前访问 / 报酬未披露”，不能写成确认为赞助或普通无利益用户。

## 34 · Nicole Huang — 容易上手，但旅行覆盖与速度不完整

- 原帖：[Nicole Huang @caitnicoleh](https://x.com/caitnicoleh/status/2099647920371032568)。日期：2026-09-14 23:54 UTC；页面 9/15 07:54 SGT。
- 访问：**X 原文直接可读**。带一张图片，图片本身未核验。作者职业和与 Meta 的关系未在此主帖明确，本次不额外背书 Grok 的职业标签。
- 具体任务：自述使用数天；旅行、购物中调整取舍；借助电话与 AI 客服沟通；较便宜且额度足以连续处理任务。对比指出 Meta 生态内容接入较强，其他平台弱；一次订机票时助手承认所用系统未考虑 Southwest。
- 完成阶段：**混合体验 / 过程性自述**。客服处理是否最终解决、航班是否出票均未提供明细。末尾以算 T1 四分之一决赛可能出赛日并买票为娱乐使用的例子，不能写成已验证出票。
- 体验：上手轻松、界面顺畅、能接住动态改需求；但浏览器操作像人点击一样慢，数据源覆盖限制选择范围。
- Grok 校正：保留“该次任务的数据源遗漏”，不升级为平台长期航空覆盖事实；“便宜 / 额度足够”是作者当时的感受，不作为现行价格表。
- 可用于报告：低使用门槛与高任务承接意愿；浏览器速度、生态边界、旅行供给盲区的反例。

## 35 · brandon galang — 浏览器能动，凭证交接使任务放弃

- 原帖：[brandon galang @brandon_galang](https://x.com/brandon_galang/status/2098805843680788942)。日期：2026-09-12 16:08 UTC；页面 9/13 00:08 SGT。
- 访问：**X 原文直接可读**。带图未逐图核验。主帖没有披露与 Meta / Nous / AsideAI 的雇佣或商业利益；作者 Vercel 职业标签本次未独立验证。
- 具体任务：想让 Muse 浏览信用卡奖励积分门户；在凭证交接上耗费多轮后放弃。作者认为浏览器本身可用，但凭证交接笨拙，安全凭证库存储很基础且看起来没有发挥作用。
- 完成阶段：**该项任务被用户放弃**，不是完成兑换或成功获取积分方案。页面没有可诊断具体技术根因的日志。
- 体验：肯定免费额度和能力对代理新手很慷慨；作为熟手，认为不及其 Hermes + AsideAI 配置，希望重点改善这一环。
- Grok 校正：大体忠实；“凭证库不能用”须写作者感受，不能写成经过复现的普遍故障。另一位 [Sudheesh 的回复](https://x.com/sudheenair/status/2098867368953024951) 谈浏览器代理普遍难以保持可复用登录态，未明确是在 Muse 上复现同一任务，不能算第二个 Muse 故障样本。
- 可用于报告：区别“浏览器操作能力”与“整条授权和接管流程”的实际可用性。

## 36 · Avi Flombaum — JFK 场外长期停车预订

- 原帖：[Avi Flombaum @aviflombaum](https://x.com/aviflombaum/status/2100468136671678756)。日期：2026-09-17 06:13 UTC；页面 9/17 14:13 SGT。
- 访问：**X 原文直接可读**。未见预订附件和后续纠正。
- 具体任务：去 RailsWorld 前找 JFK 机场场外长期停车位，并预订。
- 完成阶段：**作者明确声称已找到并订好**。支付、预订确认、停车场实际接受订单均未独立验证。
- 体验：强烈正面，具体展示旅行周边杂务的委托价值。
- 关系：主帖未说明提前访问、推荐奖励、赞助或 Meta 关系；记“未披露”，不是已证明无利益关系。
- Grok 校正：大体一致；可以称“预订完成自述”，不能笼统归为端到端旅行安排全部完成。

## 37 · Armand Domalewski — 拖延事项被推进，但每步结果要分开

- 原帖：[Armand Domalewski @ArmandDoma](https://x.com/ArmandDoma/status/2100455467810193433)。日期：2026-09-17 05:23 UTC；页面 9/17 13:23 SGT。
- 访问：**X 原文直接可读**。可见上文是 [询问最好用的场景](https://x.com/TheOmniZaddy/status/2100454967697870965)。
- 具体任务：处理拖延的保险理赔、组织找房、从邮件与银行账户发现不想续的订阅、发送之前忘记跟进的一批邮件。
- 完成阶段：**多步骤自述，终点不一**。邮件说已发；订阅只说发现；找房只说组织；理赔只说处理。没有获赔、退订成功、租约成交证据。
- 体验：强项是从个人信息里找出未完成事项并推进，降低堆积的生活行政负担。
- 关系：主帖未披露赞助、奖励或员工关系。职业标签未另查。
- Grok 校正：同线程“不信任 Zuck”来自 [另一位 O1nool 的回复](https://x.com/Olfool2/status/2100473962589462769)，是旁观者态度，不是 Armand 的使用不满，更不是产品已发生隐私事故。

## 38 · shashank — 购车流程编排，最终成交未写清

- 原帖：[shashank @_shanxS](https://x.com/_shanxS/status/2099696515845664860)。日期：2026-09-15 03:07 UTC；页面 9/15 11:07 SGT；**美东归档日为 9/14**。
- 访问：**X 原文直接可读**。上文 [Alexandr Wang 的征集帖](https://x.com/alexandr_wang/status/2099681348986515651) 同屏可见，带 Meta 关联标识，询问一周来最酷的 Muse 故事。
- 具体任务：研究车辆、与经销商议价、找合适保险报价、预约购前检查。
- 完成阶段：**用户声称管理了这些步骤**。没有明确写签约、付款、交车和最终报价，不能确认为已自动买车。
- 关系：用户本人关系未披露；材料出现在官方正面故事征集中，有选择偏差。随后 [armand_ruiz 转述](https://x.com/armand_ruiz/status/2100434962952462569) 强化为不用参与经销商流程、由 Muse 全做完。
- 员工关系核查：[armand_ruiz 的个人资料页](https://x.com/armand_ruiz) 可见自述“ai @meta”，可标 Meta 关联账号。其转述**不是第二次独立买车体验**。在原帖回复中他说自己之后将尝试卖车，也是未来打算，不是已完成实例。
- Grok 校正：原文没有明确“从未亲自去经销商”；转述里的 dealership dance 更接近复杂周旋流程，不能径直译为从没到店。只保留已明说的任务阶段。

## 39 · Erik Rogne — 云端与本地代理并用，带邀请推广

- 原帖：[Erik Rogne @erikrogne](https://x.com/erikrogne/status/2100294258322477541)。日期：2026-09-16 18:42 UTC；页面 9/17 02:42 SGT。
- 访问：**X 原文及作者邀请码回复直接可读**。
- 具体任务：未列具体一次任务。称 Muse 是自己找到最好的个人代理，同时仍以 OpenClaw 处理大量本地事务，逐步把更多任务交给 Muse。
- 完成阶段：**使用偏好 / 任务分工自述**，不列为某项任务执行成功。
- 体验：Muse 越来越常用；本地 OpenClaw 仍有角色，因此不是全面替代或彻底迁移。
- 关系：原帖下本人 [附邀请码](https://x.com/erikrogne/status/2100294313263739158)，话术为邀请可得 1b tokens。应标“邀请推广 / 奖励话术”，不写成无利益用户；没有看到邀请者个人具体奖励规则。
- Grok 校正：**漏掉邀请码推广背景**。这是本批需要更新证据权重的明显信息。

## 45 · C.V.F. — 大量产出自述，涉及其他模型且评价本身由 AI 参与生成

- 原帖：[C.V.F. @246o1Valjean](https://x.com/246o1Valjean/status/2099256815091351746)。日期：2026-09-13 22:00 UTC；页面 9/14 06:00 SGT。
- 访问：**X 原文直接可读**；附图未逐图核验。
- 具体任务：称一周内部署了拖延数月的业务自动化、夜间跑模型评测、把研究材料压成短简报、编辑并检查网页文章；娱乐内容有儿子篮球比赛集锦、讲课、漫画。作者明确称同时编排多个外部模型和代理，以及自己的本地硬件。
- 完成阶段：**作者声称多类产出已生成 / 自动化已运行**，未附逐项产物或运行记录。本地配置的贡献与 Muse 单独完成的部分没有拆分。
- 体验：突出异步高吞吐和无人盯守的感受；不是经测量的吞吐基准，也不证明所有普通账户都具备同样配置。
- 关系与生成披露：主帖未声明赞助或员工关系；**任务清单明确包括“This post”**，因此该评价存在 AI 辅助撰写 / 自我宣传混杂。不要当作纯独立人工记录。
- Grok 校正：应补充“评价本身由 Muse 参与生成”的披露；模型名单是作者自定义工作流的叙述，不证明平台原生可调用所有这些模型。

## 46 · PREEM — WhatsApp 降低切换成本，但没有任务成功明细

- 原帖：[PREEM @PipeBladex](https://x.com/PipeBladex/status/2100231113062957220)。日期：2026-09-16 14:31 UTC；页面 9/16 22:31 SGT。
- 访问：**X 原文直接可读**，另核对了 [账号资料](https://x.com/PipeBladex)。附图未逐图核验。
- 具体任务：称试过 ChatGPT Atlas、Gemini Agent、Comet，觉得这些产品要求改变浏览习惯；Muse 位于原本就在用的 WhatsApp，发任务后继续自己的生活。
- 完成阶段：**入口体验 / 偏好陈述**；没有指定任务、过程、结果凭证。不能据此比较四产品任务完成率。
- 体验：对该用户，保留既有沟通入口减少操作和注意力切换，是主要卖点。
- 关系：用户名及资料都明确自称 Unofficial Muse Guy，资料写日常技巧、工作流、AI 新闻并链接 Muse。可标“专门 Muse 技巧账号 / 明显推广导向”；未见付费合作或官方雇佣披露，不能认定官方员工。
- Grok 校正：大体一致；“发任务它就做”是口号式体验总结，不能作为无人干预执行的证明。

## 适合用于主报告的新主题连接

1. **生活行政价值**：33、36、37 让既有“邮件 / 预订 / 购物”优势更具体，但分别保留自述阶段。
2. **同一产品的新手与熟手体验差异**：34 顺滑易上手，对照 35 的凭证交接放弃；差异不矛盾，评价的是不同任务链路。
3. **复杂高价值任务仍缺终点证据**：38 购车与 37 理赔适合说明过程编排潜力，不应当作成交、赔付的闭环证明。
4. **持续委托与低切换成本**：39 的本地 / 云端分工、46 的 WhatsApp 入口，是使用方式与替代关系的证据。
5. **高吞吐叙事的边界**：45 包含多模型与本地工作流、AI 写评，适合放在进阶玩法或证据限制中；不给出客观吞吐排名。

本批 9 个主帖直接访问均成功，不含 X 不可读条目。所有核查只读，未发帖、点赞、关注或登录；研究标签已在结束时关闭。
