<?xml version="1.0" encoding="UTF-8" ?>
<rss version="2.0">
  <channel>
    <title>Journal of Carlos Gong</title>
    <link>https://carlosgong.github.io</link>
    <description>Journal of Carlos Gong</description>
    <language>zh-CN</language>
    <lastBuildDate>Sat, 31 Jan 2026 12:00:00 GMT</lastBuildDate>
    <item>
      <title>20260131: The "Read-it-Later" List</title>
      <link>https://carlosgong.github.io/posts/2026013101.html</link>
      <description><![CDATA[
        <h1 id="post-title">20260131: The "Read-it-Later" List</h1>
        <p>我在首页的 navigation 区新增了一个「<a href="../reader/index.html">Reader</a>」页面。</p>
        <p>页面的内容，现在大部分是我每天遇到的、想看一下、但是没有耐心读的英语长文。</p>
        <p>尽管目录页面还是尊重原文，采用原本的英语标题，但是每个文章详情页面都有「中文」和「英文」两个版本。</p>
        <h3>为什么做了这个页面？</h3>
        <p>在 <a href="./2026012401.html">之前的文章</a> 里面提到，随着大模型翻译水平的提升，从 25 年下半年开始，我在遇到想看的英语长文的时候，已经更倾向于直接扔给大模型翻译成中文，然后阅读母语了。</p>
        <p>为此，我自己有一个本地保存的中英对照 read it later archive 文件夹，并且最近在 vibe-coding 一个 RSS 阅读器，以便于直接在 RSS 阅读器里就可以一键转中文。</p>
        <p>事实上我本来有个更激进的规划：RSS 阅读器应该在检测到这是一篇高置信度的非中文文章的时候，就直接后台给它翻译为中文再呈现。后来，我觉得还是一定会需要大量的短文保持英语阅读量，避免退化得过快（退化已经是不可避免的了），所以放弃了这个想法。</p>
        <p>最近发现 ChatGPT 和 Kimi 最新版 K2.5 的中文翻译能力都有肉眼可见的退化：</p>
        <ul>
        <li>ChatGPT 会在大篇的中文里突然蹦出俄语；</li>
        <li>Kimi K2.5 会遗留很多本来可以翻译的英文部分。</li>
        </ul>
        <p>现在的大模型翻译仍然是不完美的，我觉得保留一个 online archive，记录从现在开始到未来很多年里，大模型翻译从「基本可用」到「非常完美」的进步，其实也挺有趣的。</p>
        <p>当然，作为一个不怎么能维护好自己的电脑配置、一言不合就会情绪上头重装系统的人，强制自己 commit 到 github 仓库里，也是一种防止本地 archive 丢失的办法。</p>
        <p>最后就是，实现这些页面的难度很小，我本来就有一个 Claude Code skill 来做这件事，如今只是把它的核心内容变成 CLAUDE.md，其它内容都几乎原封不动地复制一份到博客仓库里就好了。</p>
        <h3>这个页面怎样工作</h3>
        <p>和我的很多其它工具一样，它也是一个纯本地、纯手工的慢速流程。</p>
        <p>主要包括几个步骤：</p>
        <ul>
        <li>用 <a href="https://github.com/obsidianmd/obsidian-clipper">Obsidian 的插件</a> 来把英语文章页面转换为 markdown 格式。我不喜欢 Obsidian，但是它的 web clipper 确实是我试过的同类产品里最好的；</li>
        <li>把 md 格式的文件添加到一个目录里，然后告诉 Claude Code 或者 Codex 遵循仓库里的 CLAUDE.md 来工作；</li>
        <li>Claude Code 或者 Codex 会先按照我给出的 <a href="../reader/docs/translationPrompt.md">简单 prompt</a> 来翻译一份中文版本的 md 文件，然后把这两个文件分别生成 HTML 页面，最后更新 Reader 首页，添加一个条目；</li>
        <li>在这个过程中，图片也都会被下载下来，放到一个目录里，供本地保存和被 HTML 文件引用——我坚持所有数据都要有纯离线可用版本。</li>
        </ul>
        <p>以前在本地用过脚本来规范化 md 文件和中英文 HTML 的输出，但是自从有了 Claude Code 和 Codex，我已经懒得专门去终端运行任何脚本了——自然语言打字指挥多方便啊，it's not like 我很缺 token 钱，对吧 :-) </p>
        <h3>实际表现</h3>
        <p>这个页面上的文章，是从 01.29 开始的。翻译和转换的过程都用到了大模型。</p>
        <p>目前的页面上，有的文章是 Kimi K2.5 翻译和操作（基于 Claude Code），有的是 GPT-5.2（基于 Codex），主要看心情和当下的实际情况（比如时间）。</p>
        <p>可以看到：</p>
        <ul>
        <li>「机翻腔」还是有的，但是不同于早期的机翻腔，现在的已经基本不影响意义的理解了；</li>
        <li>细究起来，问题也还是不少的，尤其是 K2.5 的作品，甚至一定程度上是能看出来稳定的问题特征点的；</li>
        <li>在页面的细节上（比如标题部分），其实不管是 Claude Code 还是 Codex，K2.5 还是 GPT-5.2，每一次也都有细微的差别。</li>
        </ul>
        <p>后面我有可能会再调一调 prompt，优化一下产出效果。不过我觉得意义并不太大，毕竟现在的这个版本我已经凑合用了半年多了。</p>
        <p>也有可能给每篇文章添加一个头部 callout section 来写点儿简评（如果有的话），不过也觉得意义不大，我一般沉默寡言，没有什么要评论的，多看少说。</p>
        <p>样式一直都很粗糙，因为直接复制了我自己本来的 local archive 的样式。但是这显然是我最不 care 的事儿，甚至在一定程度上我就是喜欢这种粗放原始、意味不明的 rough edge 很多的状态。</p>
        <h3>最后</h3>
        <p>所有的保存到本地和翻译行为，都没有经过授权。搞不好以后哪天，这个 Reader 页面会导致我的整个博客被下掉，but I just don't really care :-) </p>
        <p>也没有什么复杂的即时备份措施，更新完以后会找个时间把整个博客文件夹拷到移动硬盘上（覆盖掉上一次拷的），而已。</p>
      ]]></description>
      <pubDate>Sat, 31 Jan 2026 12:00:00 GMT</pubDate>
      <guid>https://carlosgong.github.io/posts/2026013101.html</guid>
    </item>
    <item>
      <title>20260124: 相信未来</title>
      <link>https://carlosgong.github.io/posts/2026012401.html</link>
      <description><![CDATA[
        <h1 id="post-title">20260124: 相信未来</h1>
        <h3>1.</h3>
        <p>九十年代末，我家乡的很多政府机关和民营企业开始在办公室普及电脑，一般是在每个办公室角落里放一台。他们会专门请外部教师，来教员工基础的电脑操作，主要是键盘打字、制作文档表格幻灯片、基本的网络资料查找技能。</p>
        <p>当时，老师们都是教五笔输入法，有两个原因：</p>
        <ul>
            <li>长三角吴语区，大家的普通话都很差，要持续地把拼音打对是非常困难的事；</li>
            <li>当时 Windows 的拼音输入法是很差的，输入效率非常低，「智能 ABC」也被叫做「只能 ABC」。</li>
        </ul>
        <p>五笔输入法需要背词根，很复杂，我印象中有那么两三个月，我父母一直在背这些。</p>
        <p>在一个大家普遍家里没有电脑的时代，新华书店甚至会销售塑料的 1:1 键盘模型，来方便大家买回家随时练习五笔指法。</p>
        <p>最终，我父母花了大概半年，基本学会了五笔输入，可以很快地输入文字，据我观察，他们的主要用途是 QQ 聊天，次要用途是在棋牌平台（联众？）的聊天区跟人互喷，偶尔的用途是制作 Excel 表格记录信息。</p>
        <h3>2.</h3>
        <p>到了 04 年，我初三暑假，开始在家人面前使用电脑的时候（其实之前偷偷去网吧也不少），我出于本能，选择使用拼音输入法，这有三个原因：</p>
        <ul>
            <li>我的普通话水平很不错。输出正确的拼音，对于我来说很容易；</li>
            <li>家里的 IBM ThinkPad A30 笔记本电脑，Windows XP 已经有了微软拼音，我觉得它的输入速度还可以；</li>
            <li>小镇做题家，花时间学习五笔属于浪费时间，毕竟高考是一个纯纸笔活动。</li>
        </ul>
        <p>父母看到我在用拼音打字以后，强烈建议我趁中考完的暑假学习一下五笔，「一次记住，以后打字速度都会很快，终身受益」。</p>
        <p>我花了一天时间，了解了五笔输入法是怎么回事儿、大概要学些什么以后，<span class="bold">拒绝了这个建议</span>。</p>
        <p>这当然并不（只）是因为我想把有限的上机时间用来上网冲浪，更多是因为我觉得：</p>
        <ul>
            <li>对于一个普通话水平不错的中国人来说，拼音比五笔自然——实际上拼音是最自然的编码方式；</li>
            <li>而普通话水平不错、熟练掌握拼音技能的中国人会越来越多，普通话说不好（意味着不能正确转换拼音）的老一辈人会逐渐成为少数派；</li>
            <li>这种情况下，应该会有越来越多的中国人倾向于使用拼音输入法，拼音输入法会变得越来越好用——<span class="bold">今天拼音输入存在问题，不代表 3 年、5 年以后还这样。</span></li>
        </ul>
        <h3>3.</h3>
        <p>到了 07 年，我高三毕业，准备去上大学了。</p>
        <p>度过了高中三年不能名正言顺碰电脑的时光（偷偷去网吧还是一直有的），我得到了第一台自己的电脑：一个长辈淘汰的 <a href="https://www.ifixit.com/Device/Dell_Latitude_D610">Dell Latitude D610</a>。</p>
        <p>此时，我发现搜狗拼音输入法已经非常流行，就像我在 3 年前拒绝学习五笔时预期的那样，拼音输入法真的变得越来越好用了——实际上到 07 年底，我打拼音已经能比我爸打五笔还快了。</p>
        <p>04 年的我啥都不懂，并不能真的预测汉语输入法的发展进程是什么。</p>
        <p>07 年的我也啥都不懂，并不会理解让搜狗拼音变得比其它输入法产品 dramatically 更好用的核心 idea 和技术原理到底是什么。</p>
        <p>但是这件事情让我觉得，在合理的逻辑推论基础上去<span class="bold">「相信未来」</span>，相信事物会在发展中解决自身的问题，并做出对于未来的模糊判断，是一个重要的 mindset.</p>
        <h3>4.</h3>
        <p>07 年秋天，我上大学，北外英语系。</p>
        <p>当时的情况是：电子词典已经普及，金山词霸的破解版到处都是，免费的有道词典是新鲜事物，Google 还没被封、它的主页上有一个比较烂的 Translate 服务。</p>
        <p>那个时候，大家很喜欢聊的一个问题是：翻译类的工作，包括笔译和口译，到底会不会在未来被机器取代？</p>
        <p>当时，我的大部分同学会觉得至少在我们这一代人退休之前，这种事情不会发生，因为当前的 Google Translate 质量非常烂，笔译尚且如此，口译效果更是无法想象——事实上当时不存在任何一个民用的机器口译产品，哪怕是交替传译。</p>
        <p>我当时的预判和大部分人是不一样的。我觉得<span class="bold">在我这一代人退休前，机器翻译一定会导致人肉翻译失业</span>，至少是笔译，可能还有口译。原因在于：</p>
        <ul>
            <li>不能用现在的技术水平去套到未来：07 年距离我退休还有 40 多年，而往前 40 年是 1967 年，便携式个人计算机作为一个概念甚至还没出现；</li>
            <li>翻译本身是个很大的需求市场，小到日常读新闻、大到正式的同声传译。这个市场一定会有大量的玩家去试图用技术来解决问题，而不是一代一代靠「专业的人肉」；</li>
        </ul>
        <p>基于这样的判断，我做了几个人生选择的决定：</p>
        <ul>
            <li>尽管在专业方向上选择了翻译（因为更容易毕业），但是不要继续追求在这个方向上更进一步（北外的研究生专业里有个高级翻译学院）；</li>
            <li>可以在上学的时候接交传和同传的私活儿，因为短期赚得多，但是不要成为职业翻译，要选择一个不同的行业。</li>
        </ul>
        <h3>5.</h3>
        <p>如今，我还不到 40 岁，远远没到退休的年纪，我觉得翻译这个行业已经基本上被颠覆掉了。</p>
        <p>在今天，由大模型驱动的文字翻译能力，即使在我这种非常挑剔的人看来，也已经是「日常可用」水平了。</p>
        <p>在 25 年之前，我总是更倾向于直接阅读英语原文，并且因此大量阅读。但是到了 25 年下半年，我已经开始在 ChatGPT 和腾讯元宝上建立专门的 prompt，把长篇的英语文本转换成 Markdown 纯文本（通过改动 <a href="https://github.com/obsidianmd/obsidian-clipper">Obsidian 的官方插件</a>），然后扔进去看翻译稿了——毕竟阅读母语文本，还是会比阅读外语文本要快一点、更直觉一点的。</p>
        <p>我还在 vibe-coding 一个自己用的 RSS 阅读器，它区别于其它阅读器（我使用 <a href="https://netnewswire.com/">NetNewsWire</a>）的主要功能就是——你可以 bring your own API Key，然后它会把所有的英文源都自动翻译，并且优先给你展示中文版本。</p>
        <p>这种情况下，我甚至会担心我长期通过大量的英语读写（「刻意练习」）来在毕业以后维持了十几年的英语能力，可能会在 3～5 年的时间里快速退化掉。</p>
        <p>而我现在回想 10～11 年我在北外上的那些英语翻译课程，绝大多数的笔译作业，直接把中文扔给 ChatGPT，它在 1 分钟内吐出来的结果，会远比我当时吭哧吭哧自己在图书馆抱着电脑查资料写一下午的结果要好。</p>
        <p>我现在甚至很难想象这两年翻译专业的课堂上在发生些什么。</p>
        <p>07 年的我，显然是不会想到未来翻译软件们到底靠什么具体的技术路线和实现方式来颠覆掉人肉翻译。但是基于<span class="bold">「相信未来」</span>的基本原则，07～11 年的我已经足够做出一些模糊的方向判断，来至少对自己的人生规划做一些方向性的校准。</p>
        <h3>6.</h3>
        <p>从 25 年下半年开始，我感觉到我们又进入到了类似于 2010～2014 年那种勃勃生机、万物竞发、每隔几天就会有个新爆款产品的时代。</p>
        <p>谁也不能准确地预期未来 LLM 能力会在什么阶段达到具体的什么水平（👈 任何说他们能的人皆为神棍），但是基于「相信未来」的基本原则，很多现有的产品、思维方式、工作方法会需要被重构，仅仅是想一想未来 1～3 年和 3～5 年会有多少新东西都让人激动。</p>
        <p>今年我在工作上开了两个新坑，在业余项目上可能有大概 10 个。我觉得如果我还是<a href="https://carlosgong.github.io/posts/2026011101.html">像 25 年那样</a>花 14 个月才做出一台手机，那显然是远远地太慢了。</p>
        <p><span class="bold">Let's believe in the future and build more.</span></p>
        <h3>7.</h3>
        <p>实际上，由于 AI 能力的大幅增强，在你看到这篇文章的时候，意味着我已经改变了<a href="https://carlosgong.github.io/posts/2024011101.html">在 35 岁时的第一篇文章</a>里所说的纯手动更新方式：</p>
        <p>这一篇我没有直接手写 HTML，而是直接写了 markdown，然后让 Claude Code 自动转成了 HTML、并且修改首页、RSS 等相关各处。你甚至可以在这个博客的 github 仓库的 ./src 文件夹里<a href="https://github.com/carlosgong/carlosgong.github.io/blob/main/src/2026012401.md">看到我写的这个 markdown 源文件</a>。</p>
        <p>其实之前<a href="https://x.com/Carlos_Gong/status/1848223136530993353">我曾经计划过哪天手动写这么一套工具</a>（基本相当于写了一个静态博客程序），但是很显然，现在我已经不用自己写了。</p>
        <p>当然，这不是因为我在 35 岁是没有「相信未来」，而只是因为我现在更懒了 :-)</p>
      ]]></description>
      <pubDate>Fri, 24 Jan 2026 12:00:00 GMT</pubDate>
      <guid>https://carlosgong.github.io/posts/2026012401.html</guid>
    </item>
    <item>
      <title>20260117: Vibe-Coding &amp; AI-Native Hardwares</title>
      <link>https://carlosgong.github.io/posts/2026011701.html</link>
      <description><![CDATA[
        <h1 id="post-title">20260117: Vibe-Coding & AI-Native Hardwares</h1>
        <h3>1. 俳句时钟</h3>
        <p>两年前的大概这个时候，我在第 N 次重新学习前端代码，当时是为了尝试调用最早期的一些 AI 模型，来尝试一些奇怪的东西。大部分是和我当时的工作相关，有个跟工作不相关、可以发出来的，是一个 <a href="https://x.com/Carlos_Gong/status/1769364171328799114">每分钟自动刷新一首俳句</a> 的小废物。</p>
        <p>当时，为了做出来这样一个非常简单的东西，你也还是得认认真真地找一个教程，尽量根据目录（而不是急功近利地跳着看）去 follow 它，手敲各种示例代码，理解所有的基本概念，最后运用这些概念，把新东西做出来。在这个过程中，AI 的作用主要是在 chatbot 里提问题，然后看它回答的示例代码（其实也错误不少），来学习理解新的概念、或者 debug 已经手写出来的问题代码。</p>
        <p>然后如果你有一段时间没有使用，这些学会的东西就会被忘掉。这是为什么我每隔不固定的时间就会需要重新学一遍基础编程知识、或者基础 Blender 操作这些东西。</p>
        <p>两年过去了，事情发生了很大的变化。在今天，藉由 Cursor 和 Claude Code 的流行，任何一个思维水平正常、能够用自然语言说清楚需求的普通人，都可以在不事先投入 10+ 小时学习（或者再次学习、第 N 次学习…）基本编程概念的情况下，写出一些不那么复杂的小工具。</p>
        <p>如果在 2 年后的今天要重新做一个类似这样的俳句时钟，大概只需要 15 分钟（或者更少一些），并且你完全不需要去再次复习 javascript 基础知识，只需要有一个大概的印象「这是怎么回事儿」就好了。</p>

        <h3>2. AI-Native Builders</h3>
        <p>在今天，每个人都可以随时运用自然语言写一个小工具。这是一件非常好的事儿，但是最近我也会经常看到一些奇怪的言论，有的现役程序员（目测数量还不少）认为这不是一件好事儿，比如说：</p>
        <ul>
            <li><a href="https://x.com/meditic/status/2009031530761666987">业余人士不应该能够在手机上随时写出一个对自己有用的小程序</a></li>
            <li><a href="https://x.com/Megabits_mzq/status/2012367624622297302">人不应该能够很快地写出 11 个上架 App Store 的小程序</a> (涉及的原 tweet 是 <a href="https://x.com/AlchainHust/status/2012340611806814279">这条</a> )</li>
        </ul>
        <p>这种非常神奇的想法，让我想起很久以前，在 AI 刚能勉强生成（人手以外的、不含文字的）图片、大家都在 MidJourney 和 ComfyUI 开盲盒的时候，我还在 twitter 上见过几个画师说人不应该随便用 AI 模型生成一张具备特定视觉风格的图片——然后，GPT-4o Ghibli Moment 就来了。</p>
        <p>再往前一些，当抖音和快手让每个人都能在手机上拍出一段视频、甚至是开始一段直播，并且发到公开网络上的时候，我也在 twitter 上见过一些专业影人说普通人不应该很快地拍摄一段视频发出来，因为它们没有思考和灵魂，只是生产了一大堆垃圾 footage 数据。</p>
        <p>不是所有的程序写出来都是为了给全人类使用，就像不是所有的抖音短视频拍出来都是为了给一大群人放映。</p>
        <p>在人类历史上，我们已经有过：每个人都能阅读一段圣经的 moment、每个人都能分发文字作品（手抄本）的 moment、每个人都能拍下和分享照片的 moment、每个人都能拍一段视频或者开始一段直播的 moment、每个人都能用自然语言生成图片给自己使用的 moment……</p>
        <p>我不觉得即将到来的「每个人都能 vibe-direct 一段影片」和「每个人都能 vibe-code 一个小工具」的 moment 和之前已经发生过的那些 moments 有任何区别。</p>
        <p>解放创造力，just vibe it out，可能完全没啥用看一眼就扔了、可能只对自己有用、可能对 20 个其它人有用、可能可以卖给 1000 个陌生人、也可能更大范围地 go viral，这不重要。</p>
        <p>我不喜欢 <a href="https://x.com/Carlos_Gong/status/2011068317650592181">被 web3 从业人员称为 web2 XXXX</a>，但是他们的这个做法确实给了我一些奇怪的启发：既然现在即使是最傲慢的现役程序员也不是完全古法编程了，我们已经不能用「古法程序员」和「vibe-coder」来做这个区分，那么我们至少可以这样：

        <ul>
            <li>把那些傲慢的、觉得人不应该可以随时随地写代码和写出奇怪小工具的现役程序员称为 <span class="bold">「legacy coders」</span>；</li>
            <li>把新一代几乎永远处于 AI 写代码模式、自己几乎不会（甚至完全不会）手工写代码的、充满创造力的普通人称为 <span class="bold">「AI-native builders」</span>。</li>
        </ul>

        <h3>3. AI-Native Hardwares</h3>
        <p>「AI-Native Builders」这个说法过于有趣，以至于它让我想到了一些别的东西：</p>
        <p>两年前，我在 <a href="https://carlosgong.github.io/posts/2024011501.html">对 Rabbit R1 的看法</a> 的文章里，把当时的第一批主打 AI 卖点的消费电子产品称为「initial AI hardwares」。</p>
        <p>两年过去了，我觉得现在我们应该区分两种对于消费电子类「AI 硬件」的不同定义，即：</p>
        <ul>
            <li><span class="bold">AI-Driven Hardwares：</span>主要是被 AI 驱动的硬件。代表产品包括 Rabbit R1、Humane Ai Pin、还有各种国内的便宜 AI 教育玩具。</li>
            <li><span class="bold">AI-Native Hardwares：</span>完全为 AI 设计的产品。我其实不觉得现在市面上有这样的产品，但是我觉得未来 1～2 年会有。</li>
        </ul>
        <p>说一个消费电子产品是<span class="bold">「AI-driven」</span>硬件，意味着尽管它的核心功能是由 AI 驱动的，但是它具备哪些功能、应该被用在什么场景、在品类划分层面上叫什么名字…… 都还是被产品经理们预先定义的，这背后可能是大量的传统时代的硬件产品规划工作——场景选择、市场潜力估算、用户调研、功能设计…… 最后主动选择一个很窄的细分领域去切入、并且在整套 GTM 过程中呈现出明确的市场定位。</p>
        <p>如果一个消费电子产品是<span class="bold">「AI-Native」</span>硬件，则意味着它很可能并不是被预先定义好的、面向细分市场和明确细分用户群体的产品——它的主要功能，是由 LLM 本身的能力去决定的，没有严格的「这个东西应该怎么用」的限制。产品团队当然可以针对一些他们预期可能会有的 core use cases 做工程化的针对性优化工作（并在上市以后根据用户反馈持续地去做这样的工作），但是本质上，<span class="bold">它仍然是一个不设限的产品</span>。</p>
        <p>举个有点儿过于简化的例子：想象一个小玩具，它有扬声器和麦克风、有一个 eSIM 联网上下行的能力。那么，如果它是一个 AI-Native 硬件，它就不太应该把自己定位成一个「益智玩具」，而是从一开始就允许各种人拿它去做各种事，用户只需要提供一段或简短（比如直接语音）或复杂（比如有个 app 可以反复斟酌和大段输入）的 prompt：</p>
        <ul>
            <li><span class="bold">对于家长</span>：可以买给孩子，当成具备不同人格（当然，你可以用 prompt 来指定）的讲故事、聊天互动的玩具；</li>
            <li><span class="bold">对于我自己</span>：买一个回来，让它每天按照我指定的风格给我播放新生成的音乐——按一个键就可以用的 <a href="https://x.com/Carlos_Gong/status/1771182109857853777">无限音乐盒</a>；</li>
            <li><span class="bold">你甚至应该可以</span>：买一个回来放在床头，接上电，每天晚上监听自己有没有打鼾，第二天早上给一个语音播报。</li>
        </ul>
      ]]></description>
      <pubDate>Sat, 17 Jan 2026 14:13:02 GMT</pubDate>
      <guid>https://carlosgong.github.io/posts/2026011701.html</guid>
    </item>
    <item>
      <title>20260111: 37 岁</title>
      <link>https://carlosgong.github.io/posts/2026011101.html</link>
      <description><![CDATA[
        <h1 id="post-title">20260111: 37 岁</h1>
        <p>距离上一次更新这个纯手动 blog，已经过去了将近 2 年。</p>
        <p>上一次更新生日博文的时候，<a href="https://carlosgong.github.io/posts/2024011101.html">还是 35 岁生日</a>。两年过去了，我决定如果有可能的话，我至少应该每年生日这一天都更新一次。</p>

        <h3>过去两年发生了点儿啥？</h3>
        <p>感觉过去两年过得特别快，可能也是 36 岁生日没有写任何东西的原因。</p>
        <ul>
            <li>未能免俗，做了一台非常普通的 AI 手机，它对外的名字是 <a href="https://o.doubao.com">nubia M153 豆包手机助手预览版</a>。</li>
            <li>这应该是我做过的时间最充裕的手机项目，很多时候都不是我在从一个 deadline 奔向另一个 deadline，而是我在刻意拉长每个项目阶段的时间，等待其它领域的功能和能力赶上来——硬件等软件，可能是 AI 产品的工程常态，老罗也遇到了这样的问题。</li>
            <li>这也是我做过的在商业化层面上 drama 最多的项目，希望有一天我能把这些故事写出来——毕竟我确实觉得有很多人在这个项目上 deserve more credit，而另外一些人和团队的作用则被刻意夸大了。</li>
            <li>在 24 年坚持了长时间的早起和规律健身，在 25 年的大部分时间也保持了每天一万步的基本运动底线，体能状况改善很明显，并且在 23 年那一次之后，就没有再痛风过了。</li>
            <li>因为工作原因，在北京和深圳之间频繁飞行，最喜欢的飞行相关点位是首都机场 T3 C07 登机口旁边的星巴克、宝安机场出站口有个黄色拱门装饰的麦当劳、宝安机场 T3 出发区的老乡鸡。最不喜欢的点位是首都机场 T2 的海航休息室。</li>
            <li>日语学习进展缓慢，依然处在能读五十音图、能看懂基本语法结构、但是单词要靠汉字词望文生义和拼读片假名词来猜外语含义的阶段，希望在 37 岁能显著改善一些。</li>
            <li>去了很多次东京，很多时候其实只是为了能有一个地方和理由进行大量的徒步。同样的，也很喜欢滨海国际机场出发区的那间星巴克，每次都会在那边呆比较长时间。</li>
            <li>开始以一个比较正确的态度来面对身上的一些旧疾，去了很多次牙科诊所来解决各种长期存在的牙病。花了不少钱，但是觉得值得。</li>
        </ul>

        <h3>37 岁会是有趣的一年</h3>
        <p>在 36 岁的最后半年，感觉生活再次变得逐渐有趣起来了。</p>
        <ul>
            <li>在工作层面上，我看到了更多的 AI-native 硬件机会，希望到明年生日博文的时候，回头看看哪些想法是对的。</li>
            <li>在我喜欢的全键盘消费电子设备领域里，很多有趣的硬件产品出现了：我已经购买并将在明天拿到 <a href="https://zinwa.cn/" target="_blank">Zinwa Q25</a>（给黑莓 Q20 换一套安卓主板），并且密切关注同一家厂在做的自研手机 Q27，我也觉得 Mr Mobile 的 <a href="http://www.youtube.com/watch?v=69VgtIJOtdQ&t=455s" target="_blank">Clicks Communicator</a> 非常有趣（虽然我觉得它不一定能做出来）。</li>
            <li>计划探索更多国家（目前的 target list 是新西兰和新加坡）和东京以外的更多日本城市。</li>
            <li>计划了和家人的春季 / 初夏赛里木湖旅行。</li>
            <li>除了深圳以外，也计划去探索更多国内主要城市。从工作变动情况看，也确实会发生。</li>
            <li>Vibe-coding is now a real thing. 有很多奇怪的想法，希望今年能至少实现 2～3 个——整体上，我觉得每个人都能写一个只有自己会用到的诡异小 app 的时代已经近在眼前了。</li>
        </ul>
        <p>其实本来想写点儿对 2026 年的预测，但是鉴于 <a href="https://carlosgong.github.io/posts/2024011501.html" target="_blank">前一篇文章</a> 很可能要变成回旋镖打回到我自己身上了，所以我决定今年还是（暂时先）不写了 ^_^</p>
      ]]></description>
      <pubDate>Sun, 11 Jan 2026 00:00:00 GMT</pubDate>
      <guid>https://carlosgong.github.io/posts/2026011101.html</guid>
    </item>
    <item>
      <title>20240115: Rabbit R1 Reactions</title>
      <link>https://carlosgong.github.io/posts/2024011501.html</link>
      <description><![CDATA[
        <h1 id="post-title">20240115: Rabbit R1 Reactions</h1>
        <div style="border: #444 solid 1px; padding: 5px 10px; border-radius: 5px; margin: 20px 0;">
            <h4>Note:</h4>
            <p>We are now in an era of initial AI hardwares...</p>
            <p>我觉得在这个阶段记录一下自己的早期想法和看法，以后来看对了多少 / 错了多少，是一件很有意思的事情。</p>
            <p>本文是我对于近期刚发布的 Rabbit R1 的一些初期看法——主观、无上手、云讨论、暴论很多，全是文字没有图，爱看不看 :-)</p>
        </div>
        <p><a href="https://www.rabbit.tech/">Rabbit R1</a> (据说按照该司高管的说法，应该 styled as「rabbit r1」全小写，but I just don't care ^_^) 发布了，各处讨论很多。</p>
        <p>和 Humane Ai Pin 一样，我仍然觉得这又是一个「抢概念首发、缺点远比优点多」的设备，它有一些我很难理解的定义方式和宣发方式，我也不觉得它是一家创业公司的 solid first generation product.</p>
        <p>以下硬件相关的看法会比较多，一方面是我觉得我自己对于 LLM 能做到什么程度也没有很好的把握；另一方面我的主业是一个硬件产品经理，对 OS 和软件确实经验和心得都很少。</p>
        
        <h3>1. 「Mobile Companion」是安全的形态吗？</h3>
        <p>按照《乔布斯传》第 36 章的记载，苹果在 iPod 事业成功以后寻求制造手机，是因为乔布斯觉得如果手机制造商开始在手机中内置音乐播放器，每个人都随身带着手机，就没必要买 iPod 了。</p>
        <p>这个故事，以及过去 10 多年【智能手机+移动互联网】吞噬一切其它随身设备（MP3 播放器、数码相机、录音笔、电子辞典……）的历史，告诉我们一个很简单的道理——当你准备做任何随身移动设备的时候，都需要最先仔细想好应对策略的问题是：<span class="bold">你的设备会不会最终成为智能手机的一个功能，被手机吞噬掉？</span></p>
        <p>现在的 Rabbit R1 仍然被定位成<span class="bold">「手机之外的另一个需要随身携带的设备」（Mobile Companion）</span>，吕骋的团队做了两件事，来 justify Rabbit R1 为什么需要存在、为什么用户在携带手机之外还要再携带这个设备：</p>
        <ul>
            <li><span class="bold">发布会的口径：</span>原话大致是「Rabbit R1 可以做的事情在 iPhone 上做不了」，以及「智能手机是浪费时间的产品，Rabbit R1 是节省时间的产品」；</li>
            <li><span class="bold">实际的产品定义取向：</span>主要是两个策略；
                <ul>
                    <li>在外观和整机设计上，走小众极客潮玩的定位，尝试抓住一小波愿意在手机之外再携带一个电子设备的群体；</li>
                    <li>在价格上，压价到 $199，让一部分 early adopters 可以「冲动购买，买一个来玩玩」。</li>
                </ul>
            </li>
        </ul>
        <p>对于我个人来说，发布会口径是没有说服我的：在当下这个时间节点，iOS 还没有部署大模型 AI 助手，搭载 Gemini 的 Android 大版本也还没有广泛推出。但是我们可以合理地预测，5~6 月的 Google I/O 和 WWDC 上，主流智能手机产品的 AI 能力会有很大的提升，到时候，用户仍然会倾向于直接在手机上使用今天在 Rabbit R1 上 demo 的这些功能。</p>
        <p>毕竟，直接在手机上做这些事，是明显更简单、也更顺理成章的：你不需要去一个创业小公司做的网页 portal 上登录自己的账号，当 AI 助手提供的答案不符合你的需求的时候，也可以直接一步进入 app 去进一步查看和操作。</p>
        <p>这里面最本质的问题是有两点：</p>
        <ul>
            <li>经过全行业十几年的反复试错和打磨，今天的智能手机，在关键指标上已经抵达了一个非常理想的平衡区间：屏幕尺寸、续航、重量…… 它是一个各方面都「刚刚好可以接受」的、最普适的随身设备；</li>
            <li>AI 可以做一部分的事情，但是不可能帮你做所有的事情。至少在未来几年内，你的绝大部分时间还是会花在 app 里，一半甚至更多的需求还是要靠 app 来满足（要注意游戏也是一大类 app，视频也是）。</li>
        </ul>
        <p>最终，不存在一种「和手机共存的设备」，<span class="bold">这些设备会成为手机的一个功能</span>，并且在手机上运行比在单独的设备上运行更好，比如说：</p>
        <ul>
            <li>在 Rabbit 演示订餐功能的时候，吕骋不得不告诉 R1 选择最热门的披萨组合就行——但凡你要进行哪怕一点儿尺寸和馅料的定制，公开的 API 可能就难以满足了，你只能打开手机去 app 里面完成（除非你真的相信今天的 Teach Mode 就能让 AI 学会帮你定制披萨……）；</li>
            <li>在 Rabbit R1 的演示里，需要用 R1 拍电脑屏幕来导入的那个 Excel 表格，在手机上完全可以直接从 Excel for Android 或者 WPS 把源文件喂给 AI 去做，远远更加精确。</li>
        </ul>
        

        <h3>2. Cutting Cost 与 Over-Promise</h3>
        <p>Rabbit R1 是第一个把 AI 硬件的价格降到 $199 的初创团队，相比 $699 还需要订阅费的 Humane Ai Pin，这个价格确实是可以在早期引发 early adopters 的冲动购买，如果 Rabbit 承诺的功能都能实现的话，它的性价比也确实比其它 AI 硬件要远远地更高。</p>
        <p>但是，如果你是一家初创公司、需要把一个设备压价到 $199，还需要一点盈利空间，那么你会需要面临巨大的 cutting cost 压力，在 Rabbit R1 上，可以看到很多这样的点。举几个例子：</p>
        <ul>
            <li>Rabbit R1 用了 2.3GHz 的 MTK 处理器和 4+128 的存储组合。具体的处理器型号不明，但是对于这个参数水平，我自己的第一反应是我曾经用过的 <a href="https://i.mediatek.com/p35">P35</a>（很可能不是）——这是一颗 2019 年的中低端处理器，很便宜，我印象中整个套片仅售 10+ 美元，现在会更便宜；</li>
            <li>P35（或者其它这个水平的 MTK 套片）是一套 4G 方案，它本身就不支持 5G 连接；</li>
            <li>屏幕很可能非常差。从各种 demo video 看起来，可以确定的是黑边非常大，其它可能的情况是分辨率很低、以及最离谱的——可能是非全贴合屏幕；</li>
            <li>亮面光滑塑胶机身。可以预见的是，只要它不是白色的，指纹状况就会非常明显。</li>
            <li>单扬声器。外放效果不太可能好。</li>
            <li>从空间体积来看，相机质量也不会很好，它的盖板开口很小，所以甚至很可能不是一颗视野足够大的超广角摄像头（Humane Ai Pin 用的是 120 度的超广角摄像头）。所以我对于发布会上的那个「看一眼冰箱里的食材就能判断做什么菜」和「直接拍屏就能复刻出 Excel 表格」的场景有非常非常多的疑问……</li>
        </ul>
        <p>对于初创公司来说，这么做确实有利于把最终价格压到 $199，甚至还能有可观的单台毛利，但是问题在于：<span class="bold">如果你真的这么做了，你不能 over-promise</span>，要非常精确而谨慎地控制好围观群众和目标用户的预期，而不是上来直接拿它跟当代 iPhone 和 Android 手机做比较，并且不做任何控制预期的附加注解。</p>
        <p>我相信很多观众在看完这个 Keynote 发布，对 R1 的印象是一个外观很酷、非常便宜、yet 各方面基础体验对齐当代 iPhone / Android 手机、甚至响应速度更快的设备。</p>
        <p>当他们发现拿到手的是一个低分辨率发白屏幕、可能会有不少卡顿、外放效果也不好的指纹收集器时，这种落差将会非常、非常明显。</p>

        <h3>3. 关于 AI 硬件创业的一点主观言论</h3>
        <p>作为一个在创业时期一贯被内部认为行事作风过于谨慎和保守，「算 Excel 比思考新 idea 的时间多」，甚至被前老板评价为 「<a href="https://www.sohu.com/a/345358705_100185880">比库克他爹还保守的人</a>」的人，我对于创业这件事通常没有什么发言权，但是我还是想讲讲我对于 AI 硬件创业的一些 unpopular opinion :-)</p>
        <p>我觉得，除非你只是想要抢「AI 硬件」的概念首发，否则，<span class="bold">现在不是开启一次 AI-driven 消费电子硬件创业的好时机</span>。原因很多，比如说：</p>
        <ul>
            <li><span class="bold">巨鲸们还没有出牌，但是很快就要出牌了。</span>iOS 和 Android 的第一批 LLM 功能直接集成和 API 开放，会发生在今年的 5~6 月（Google I/O 和 WWDC）——不管现在独立的 AI 硬件能够做什么，都有可能在那个时候变成手机的一个功能。要判断自己的 idea 在短期未来被手机吞噬的概率，在那个时间点上比较好一些；</li>
            <li><span class="bold">新形态产品的技术成熟度严重偏低。</span>AR 眼镜现在的技术成熟度太低了，不管是光学 AR 眼镜还是类似 Vision Pro 的流媒体 AR 眼镜都是这样。技术供给的成熟度低到什么程度呢？——不仅创业公司做不出来体验过关的东西，大厂巨鲸们也做不出来体验过关的东西。</li>
        </ul>
        <p>如果你现在有一个非常好的 idea，并且能够很好地 justify 它的存在，那么你是可以去创业的。但是要知道，这些理由的要求很苛刻（创业本来就是一件九死一生、需要深入思考才能做的事情），比如说（以下的几条里至少要占一条吧……）：</p>
        <ul>
            <li>你对于「我的产品未来不会被手机吞噬」有一个非常完美的回答；</li>
            <li>你有办法证明「未来的手机会是一个和现在根本截然不同的形态，而大厂不敢这么快转身，并且它就是我现在要做的这个产品的形态」；</li>
            <li>你有办法证明「我本来也只需要每代卖几万个，给小众用户群体，就能很好地活下来。所以我不需要关心未来手机会不会继续吞噬任何东西。」（但是这种情况通常需要产品非常有特色且单价很贵，比如 Teenage Engineering 自己出的各种硬件，或者像是步步高的教育平板）；</li>
            <li>你能让投资人相信「虽然这一代没有想好就出了，但是抢概念首发对我们的事业很重要，并且是后面推出『真正的产品』之前必须经过的一个环节。」</li>
        </ul>

        <p>不过，另外一个有趣的思维实验是，如果我自己现在被按头让做一个「AI-driven hardware」，并且不准做垂直用户群体（比如做成教育硬件），我会做什么形态？我觉得我有 2 个答案，但是它们都很差（所以我这个时候不会去创业 ^_^）：</p>
        <ul>
            <li><span class="bold">带有摄像头的智能手表</span>：市面上其实有一些带有摄像头的智能手表，比如<a href="https://www.okii.com/html/pc/products/z6s.html">小天才的儿童手表</a>。手表是极少数没有被手机吞噬的产品形态，并且它足够随身、对于习惯戴手表的人来说，也没有「带两个设备」的负担。</li>
            <li><span class="bold">TWS 耳机</span>：TWS 耳机是另一个没有被手机吞噬的形态，并且 TWS 的盒子/配套手机 app 有很多非常规的玩法，比如在上面加个屏幕显示点儿简单交互的信息。</li>
        </ul>
        <p>我觉得这 2 个答案都很差，最重要的原因是虽然手表和 TWS 耳机没有被手机吞噬掉，但是它们现在是以手机为中心的硬件生态圈子里紧密的部分——举个最简单的例子，如果 WWDC 以后 iOS 新版具备了很强的 AI 能力，那么 Apple Watch 和 AirPods（尤其是 AirPods）会一夜之间什么也不用干就成为强大的 AI 硬件，打死一大批创业做这种形态的团队。</p>

        
        <h3>4. 最后：其它零碎的暴论</h3>
        <p>一些不属于上面任何一部分的看法：</p>
        <ul>
            <li>For both Rabbit R1 & Humane Ai Pin: 把语音作为几乎唯一的交互方式，是愚蠢的定义。语音天然有私密性差+场景适应性差的弱点（「吵到我用 TNT 了」），短期内也很难根治识别精确度和沟通负担的问题。Humane Ai Pin 完全不能使用键盘输入；而 Rabbit R1 的屏幕尺寸和非对称设计，键盘体验太差了。</li>
            <li>我觉得 Rabbit R1 的人机工学有一些问题，比如说：
                <ul>
                    <li>它太宽了（<a href="https://twitter.com/jessechenglyu/status/1746045442406928516">周末吕骋自己发的视频</a> 显示它实际上和 iPhone 15 Pro Max 一样宽），并且是非对称设计，这对于非右手持机的用户来说体验会很差；</li>
                    <li>如果我没理解错的话，右手握持的时候，手掌会正好遮住背后的扬声器；</li>
                    <li>边框看起来非常方正，并且不薄。这在宽度问题的基础上进一步恶化的它的握持手感体验。</li>
                </ul>
            </li>
            <li>同样是 Teenage Engineering 作品，我觉得相比 Playdate 和 CMF by Nothing 的红色手表，Rabbit R1 相对看起来比较丑…… 吕骋的上一个作品，<a href="https://teenage.engineering/designs/H">Raven H 智能音箱</a>，完工水平明显更高，至今是我最喜欢的桌面摆件。</li>
            <li>但是不管怎么说，吕骋依然是我见过的最好的演讲者之一。从当年乐流 app 的发布会开始，到这个 Rabbit R1 的发布会，在「怎样有说服力地 present 一个产品」这件事上，吕骋是非常接近老罗的水平。</li>
        </ul>
        <p>最后，尽管上面全篇我都在避免实际讨论 LLM 和 LAM，但是最后还是忍不住想说：我觉得不管是 Humane 还是 Rabbit，当用户第一次拿到设备时，他们都会面临「预期这个设备能做什么」和「这个设备实际能做什么」之间的巨大落差。主要原因在于，<span class="bold">现在的用户，尤其是会买这两个设备的早期尝鲜用户，很可能是在以 AGI（真·通用人工智能）的预期去要求今天的 AI 产品</span>，而这，是非常非常危险的，因为它意味着不切实际的超高市场预期——会让第一批 AI 硬件在交付到用户手里的时候就见光死的那种。</p>

        <div style="border: #444 solid 1px; padding: 5px 10px; border-radius: 5px; margin: 20px 0;">
            <h4>Update 2023.01.15 晚间 11PM:</h4>
            <p>经过同事提醒，北京时间今天傍晚左右，<a href="https://www.rabbit.tech/">Rabbit R1 的页面下方更新了一个基本的 spec 表</a>。</p>
            <p>按照 spec 表，这个 MTK 处理器的具体型号确实是 P35，同时也可以看到一些额外的信息，比如 R1 的充电速度非常缓慢，以 500mA 的电流，充 1000mAh 的电池，在实际使用环境中会需要大概 2.5 小时、甚至 3 小时左右。</p>
            <p>另一个有趣的事情是：基于我个人的一些经验，我觉得这套没啥亮点的 P35 方案的总价不会超过 $99（即使是计入小公司的议价权劣势和 Teenage Engineering 设计要求的溢价）。考虑到 R1 售价为 $199 且仅在官网发售（即没有其它渠道提成费用），<span class="bold">这意味着 Rabbit 团队的内部核算可能认为每个用户在生命周期中会造成的 AI 大模型相关费用大概为 $100 上下</span>，或者更多些。</p>
        </div>

      ]]></description>
      <pubDate>Mon, 15 Jan 2024 00:00:00 GMT</pubDate>
      <guid>https://carlosgong.github.io/posts/2024011501.html</guid>
    </item>
    <item>
      <title>20240111: 35 岁</title>
      <link>https://carlosgong.github.io/posts/2024011101.html</link>
      <description><![CDATA[
        <h1 id="post-title">20240111: 35 岁</h1>
        <h3>1.</h3>
        <p>小时候曾经觉得我活不到 18 岁。</p>
        <p>后来 18 岁上了大学，觉得我大概活不到 30 岁。</p>
        <p>开始工作以后，觉得 35 岁是一个特别遥远的岁数。</p>
        <p>但是今天，我确实抵达了 35 岁。</p>

        <h3>2.</h3>
        <p>和更年轻的时候比起来，步入 35 岁时的几个身体上的感觉：</p>
        <ul>
            <li>身体确实变差了：2023 年 9 月，我经历了人生中的第一次痛风，有超过一周时间几乎无法出门，只能在家中各处依靠拐杖来移动；</li>
            <li>睡眠确实变差了：一直到至少 31 岁，我都是一个可以无视大部分噪音（除非是很离谱的装修噪音），在几乎任何地方按照自己的意愿快速入睡的人。但是现在我变得认床、并且对噪音更加敏感——事实上，我最近正在因为邻居家的空调室外机声音影响我的睡眠而准备搬家；</li>
            <li>不再擅长熬夜和倒时差：疫情三年之后，在 34 岁再次开始每季度跨国旅行时，发现我已经失去了「时差是什么？我不需要倒时差」的能力；</li>
            <li>性能力有明显的衰退：for any activity involving the use of my penis, the experience I am able to deliver is now way worse.</li>
        </ul>

        <h3>3.</h3>
        <p>我觉得在进入 35 岁时，我在心理上主要变化是：接受自己是一个不太聪明的人，并且不再为自己过去的「幼稚」行为和想法感到羞耻 / 不好意思。</p>
        <p>我从 18 岁开始在 <a href="https://twitter.com/Carlos_Gong">twitter</a> 发碎碎念。在漫长的时间里，我不使用实名、甚至会每隔一段时间删除所有的信息，因为我很难面对过去的幼稚、偏激、想法奇怪的自己。</p>
        <p>我也有很长一段时间会定期删除自己的 blog，甚至到最后完全不写了。因为我经历了非常多次「看自己以前写的 blog posts 感觉全是黑历史」的 moments，以至于到最后完全不愿意做任何记录了。</p>
        <p>到了接近 35 岁的时候，我觉得经历了过去十几年的反复循环，这些「无法面对过去的自己」的想法都逐渐烟消云散了——我就是我，我有各种问题、我有很多不会的东西、我曾经想法很奇怪，但是这些都是生命中必经的阶段。所以我不再纠结这些了——过去几年，我没有再反复删除自己的 twitter 信息，并且最终在 35 岁的第一天，我有勇气去重新写 blog 记录更长篇一些的想法。</p>
        <p>同时，这个 blog 的 title 叫做「Biased & Debatable」，因为我很直白地觉得，我的个人观点当然是 biased and debatable 的，会有很多人觉得根本不值得看、会有很多人不认同、会有很多人觉得我蠢、会有很多人有其它的各种看法，but I just no longer care :-)</p>

        <h3>4.</h3>
        <p>在过去的漫长岁月里，我曾经有很多想学的东西：日语、朝鲜语、前端开发、iOS 开发、数学、经济学、各种投机交易、历史、国际关系…… 有很多想读的书，也曾经无数次想要开始健身。</p>
        <p>但是实际上，我的工作一直都很忙，也没有很多时间去学习和运动，所以给自己挖了很多个坑，但是没有任何一个填到了能让我自己满意的状态。</p>
        <p>到了接近 35 岁的时候，在这些事情上，我也终于想开了：只要我还在上班，时间不足就是一件非常正常的事情，世界上不存在「副业」和「斜杠青年」，不管是做一件新的事、学习一种新的技能、还是在一个新的方向上提高自己，唯一有效的路径是在很短的时间里，饱和式地投入大量的时间，冲过一个良性循环的阈值，然后才可以细水长流地日拱一卒逐渐进步。</p>
        <p>所以最终，我觉得在同一时间里只能给自己设立最多两个工作以外的目标，对于我自己来说，今年的一个是运动健身，另一个是日语。</p>

        <h3>5.</h3>
        <p>对于我来说，运动健身是一个已经冲过了良性循环阈值的事情。</p>
        <p>经历了 9 月份的一场痛风之后，从 10 月份开始，我开始刻意每天花 1 个多小时的时间，给自己找各种理由来引入运动量。比如在圣何塞走 2 mile 节省 $10+ Uber 费用、或是在北京中午走到 3 公里以外的地方去吃某种我喜欢的三明治（不加芝士和酱料的版本 of course）。</p>
        <p>从最初只能步行很短的时间开始（一部分是因为痛风还没完全好，一部分是因为确实体能差），到现在可以比较稳定地维持在每天 1 万步以上，并且尽量每天早起使用划船机。到 35 岁生日的今天，我的体重比 9 月份痛风发作时减少了 20% 多。</p>
        <p>今年在运动健身方面的计划，总体的 O 是把体重降到正常区间，KR 包括运动类型、饮食习惯和贯穿全年的「周末特别活动」规划。日拱一卒，不期速成，每天都比前一天健康一点点，基本上就可以了。</p>

        <h3>6.</h3>
        <p>对于我来说，日语是一个我还没有冲过良性循环阈值的事情。</p>
        <p>作为一个学语言出身的人，我觉得我在语言学习方面的良性循环阈值其实是很低的：掌握字母表和发音规则。剩下的都可以每天进步一点点来逐渐习得。</p>
        <p>而日语和英语/西班牙语不同 (我是英语系毕业)，它的字母表和发音规则是非拉丁化的，所以我会需要在一两周的周末和晚间时间段里快速地解决五十音图相关的所有事情，然后进入到常规的课程学习里去。</p>
        <p>同时，我在 23 年 5 月份办了日本的五年多次往返签证，但是一直没有使用过，我坚持觉得我应该在解决完「基本的读写能力」之后再去对应的国家，所以也确实需要比较快地冲过阈值，然后才可以不浪费掉这张签证 :-)</p>
        <p>整个 2024 年，我只有这两个 New Year's Resolution，其它的都无所谓——是的，甚至工作也无所谓。</p>

        <h3>7.</h3>
        <p>这个 blog 放在了 Github Pages 上，没有采用任何一个博客程序，因为我预感到这一次应该不会再发生「过了一两年，觉得自己写的全是黑历史，情绪一波动就删光了」的情况。所以希望能自己完全掌控和理解这个 blog，而不是再借助于某种我并不完全理解代码和工作原理的现成程序（比如 Wordpress）。</p>
        <p>目前，这是个「纯手动」blog：它事实上就是我在 Visual Studio Code 里面写了几个 html 页面，然后上传到了一个服务器上——就像 90 年代中期的人们一样。</p>
        <p>会有这种情况，主要是因为事实上我自己能够理解的 web 技术很少：我会读和写一点点 html 和 css，几乎不会任何 JavaScript（还是能看懂一点），基本也就这样了。如果你只会写 html 和 css，那么你大概也就确实只能这样来写 blog 了。</p>
        <p>好在我本身对于 blog 也没有什么特别的外观/功能要求。事实上，我一直想拥有一个看上去很原始、但是实际上以当代 web 技术构建的 blog——理想状态下，它看上去应该像是类似于 <a href="https://motherfuckingwebsite.com/">motherfucking website</a> 或是 <a href="https://stallman.org/">Richard Stallman 的个人主页</a> 这样的外观。</p>
        <p>所以我的计划非常简单：</p>
        <ul>
            <li>会多少就用多少。不会的东西不要碰，除非先学会了——事实上，你不需要会很多东西才能写 blog post，要让自己起步，你只需要会这么少的东西。</li>
            <li>Roadmap 驱动的学习，学一点改一点/加一点功能。我自己有一个 roadmap，上面有很多我希望给这个 blog 添加的功能，等学会了再慢慢添加。最近一个有可能会加上的功能是 RSS，因为我看了一下 RSS 的格式 spec，感觉好像也不是很难。而剩下的很多功能和自动化能力，大概需要先学习一段时间的 JavaScript，才可以逐渐地部署。</li>
            <li>但是，学习这些东西 + 开发部署新功能，不应该占用上面的两个年度目标的时间——我完全可以接受一年之后我的 blog 还是现在这个纯手动、啥功能都没有的样子。</li>
        </ul>

        <h3>8.</h3>
        <p>在写这篇 blog post 和完成第一版 blog 的过程中，我询问了很多次 <a href="https://www.ciciai.com/">Cici</a>（字节跳动的对话式大模型，海外版）。</p>
        <p>以下是一个我问的所有问题的回顾（问的时候有中有英，统一为中文来简要记录），just because I think these are interesting logs，将来回顾版本历史的时候可能会觉得很有趣：</p>
        <ul>
            <li>怎样写一个 css reset 文件；</li>
            <li>怎样安排 css reset 和 style.css 的顺序；</li>
            <li>怎样定义 unordered list 的 bullet point 样式；</li>
            <li>具体地解释一下怎样定义 list-style-type；</li>
            <li>让页面上所有内容居中的方法；</li>
            <li>不用 flexbox 怎样让所有内容居中（因为我不想全部 flexbox 化）；</li>
            <li>怎样 target 到同类元素中的第一个；</li>
            <li>怎样自定义 hr 元素的颜色和粗细。</li>
        </ul>
      ]]></description>
      <pubDate>Thu, 11 Jan 2024 00:00:00 GMT</pubDate>
      <guid>https://carlosgong.github.io/posts/2024011101.html</guid>
    </item>
  </channel>
</rss>
