独立开发者节点

愿每一位独立开发者都能保持初心,获得一个好的结果.

tjunsh

一个人干了一周,终于完成了人生第一个 App: AI 错题本

  •  
  •   tjunsh · 1h 26m ago · 71 views

    我也说说我 vibe coding 的经历

    我切入的项目是:错题本,借力 LLM 多模态大模型的能力,开始打造我的:ai 错题本

    最终,一个人干了一周,完成了人生的第一个 APP——AI 错题本 for Android

    github 地址: https://github.com/tjunsh/ai-wrong-notebook

    我虽然是理工科背景,但是从来没有写过 app ,所以如果没有 AI ,这根本完成不了~

    我先说下我 vibe coding 的心得:

    我的 AI agent ,选的是:Claude code ,然后通过 cc switch 使用第三方中转的大模型 api ,

    整个过程非常方便,Claude code 并不需要注册,简单配置就可以使用其他大模型;

    我一开始用的大模型,是:gpt5.4 ,它帮忙进行了整个 app 的架构设计,并完成了 75%左右的代码;

    后续我切换到了 GLM5.1 ,让它进行收尾,实测下来国产大模型 glm ,用来干活,完全没有任何问题。

    在 gpt5.4 的时代,我认为:在开发的过程中,最好还是约束一下大模型,即使是顶配的大模型 GPT5.4 ,也会像一个超级实习生,“想到哪写到哪”,而且 AI 的逻辑永远是最短路径,有时候并不是最优最合理的办法

    所以我先建立了一套开发规范,如图。(大家可以把这张图丢给你们的 AIAgent ,让它参考一下,搭建符合你们的工作 sop )

    这是适合我的,基于单一模型 GPT/GLM ,配合 superpowers 插件。为了保持极高的代码质量和 vibe coding 的状态

    这里极力推荐大家给:Claude code/open code 安装 superpowers 插件。真的超级有用,比如你有个新点子,可以让它 brainstorming 一下

    在这个过程中,我没有跟风去搞多 agent team ,我觉得单一模型+superpowers ,完全足够了;

    https://i.imgur.com/Kczv1zu.jpeg

    tjunsh
        1
    tjunsh  
    OP
       1h 23m ago
    然后:
    经过一个多礼拜,一个人持续 vibe coding ,把 “AI 错题本“进行了史诗级的迭代/更新:

    本次更新,不仅仅是小 bug 的修补,而是 从 最简 MVP 进化到 可用的学习闭环版本了

    最早的版本比较简单:拍一张错题照片,把整张图交给 AI 分析,然后展示一个解析结果。

    这次新版不只是修 bug ,而是把整个链路升级了一遍:题目结构识别、多题逐题解析、文科综合题判断、LaTeX 数学公式渲染、举一反三练习、错题保存和复习统计都做了增强。

    1. 从“整张图分析”升级到“题目结构识别”
    以前基本是把整张图片当成一道题处理。
    新版会先判断题目结构:
    - 单道题
    - 一图多题
    - 英语完形、语文文言文、历史政治长填空等综合题
    如果是一图多题,会自动拆成多道候选题。
    如果是文科长篇综合题,会尽量保持为一道完整题,避免被编号误拆。

    2. 多题可以逐题解析,不再串题
    一张图里有多道题时,新版会逐题解析:
    - 每道题有自己的解析
    - 每道题有自己的知识点
    - 每道题有自己的举一反三练习
    - 失败题不会复用其他题答案
    这比之前“整张图一起分析”可靠很多。

    3. 部分失败也能继续使用
    AI 分析多题时,偶尔某一道题失败是正常的。
    新版不会因为一题失败就整组失败:
    - 成功题正常显示
    - 失败题明确标记
    - 成功题可以继续保存
    - 失败题不会保存进错题本

    4. 保存错题前可以逐题确认
    多题解析完成后,保存时会进入逐题确认。
    可以选择哪些题保存,解析失败的题不能勾选,避免错题本里出现空解析、串题解析。

    5. LaTeX 数学公式渲染升级
    这次专门升级了数学公式渲染能力。
    以前 AI 输出数学内容时,容易出现:
    - $x^2=4$ 这种公式没有正常显示
    - \frac{a}{b}、\sqrt{x}、\pm 等公式显示不稳定
    - 多行方程组、cases 、括号包裹的公式容易渲染失败
    - AI 输出中混杂中文、公式、换行时显示比较乱
    新版对 LaTeX 公式做了更强的兼容处理:
    - 支持行内公式和块级公式
    - 支持常见数学符号、分式、根号、角度、方程组
    - 对 AI 输出里不规范的公式格式做了清洗和修正
    - 解析结果、解题步骤、知识点、举一反三题目都可以渲染公式
    - 公式渲染失败时也尽量避免整段内容崩掉
    这点对数学、物理、化学题很关键。
    不然 AI 解析再对,公式显示不好,实际体验也会很差。

    6. 举一反三练习变成学习闭环
    新版不只是看解析,还能围绕错题继续生成类似题。
    - 做练习不会自动乱保存
    - 已保存错题也可以继续练习
    - 练习题尽量保持原题型,不随便跑偏
    - 可以通过练习真正巩固知识点

    7. 错题详情和复习体验升级
    这版也做了不少界面和体验优化:
    - 知识点改成满宽卡片
    - 解题步骤改成分步浅卡片
    - AI 标签、掌握状态更清楚
    - 首页、复习页、统计页、设置页都有视觉调整
    - 深色模式也做了适配

    整体更像一个可以长期使用的学习 App

    8. 仍然是单机 Android 版本
    目前还是单机版 Android App:
    - 不需要登录
    - 数据保存在本地
    - 适合自己或孩子日常记录错题
    - 后续再考虑同步、iOS 、多端等能力

    这次算是从“最简 MVP”往“真正可用的错题学习工具”迈了一大步。
    tjunsh
        2
    tjunsh  
    OP
       1h 20m ago
    在 5 月份更新 v1.0.4 后,又过了好一阵子!大概在 8 月份,我又做了 v1.0.5 的版本迭代

    这段时间,我没有急着继续堆新功能,而是拿自己真实拍题的过程反复测试。慢慢发现,AI 错题本真正容易出问题的,其实是最核心的一条链路:

    拍题 -> AI 解析 -> 保存错题 -> 继续学习


    以前看起来“能解析出来”就够了,但实际用起来会遇到很多细节:
    扫描题目之后,一次性要求大模型生成太多内容,既浪费时间,也浪费 Token 。
    扫题之后需要长时间等待,不能继续扫下一题,多题和连续扫题的体验不好。
    错题保存之后,如果某一步没看懂,没有继续问 AI 的入口。
    多题里有几道解析失败时,之前也缺少一个自然的补救流程。


    所以这次 v1.0.5 ,我重点不是“再加一个花哨功能”,而是把这条主流程重新梳理了一遍。
    发布地址:
    https://github.com/tjunsh/ai-wrong-notebook/releases/tag/v1.0.5

    1. 首轮解析,先解决“看懂这道题”

    以前的逻辑比较直接:拍完题后,尽量让 AI 一次性把解析、错因、知识点,甚至举一反三练习都生成出来。
    看起来一步到位,但真实使用下来问题很明显:
    - 用户第一次最需要的是“题目识别对不对、这题怎么做”。
    - 举一反三不是每道题都立刻需要。
    - 一次请求塞进太多任务,会拉长等待时间,也会增加 Token 消耗。
    - 只要其中一个附加任务生成不稳定,首轮体验也会被拖累。

    所以 v1.0.5 把一题的学习过程拆开了:
    1. “第一次解析”:只要求 AI 给出题干、答案、关键步骤、知识点、错因和学习建议。
    2. “保存到错题本后”:用户哪里没看懂,再进入 AI 追问。
    3. “需要练习时”:用户主动点击“举一反三”,再单独生成对应练习。

    也就是说,举一反三不再和第一次解析绑在一起生成。这样首轮任务更聚焦,用户可以先快速确认解析结果;
    后续追问和练习按实际需要再发起,不会为用户根本不用的内容提前消耗时间和 API 。

    2. 连续扫题,可以排队处理
    连续扫题的逻辑调整为:首轮解析减负 -> 连续扫题排队 -> 多题失败重试 -> 保存/放弃 -> AI 追问与举一反三

    以前扫完一道题,用户基本要等解析结束,才能安心扫下一道。

    现在改成了严格排队:
    当前题正在解析时,可以继续扫下一题。
    用户可以返回首页,不需要一直守在解析页。
    多个任务按顺序执行,不会同时请求 AI 。
    不会因为并发任务拖慢速度,也避免重复消耗 API 。

    3. 多题部分成功,可以逐题重试
    一张图里有多道题时,会逐题解析。
    例如 6 道题成功了 3 道,失败的 3 道不会影响成功题。进入结果页后,可以只重试某一道失败题:
    不重新 OCR
    不重跑已成功题
    不新增首页任务
    不浪费已经成功的结果和 API 请求

    4. 保存和放弃,流程更清楚
    解析后不再强制把题目存进错题本。
    用户可以选择:
    保存已解析成功的题目
    直接放弃这次扫描结果
    如果当前是 3/6 部分成功,保存时只会保存成功的 3 道题,失败题不会混进题库。用户也可以返回结果页,继续单独重试失败题。


    5. AI 追问和举一反三,补上“继续学习”
    通过大量的使用和用户反馈,目前我更认同这三个层次:
    解析解决“这题怎么做”
    AI 追问解决“我哪里没看懂”
    举一反三解决“类似题我会不会”

    保存后的错题详情页支持继续追问,追问记录会跟着题目保存。
    后面复习时,可以看到自己当时具体卡在哪一步。
    举一反三练完一轮后,也可以继续生成新题,不会一直重复同一组练习。

    6. API 配置也顺手优化了一下
    这次也调整了 AI 服务配置流程:
    支持服务商预设,自动填写 Base URL
    填写 API Key 后可获取模型列表
    支持选择模型和保存前测试连接
    仍支持自定义 OpenAI 兼容接口

    项目不内置 API Key ,用户需要自行配置支持图片输入的多模态模型。

    7. 安装说明已经安装 v1.0.4 的用户,可以直接安装 v1.0.5 覆盖升级,本地错题数据会保留。下载 APK 后直接安装即可。
    这版没有追求“所有复杂题都秒解”,而是优先把拍题、解析、多题排队、保存、追问、练习这条主链路做稳。
    后续也欢迎大家拿真实题目来测试和反馈。

    8.
    接下来的方向
    iOS 版本这次暂时没有同步推进,计划放到下一阶段一起考虑。
    下一阶段我想补上用户体系和积分机制,主要是想解决 API 配置对小白用户不够友好的问题:
    - 给刚开始使用的用户准备一部分免费解题额度,先能直接体验核心功能。
    - 后续可以通过积分兑换解析次数,不必一开始就研究模型、Key 和接口配置。
    - 已经有自己 API 的用户,仍然可以自行配置,不受积分额度限制。


    希望最终能同时兼顾两类用户:想直接拿来用的人,和愿意自己配置 API 的人。

    最后,欢迎大家访问我的 github:

    https://github.com/tjunsh/ai-wrong-notebook

    有任何 issus ,都可以反馈给我,也希望我自己能坚持迭代下去。
    tjunsh
        3
    tjunsh  
    OP
       1h 17m ago
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Solana   ·   977 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 20ms · UTC 19:35 · PVG 03:35 · LAX 12:35 · JFK 15:35
    ♥ Do have faith in what you're doing.