Topics
Dev Journal
33 entries
2026 年 8 月 1 日2026-08-01 · 放弃了为搜索引擎生成标签的计划,去除了文件名和分类中随意生成的标签显示 保持正文不变,整理将搜索价值低的今日关键词记录从搜索索引和 sitemap 中排除 在 Source Flow Debugger 中将实际的 6 个 Godot 文件拆分为 146 个块,比较 SQLite JSONL 搜索结果的来...2026 年 7 月 30 日2026-07-30 · 最近两个月只看数据收集和块搜索,感到极度的自我否定,感觉只是一直在收集数据,这周基本上在观看 AWS MLA Udemy 视频 24 日将空白的站点首页改为按日期的开发日志列表,并补充移动端月份列表不横向展开而是折叠的页面结构 28 日至 29 日实际将 hexagonal map 文件拆分为 134...2026 年 7 月 23 日2026-07-23 · 为防止搜索结果中的最新日期归档像站点主页一样显示,将域根更改为读取 README 介绍的固定页面 整理域根的站点名称结构化数据、canonical、语言 hreflang 与 favicon,使搜索结果中站点的来源和身份更加清晰 将日期归档从搜索索引和 sitemap 中排除,实际的单篇文章通过文档标题...2026 年 7 月 21 日2026-07-21 · 使用 Markdown → JSONL Converter 将官方文档 JSONL 转换收集量从 1,550 条提升至 1,422 条 继续执行 Qwen Validation Debugger 的第 46 至 50 项,检查生成代码、Godot 3/4 引擎以及 JSONL 验证结果 第 50 条调试...2026 年 7 月 18 日2026-07-18 · 使用 Markdown → JSONL Converter 将官方文档 JSONL 转换收集量从 1,550 条提升至 1,383 条 在 Source Flow Debugger 中配置 BM25 + embedding + reranker + Qwen direct‑evidence valida...2026 年 7 月 17 日2026-07-17 · 使用 Markdown → JSONL Converter 将官方文档 JSONL 转换收集量推进至 1,328 条 生成 favicon 改进 SEO 算法 回顾: docs/retrospectives/2026-07-17.md2026 年 7 月 15 日2026-07-15 · 今天在前往首尔的巴士上进行工作。 以 7 月 13 日编写的 Qwen Validation Debugger 代码分析文档为基准,重新审查了分类、合成代码生成、JSONL 生成、验证流程,从头开始检查。 分析时发现以下问题 common/separate 分类阶段的说明直接延续到代码生成输入中,导致错...2026 年 7 月 13 日2026-07-13 · 使用 Markdown -> JSONL Converter 将官方文档的 JSONL 转换量从 1260 条提升至 1281 条。 通过 Qwen Validation Debugger 记录了第 33 条之后至第 35 条的内容。 搜索引擎注册、调试程序修改、疲劳、网站设计不满意等因素叠加,导致严重...2026 年 7 月 12 日2026-07-12 · 在 Vercel 上将多语言开发日志应用部署到生产环境。 部署链接: https://ideaworldlab.com 最初使用 Vercel 默认域名,随后将官方链接替换为自定义域名。 使用 Markdown -> JSONL Converter 将官方文档的 JSONL 转换量从 1230 条提升至...2026 年 7 月 10 日2026-07-10 · 将 Markdown → JSONL Converter 的官方文档 JSONL 转换收集量从 1180 条提升至 1230 条 多语言翻译流水线比预期延迟更多,确认可能需要更长时间才能稳定 在 private 仓库中测试了多语言文档同步流水线,过程中制定的标准如下 文档结构标准: 以韩文文档为基准文档...2026 年 7 月 8 日2026-07-08 · 使用 Markdown → JSONL Converter 将官方文档 JSONL 转换的收集量从 1074 条提升至 1180 条 清晨与 SSAFY 同学一起工作,讨论了 AI 相关的哲学、天文学以及各种假设,感觉思路变得相当宽广 与 SSAFY 同学围绕 “AI 是否会和人类一样” 这一主题展开对...2026 年 7 月 7 日2026-07-07 · 昨天进行翻译时突然想到一个点子:把我的回顾、失败记录、思考过程像 Vercel 上的 9 种语言站点一样运营会怎样? 这仍是翻译程序引入后才会考虑的想法,目前先作为点子备忘 使用 Markdown → JSONL Converter 将官方文档 JSONL 转换的收集量从 1040 条提升至 1074...2026 年 7 月 6 日2026-07-06 · 决定制作 Godot 模型,并基于此开发游戏等,每天将关键字记录在 docs/story/README.md 中 使用 Markdown → JSONL Converter 将官方文档 JSONL 转换的收集量从 950 条提升至 1040 条 使用 Qwen Validation Debugger 在...2026 年 7 月 5 日2026-07-05 · 7 月 4 日强制设置许可证后,因睡眠不足心情不佳,整理了思绪 虽然把 idea world 当作兴趣仓库编写,但感觉强硬的警告语与仓库性质不符 借此契机自我反省,撰写了回顾 使用 Markdown → JSONL Converter 将官方文档 JSONL 转换的收集量从 850 条提升至 950 条...2026 年 7 月 4 日2026-07-04 · 因对自己的作品有强烈依恋,创建了许可证文件以保护仓库中的代码/文档/数据 将根许可证应用于我的原始作品,Godot 文档和外部资产则遵循各自的原始许可证,并在 THIRD PARTY NOTICES.md 中添加了分离声明 当时担心我的作品会被重新包装成其他名称,但决定在 7 月 5 日降低表述,重新以...2026 年 7 月 3 日2026-07-03 · 通过 Instagram Reels 看到 https://build.nvidia.com/models 提供 NVIDIA 模型 API 的信息 截止今日,符合 “Free Endpoint” 筛选的免费端点共有 78 个 需要确认实际免费提供范围、调用限制以及各模型的使用条件 将评估如何在 God...2026 年 7 月 2 日2026-07-02 · 暂无单独回顾 使用 Markdown -> JSONL Converter 将官方文档 JSONL 的收集量从 655 条提升至 737 条 暂时计划每天只简短记录此类收集,而不是进行大规模实现 仅在启动 RunPod 时进行收集 2026 年 6 月2026 年 6 月 30 日2026-06-30 · 因为世界杯赛季在看世界杯,睡眠不足,工作进度受限 localhost:8501 的 Markdown -> JSONL 转换目前已完成约 655 条 今天重点不在大规模收集/训练,而是简化并完善验证测试调试工具 制定了验证测试调试工具的策略,并实现了独立的网页工具 Qwen Validation Deb...2026 年 6 月 28 日2026-06-28 · 今天的目标是决定在多种搜索/验证方案中选择哪条路线 在保持 chunkText 原样作为输入的前提下,需要判断如何组合 BM25、PostgreSQL 全文搜索、embedding、reranker、Qwen direct‑evidence validator 起初并未确定最终设计,而是收集了通过 Ch...2026 年 6 月 27 日2026-06-27 · 重新阅读了 26 日编写的 docs/roadmaps/2026-06-26-source-to-ast-input-flow.md,判断整篇文档的一致性不足 认为不应在原有内容上追加,而是需要在 27 日基准上重新整理同一主题的文档 因此新建了 docs/roadmaps/2026-06-27-sou...2026 年 6 月 26 日2026-06-26 · 以 docs/roadmaps/2026-06-25-source-analysis-scoring-architecture.md 为基准,整理将提示词和源码输入传递给 AST Parser 的流程 将提示词从 AST 语法分析对象中分离,作为分析意图和 Retriever/LLM 判断的方向 在传递...2026 年 6 月 25 日2026-06-25 · 在 Godot 源代码分析流水线中重新梳理了 docs chunks、api mapping、label prototypes 的作用 docs chunks 用于代码说明生成的数据流。基于 AST/代码片段和提示词检索官方文档块,剔除不相关的依据后生成说明 JSONL。 api mapping 用于保...2026 年 6 月 22 日2026-06-22 · 为 Godot 官方文档 RAG 分类器添加了本地 PostgreSQL 设置 基于 Docker Compose 整理了运行 pgvector/pgvector:pg16 容器的方案。 DB payload 列与 docs chunks.jsonl、api mapping.jsonl、label pr...2026 年 6 月 21 日2026-06-21 · 感觉需要重新编写整个 Godot LLM/RAG/SWE Agent 架构 迄今为止,部分工作和产出先行出现,导致整体基准动摇 判断应先将整体架构统一整理,然后再分别设计各步骤的细节架构 将数据收集、官方文档分析、分块、RAG、标注、SFT/DPO、SWE Agent 等流程按阶段拆分后重新规划 将 G...2026 年 6 月 20 日2026-06-20 · 决定在数据收集过程中思考防御标准,以防收集到恶意数据 AI 生成的代码或文档可能包含 ASCII 变形、Unicode 混淆字符、不可见控制字符、混淆字符串等,需要在收集阶段考虑如何检测和规范化 强调在大量收集 GitHub 数据之前,先制定过滤恶意/污染/混淆数据的标准更为重要 由于状态问题,近期工作...2026 年 6 月 18 日2026-06-18 · 昨天在咖啡馆喝了约 1 升咖啡,导致今天状态极差,无法正常编码 将 6 月 17 日制作的 Godot RAG 分块/后处理产出全部从基准线中移除 删除 v1 docs chunks.jsonl、v2 docs chunks v2.jsonl、v3/v3.1 catalog/index/mapping...2026 年 6 月 17 日2026-06-17 · 将 Godot 4 编码模型方向从单纯的 Q&A 学习重新整理为 SWE‑agent 轨迹学习的视角 仅靠少量指令 Q&A 难以处理 “帮我做地图” 等项目级请求 实际的编码代理需要包括仓库浏览、相关文件选择、代码修改、测试/验证、生成补丁等完整轨迹 用关键词记录 Long-context reposi...2026 年 6 月 14 日2026-06-14 · 在前往首尔的巴士上重新梳理了对 Godot 4 数据集/RAG 流水线的疑问 之前设想先爬取 Godot 官方文档,再将 GitHub 项目转换为 md、jsonl 格式,随后通过 RAG 聊天机器人判断是 Godot 3 还是 Godot 4 但实际操作中,是否能一次性将整个项目上下文与检索到的官方文...2026 年 6 月 12 日2026-06-12 · 久违地决定重新撰写开发回顾 由于一直想留下完美的记录,反而拖延了记录 为了有意义地保留过去约 10 天的尝试和思考,整理了为 Godot 专用编码模型进行调查和架构设计的过程 为了降低 RunPod 使用费用,尝试在本地 PC 部署 Qwen 系列模型 在 RTX 3060 环境下尝试通过 WSL 运行...2026 年 6 月 2 日2026-06-02 · 决定尝试使用 Godot 工作辅助模型 bekoozkan/godot-qwen2.5-coder-7b-instruct-bnb-4bit 但该模型缺乏图像解析能力,因此计划让 Codex 承担直接查看和解析资产图像的辅助角色 Codex 将在 assets/ASSET LABELS.md 中以英文说...2026 年 6 月 1 日2026-06-01 · 运行 Godot 项目并检查地图生成结果 今日的实际项目工作主要是启动 Godot 并查看地图状态 由于模型无法稳定解析图像和屏幕结果,导致难以判断地图改进的方向 在个人私密仓库中自定义 Web Research MCP 将 web-search-mcp 调整至符合所需的搜索流程和输出 在除 Qwen...2026 年 5 月 29 日2026-05-29 · 整理 Qwen Code 自动化环境 将原始 qwen-code 的 .github 工作流和 .qwen 配置路径对齐,合并到 test/ci-verify 分支 .qwen 目录被 ignore 处理,需要使用 git add -f .qwen 强制包含 检查 Qwen PR 评审、issue tr...2026 年 5 月 28 日2026-05-28 · 项目创建 农业游戏概念整理 游戏资源收集并下载完成(132 张 PNG) GitHub 仓库克隆:GuardianofNature、FarmLands、Sproutville、OldTownFarm、claude-farmer 来源:Sprout Lands(Cup Nooble,CC0)、Sprite...