跳转至内容
  • 经过复现、说明适用边界,并标注工具版本与日期的 AI 实践。

    6 6
    6 主题
    6 帖子
    C
    长任务最危险的并不总是模型能力不足,而是目标、事实和边界在几十次工具调用后悄悄漂移。一个好的检查点应该让任务被打断后可以继续,也让人能发现它正在回答旧问题。 三份持续更新的状态 事实表 只记录已经验证的事实、证据位置和时间。易变化的信息带日期;不确定内容明确标记为假设。 决策表 记录已经确认的选择、否决项、理由和生效范围。新消息与旧决定冲突时,先停下来处理冲突。 执行表 每个步骤只有 pending、in_progress、completed 三种状态,并写出验收证据。任何时刻最多一个主要步骤处于进行中。 什么时候建立检查点 完成一个可独立验收的阶段后。 即将进行不可逆或高风险操作前。 工具返回异常、环境发生变化或用户追加要求后。 上下文将被压缩、任务将转交或运行时间较长时。 停止条件比“继续努力”更重要 提前定义预算、最长运行时间、最大重试次数、允许修改的对象和必须转人工的事件。检查点不是为了让 Agent 永远运行,而是为了让它知道何时应该停。 编辑说明:2026-08-15,COHAO 编辑部基于长任务执行和社区建设记录整理;AI 协助起草,项目负责人复核。
  • 记录失败现象、证据、根因、修复和仍未解决的问题。

    5 5
    5 主题
    5 帖子
    C
    空社区最让人焦虑,于是很容易想到一个办法:让 AI 一次生成几百篇帖子,再让多个账号互相回复,先把页面填满。 这会同时制造三个假象:好像已经有人使用,好像内容经过讨论,好像社区已经形成共识。新用户一旦发现这些互动不是人发生的,信任损失比看到一个安静的新社区更难修复。 批量内容为什么救不了冷启动 它回答的是编辑部想象的问题,不是成员正在付出成本的问题。 没有人对结果负责,错误和过期内容很快堆积。 回复数量上升,但真实关系、答疑和共同工作没有增加。 数据指标失真,团队无法判断哪些内容真的有价值。 COHAO 采用的替代方案 编辑部只发布数量有限、来源透明的种子内容。 所有种子帖标记 AI 协助与人工复核,不伪装普通成员。 留出明确问题和公开任务,让真实参与从纠错、复现和补充开始。 统计真实用户、有效回复、被解决的问题和持续维护,不把编辑部批量输出算作社区活跃。 社区可以从内容开始,但内容必须给真人留下位置,而不是提前替真人把所有话都说完。 编辑说明:2026-08-15,本文说明 COHAO 的冷启动选择,不声称存在已经发生的批量造假事件。AI 协助起草,项目负责人复核。
  • 按真实任务、成本、可靠性和维护负担比较 AI 工具与架构。

    4 4
    4 主题
    4 帖子
    C
    COHAO 原本已经有一个自研的创世申请工作台,但它不具备完整内容社区所需的账号、主题、回复、搜索、通知、举报和审核体验。继续从零开发,会把时间花在重复建设基础能力,而不是内容与关系。 因此我们选择 NodeBB 作为当前社区底座,并保留旧工作台、SQLite 数据、备份和发布目录作为回滚与运营资料。 当前采用的版本与部署 NodeBB v4.14.10,核验日期 2026-08-15。 PostgreSQL 单机数据库,NodeBB 单实例运行。 应用只监听服务器回环地址,由现有 Nginx 和 TLS 对外提供服务。 开放注册,不强制邮箱;新账号第一次内容进入人工审核。 暂时关闭私聊、私有群组和 ActivityPub,降低创世期审核面。 为什么适合现在 已有成熟的主题、回复、标签、搜索、书签、关注、通知、举报和审核队列。 Node.js 技术栈与现有项目接近,4 核、约 4GB 内存的服务器可以承载早期单实例。 REST API 和插件机制允许 Agent 以后通过窄接口辅助整理,但不需要给它数据库或管理员权限。 中文界面已经包含在官方发行版中。 当前限制 尚未配置 SMTP,所以邮件验证、通知和自助找回密码暂不可用。 首帖审核需要真人及时处理,不能靠 Agent 自动放行。 单实例适合创世期;扩容、多节点缓存和搜索增强要由真实负载触发。 选择成熟引擎不是把社区交给软件决定。栏目、文化、内容质量、权限和收入分配仍然由 COHAO 的公开制度负责。 参考: https://github.com/NodeBB/NodeBB/releases/tag/v4.14.10 https://docs.nodebb.org/ 编辑说明:2026-08-15,本文记录 COHAO 的真实技术选择;AI 协助起草,项目负责人复核。
  • 基于一手来源说明 AI 新进展发生了什么、没有发生什么。

    4 4
    4 主题
    4 帖子
    C
    2025-01-20,DeepSeek 发布并开放 DeepSeek-R1 系列模型、论文与蒸馏模型权重。它让更多团队可以直接研究、部署和改造推理模型,而不只通过封闭 API 观察输出。 三个现实变化 推理过程研究门槛降低 开放模型与论文让研究者能够检查训练方法、复现实验、比较蒸馏效果,并在自己的评测集上研究推理能力与失败模式。 本地与私有部署选择增加 不同规模的蒸馏模型让团队可以在本地硬件上尝试推理工作负载。不过“能运行”不等于质量、速度和总成本适合生产,仍要用自己的任务评测。 模型能力不等于系统可靠性 更强推理仍可能产生错误事实、冗长过程、工具误用和提示注入风险。生产系统还需要权限、验证、状态管理、超时、成本控制和人工接管。 使用开放权重时要额外记录 模型具体变体、量化方式、推理引擎、上下文设置、采样参数、硬件与许可证。不同部署组合可能让同名模型表现明显不同。 一手来源: https://github.com/deepseek-ai/DeepSeek-R1 https://arxiv.org/abs/2501.12948 编辑说明:本文按 2025-01-20 的官方发布记录整理,并于 2026-08-15 核对仓库与论文页面。AI 协助起草,项目负责人复核。
  • 带上环境、输入、已尝试方案和错误证据,让问题可以被共同解决。

    3 3
    3 主题
    3 帖子
    C
    COHAO 的长期设想是让贡献者和未来建设者共享社区创造的价值。但如果一开始就把每个动作换算成积分、价格和排名,成员很容易开始优化分数,而不是帮助别人。 创世期准备先做“影子贡献账本”:记录发生了什么,不公开实时财富估值,也不承诺兑换。 可能记录的贡献包括: 原创实践、失败复盘和评测。 复现、纠错、补充证据与版本维护。 高质量答疑、新人欢迎和问题整理。 翻译、编辑、主持、活动和文档维护。 安全报告、财务透明与公共基础设施。 我们需要一起回答: 怎样区分一次性输出和长期维护? 无法公开的安全、照顾和协调劳动怎样被看见? 纠错是否应与原创同等重要? 如何防止互刷、拆分任务和低质量数量竞争? 未来成员应保留多大比例,谁来代表他们? 哪些贡献不应该被货币化? 欢迎给出你见过的好制度和失败案例。这个主题讨论的是记录原则,不代表已经确定分配公式或收益承诺。 编辑说明:2026-08-15,COHAO 编辑部根据社区 5/95 价值共享蓝图提出问题;AI 协助起草,项目负责人复核。
  • 社区规则、公共任务、建设日志、提案与可领取的维护工作。

    4 4
    4 主题
    4 帖子
    C
    社区已经可以注册、发帖和回复,但“服务启动成功”不等于真实设备上的流程顺畅。这个任务邀请你用自己的浏览器完成一次小范围体验测试。 测试路径 未登录阅读首页、分类和一个主题。 注册一个账号;现阶段邮箱不是必填项。 创建一篇测试主题,正文至少写明设备和浏览器。 确认首篇内容进入审核提示,而不是悄悄消失。 审核通过后登录、退出、再次登录。 回复、搜索、收藏或关注一个主题。 尝试举报本任务,并确认能看到合理反馈。 回报问题时请写 测试时间与时区: 设备与屏幕尺寸: 操作系统: 浏览器与版本: 网络环境: 执行到哪一步: 期望看到什么: 实际看到什么: 是否可稳定复现: 截图或录屏:请先遮住账号、Cookie 和个人信息 不要为了测试发布攻击性、违法或大量重复内容,也不要扫描非公开端口。涉及安全漏洞时先通过管理员可见的举报说明最小影响,不在公开回复中放可直接利用的细节。 编辑部会公开更新已确认问题、修复版本和复测状态,不伪造测试人数或成功率。 任务发布:2026-08-15。AI 协助起草测试步骤,项目负责人复核。