首页 / 标签

#GitHub

21 篇文章

Yazi 上手:把终端文件管理做成一个键盘驾驶舱

终端文件管理器这类工具,很容易被写成“ls 和 cd 的升级版”。这说法没错,但有点浅。 Yazi 更关键的地方,不只是它能在终端里预览图片、PDF、压缩包和代码,而是它把“文件浏览”这件事重新放回了键盘工作流里。对开发者、运维、远程服务器用户来说,文件管理不是打开一个 Finder 或资源管理器那么简单:你经常在

3 min

World2Agent 上手:让 Agent 先看见世界,再谈自动行动

## Agent 如果看不见世界,就只能在上下文里瞎猜 很多 Agent 项目聊到最后,都会卡在同一个地方:模型会推理、会写代码、会调用工具,但它对外部世界的感知仍然很碎。新闻、市场、日志、告警、天气、发布动态、GitHub 事件,各走各的格式,各写各的接入。Agent 想行动之前,先得靠一堆临时 glue code

3 min

OpenHarness 上手:把 Agent 从聊天框推进到可恢复的长期工作台

Agent 真正进入日常工作以后,瓶颈往往不在模型本身,而在运行时。聊天框能回答问题,但很难长期维护一个项目:它要记住上下文、调用工具、拆任务、写代码、跑测试、处理失败、接消息平台,还要能在长会话里恢复状态。 OpenHarness 把这个问题直接摆到了台面上。它不是另一个“套壳聊天助手”,而是一套轻量 Agent h

3 min

Hive 教程:给多 Agent 任务补上 Harness,而不是再写一条链

很多多 Agent 项目看起来都挺热闹:一个规划,一个执行,一个检查,再来一个总结。演示的时候顺滑,真塞进业务流程,麻烦就来了。中途失败怎么办?状态丢了怎么办?两个 Agent 写冲突了怎么办?谁来判断它该停手? Hive 的切口不是再做一个花哨 Agent,而是做 harness。也就是给多 Agent 任务补上状态

3 min

Coze Loop 教程:Agent 上线前,先把评测、Prompt 和监控闭环补上

Agent 项目最常见的事故,是上线前靠感觉调 prompt,上线后靠用户投诉发现问题。模型换了、工具改了、知识库更新了,没人知道效果从哪天开始变差。 Coze Loop 是面向 AI Agent 优化的平台,覆盖开发、调试、评测、Prompt 管理和线上监控。它的价值不是多一个控制台,而是让 Agent 的质量变化能

3 min

Banana Slides 教程:用 AI 做可编辑 PPT,先管模板、素材和复核

AI 做 PPT 最大的问题,不是能不能生成页面,而是生成出来能不能继续改。很多工具输出一堆图片,看着还行,到了客户修改、老板改字、设计调版时就废了。 Banana Slides 押的是另一条路:上传模板图片和素材,让 AI 解析内容,按自然语言生成或修改页面,并导出可编辑 PPTX。它更像一个 AI PPT 工作台,

3 min

MOSS-TTS 教程:自托管语音生成,先把延迟、显存和授权边界讲清楚

语音 AI 的 demo 通常都很好听。真正落地时,问题才冒出来:长文本断句不自然,显存吃紧,首包延迟高,声音克隆授权不清楚,多说几分钟后情绪和音色开始飘。 MOSS-TTS 是开源语音生成模型家族,覆盖长文本语音、多说话人对话、声音设计、环境声和实时流式等方向。它适合想把 TTS 放到本地或自托管环境里的团队。 但语

3 min

YourMemory:Agent 记忆不是越多越好,还要会遗忘

Agent 记忆经常被说成“越多越好”。这话只对了一半。记得越多,确实更像一个长期助手;但如果旧事实、错误偏好、过期项目状态一直留着,Agent 也会被记忆带偏。 `YourMemory` 有意思的地方,是它把“遗忘”也放进了 Agent 记忆系统。 仓库地址:sachitrafa/YourMemory ## 记忆不是

3 min

Xyne:企业搜索别再让 Agent 翻聊天记录

企业里最浪费时间的动作,可能是找东西。文件在 Drive,决策在 Slack,需求在 Jira,线索在邮件,代码在 GitHub,最后每个人脑子里还有一份“只有我知道”的隐性地图。 `Xyne` 盯上的正是这个问题:给工作场景做一个开源的 AI 搜索与问答引擎。 仓库地址:xynehq/xyne ## 它不是普通知识库

3 min

Agent Reach 教程:给 Agent 接一套可替换的互联网工具箱

Agent 想做研究,最先卡住的不是模型,而是“看不见”。网页能不能读,YouTube 字幕怎么拿,Reddit 讨论怎么搜,GitHub 信息怎么查,RSS 怎么订阅,微博客平台怎么处理登录态——这些事情分散又琐碎。 Agent Reach 把问题拆成一套互联网工具箱:网页、RSS、GitHub、YouTube/B

3 min

gstack 教程:把 Claude Code 变成一支会复盘的产品小队

很多人用 Claude Code,习惯是把需求直接扔进去,然后盯着它改。能跑,效率也有,但问题很快出现:产品判断没人做,设计味道没人看,安全审计靠运气,最后发布时再补文档和测试。AI 写代码变快了,工程流程反而容易被省掉。 gstack 值得看的地方,不在“Garry Tan 的同款配置”这个噱头,而在它把 Claud

3 min

Future AGI 教程:把 Agent 评测、追踪和防护放进同一个闭环

Agent 应用最怕“演示很好,上线就飘”。本地试十次都对,真实用户换个问法就错;工具调用在测试里正常,生产里突然走偏;你知道它失败了,却不知道失败发生在哪一步。 Future AGI 想做的是一条完整质量闭环:评测、追踪、模拟、数据集、网关、防护都放在一个平台里。它不是单点 eval 工具,而是更像 Agent 应用

3 min

Archon 教程:把 AI 编程流程写成可重复的工作流

AI 编程最大的问题之一,是同一句“修这个 bug”,今天和明天可能跑出两种完全不同的过程。一次它先读测试,一次它直接改代码;一次会写计划,一次把计划省了;一次跑验证,一次嘴上说完成。 Archon 的思路很直接:不要把工程流程交给模型临场发挥,而是把计划、实现、测试、review、审批和 PR 创建写成工作流。模型负

3 min

用 tempmail.ee 注册 GitHub:先试用,再把主邮箱留给真正重要的账号

GitHub 是典型的代码托管和开发者协作平台:不注册,很多功能看不完整;一注册,又可能开始收到确认邮件、提醒、营销信息和各种后续通知。只想先试一下时,tempmail.ee 可以当作临时邮箱缓冲层。 要先把边界说清楚。临时邮箱不是绕过平台规则的工具,也不该用于刷号、规避封禁、垃圾信息或冒充身份。它只适合低风险试用:先

3 min

Awesome Codex Skills:Codex 真要进工作流,靠的不是神提示词,是可安装技能

“让 AI 帮我做事”这句话,听起来已经不新鲜了。真正麻烦的是,每次都得重新解释:这个仓库怎么跑,邮件怎么发,Issue 怎么建,PDF 怎么处理,团队规矩是什么。 Awesome Codex Skills 的价值,不是收集了一堆酷炫提示词,而是把这些重复解释,整理成 Codex 可以安装、识别、触发的技能包。 Com

3 min