Skip to content
B Bloger.fm

Organisation

GitHub

The code hosting platform owned by Microsoft, and the home of Copilot — one of the earliest and most widely deployed coding assistants.

GitHub was recorded in 67 items across 8 of the 8 briefings in the current window. That makes it the 6th most covered.

Its share of coverage was steady: 25 items in the first half of the window and 42 in the second, tracking the feed as a whole, which grew about 2.2×.

It appeared most often alongside Claude Code, Codex and MCP.

Tracking the feed
items
67
briefings
8
mentions
86
last seen
2026-09-19
Official channel
github.com

Coverage timeline

Sat 12 Sept – Sat 19 Sept / 8 briefings

Everything recorded

19 September 2026 6 items

THIS IS PURE TREASURE FOR ANYONE BUILDING AN AI-NATIVE COMPANY. JACK DORSEY JUST RELEASED A FREE OPEN-SOURCE FRAMEWORK WITH 33,000+ GITHUB STARS WHERE AI AGENTS WORK AS FULL TEAMMATES WITH THEIR OWN CHANNELS, PERMISSIONS, GIT ACCESS AND AUTOMATIONS.

Cloudflare 团队把其内部找漏洞的那套方法做成了一个 Skill,叫 security-audit,并开源了。 装进编码 Agent 就能对自己的代码库跑一次正经的安全审计,已斩获 11000+ Star! 流程分 6 个阶段,先摸清架构和信任边界,再派出多个独立的 Agent 分片去找,每个候选漏洞交给一个新的 Agent 专门去推翻它。 GitHub: 它的规矩是找到的那个 Agent 不能自己验,验证阶段的目标就是证明这条不成立,最后只有三种结论,确认、待核实、已排除。 待核实的会写清卡在哪个具体事实上,不给严重程度。少了一层防护但另一层挡得住的,只算加固建议,不算漏洞。 产出是一份主报告加一份逐条细节,每条确认的都能追溯到源码位置。 Cloudflare 博客说这就是他们内部漏洞发现系统的起点,多跑几次结果会叠加,他们自己测下来单跑一次大概只能找到一半。 用法就一句「security audit this codebase」,在自己有权限审的代码库上跑,把结果当一份第二意见看,我觉得比裸问 Agent 靠谱得多。

capcut-cli,一个非官方的剪映(CapCut)命令行工具,可以装给任意 Agent 在终端里剪视频。 支持读写存在本地的草稿文件,命令行或 Agent 改完,打开剪映每条轨道都还是活的,能接着手动调整。 一段原始视频丢进去,自动按静音把空白切掉,用 Whisper 打上带样式的字幕,出来就是一个能在剪映里打开的草稿,最后导出那一下还是自己点。 GitHub: 长视频切短视频这块也支持,检测场景切换、检测静音,还有一个专门找口误重录的,说错了又重说一遍的那句它能认出来。 字幕能导出 SRT 也能导入,还能一键把整个草稿克隆成多语言版本,抠像、绿幕、变速、转场、套模板这些也都有。 不上传、不起服务,在本地就能跑,改动原地写回并留一份备份。也能当库调用,或者接进 n8n、Coze 这类自动化平台批量跑。 作者还专门写了份剪映的中文快速上手。平时要批量出短视频、又想让 Agent 干粗活自己收尾的,接进工作流正合适。

GitHub reliability has been rough for months.. and Cursor Origin is cool, but it still does not give you the Actions infra that usually lives next to the repo. @Trylle looks like a very solid alternative: Magic Sessions is a long-running task engine that keeps a coding agent working in the cloud while you're away. Kick off a coding task, check in later from your phone. The bonus: it has GitHub-compatible Actions running in the same place, plus a full two-way sync. You keep GitHub, branches stay synced, no need to migrate the whole team on day one. Definitely checking this out. 🔥

@stylessh

we just shipped Magic Sessions in Trylle > a new way to run longer coding tasks directly from your repos > try it on > - start from an issue - kick off a task - test the change - open the PR > here’s me taking a real issue all the way to a pull request

同时跑三四个 Agent,每个占一个终端窗口,谁做到哪一步得挨个切过去看,同事想插句话都没地方插。 Cumora 是 yetone 做的一个团队聊天 AI 工具,Agent 和人在同一个通讯录里,能私聊、能拉群,看板和日历也是共用的。 Agent 在里面不是问一句答一句,每个有自己的人设和记忆,会主动认领看板上的任务,还能收发真实的邮件。 GitHub: 几个 Agent 在一个群里不会互相踩,一条回复如果基于的是过时消息,服务器会先扣住,让它看完新消息再决定发不发。 任务认领也是原子的,一件事只归一个 Agent,不会两个同时上手改同一处。 大脑有两种接法,用官方云端跑,或者在自己的 Mac 或服务器上配一条命令,让本地的 Claude Code、Codex、Gemini CLI 来当脑子,本地引擎认 10 种。 后一种密钥留在自己机器上,不经过服务器。有桌面版、网页版,iOS 在 TestFlight 测试,代码全开源,自己部署要准备 Postgres 和 Redis。 想让手上这几个 Agent 像同事一样在一个群里配合的,这个形态我觉得顺,自己只管盯着群聊就行。

Jev 有意思的一点是,它既是模型,也很像一个给大模型调用的工具。以后模型和工具的边界可能会越来越模糊。

@0xLogicrw

昨天整理了 14 个 Jev 项目,@yangyi 开玩笑说:「让 Codex 一个 goal 跑个 Jev 导航站。」 > 我真的让 Codex 去跑了,现在导航站已经上线: > 而且增加到 130+ 个 Jev 项目。后面还挂了 GitHub Actions,每 12 小时自动扫一次新项目。 > 拿到 Jev API 还不知道怎么玩的,可以直接进去抄思路。 > 如果你也做了 Jev 项目,欢迎提 PR / Issue,我继续往里补。

18 September 2026 10 items

🚀Congrats on 50k, Multica! Excited to contribute to the Qoder Cloud Agent integration. Multica coordinates tasks and teamwork; QCA handles coding, testing, and GitHub pushes in a managed cloud environment—no local agent daemon to maintain. Progress and results flow back to the issue. We’ve tested the workflow end to end. Looking forward to shipping it together!

@jiayuan_jy

Multica reached 50k GitHub stars 🚀 > We shipped 150+ releases in the past few months. Thanks to all 300+ contributors! More coming this month: > - Full automation for issues - Project Workflow - Triage - Cloud Agent with @qoder_ai_ide > Stay tuned! >

The demo runs on your GPU now. It wanted ~25GB of VRAM on launch day. 💻This week: CPU offload, a ~7.5GB encoder cut, an MLX branch for apple silicon.

@TencentHunyuan

🚀 AuK is officially here. Nano banana🍌 for audio > An open-source foundation model for unified speech generation and editing. Natural-language instructions + reference audio. One interface. Zero-shot TTS. Instruction-controlled generation. Content editing. Whisper-conversion. De-accent. Timbre/style/emotion edit. Speed/Pitch control. Enhancement, denoising, multi-speaker and music separation. Also releasing AuK-Flash: 4-step inference. ~4.5× faster under matched conditions. Code, weights, and demo are live. Try it and share your feedback. > 🤗 Paper & upvote: ⭐ GitHub & star:

YuE2,港科大、纽约大学、斯坦福等几家联合出的开源音乐模型,给它歌词和风格描述,先写出一份旋律和和弦的谱,再按谱生成带人声伴奏的整首歌。 中间那份谱是能看能改的,改一段和声、换个速度、动几个音,再交回去生成新的一版,整首歌怎么走自己说了算。 GitHub: 翻唱也能做,把一段现成录音转成旋律谱,配新歌词或者换个风格,同一个模型直接出一版新的演绎。 官方演示里一首《The Last Train》通过对话改了 9 步 14 个版本,从中文流行一路改成英文爵士还加了段萨克斯独奏,每一版的谱和对话都能翻。 自家评测里跟 Suno v5、v6 打得有来有回,README 也承认头几名差距很小分不出高下。 配套给了一个 Agent Skill,让 Claude Code 这类工具直接调它写歌改歌。 需要 Linux 加 24 GB 显存的 N 卡,出的是 48 kHz 立体声。个人和音乐人自己用是免费的,生成的作品拿去变现也不用交授权费。

AI Agent 写代码越来越快,代码评审反而成了新的瓶颈。 过去,一个 Pull Request 通常对应开发者几小时甚至几天的工作。现在 Agent 可以一次改几十个文件,但评审者最后看到的,往往只有一份巨大的代码差异,很难知道这些修改是在什么要求下产生,又经过了哪些尝试。 Zed 新开放公测的 Delta,想把这部分过程重新补回来。它会把 Agent 对话、每一次代码修改和后续评论放进同一份历史里。看到一段有问题的代码,可以直接往前追,看看当时提了什么需求,Agent 又是怎么一步步改到这里。 评审也不再等到开发结束才开始。开发者可以随时另开一个线程,让人或另一个 Agent 检查当前代码,并在独立副本里继续修改。 Zed 已经先在自己身上试了。Delta 仓库关闭了 GitHub Pull Request,33 名成员已经通过 Delta 向主分支合入 570 次改动。 Git 仍然保留,commit、push 和构建流程都不受影响。Zed 真正想改的是代码评审这一层:当越来越多代码由 Agent 生成,只看最终 diff,可能已经不够了。 Delta 目前支持 macOS、Linux、Windows 和网页端,公测期间免费。MCP 和远程运行环境等功能还在开发。

@zeddotdev

Delta is now in public beta. It’s a multiplayer environment for coding with agents and reviewing what they build, with every code change linked to the conversation that produced it. > Anyone can download it today on macOS, Linux, and Windows:

MiniMax Code 研发负责人何涛宣布,MiniMax Code 将在今晚开源。 MiniMax Code 是 MiniMax 的桌面 AI 编程 Agent,支持直接操作项目文件、运行命令和代码审查,也能让多个 Agent 分工协作,手机端还可以远程查看任务进度和批准操作。 MiniMax 其实早就建好了 minimax-code GitHub 仓库,但此前主要用来收集 Bug 和功能建议,目前仓库里仍只有 README 和 Issue 模板,还没有真正的客户端源码。

@Ronny_MiniMax

MiniMax Code is going open source in the next few days. > Built with developers. Now, built in the open. > See you on GitHub.

Utopia is a self-governing knowledge system that learns passively and evolves as new information arrives. Not a vector store. Not a knowledge graph. Time awareness and conflict detection are baked into the base layer - reasoning and decision making run against a live ontology. Deploys offline. Your agents get a knowledge foundation they can actually trust. Github:

truncated at source

You can run it too, easily. DeepSeek v4.1 Flash for 2x DGX Sparks Buttery smooth experience.

@HealthRanger

Special thanks to @MiaAI_lab for this recipe, which I have confirmed: "MiaAI-Lab/DeepSeek-v4.1-Flash-EXL3-2x-DGX-Sparks" (on Github) indeed works quite well. > Installed it on 2x DGX Sparks, connected via the ConnectX-7 network ports, which took quite a bit of debugging to get to actually work at 200+ Gb/s. (The units ship with a bad settings that limits speed to around 12 Gb/s.) > Now getting nearly 48 tokens / second aggregate output (decode) across 4 lanes of concurrency, tested at theoretical allowance of 600K tokens context window but not actually using anywhere near that many tokens (as speed falls off when KV gets filled). > Have not benchmarked pre-fill, but the decode token speed is impressive for this hardware, and Mia AI Lab has once again achieved a huge milestone for run

EvoOntology:让数据Agent更懂业务 这个项目是给做数据分析的AI助手打造的一本“业务词典”。很多时候,企业里的表格、数据库只记录了代号和数字,AI很难直接看懂背后的真实业务含义,每次做分析都容易猜错或者重复摸索。EvoOntology的作用就是梳理这些隐藏的业务规则,形成结构化的知识库。 而且,它能一边看着AI干活,一边自动补充和修正这本词典,让AI越用越聪明、越来越懂你的业务。 Github: 论文:

抠个图得把照片上传到别人服务器上,这事我一直觉得别扭,BG0 干脆把整套流程搬进浏览器里跑。 打开网页把图拖进去,出来一张透明背景的 PNG,没有账号、没有次数限制,模型第一次用时下载一次存在本地,之后不用再下。 GitHub: 显卡能用就用显卡算,不行就退回处理器照样跑,提供在线演示 Demo,可以直接使用。 核心那部分还拆成了一个库,自己的网页想加本地抠图,引进来就是同一套流程。

跟 Claude Code 说「这个项目用 pnpm」,隔天新开会话它又拿 npm 装一遍,同一句纠正一周说三次,说到最后自己都烦。 于是找到 claude-reflect 是个 Claude Code 插件,专治 Agent 失忆问题。会话里每次纠正它、夸它做对了、或者说一句「记住:」,钩子都会自动捕捉下来排进队列。 跑一下 /reflect,它把队列里这批列成一张表,一条条给我们过,采纳、改一改再采纳、或者跳过,确认的才写进 CLAUDE.md 文件,以后每个会话都带着。 GitHub: 写的目标不止全局那份,项目里的 CLAUDE.md、子目录的、还有 AGENTS.md 都认,用 Codex、Cursor 的也能吃到同一份纠正。 v2 加了个 /reflect-skills,回头翻过去两周的会话记录,发现「看下我今天的效率」这类话反复问了十几次,就建议做成一条命令,草稿直接生成。 纠正用中文说也能识别,靠一层 AI 语义过滤兜底,英文关键词没匹配上也不会漏。每条带置信度,写进去前都要过人工这关,不会偷偷往配置里塞东西。

17 September 2026 11 items

Qwen3.8-Flash-Next Recipe for 2 @NVIDIAAI DGX Sparks just got an update! The wins 👇 ・+8.4% faster decode, no quality change ・50.5 → 56.5 tok/s single-stream prose (71.3 code) ・Shrank the drafter's vocab 248k → 47k tokens ・8 streams: 227.7 tok/s aggregate prose, 328.6 code ・Each user still gets ~28 tok/s at 8 streams ・4x the users costs only 38% of per-stream speed ・Gains held at every concurrency: +3.8% to +12.9% ・One invisible newline stopped the server booting ・Freed 70 GB of stale RAM cache per launch, no root ・4 PRs merged, 8 issues closed, backlog 16 → 8 Thanks to all community members pushing issues and pull requests on github 🙌

I just open sourced Foreman: a software factory foreman built with @typesafeai's Jev. Coding agents work the factory floor. Foreman watches them, continuously assessing progress, completeness, tests, drift, and verification, and intervenes when needed. GitHub:

Most alt text checkers confirm that an accessible name exists, but not that it says anything useful. So alt="IMG_2847.png" passes, and so does the same rating text pasted onto five different star icons. More than one in four images on the top million home pages have alt text that is missing, vague, or duplicated from a neighbor. That's why we built an alt text plugin for the GitHub Accessibility Scanner.

5,000 stars for 𝙾𝚙𝚎𝚗 𝙱𝚘𝚝 🌟 Self-hostable AI Coworkers, on your infra. 1. Each bot gets its own computer 2. Bring ANY agent harness over AG-UI 3. Skills, tools, routines, connectors & more Fork it and customize it 👇 GitHub:

@ataiiam

🎉 Introducing 𝙾𝚙𝚎𝚗 𝙱𝚘𝚝 > An open source Grok Bot that works with ANY agent harness, designed for real companies. > It includes: > - AI Coworkers - Generative UI - Computer use (remote/local) - Agent-human handoffs - Full data recording, owned by you > Repo → > We're using this internally at @CopilotKit and it's changing the way we work forever. > Powered by CopilotKit and AG-UI. > More info below 👇

⚡ Building the new GitHub Copilot Inline Suggestions Model From completions to next edits, see how we brought inline suggestions together in one model. 📖 Read the full story:

OpenClip 是一个 macOS 上的开源小工具,在任何应用里选中一段文字,旁边就浮出一条操作栏,用过 PopClip 的一看就懂。 复制、搜索、大小写转换这些直接点,选中的是算式就地出结果,选中一段英文能就地总结、翻译或改写。 AI 那部分可以走 Apple Intelligence、本地的 Ollama 模型,也能接 OpenAI 或 Claude,结果卡上有替换和复制两个按钮。 GitHub: 扩展是它的重头,一个描述文件加一个脚本就是一个扩展,JavaScript、AppleScript、命令行脚本、网址模板都行,不用编译。内置了扩展商店,一键装。 也能在设置里直接加一个搜索网址或者一段脚本当动作,不用写描述文件。还能按应用定规则,比如某个动作只在终端里出现。 第一次启动有 4 步引导,授一个辅助功能权限、装几个基础扩展,最后给个练手区试一遍。 Homebrew 一条命令装好,要 macOS 14 以上。每天在 Mac 上复制来复制去切窗口的,装上能省不少功夫。

让 Agent 做一份幻灯片,吐出来一个 HTML 文件,标题位置不对想挪一下,只能回聊天框再打一行字,改完别处又跑偏。 Design Studio AI 给 Agent 和人开了一个共用的设计工作台,同一份带版本的设计稿,Agent 通过聊天改,人直接在编辑器里拖。 能做的内容有六类,网页界面、幻灯片、报告、线框图、3D 场景和时间线动画视频,从一句需求或者一个模板起手,先看预览再一处一处改。 GitHub: Claude Code 这类编码 Agent 能通过 MCP 或者命令行工具直接连进来,读写的还是那份设计稿,官方也给了配套的 Agent Skill。 导出格式给得挺全,HTML、SVG、PNG、PDF、PowerPoint、WebM 视频、React 原型压缩包、3D 的 GLB 模型都有,还能直接发到 Google Slides。 生图、配音、生视频这些接自己的模型账号,有在线版可以直接用,也能用 Docker 部署到自己服务器上,数据存本地。

Someone at GitHub just released Spec Kit, which solves one of the biggest problems with vibe coding by making agents create a full specification before touching any code, already getting massive attention. → /constitution sets rules and standards, /specify defines what to build, /clarify resolves doubts → /plan handles architecture and tech stack, /tasks generates ordered implementation, /implement executes → Works with Claude Code, Cursor, Copilot, Codex, Gemini CLI and more → Open source, built by GitHub Repo link:

📺 Recording of the #Copilot, #Microsoft365 & #PowerPlatform product updates call 15th of September • Catch up on the latest updates ⚡ • Copilot Studio GitHub Harness, SharePoint Embedded & UX in Copilot canvas • (cont)

truncated at source

You can now train and run 500+ models locally with our Unsloth Docker image! 🐳 Use our new GUI or notebooks workflow. No setup required. Works on NVIDIA and AMD. Guide: GitHub:

@UnslothAI

Introducing Unsloth Desktop 🦥 The first desktop app to run and train models locally. > • Open-source. Runs on Mac, Windows and Linux • Supports MLX, diffusion image/video, audio, GGUF • Connect Claude Code and Codex to local LLMs • 50% more accurate, self-healing tool calls + sandboxed code exec • Works for CPU + multiGPU setups - NVIDIA, AMD, Intel, Mac • Train models 2× faster with 70% less VRAM • Private web search, deep research, RAG, MCP and exports (NVFP4, GGUF) • Use Unsloth’s OpenAI-compatible API and cloud models • Securely deploy LLMs remotely and access anywhere > Unsloth Desktop is now available on and GitHub. > GitHub:

16 September 2026 15 items

3 OPEN-SOURCE GITHUB TOOLS THAT LET YOUR AI AGENT PULL DATA FROM ALMOST ANYWHERE ON THE WEB: Agent-Reach — Patchright Enhanced — Scrapling — X, YOUTUBE, REDDIT, WEBSITES AND MORE, YOUR AGENT CAN COLLECT THE DATA, ANALYZE IT AND RETURN THE RESULTS.

受够了 CapCut 日益增多的付费墙和云端绑定?开源平替 Concat 来了。 它不是基于 Web 技术的套壳工具,而是使用 Rust 原生构建的桌面端应用,将核心剪辑和 AI 流程完全拉回本地。 关键能力: 告别订阅制:零付费墙,无导出水印,不限制 4K 画质。 纯本地 AI 辅助:自动字幕(Whisper)、文本转语音(TTS)与智能抠像均在设备本地执行,断网可用。 极低硬件门槛:4GB 内存即可启动运行,AI 模型按需下载(15MB 到 488MB 不等),不强求高端 GPU。 原生跨平台:在 macOS、Windows 和 Linux 上提供一致的多轨道剪辑体验。 作为在 GitHub 获 2.4k Star 的 Beta 版项目,它的短板同样清晰:目前仅支持 H.264 MP4 格式导出,特效模板仅有几十种,且关键帧目前只支持基础的位移、缩放、旋转和透明度调整。 如果你需要一个响应迅速、注重隐私且完全受控的本地剪辑环境,现在就可以直接下载免安装版体验。

论文要交,数据还在 Excel 里,让 AI 画出来的图是默认那套蓝橙配色,导师一句图太丑打回来重画。 可以试下 vivid-figures-skill,装好后把数据文件丢过去,说一句想比较什么,它选图、画图、自己检查,最后交 PNG、PDF 和绘图源码。 内置 108 个图表配方,山脊图、雨云图、热力图、三维曲面、技术路线图都有,不知道图叫什么也行,说「比较这几种方法,选能看清差异的图」就够了。 GitHub: 配色有七套,珊瑚青绿、橄榄杏棕、粉彩少女、海洋清风,名字起得挺有意思,也能自己给一组色值。 选图先读数据和表达目的,再翻说明卡、看候选实图,最后拿完整配方代码改数据。 模板里的渐变和透明层次要求保留,不许为了省代码改成纯色。 画完它会看一眼实际图片再修,每张最多三轮。数据里没有重复试验就不画置信带,这条我挺认,图好看不能靠编数据。 需要 Python 环境,仅限个人非商业使用。写论文、做数学建模要出图的同学,可以让它先出一版。

AI 终端助手最影响心流的一点,就是执行复杂任务时的漫长等待。 新开源的 pi-crew 解决了一个核心痛点:它为终端 AI 工具 pi 带来了非阻塞(Non-blocking)的并行子 Agent 编排能力。 不是“输入指令-干等-出结果”,而是“分配任务-继续手头工作-结果后台自动回调”。你可以让 AI 在后台跑全量代码审查,同时自己继续在主会话里高频交互,互不干扰。 核心能力: • 真·并行工作流:例如执行 /pi-crew-review,系统会同时启动代码正确性(Bug/安全)和可维护性(耦合/重复度)两个 reviewer 进行并行审查,最后合并报告。 • 6 个内置独立角色:开箱即带 scout(调查与路径收集)、planner(实施方案规划)、worker(修改并验证代码)等明确分工的专用 Agent。 • 上下文隔离:后台任务运行在独立进程中,支持随时中止(crew_abort),不会污染或打断当前开发上下文。 • 高度本地化定制:支持在 .pi/agents/ 目录通过纯文本定义专属 Agent,并直接为其挂载特定工具。 目前该插件刚开源不久,采用 MIT 协议。(注:依赖 Pi 0.84.3 或更高版本) GitHub 🔗:

Peter Yang 把他改稿时最烦的 20 多种 AI 腔写成了一个 Skill,叫 no-ai-slop,从稿子里删这些模式,同时保住作者本人的用词和节奏。 让 AI 润色一段文字,改完通顺是通顺了,满篇「不是 X,而是 Y」「说实话」,自己原来那点语气也被磨没了,它治的就是这个。 它认的模式列得很细,二分对照、清嗓子式开头、「大多数人都漏掉的一点」这类假洞见都在名单上。 还有冒号后面甩一个戏剧性揭示、「专家一致认为」这种查无出处的引用,也算。 结尾那句听起来很深刻的金句处理得挺狠,直接删,不改写成更好的比喻,回到稿子里最后一句具体的话收尾。 GitHub: 改稿会附一份改动清单。检测模式只把命中的句子引出来标名,不猜是不是 AI 写的,还有个反着用的,专门生成最油的 AI 文当乐子。 我们平时改稿也有一份类似的清单,拿它这 20 多条对了一下,重合的不少,同义词轮换、拔高词这些两边都列了。

Jack Dorsey just released a free framework for running a business 100% on AI agents, already at 29,000 GitHub stars, where agents join channels like team members and collaborate in real time.

大模型本地推理,未必需要把全部权重塞进显存。 Colibrì 关注的是“权重该放在哪里”。今天 GitHub Trending 页面截取时显示新增 2,026 stars。 它用纯 C、零引擎依赖,把 VRAM、RAM 和 NVMe 视为同一个分层内存系统:密集部分常驻,专家权重按需从磁盘流式加载,再用热度缓存、提前预取和 CPU/GPU 重叠减少等待。 项目称已支持 744B 到 2.8T 级 MoE 模型,并提供 chat、serve、web 入口。更难得的是 README 没把速度包装成保证:没有速度 SLA;内存不足只应变慢,不能偷偷改变精度或路由语义。 适合做本地 MoE 推理、存储调度与异构计算实验的人。

声音克隆和视频配音,也可以完全留在本地。 VoiceStudio 是今天 GitHub Trending 上值得看的本地优先项目,页面截取时显示新增 2,072 stars。 它把 16 个 TTS 引擎、11 个 ASR 引擎放进同一桌面工作台,覆盖声音设计、语音转换、视频配音、听写、转录、多角色有声书与批处理;支持 macOS、Windows、Linux、Docker,还提供本地 API 与 MCP Server。 亮点不是“646 种语言”这个数字本身:项目明确说明实际覆盖与质量取决于所选引擎。它目前仍是 active beta,main 分支也可能变化。 适合重视隐私、离线流程和可控成本的创作者。

Apple's MobileCLIP2 matches models 2.3x its size - fast image-text understanding built for the edge, not the data center. On-device multimodal AI just got a serious upgrade. Github:

一个需求下去,Agent 一口气动了十几个文件,改动一行行翻过去,到底牵连了哪几个模块看不出来,合并了才发现碰到别处。 Birdview 的做法是改代码之前先给项目画一张架构地图,标出这次准备碰哪些模块,再让 Agent 在这张图看得见的情况下动手。 地图上每个模块有固定编号、归属的文件和对应的源码证据,模块之间的关系也画出来,每一条都能追到源码。 GitHub: 生成的是一个独立 HTML,不用起服务,3 个视图切着看,完整架构、这次改了什么、改前改后并排对照,改动范围一眼扫完。 装成 Skill 后默认自动介入,每次改代码前先复用或更新地图,声明涉及的模块,也能切成按需模式只在要求时才画。 它记任务时把「完成」和「检查通过」分开,Agent 说做完了不算,只认记录下来的检查结果。这思路跟前几天分享的 open-steps 一路,都是不信 Agent 的自述。 Codex、Claude Code 都能装,界面中英文都有。项目大了、不放心 Agent 闭着眼改的,可以拿它先看一眼再动手。

用 AI 做安卓 App,界面全靠嘴说,顶上搜索栏、底下三个标签页,做出来跟脑子里那张图对不上,来回改三轮还在调位置。 M3E Canvas 换了个顺序,先在浏览器里把界面拖出来,再把这张图变成一段提示词,复制给 Claude Code、Codex 或 Cursor 去做。 组件全按 Material 3 Expressive 画,按钮、导航栏、卡片、对话框、搜索栏这些拖进屏幕就行,两个按钮靠近会自动吸成一组,圆角跟着融合。 GitHub: 屏幕可以加很多张,给按钮设一个目标屏幕和过渡动画,画布上就画出跳转箭头,预览里能真的一路点过去,返回时动画倒着放。 预览能点着走这点,我看比出图本身有用,流程顺不顺点两下就知道,不用等 Agent 做完了再发现。 主题在一个面板里调,七套配色或者给一个基准色生成整套,浅色深色、圆角方角一键切换。 屏幕在 412×892 的手机和 1280×800 的桌面之间也能切,导航栏自动变成侧边栏。 提示词支持中英日韩四种语言,目标平台选 Android 或 Web,自己写的组件行为说明也会带进去。全部存在浏览器本地,没有后台,打开网页就能用。

阿里把 AI 代码审查能力正式开源了:OpenCodeReview。 它来自阿里内部的大规模实战验证。今天 GitHub Trending 页面截取时显示新增 2,756 stars。 它不是把 diff 一股脑丢给通用 Agent,而是“确定性流水线 + LLM Agent”:工程逻辑负责选文件、匹配规则和定位行号,Agent 专注理解上下文与判断缺陷。 官方基准包含 50 个开源仓库、200 个真实 PR、10 种语言和 1,505 个标注问题。项目称同模型下 Precision/F1 更高、token 约为通用 Agent 的 1/9,但也明确承认 Recall 更低。 支持兼容 OpenAI/Anthropic 的模型与全文件扫描,适合受够误报和评论漂移的团队。

Coding Agent 也能变成可复现的 Research Agent。 OpenResearch 补上的不是更长的 prompt,而是一套追踪假设、实验和证据的工作台。今天 GitHub Trending 页面截取时显示新增 531 stars。 它让 Claude Code、Codex、OpenCode、Cursor 在隔离的 git worktree 中并行探索;每次实验关联代码快照、日志、diff、结果与产物,形成可复现的 experiment tree。还能自动循环:提出想法→改代码→跑实验→读证据→决定下一步。 任务可在本机、SSH 或集群运行,记录默认保存在本地。注意 Windows 仍是 beta;远程服务没有应用级鉴权,同机多人环境要额外小心。

truncated at source

Hugging Face 已封禁 AI 安全公司 Audn 上传的 penclaw-GLM-5.3-abliterated-for-offensive-cyber,页面显示其违反 Content Policy。这个版本直接修改 GLM-5.3 权重,削弱模型的拒答行为。原仓库名和介绍还明确写着 offensive cyber。作者随后删掉这几个字,重新上传了模型。 具体为什么被封,Hugging Face 没有公开解释。作者称自己也没搞懂原因,社区有人猜测是 offensive cyber 的命名触发了审核。Hugging Face 的现行政策确实禁止旨在破坏、未经授权访问系统,以及生成恶意代码的内容。 但这类削弱模型拒答限制的版本在 Hugging Face 并不少见,平台上已有数千个类似的 abliterated 模型。

@audn_ai

Hello world! It was probably taken down because of its name. Similar content was reuploaded here: > No, we will not do PR by saying it was so "harmful" that it was taken down. > Timing is interesting because we were also banned by @OpenAI recently for trying to use their model on OWASP Juice Shop ( A vulnerable GitHub web application for red-teaming training ) . We were also never accepted for Anthropic's program, even though we applied. > We applied several times for both companies' Trusted Access for Cyber program and were rejected

Agent TARS brings GUI control and vision into your terminal, browser, and product — a full multimodal agent stack that completes tasks the way a human would navigate them. CLI and Web UI included. MCP ready out of the box. Github:

15 September 2026 9 items

具身模型在云端跑得挺好,一放到机器人本体上就变样,看一眼、想一下、再动手,中间隔着几百毫秒。 也许 AI 聊天慢几百毫秒没人在意,但机器人慢这一下,动作就迟滞、轨迹不连贯,任务直接失败。 就在今天,无问芯穹联合清华、上交开源了一款具身端侧推理引擎:APXInf,专门让模型在机器人上跑得更快更稳。 官方实测在 Jetson Thor 上跑 PI 0.5 模型,反应时间从 278ms 压到 26ms 以内,快了 10.7 倍,机器人也能实时控制了。 GitHub: 稳定性这块也下不少功夫,机器人是要连着跑很久的,中间不能抖、不能卡、不能突然断掉,它的设计就是围着长期运行来做的。 新模型往上接的门槛也压低了,自己训练的模型想放到机器人上跑,接入和调优不用花大把时间。 支持 PI 0.5 和 WALL-OSS 两款具身模型,桌面上的 RTX 4090 显卡和机器人常用的 Jetson Orin、Thor 都能直接部署。 它和去年开源的具身智能训练框架 RLinf 是同一个生态,从训练到部署可以在同一套工具链里走完。 正在把具身模型往机器人上部署、被延迟卡住的开发者,可以看看。

做公众号或发推文章的封面,每次都要重新想版式,同一个人物形象换张图就走样,一致性很难保持。 xialingguo-ip 是一套封面设计 Skill,回答标题、风格、这次想突出什么、用哪版真人形象四个问题,它就把版式安排好出一张成品。 内置 9 种风格,暖色手绘教程风、深色科技爆发风、黑金步骤风、编辑杂志风都有,默认出 21:9 的横版,也能改成方图或竖图。 GitHub: 人物位置不写死,按这次要突出的重点自然摆,突出标题就让人物退到辅助,突出真人就把人放到画面中心,这点比固定模板灵活。 标题特别长的时候它会先提醒中文容易出错字,同意后改成先出视觉底稿、再用排版工具把文字加上去。 需要自己准备一套真人形象素材,打招呼、讲解、举食指几个姿势各来一张。经常给自己账号做封面又想保持人物统一的,可以配一套自己的。

做渗透测试,光 Web 一个方向就有 SQL 注入、XSS、SSRF 十几种攻击面。 每种的思路、工具、容易踩的坑都得记在脑子里,换个方向又是一整套。 Claude-Red 把这些方法论整理成 78 个安全测试 Skill,装进 Claude 后在对话中按话题自动加载,说到 SQL 注入就调出对应那一个。 分成 23 类,Web 应用有 16 个覆盖 OWASP 常见问题,无线有 14 个,还有漏洞挖掘、云、移动端、逆向这些方向。 GitHub: 每个 Skill 就是一个 SKILL.md,把某个领域的方法、工具链、边界情况写清楚,让 Claude 在这个方向上答得像个熟手,而不是泛泛而谈。 作者写明适用场景是授权的红队项目、漏洞赏金、安全研究和 CTF 备赛,动手前先确认自己在授权范围内。

DeepSeek Harness 官方桌面端已经基本做完。官方仓库主分支新增完整的 apps/desktop,用 Electron 把现有 Harness Web UI 封装成桌面 App。应用自带 Node.js 和 pnpm,用户不需要再手动启动 Web 服务,桌面端也不会对外监听端口。 官方已经准备好 macOS Apple Silicon、Intel 和 Windows x64 三套安装包构建流程,还包括 macOS 签名与公证、Windows EV 签名、自动更新和安装失败恢复。生产更新服务器已经指向 DeepSeek 自己的 暂时不在官方发布目标里。 最近一轮桌面端提交主要在处理 macOS 公证提速、启动恢复、打包校验等发布前问题。 DeepSeek 目前还没有公布具体发布日期,GitHub Release 里也还没有桌面安装包。但从仓库状态来看,桌面端已经进入发布前收尾阶段。

truncated at source

Video editors were built for people clicking through timelines. Hypit is built for coding agents. Give Codex or Claude Code a reference video, and it can use Hypit to clone the production through natural-language instructions instead of navigating a traditional editing interface. It’s open source, free to use, and BYOK. Check it out and star the repo:

@cccyd_qwq

Introducing Hypit: Clone any viral video with AI agents. > 1 clone, 100 variants, 100M views. Hypit lets your AI agent (Claude Code, Codex...) clone any viral video. > Paste any viral video link from TikTok, Instagram, or YouTube into your agent. Hypit clones it into a complete agentic video workflow: footage, captions, B-roll, effects. > GitHub: > Key Point: - Arcads: $220 / month - Higgsfield: $129 / month - Creatify: $99 / month - Hypit: FREE 🌟 > Build the video creation harness for AI Agents. Redefine how vide

DeepSeek V4.1 Flash on max is ranked as the #3 open model on @arena. I'm using this model as my daily driver right now and am incredibly impressed. It's fast, it's smart and I have an enormous amount of context that remains coherent and accurate. The whale definitely cooked.

@YourLocalAILab

With today's release of Jovian Judgement R37, DeepSeek V4.1 Flash has full support with blazing speeds. > Decodes of 500 tok/s and prefills of 20k tok/s for single stream workloads on 4 RTX 6000 Pros. ⚡️ > To learn more point your agent at our GitHub here:

opennews-mcp 是一个把各大金融消息源汇到一起的 MCP,装进 Claude Code 后用聊天就能问最近有什么值得注意的动向。 一共接了 85 个以上的数据源,分成新闻、交易所上币、链上大额、市场异动、预测信号几类,光新闻类就占了 55 家。 GitHub: 每条消息都过了一遍 AI,打一个 0 到 100 的影响力分,标出偏多还是偏空,再配一段中英文摘要。 链上那块还能盯着大额的交易和持仓变动,市场那块可以查看啊资金费率、大额爆仓这些异常。 用之前需要先配置 API Key。除了盯盘之外,还想让消息面也自动汇总的朋友,可以接进去试试。

14 September 2026 6 items

NGL ...this is fucking insane a solo developer just dropped a fully free, open-source ElevenLabs replacement no subscription, no catch and it's already at 28K stars on GitHub. what it can do: → clone a voice off a single clean audio clip → dub full videos into 646 languages → generate audiobooks, handle dictation and transcription → let you swap between 14 different TTS engines ElevenLabs? 32 languages. this one? 646. No per-character pricing. No caps on usage. Everything processes locally, so nothing leaves your machine. Bookmark it now repo's linked below.

If you've been looking for a best in class recipe for setting up DeepSeek V4.1 Flash on your RTX 6000 Pros, I have a treat for you from the team at @YourLocalAILab. 🐋

@YourLocalAILab

With today's release of Jovian Judgement R37, DeepSeek V4.1 Flash has full support with blazing speeds. > Decodes of 500 tok/s and prefills of 20k tok/s for single stream workloads on 4 RTX 6000 Pros. ⚡️ > To learn more point your agent at our GitHub here:

Crazy how T3 Code is still the only tool that cares about the relationship between a thread and a PR

@jullerino

The 1:1 Thread to PR relationship is now gone. It was always wrong. A thread can now be linked to multiple PRs in @t3dotcodes, oh and we added support for GitHub Stacks as well!

下了一本 300 页的 PDF 想系统读一遍,让 AI 总结出来的东西又不敢全信,哪句是书里写的、哪句是它自己补的分不清。 learn-from-materials 是一个学习用的 Agent Skill,把 PDF、EPUB、Word、PPT、网页这些材料变成一个能交互的学习网页,Claude Code、Codex、Copilot 命令行都能装。 它先完整读完材料建一个知识库,页面里每条内容都标出处,PDF 精确到页码,PPT 精确到第几张,EPUB 精确到章节。 GitHub: 生成的页面有核心框架、内容导学、术语大全、行动规则几个板块,还带自检题和笔记,学到哪不明白直接在页面上记。 我最看重的是它把「材料里有的」「材料没写的」「模型补充的」分开标,读的时候心里有底,这个设计比多数 AI 读书工具老实。 分「快速了解」和「系统学习」两档深度,生成完还会审计一遍有没有漏读的章节。 默认不联网,笔记和错题只存在自己浏览器里,README 和页面都是中文。 手里堆着几本电子书和论文一直没读的,可以让它先啃一遍。

让 Agent 用 Three.js 搭个 3D 场景,出来的东西常常是几个方块加一盏灯,或者跑起来一片黑,它自己还说搭好了。 3dviz-pro-max 是一个专门做 3D 可视化的 Agent Skill,Claude Code 和 Codex 都能装,一句话描述想要的场景,它带着 Agent 从美术方向、物体结构一路做到能交互的成品。 它最不一样的地方,是逼 Agent 看自己渲染出来的画面。自带一个截图脚本,把搭好的场景按预设机位跑一遍截图,Agent 对着真实的帧改。 GitHub: 背后是一个能检索的资料库,223 个配方、440 条知识记录、22 套验证过的组件套件,覆盖 24 个方向。 从奇幻村庄、产品拆解到心脏剖面、线性代数、天体轨道都有,配方里调色板、天空、雾、灯光、相机参数都给了起始值,Agent 拿来改就行,不用从零猜。 仓库里还有 37 个能直接跑起来的示例,解剖、数学、物理、灯光练习分了 5 章,每个都附当初的提示词。装了 Blender 能烘出更细的模型,没装也能跑。 想拿 Agent 做 3D 演示、教学动画或者小场景的,装上试试,比裸奔靠谱。

平时在 Mac 上干活,偶尔要回家里那台 Windows 上取个文件、跑个只有 Windows 才有的软件,商业远程软件不是限速就是要买会员。 YourDesk 是一款 macOS 和 Windows 互连的远程桌面工具,输入对方 ID 和密码就连上,源码在 GitHub 公开,个人和公司内部用都免费。 编解码走硬件加速,Mac 上 H.264 和 HEVC,Windows 上 H.264 和 AV1,两端按各自能力自动选,工具栏能看到当前用的是哪种。 跨电脑复制粘贴是我觉得最实用的一点,文字、图片、文件、整个文件夹都能复制过去直接粘贴,一批最大 2GB。 GitHub: 多显示器在工具栏中间直接切,最多 4 个屏。远端分辨率高的话可以开画面增强,先压低传输再本地放大,4K 桌面效果更明显。 新版加了 MCP,AI Agent 能自己连上远程电脑,操作桌面或命令行,干完活断开。这个功能默认关着,开了也只放行本机来源。 除了桌面模式还有远程命令行模式,Linux 机器也能当命令行被控端。Mac 端是签过名过了苹果公证的 DMG,Apple Silicon 专用。

13 September 2026 7 items

做独立游戏或者 3D 打印建模,模型建好了到画贴图这一步,主流软件按年订阅,学生和独立开发者掏钱掏得肉疼。 ArmorPaint 走的是开源路线,专门做 3D PBR 贴图绘制,模型拖进去直接在上面画,视口里实时看到光照下的效果。 它整个是围绕 GPU 从头写的,中等的集成显卡就能顺畅画 4K 贴图,高端显卡上 16K 也不卡。 材质和笔刷都是节点式的,能做全程序化材质和填充图层。 烘焙、绘制特效和视口渲染都走光线追踪,还带了 Blender、Unreal、Unity 的实时联动插件。 GitHub: 新版加了本地跑的 AI 节点,一段文字或一张照片就能生成无缝贴图,照片还能拆出颜色、高度、法线、粗糙度几张图。 模型下载好后不用联网,显存建议 6GB 以上。 Windows、Linux、macOS、iOS、Android 都能跑,桌面版免安装,安装包不到 10MB。

🚨 BREAKING: Today, we killed OpenClaw. I just watched my Mac alone oneshot a $31B company in 176 seconds. This is, without exaggeration, completely scary.

@openclaw

The lobster has molted into its final form 🦞 > Clawd → Moltbot → OpenClaw > 100k+ GitHub stars. 2M visitors in a week. And finally, a name that'll stick. > Your assistant. Your machine. Your rules.

this is very cool ! can't wait to try.

@drewwilson

Visual Diffs! For design AND code. Real-time look at me building @OpacityHQ! > We have our OWN version control that has nothing to do with Git. Y'all, it's time to move off Github and Figma (genuinely love them both, but there's a new kid on the block) and onto Zoah!

JUST SHIPPED: 8 free Agent skills with evals. 100% free and open-source. Here are my top 3 picks: /advisor-orchestrator-worker Your agent becomes the orchestrator of a three-tier model team. GPT-6 runs the orchestration, Gemini 3.8 does the cheap parallel worker tasks, and Claude Fable 5.1 gets consulted as the advisor. /first-reader Simulates real readers going through your draft and reports where they lose interest, where they stop reading, and what they remember afterward, without rewriting a word. /project-graveyard: It scans your machine, works out why each one died from its git history, shows you your own death patterns, and resurrects the one with a pulse. 🌟 agent skills github repo:

THIS TOOL TURNS A MESSY GITHUB REPO INTO A MAP YOU CAN ACTUALLY UNDERSTAND AppGraph scans JS/TS repos and visualizes how pages, APIs, services, databases, and packages connect Repo:

OpenResearch,一个开源的本地科研工作台,把 Claude Code、Codex、OpenCode、Cursor 这 4 款变成研究 Agent,每个研究方向单开一个 Agent 会话和一个独立的 git 工作树,互不干扰。 实验按 git 树来管,每次运行都存一份当时提交的快照,日志、改动、结果文件全挂在产生它们的那次运行下面,回头查得清楚。 GitHub: 它能把整个循环自动跑起来,提出想法、改代码、起实验、看结果、决定下一步试什么,多个 Agent 并行探索,实验树保留谱系。 每个方向一个工作树这个设计我觉得是最实在的一点,隔离干净了后面的事都好办。 同一份代码快照本地能跑,远程 GPU 机器上也能跑,Slurm、Kubernetes、Ray、Modal 都接,浏览器留在笔记本上看进度就行。 项目、对话、运行记录全存自己机器上,建项目和跑实验都不会把代码传出去。 有桌面版和命令行版两种,还能按关键词找论文、直接拉 arXiv 文章进来读。

CloddsBot 这个开源项目最近在 GitHub 上很火,作者是在一场 Agent 黑客松花费 12 天时间做出来的。 一个跑在自己电脑上的 AI 交易终端,底层用的是 Claude,用聊天的方式就能看盘和下单。 覆盖 10 家预测市场、7 家合约交易所,外加 Solana 和 5 条 EVM 链上的去中心化交易所。 支持接入 Telegram、Discord、WhatsApp、Slack 等社交渠道。 GitHub: 内置 118 种策略,鲸鱼地址追踪、跟单、定投机器人都有,风控带熔断、每日亏损上限和一键停机。 还有 121 个 Skill,也能当 MCP 工具挂在 Claude Desktop 和 Claude Code 使用。

12 September 2026 3 items

truncated at source

🚨 Episode 94 of The Intelligence Journal is here. NASA Open-Sourced an AI Model of the Moon 🌙🛰️ NASA and IBM just released a foundation model trained on the Moon itself. Two million image tiles. Seventeen years of Lunar Reconnaissance Orbiter data. Over a million high-resolution frames at one metre per pixel, plus nearly 964,000 multispectral images, stitched together with data from GRAIL, Lunar Prospector and Japan's SELENE. It maps craters, dates surfaces, spots volcanic features that break existing cooling models, detects changes between passes, and estimates where ice is stable near the poles. It beat the baselines on ice prospecting 🧊 And they put the whole thing on Hugging Face with the code on GitHub. Free. Join us as we break down: - Why a general model trained once on raw sensor data beats a decade of purpose-built algorithms, and why that lesson transfers to every domain sitting on unused data. - What finding stable ice actually unlocks, because water on the Moon is fuel, air and the differe

🔥爆肝了,兄弟们。我也搞了个MacDuo 来了! 直接可以实现Mac Duo效果,关闭的时候就会有磨砂玻璃效果,打开会逐渐显示,并且可以开启开门吱吱扭扭的声音,当然你不喜欢可以关闭😄 使用Swift语言撰写,你可以直接下载使用,我已经将其开源在GitHub,你如果觉得不错就可以直接Star。 地址:

Plannotator 让 Agent 写的计划,我们可以在网页上打开审查,在段落上划线、写批注,点一下就把意见整包送回给 Agent 改。 代码写完也一样,改动以左右对照的形式打开,逐行评论、直接给建议代码,GitHub 和 GitLab 上的 PR 也能拉进来评。 GitHub: Claude Code、Codex、Copilot CLI、Gemini CLI、OpenCode 等 9 个编码 Agent 都接了,一个安装脚本自动识别装了哪些,对应配置一并配好。 Agent 生成的 HTML 页面也能直接渲染出来在上面批注,评论时还能随手问 AI,或者让它先跑一轮审查把评论贴到改动上。 计划、改动、批注全存本地,不收使用数据。想让审计划这一步从终端里挪出来、能划线能批注的,可以装上试试。