CodeZen
一个专注中文区的 GitHub 项目发现
所有语言
C
C#
C++
CSS
Dart
Go
HTML
Java
JavaScript
Jupyter Notebook
Kotlin
Lua
PHP
PowerShell
Python
Ruby
Rust
Shell
Swift
TypeScript
Vue
oai-skills
The contents of /home/oai/skills in ChatGPT's code interpreter environment
OCRPDF-TO-PPT
AI PPT Restorer | AI生成PPT图片还原工具 **将AI生成的精美PPT图片还原为可编辑的PPT文档** Englishenglish | 中文文档chinese --- 📖 项目简介 使用Google Nano Banana Pro等AI工具生成的PPT虽然视觉效果惊艳,但输出的是**不可编辑的图片格式**。当需要修改文字内容时,只能重新生成,极其不便。 参考视频: https://www.bilibili.com/video/BV1a7mJBbEht/?vd_source=32d1e5983d8d2a40a44db0d2e38f9ab4 *
MaaMCP
基于 MaaFramework 的 MCP 服务器 为 AI 助手提供 Android 设备和 Windows 桌面自动化能力
QQgroup-annual-report-analyzer
一个用于分析QQ群聊记录并生成年度热词报告的工具。支持热词发现、趣味统计、可视化报告生成等功能。
GLM-TTS
GLM-TTS是一个基于大型语言模型的高质量文本到语音(TTS)合成系统,支持零样本语音克隆和流式推理。本系统采用两个阶段架构:首先使用LLM生成语音令牌序列,然后使用流模型将令牌转换为高质量的音频格式。通过引入多奖励强化学习(Multi-Reward RL)框架,GLM-TTS能够生成更加丰富的情感表达力和流式推理,显着提升了传统TTS系统的表现力。
vLLM-Kunlun
vLLM Kunlun (vllm-kunlun) is a community-maintained hardware plugin designed to seamlessly run vLLM on the Kunlun XPU.
visionary
Visionary:面向下一代"大世界模型"的web渲染引擎
bl_sbx_apple_wallet
暂无简介
Wan-Move
[NeurIPS 2025] Wan-Move: Motion-controllable Video Generation via Latent Trajectory Guidance
GLM-ASR
GLM-ASR Readme in EnglishREADME.md 👋 加入我们的 微信 社区 模型介绍 **GLM-ASR-Nano-2512** 是一款鲁棒的开源语音识别模型,参数量为 **1.5B**。 该模型专为应对真实世界的复杂场景而设计,在多项基准测试中超越 OpenAI Whisper V3,同时保持紧凑的模型规模。 核心能力包括: * **卓越的方言支持** 除标准普通话和英语外,模型针对**粤语**及其他方言进行了深度优化,有效填补了方言语音识别领域的空白。 * **低音量语音鲁棒性** 专门针对**"低语/轻声"**场景进行训练,能
mistral-vibe
Minimal CLI coding agent by Mistral
Open-AutoGLM
Phone Agent 是一个基于 AutoGLM 构建的手机端智能助理框架,它能够以多模态方式理解手机屏幕内容,并通过自动化操作帮助用户完成任务。系统通过 ADB(Android Debug Bridge)来控制设备,以视觉语言模型进行屏幕感知,再结合智能规划能力生成并执行操作流程。用户只需用自然语言描述需求,如“打开小红书搜索美食”,Phone Agent 即可自动解析意图、理解当前界面、规划下一步动作并完成整个流程。系统还内置敏感操作确认机制,并支持在登录或验证码场景下进行人工接管。同时,它提供远程 ADB 调试能力,可通过 WiFi 或网络连接设备,实现灵活的远程控制与开发。