FoundationAgents/OpenManus Python ⭐ 56,404

OpenManus:无需邀请码的开源通用智能体实现 | FoundationAgents/OpenManus

项目背景 OpenManus 由 MetaGPT 团队(@Xinbin Liang、@Jinyu Xiang 等五人)在3小时内写出原型,发布后快速获得56404个star。它直接对标闭源项目 Manus(需要邀请码才能用),而 OpenManus 不需要任何邀请码,所有人都可以在本地运行、修改代码...

eyaltoledano/claude-task-master JavaScript ⭐ 27,283

Claude Task Master:面向 AI 驱动开发的任务管理系统 | eyaltoledano/claude-task-master

问题:AI记不住自己说过的话 我在Cursor里让Claude“先建一个users表,字段id、name、email”。它写了。然后我说“加一个login API”。它改了代码,但回头一看,users表里的email字段写成了mail。Claude自己忘了之前定的命名规范,而我翻了几十轮对话才找到当...

musistudio/claude-code-router TypeScript ⭐ 34,502

用 Claude Code 接入任何大模型:claude-code-router 项目解读 | musistudio/claude-code-router

为什么需要 CCR claude 是 Anthropic 官方的终端编程助手。你在项目目录下敲 claude,它能读代码、写文件、操作 git。但 Claude Code 默认只连 Anthropic 自家的模型——你想用 DeepSeek 做快速推理,或者在公司内网跑 Ollama 省成本,直接换...

anthropics/claude-code Python ⭐ 127,596

Claude Code:终端中的智能体编程工具详解 | anthropics/claude-code

它不是一个补全引擎 Claude Code 不讲自动补全,也不在 VSCode 侧边栏里出建议。它接管你的终端,听懂自然语言请求,然后自己读文件、改代码、跑命令、提交 commit。你描述目标,它执行操作。 把它当成一个在项目目录里工作的编码助理——没有界面,只有命令行对话。你打字说“移除所有 co...

index-tts/index-tts Python ⭐ 20,825

B站开源的零样本TTS:IndexTTS2如何解决情感与时长控制难题 | index-tts/index-tts

仓库现状:论文发了,代码没开 点开 index-tts/index-tts,第一行警告:“仓库历史已重置,请删除本地副本并重新克隆”。翻遍整个仓库,没有模型权重、推理脚本、安装说明。只有一篇论文摘要、一个B站演示视频、几个Demo音频。 20825个star,全是冲着论文效果和Demo质量来的。作者...

huggingface/open-r1 Python ⭐ 26,022

Open R1:复现 DeepSeek-R1 的完整开放路线图 | huggingface/open-r1

项目完成度:蒸馏做完,纯RL交了一半数据,多阶段训练没放 HuggingFace 的 Open R1 公开了一个目标:完全复现 DeepSeek-R1 的训练流程。项目分三步,目前完成了第一步(蒸馏),第二步(纯 RL)放了部分数据和一个难基准,第三步(多阶段训练)还没给出训练配置。代码和数据集都已...

Jiayi-Pan/TinyZero Python ⭐ 13,119

TinyZero:复现DeepSeek R1-Zero的自验证与搜索能力 | Jiayi-Pan/TinyZero

TinyZero:一段被刻意冻结的RL实验记录 不是所有归档的项目都值得看,但这个值得。TinyZero用纯强化学习,在倒计时和乘法两个任务上,让3B参数的base模型(Qwen2.5-3B)自己学会了自我验证和搜索。没有预训练推理数据,没有人工标注的链式思考。作者管这个现象叫“Aha moment...

Tencent-Hunyuan/Hunyuan3D-2 Python ⭐ 13,845

腾讯混元3D-2:从单图到高保真3D资产的生成实战 | Tencent-Hunyuan/Hunyuan3D-2

1.3 万 star 的开源项目 Tencent-Hunyuan/Hunyuan3D-2 到底是干啥的?简单说,它是一套把单张图(或文字)变成 3D 模型的模型组合。但不是只有一个模型,而是一个包含多个变体的家族,分别解决不同需求:有人要快,有人要精细,有人显卡只有 6G。 我读完 README 并...

Alibaba-NLP/DeepResearch Python ⭐ 18,983

阿里开源的深度研究智能体:Tongyi DeepResearch 技术解析 | Alibaba-NLP/DeepResearch

这不是聊天模型,是能自己搜索验证的智能体 通义实验室开源的 Tongyi DeepResearch(仓库 Alibaba-NLP/DeepResearch)是一个 MoE 模型,总参数 30.5B,推理时每个 token 只激活 3.3B 参数。它的定位不是对话,而是“长周期深度信息搜索”(long...

nanobrowser/nanobrowser TypeScript ⭐ 13,051

Nanobrowser:在浏览器内运行的开源多智能体自动化工具 | nanobrowser/nanobrowser

项目是什么 Nanobrowser 是一个开源的 Chrome 扩展,用来做 AI 网页自动化。它把自己定位成 OpenAI Operator 的免费替代品——后者每月收费 200 美元。GitHub 上 13051 颗星,Apache-2.0 许可证,代码完整可读。 核心逻辑:你在侧边栏用自然语言...

deepseek-ai/DeepSeek-V3 Python ⭐ 103,647

DeepSeek-V3:671B总参数的MoE模型,如何用270万GPU小时实现SOTA性能 | deepseek-ai/DeepSeek-V3

引言:成本与稳定性的双赢 DeepSeek-V3 的 README 里藏着两个硬事实:预训练只花了 2.664M H800 GPU 小时,后训练再加 0.1M;全程没有一次不可恢复的 loss spike,没有一次回滚。对比 Llama 3 405B 估算的三千万小时,成本低了一个数量级,稳定性却高...

microsoft/TRELLIS Python ⭐ 12,769

微软TRELLIS:基于结构化3D潜空间的统一生成框架 | microsoft/TRELLIS

SLAT不是中间产物,是整个架构的关键 大多数3D生成模型一条路走到头:输入是文本或图片,输出直接绑死网格(mesh)或NeRF。你选了一种,换格式就得重新跑模型。 TRELLIS在输入和输出之间加了一层叫Structured LATent(SLAT)的结构化隐空间表示。模型只做“输入→SLAT”这...