KNOWLEDGE NOTES

知识整理

按主题浏览已经整理的知识、课程笔记与方法。保留原有正文和出处。

287份知识文档
AI 技术与工程 / 大语言模型学习

5 本大模型入门厚书核心导读 / 1485 页系统化教材

5 本大模型主流教材的统一索引与核心导读。①一本书读懂 AIGC(2023, 256 页, 通识科普)② 从零开始大模型开发与微调 基于 PyTorch+ChatGLM(376 页, 实操教材)③ 大模型应用开发极简入门 基于 GPT-4+ChatGPT(177 页, O'Reilly, 2024 SDK 实操★深度精读)④ 大规模语言模型:从理论到实践(297 页, 复旦学术派, 张奇桂韬郑锐黄萱菁)⑤ 大模型黑书 基于 GPT-3/4 Transformer NLP(379 页, Denis Rothman)。覆盖 NLP 经典理论 → Transformer → GPT 演化 → Prompt 工程 → 微调 → 应用开发完整路径

LLM教材模型开发大模型基础中文整理稿

王凯 收藏 / 2024-2026 AI 前沿论文与报告精读

Aschenbrenner Situational Awareness 165 页宣言 + How People Use ChatGPT (OpenAI) + Why LLMs Hallucinate (OpenAI) + Generative AI Seniority-Biased Change + Reddit 大规模说服实验 + OpenAI Practical Guide to Building Agents + Google Prompt Engineering (Lee Boonstra) + 看 DAO 2025 (未尽研究) + DeepSeek 入门 + AGI 介绍。10 篇文献,组合起来回答"AGI 是什么 / 多快来 / 怎么用 / 谁受冲击 / 怎么造 Agent"五大核心问题

前沿论文大模型Agent中文整理稿
AI 技术与工程 / AI 产品与辅助设计

在 Claude.ai 安装和使用 Skill(操作步骤 + 何时用)

在 Claude.ai 网页端怎么安装并启用 Skill(把 .md 文件上传即可),以及对 PM 的用途:Skill 是预装在 Claude 里的"专家说明书",提任务时系统自动把对应专家流程塞进上下文,按验证过的最佳实践干活而非瞎猜。与 newtype-skills-collection 分工:那篇讲 Skill 工程化(怎么造一个好 Skill),本篇只讲 Claude.ai 终端用户视角的安装/启用两步操作 + 何时用 + 坑。

Claude Skills工具使用工作流中文整理稿
AI 技术与工程 / Newtype

Agent 研究论文 3 篇精读(2024-2025)

newtype 星球收录的 3 篇 Agent 研究 / 演讲精读。05 CAMEL-AI Wendong Fan《Finding the Scaling Laws of Agents》(2025 演讲:# Parameters → # Agents 类比 / CAMEL + OWL + CRAB + OASIS 框架 / Agentic Data Generation 反哺训练)/ 07《More Agents Is All You Need》(Tencent ICML 2024:sampling-and-voting 暴力堆 Agent 数量,Llama2-13B + 15 个 agents 匹敌 Llama2-70B,3 个维度决定 gain 大小)/ 08《ChatQA》(NVIDIA 2024:two-stage instruction tuning,70B 在 10 个 conv QA 数据集上 54.14 vs GPT-4 53.90,fine-tune retriever 替代 query rewriting 省 API 钱,"unanswerable" sample 训练消除幻觉)

AI 工程Agent 工作流模型与评测中文整理稿
AI 技术与工程 / Newtype

AI Agent 技术架构演进 2025(深度研究报告)

2026-01 newtype 整理的 AI Agent 技术架构演进研究报告。基于 2024-10 至 2026-01 的论文 + Anthropic/OpenAI/Google/Microsoft 官方博客 + 开源项目 + 真实部署案例。涵盖 6 大演进 / 4 种多 Agent 编排模式 / Google 8 大基础模式 / 记忆管理(MemoryOS 3 层 + 向量库选型)/ 工具调用 + MCP 标准化 / 推理框架(ReAct → ToT → GoT → WoT 演进)/ 推理模型 LRM / 生产 7 层架构 / 主流框架对比(LangGraph/CrewAI/MAF/AutoGen/LlamaIndex/ADK)/ Morgan Stanley + Klarna + BBVA + Rakuten 真实部署案例 / 2026 趋势预判 / 合规与治理 / 生产清单。是 [[newtype-agent-architecture]](黄益贺帖子级判断)的"研究报告级"补充。

AI 工程Agent 工作流模型与评测中文整理稿
AI 技术与工程 / 跨来源主题整理

AI Agent 架构与多 Agent 编排(跨作者主题综合)

6+ 视角的 AI Agent 架构融合。黄益贺(Workflow / Agentic Workflow / 5 大特征 / Chief-Deputy-Specialist / Agent Native 预测)/ newtype 研究报告(4 大编排模式 + Google ADK 8 模式 + MemoryOS 3 层 + 6 大框架对比)/ 王凯(字面"终端窗口即 Agent" + 身份×工种矩阵 + cdp-proxy 隔离 + Agent 分级 L1-L5)/ AWS Agent 4 篇(idoubi / ANP 协议 / Reasoning Model)/ Agent 论文 3 篇(CAMEL Scaling Laws / More Agents Is All You Need / ChatQA)/ Codex/Cloud Code(lenny)/ 深思圈 VC 视角。覆盖 Manus 评价分歧、Sub-Agent 哲学、Workflow vs Agent 命门、生产部署案例

Agent 架构多 Agent 编排记忆系统中文整理稿
AI 技术与工程 / Anthropic 与 Claude

AI Agent 评测方法论(Anthropic 工程团队 demystifying-evals 深 dive)

Anthropic 工程团队 2026 给的 agent 评测系统化框架。8 概念词典 / 3 类 grader 矩阵 / Capability vs Regression 双轨 / 4 类 agent 评测套路(coding / 对话 / research / 计算机操作)/ 从 0 到 1 的 8 步路线图 / pass@k vs pass^k 数学直觉 / 评测框架生态 / 反 pattern。Phase A 锚 wiki,设定 anthropic-* 这批的密度与双语风格基准

Agent评测评测方法质量保障中文整理稿
AI 技术与工程 / AI Builders

AI Builders · 前沿模型研究与通往 AGI(播客精炼)

13 期前沿研究播客按"争论"重组:LeCun 唱衰 LLM(死路 vs scaling 派)/ 世界模型 JEPA vs 语言符号 vs 渲染器三派 / continual learning 是不是被神化 / RL 出代码圈能不能成 / AI 造 AI 递归自进化 / 前沿风险与对齐 / Hassabis 的 AGI 终局 / EBM·Mistral·Leanstral 三条非主流架构。说话人含 LeCun、Pachocki、Dubois、Kolter、Manning、Dehghani、Vinyals、Hassabis、Brockman

前沿模型AGI模型研究中文整理稿
AI 技术与工程 / Anthropic 与 Claude

Anthropic · Claude Managed Agents 平台 + 2026 产品/安全更新(官方博客精炼)

13 篇 2026 官方博客主题化精炼。核心是 Claude Managed Agents(托管智能体)——一套"租 Anthropic 的云基建跑长跑 agent"的 API:memory(跨会话记忆)+ dreaming(梦境自改进)+ outcomes(评分自纠)+ multiagent(主从协作)+ self-hosted sandboxes(自带沙箱)+ MCP tunnels(私网隧道),底层是"脑(Claude+harness)/手(sandbox)/会话日志"三件解耦的元 harness 设计。外加 Claude Code 桌面端重做(并行 agent)+ harness 设计哲学(用 Claude 已会的工具/不断追问"我能停掉什么")+ 企业落地数据 + 三产品 containment 安全架构 + AI 加速攻防的安全清单 + 图表可视化/前端 Skills/生活类 connectors

托管AgentAgent架构安全更新中文整理稿
AI 技术与工程 / Anthropic 与 Claude

Anthropic 工程团队第一方视角:Agent 工程化 / Skills / MCP / Claude Code(2025-2026 全集)

Anthropic engineering 博客 25 篇 hub wiki。Building Effective Agents 框架(Workflow vs Agent + 5 模式)+ Context Engineering 新范式(prompt engineering 的演化)+ Harness 设计 4 类(单次 / 长跑 single agent / 长跑 multi agent / managed-decoupled)+ Tool 设计 5 原则 + Agent Skills 开放标准 + Claude Code 工程化(sandboxing / auto mode / best practices / 2 次 postmortem)+ MCP 演化(code execution / DXT/MCPB / advanced tool use)。25 篇 1 句话索引。Anthropic 视角是 [[wiki-ai-agent-architecture]] / [[wiki-claude-code-workflow]] 系列里"官方第一方"层,与三方观察互校

Agent工程SkillsMCP中文整理稿
AI 技术与工程 / Anthropic 与 Claude

Anthropic 可解释性 + Claude 行为研究(Natural Language Autoencoders + 用户使用洞察)

Anthropic research 板块 5 篇 hub:Natural Language Autoencoders(把 Claude 内部 activations 解码成自然语言,2026-05 重大突破)+ How people ask Claude for personal guidance(100 万对话采样 / 6% 是寻求人生建议)+ BioMysteryBench(生物信息学评测)+ Why do AI models hallucinate? + What is sycophancy? + 4 个研究 team 页(Alignment / Economic Research / Interpretability / Societal Impacts)。覆盖"AI 内部怎么想 + 用户怎么用 + 容易出什么 bug"3 块研究

模型可解释性AI行为安全研究中文整理稿
AI 技术与工程 / Anthropic 与 Claude

Anthropic AI 安全 / 对齐 / 政策研究全集(Constitutional AI + RSP + Welfare + Policy)

Anthropic research 板块 11 篇 hub:Constitutional AI(2022 foundational)+ Automated Alignment Researchers(2026 scalable oversight)+ Petri 开源(donating-open-source-petri)+ deprecation commitments(模型不删)+ end-subset-conversations(Claude welfare)+ Teaching Claude Why(agentic misalignment 后续)+ Project Vend Phase 2(Claudius 红队失败实验)+ 2028 AI Leadership(US-China)+ Anthropic Institute 4 大研究 agenda + Core Views on AI Safety + ASL3 全景。Anthropic 安全立场 5 大支柱:Constitutional + RSP/ASL / 透明 / Welfare / Red Team

AI安全模型对齐治理中文整理稿
AI 技术与工程 / Newtype

AWS Agent 系列讲座 2025(4 篇汇编)

2025 Amazon Web Services Agent 系列讲座 4 篇汇编。汪其香(Reasoning Model + Agent 大脑 + Multi-Agent Orchestrator + 框架对比)/ 王晓妍(Agentic AI 4 要素 Planning/Memory/Tool/Action + 段位 3 级 + RL + 产品定价)/ 常高伟(ANP 协议:智能体的 email,对标 MCP 的 USB-C,W3C DID + P2P 架构)/ idoubi(独立开发实战 + AI Wrapper SOP + ProductHunt 打榜 + 程序化 SEO + all-in 方向)。是 [[newtype-agent-architecture-research-2025]] 研究报告的"产业实操视角"补充

Agent 架构多 Agent 系统AI 产品定价中文整理稿