KNOWLEDGE NOTES知识整理
按主题浏览已经整理的知识、课程笔记与方法。保留原有正文和出处。
287份知识文档5 本大模型主流教材的统一索引与核心导读。①一本书读懂 AIGC(2023, 256 页, 通识科普)② 从零开始大模型开发与微调 基于 PyTorch+ChatGLM(376 页, 实操教材)③ 大模型应用开发极简入门 基于 GPT-4+ChatGPT(177 页, O'Reilly, 2024 SDK 实操★深度精读)④ 大规模语言模型:从理论到实践(297 页, 复旦学术派, 张奇桂韬郑锐黄萱菁)⑤ 大模型黑书 基于 GPT-3/4 Transformer NLP(379 页, Denis Rothman)。覆盖 NLP 经典理论 → Transformer → GPT 演化 → Prompt 工程 → 微调 → 应用开发完整路径
Aschenbrenner Situational Awareness 165 页宣言 + How People Use ChatGPT (OpenAI) + Why LLMs Hallucinate (OpenAI) + Generative AI Seniority-Biased Change + Reddit 大规模说服实验 + OpenAI Practical Guide to Building Agents + Google Prompt Engineering (Lee Boonstra) + 看 DAO 2025 (未尽研究) + DeepSeek 入门 + AGI 介绍。10 篇文献,组合起来回答"AGI 是什么 / 多快来 / 怎么用 / 谁受冲击 / 怎么造 Agent"五大核心问题
272 帖记录的 Agent 工程实践:从 Devin / Manus 观察到自建 Agent 系统、MCP 接 FMP/飞书/Chrome、Loop 任务、多 Agent 多浏览器多账号体系、自动化推广 SOP
王凯 2026 主力工作流的完整工程化沉淀。终端窗口即 Agent / 多模型混编 / Skill 体系 / 飞书 CLI 协作总线 / 三层配置分层 / Chrome MCP 控制真实浏览器 / 长任务 10min 巡检 / 反共识"Claude 订阅最便宜"
一台电脑 × N 套独立身份 × 每套身份 1 个浏览器 + 1 个 cdp-proxy + M 个 agent。Claude Code v2.1.x 实测路径 + 端口对分配 + 文件模板 + hub 协调层 + 指纹工具 + 住宅代理 + CDP 安全
在 Claude.ai 网页端怎么安装并启用 Skill(把 .md 文件上传即可),以及对 PM 的用途:Skill 是预装在 Claude 里的"专家说明书",提任务时系统自动把对应专家流程塞进上下文,按验证过的最佳实践干活而非瞎猜。与 newtype-skills-collection 分工:那篇讲 Skill 工程化(怎么造一个好 Skill),本篇只讲 Claude.ai 终端用户视角的安装/启用两步操作 + 何时用 + 坑。
newtype 星球收录的 3 篇 Agent 研究 / 演讲精读。05 CAMEL-AI Wendong Fan《Finding the Scaling Laws of Agents》(2025 演讲:# Parameters → # Agents 类比 / CAMEL + OWL + CRAB + OASIS 框架 / Agentic Data Generation 反哺训练)/ 07《More Agents Is All You Need》(Tencent ICML 2024:sampling-and-voting 暴力堆 Agent 数量,Llama2-13B + 15 个 agents 匹敌 Llama2-70B,3 个维度决定 gain 大小)/ 08《ChatQA》(NVIDIA 2024:two-stage instruction tuning,70B 在 10 个 conv QA 数据集上 54.14 vs GPT-4 53.90,fine-tune retriever 替代 query rewriting 省 API 钱,"unanswerable" sample 训练消除幻觉)
隐形 AI 水印能被频谱分析洗掉且画质无损(reverse-SynthID 实证)→ 水印是诚信用户溯源工具,不是防伪铁证;做内容方该叠加多信号 + 主动合规标识
2026-01 newtype 整理的 AI Agent 技术架构演进研究报告。基于 2024-10 至 2026-01 的论文 + Anthropic/OpenAI/Google/Microsoft 官方博客 + 开源项目 + 真实部署案例。涵盖 6 大演进 / 4 种多 Agent 编排模式 / Google 8 大基础模式 / 记忆管理(MemoryOS 3 层 + 向量库选型)/ 工具调用 + MCP 标准化 / 推理框架(ReAct → ToT → GoT → WoT 演进)/ 推理模型 LRM / 生产 7 层架构 / 主流框架对比(LangGraph/CrewAI/MAF/AutoGen/LlamaIndex/ADK)/ Morgan Stanley + Klarna + BBVA + Rakuten 真实部署案例 / 2026 趋势预判 / 合规与治理 / 生产清单。是 [[newtype-agent-architecture]](黄益贺帖子级判断)的"研究报告级"补充。
6+ 视角的 AI Agent 架构融合。黄益贺(Workflow / Agentic Workflow / 5 大特征 / Chief-Deputy-Specialist / Agent Native 预测)/ newtype 研究报告(4 大编排模式 + Google ADK 8 模式 + MemoryOS 3 层 + 6 大框架对比)/ 王凯(字面"终端窗口即 Agent" + 身份×工种矩阵 + cdp-proxy 隔离 + Agent 分级 L1-L5)/ AWS Agent 4 篇(idoubi / ANP 协议 / Reasoning Model)/ Agent 论文 3 篇(CAMEL Scaling Laws / More Agents Is All You Need / ChatQA)/ Codex/Cloud Code(lenny)/ 深思圈 VC 视角。覆盖 Manus 评价分歧、Sub-Agent 哲学、Workflow vs Agent 命门、生产部署案例
Anthropic 工程团队 2026 给的 agent 评测系统化框架。8 概念词典 / 3 类 grader 矩阵 / Capability vs Regression 双轨 / 4 类 agent 评测套路(coding / 对话 / research / 计算机操作)/ 从 0 到 1 的 8 步路线图 / pass@k vs pass^k 数学直觉 / 评测框架生态 / 反 pattern。Phase A 锚 wiki,设定 anthropic-* 这批的密度与双语风格基准
Karpathy / Boris Cherny(Claude Code 之父)/ OpenAI Codex / Cursor / Notion / Pydantic 等 11 档播客横切。核心共识=2025/12 "从打字到调度" 拐点 + "skill = markdown + 脚本" + "凡是 agent 没法用 API 调到的就等于不存在";核心分歧=Claude Code vs Codex、MCP vs CLI、零人工审查走多远
13 期前沿研究播客按"争论"重组:LeCun 唱衰 LLM(死路 vs scaling 派)/ 世界模型 JEPA vs 语言符号 vs 渲染器三派 / continual learning 是不是被神化 / RL 出代码圈能不能成 / AI 造 AI 递归自进化 / 前沿风险与对齐 / Hassabis 的 AGI 终局 / EBM·Mistral·Leanstral 三条非主流架构。说话人含 LeCun、Pachocki、Dubois、Kolter、Manning、Dehghani、Vinyals、Hassabis、Brockman
Karpathy/sama/Anthropic & Google 模型派与实验室声音的 X 长效观点——LLM 知识库范式、能力锯齿理论、harness/skills 工程、模型版本策略、agent 安全、AI for science、HTML 即新 markdown
把 AI 接到物理世界——材料/生物自动驾驶实验室(Periodic、Ginkgo)、Waymo、AI 芯片与推理算力(Cerebras、Baseten)、太空数据中心(Starcloud)、AI 智能灶——以及让"AI for X"在原子世界真正跑通的跨域心法
13 篇 2026 官方博客主题化精炼。核心是 Claude Managed Agents(托管智能体)——一套"租 Anthropic 的云基建跑长跑 agent"的 API:memory(跨会话记忆)+ dreaming(梦境自改进)+ outcomes(评分自纠)+ multiagent(主从协作)+ self-hosted sandboxes(自带沙箱)+ MCP tunnels(私网隧道),底层是"脑(Claude+harness)/手(sandbox)/会话日志"三件解耦的元 harness 设计。外加 Claude Code 桌面端重做(并行 agent)+ harness 设计哲学(用 Claude 已会的工具/不断追问"我能停掉什么")+ 企业落地数据 + 三产品 containment 安全架构 + AI 加速攻防的安全清单 + 图表可视化/前端 Skills/生活类 connectors
Anthropic engineering 博客 25 篇 hub wiki。Building Effective Agents 框架(Workflow vs Agent + 5 模式)+ Context Engineering 新范式(prompt engineering 的演化)+ Harness 设计 4 类(单次 / 长跑 single agent / 长跑 multi agent / managed-decoupled)+ Tool 设计 5 原则 + Agent Skills 开放标准 + Claude Code 工程化(sandboxing / auto mode / best practices / 2 次 postmortem)+ MCP 演化(code execution / DXT/MCPB / advanced tool use)。25 篇 1 句话索引。Anthropic 视角是 [[wiki-ai-agent-architecture]] / [[wiki-claude-code-workflow]] 系列里"官方第一方"层,与三方观察互校
Anthropic research 板块 5 篇 hub:Natural Language Autoencoders(把 Claude 内部 activations 解码成自然语言,2026-05 重大突破)+ How people ask Claude for personal guidance(100 万对话采样 / 6% 是寻求人生建议)+ BioMysteryBench(生物信息学评测)+ Why do AI models hallucinate? + What is sycophancy? + 4 个研究 team 页(Alignment / Economic Research / Interpretability / Societal Impacts)。覆盖"AI 内部怎么想 + 用户怎么用 + 容易出什么 bug"3 块研究
Anthropic research 板块 11 篇 hub:Constitutional AI(2022 foundational)+ Automated Alignment Researchers(2026 scalable oversight)+ Petri 开源(donating-open-source-petri)+ deprecation commitments(模型不删)+ end-subset-conversations(Claude welfare)+ Teaching Claude Why(agentic misalignment 后续)+ Project Vend Phase 2(Claudius 红队失败实验)+ 2028 AI Leadership(US-China)+ Anthropic Institute 4 大研究 agenda + Core Views on AI Safety + ASL3 全景。Anthropic 安全立场 5 大支柱:Constitutional + RSP/ASL / 透明 / Welfare / Red Team
2025 Amazon Web Services Agent 系列讲座 4 篇汇编。汪其香(Reasoning Model + Agent 大脑 + Multi-Agent Orchestrator + 框架对比)/ 王晓妍(Agentic AI 4 要素 Planning/Memory/Tool/Action + 段位 3 级 + RL + 产品定价)/ 常高伟(ANP 协议:智能体的 email,对标 MCP 的 USB-C,W3C DID + P2P 架构)/ idoubi(独立开发实战 + AI Wrapper SOP + ProductHunt 打榜 + 程序化 SEO + all-in 方向)。是 [[newtype-agent-architecture-research-2025]] 研究报告的"产业实操视角"补充