Categories
- NLP 24
- Agent 15
- RL 10
- LLM 8
- Math 6
- AI 6
- DL 5
- software-engineering 5
- research 5
- quant-trading 4
- RecommenderSystem 2
- web 2
- graphics 2
- 投资 2
- Misc 1
- CV 1
- EnsembleLearning 1
- ImageGeneration 1
- ComputerScience 1
- Language 1
- RAG 1
- graph-learning 1
- prompt-engineering 1
- ai-finance 1
- quant-research 1
- ai-systems 1
- finance 1
- deep-dive 1
- game-dev 1
- ai 1
- blender 1
- aigc 1
- diffusion 1
- web-scraping 1
- Finance 1
NLP
- » 机器翻译进展追踪: TACTIC, 认知理论驱动的多代理翻译框架
- » 来自微信团队的 DeepTrans: 自由(机器)翻译前沿进展调研
- » Prompt4py, 程序化提示词模板框架
- » 文本生成算法中, 采样与解码的基本原理: Top-K, Top-P, Temperature, Beam Search
- » 机器翻译技术调研: ByteDance-Seed/Seed-X-PPO-7B, 超越 Gemini-2.5-Pro 的开源翻译小模型背后的训练管线与技术细节
- » Paper 追踪: Where to show Demos in Your Prompt: A Positional Bias of In-Context Learning (上下文学习中示例在提示中的位置会影响生成性能)
- » 技术调研 DEBATE: Devil's Advocate-Based Assessment and Text Evaluation
- » 论文精读 Re³: Generating Longer Stories With Recursive Reprompting and Revision
- » 技术调研 GROVE 框架: A Retrieval-augmented Complex Story Generation Framework with A Forest of Evidence
- » 论文精读 STORYTELLER: An Enhanced Plot-Planning Framework for Coherent and Cohesive Story Generation
- » 深入理解 DPO: PPO 的对比学习平替
- » 可控文本生成技术概述, 与 CTRL 方法论(模型)
- » 基于 LLM 的内容自动化 Tagging 实践
- » 论文精读 LongStory: Coherent, Complete and Length Controlled Long story Generation
- » 旋转位置编码 (RoPE), 原理与应用
- » 深入理解 BERT, 并基于 BERT 实现 NLU
- » 基于集合的相似性度量算法
- » 词频-逆文档频率(TF-IDF)的计算
- » 计算词汇熵(基于词汇的信息熵)
- » 序列模型中什么是 Bidirectional
- » KL 散度的非对称性质
- » 基于潜在狄利克雷分配算法(LDA)实现长文档主题建模
- » 大模型权重量化学习笔记
- » 词嵌入模型(Embedding Model)是什么
Agent
- » LangGraph 深度调研:从 Graph API、Pregel 执行引擎到 Checkpoint / Interrupt / Time Travel 的完整源码级理解
- » Codex + Blender 自动 3D 建模实践
- » Amplication:面向平台工程的自动生成与持续治理系统
- » InkOS 的记忆和状态实现
- » InkOS:小说界的 Claude Code
- » ML Agent:面向机器学习工程的 Hugging Face 代理运行时
- » MemPalace: 启发式记忆检索与本地原文记忆系统
- » OpenSpec 与 SDD:给不可靠的 AI 编程加上一层规格护栏
- » 深入 Claude Code 源码:学会与你不信任的伙伴(LLM)共事
- » Harness Engineering: 反馈闭环和熵治理, 构建可控的 LLM Agent
- » 在中国境内使用 Claude Code, 简明教程
- » 理解 Agent Skills 开放标准
- » Autono: MCP 兼容性更新
- » Autono: A ReAct-Based Highly Robust Autonomous Agent Framework
- » AGENTS.md
RL
- » 贝尔曼方程:从递推直觉到强化学习算法
- » Atropos:面向语言模型强化学习的环境与 Rollout 框架
- » 基于 Stable Baselines3 和 Gymnasium 的强化学习 (PPO) 算法实践
- » 时序差分方法 (TD)
- » 广义优势估计方法 (GAE)
- » RL中的奖励折扣机制
- » 现代强化学习-策略梯度算法学习
- » 强化学习中, 价值函数和优势函数分别是什么?
- » 强化学习发展史
- » 深入强化学习算法
LLM
- » FlawedFictions 调研报告:用 Plot Hole Detection 评估语言模型的深层叙事推理
- » Fill-In-the-Middle Completion:让大语言模型补全文本中间缺口
- » LLM 生成(补全)阶段的 Neural Text Degeneration 检测算法设计: 缓解 Repetition Curse 问题
- » Agent 长期记忆策略调研: MemoryOS, 首个智能体记忆系统
- » 当前主流 AI 语言模型深入汇总对比
- » Branch-Solve-Merge: 用并行的分治方法提高 LLM 生成质量
- » 新手向: 语言模型训练算法简要总结
- » 如何微调 Gemini-2.5-Pro: 简明教程
Math
- » 机器学习数学基础: 理解对数几率 (Logit 函数)
- » 深度学习中的权重正则化方法: Lasso/Ridge/ElasticNet
- » 深入逻辑回归模型
- » 深入线性回归模型, 最小二乘法和梯度下降法求解
- » 皮亚诺公理 (Peano's Axioms)
- » 困惑度和熵
AI
- » 论文精读:LLMs Get Lost in Evolving User Intent
- » 深入模型剪枝与量化:LLM 原理、工程实践与代码实现
- » Toolformer 精读:从自监督工具调用到现代 Agent 的训练范式
- » LLMLingua 深度调研:从困惑度压缩到长上下文、蒸馏分类与越狱意图提取
- » 使用 LangGraph:用法与应用场景
- » LLM Agent 设计架构综述:从 ReAct 与 Workflow 到规划、搜索、记忆、多 Agent 协作与场景选型
DL
- » 深入理解 LoRA 理论原理, 并基于 PyTorch 实现 LoRA 模块
- » Paper 追踪: Attention is NOT all you need: Pure Attention Loses Rank Doubly Exponentially with Depth (深层自注意力网络的灾难性秩退化)
- » 从 0 开始, 手搓一个 Transformer (Roformer) Encoder
- » 深入对比学习,机器是如何学习到信息的向量表示的?
- » 深度学习-梯度不稳定-学习笔记
software-engineering
- » Scrapling 深度调研:它为什么让爬虫从“东拼西凑”变成一套完整框架
- » Reflex 框架深度研究:从开发体验到运行原理
- » 架构设计才是当下程序员的核心竞争力
- » AI Coding 完整方法论: 从让模型写代码, 到建立受约束的工程协作系统
- » AI Coding 时代, 学习并理解设计模式将变得愈发重要
research
- » Scrapling 深度调研:它为什么让爬虫从“东拼西凑”变成一套完整框架
- » 美团 PosterCraft 海报生成方案调研:统一式高审美海报生成框架
- » Web 原生 2D / 3D 图形引擎概览:Canvas、Phaser、three.js 与 three.js 生态
- » Blender 入门学习:从下载、建模到 Python 自动化的系统入门
- » Canvas 2D 技术深度调研:规范、API 全景、开源生态与未来方向
quant-trading
- » 基金交易导论:从看懂基金是什么,到看懂名字、规则与选择
- » 如何从量价里识别机构吸筹与派发:盘面图谱、可量化因子与交易员看板
- » OpenTrade 自动化投研实战:它如何把行情、技术指标与 Agent 研究工作流接到一起
- » (深度) 量化交易导论:从市场结构、策略研究到回测、风控与实盘工程
RecommenderSystem
Top ⇈web
- » Web 原生 2D / 3D 图形引擎概览:Canvas、Phaser、three.js 与 three.js 生态
- » 深入拆解 World of ClaudeCraft —— 由 Claude Fable 5 自主实现的完整魔兽世界游戏
graphics
Top ⇈投资
Top ⇈Misc
- » 学习布隆过滤器