# Codex 源码阅读与分析(一):客户端主流程——从用户输入到事件循环
Codex 源码阅读与分析(一):从用户输入到事件循环本篇技术博客主要解读 Codex 命令行版本的运行机制。我会沿着一次 codex exec 任务的主流程,从用户输入开始,一直看到事件循环结束以及最终结果输出。 Codex 面向用户的输入方式大体可以分为两类: 通过 code...
Codex 源码阅读与分析(一):从用户输入到事件循环本篇技术博客主要解读 Codex 命令行版本的运行机制。我会沿着一次 codex exec 任务的主流程,从用户输入开始,一直看到事件循环结束以及最终结果输出。 Codex 面向用户的输入方式大体可以分为两类: 通过 code...
多臂老虎机 (multiarms Bandits) 问题形式 你要重复地在k个选项或动作中进行选择 每次做出选择之后,你都会得到一定数值的收益,收益由你选择的动作决定的平稳概率分布产生。你的 目标是在某一段时间内最大化总收益的期望。 \(\epsilon - greedy方法\)...
这个论文做的是,从一篇有开源代码库的论文开始,复现论文项目,然后再将这个论文的指标优化高。 没开源 AgentResource 因为现在的论文严重依赖于大规模数据集,预先训练的权重和专门的ckpt。 所以这里做了一个外部资源获取模块。 这个模块由两个阶段构成 符号化资源获取 ze...
第一章 第一次阅读,只能发现扩展实例有价值 扩展实例: 井字棋 问题: 井字棋由两名玩家轮流在 3×3 棋盘上落子,一方使用 X,另一方使用 O。率先在行、列或对角线上连成三个棋子者获胜;若棋盘填满仍无人获胜,则为平局。 由于完美玩家永远不会输,我们考虑与一个偶尔犯错的对手对弈,...
AI scientist-v2 AI Scientist v1 和 v2 的区别 More General Idea Generation 他们没有使用代码库增量开发,论文里面说的是采用了更高抽象级别开始的过程 这里需要查看一下,对比AI Scientistv1 和v2 在实验代...
Co Scientist 这个系统构造了一个带有 self-play 性质的自我改进闭环:不断生成假设、审查假设、让假设彼此竞争、再从竞争结果中继续演化出更好的假设和研究提案。论文里把这种过程概括成一种更贴近科研流程的 generate -> debate -> ra...
AI scientist 对于现在的 AI research,主要有两种方式: 一种是纯粹的 workflow。 另外一种是 agent 协作模式。多个 agent 分别执行不同 role,来实现半自动甚至全自动的协作模式。 另外还有 Agent 虚拟实验室。 根据 survey...
本文知识点来源于FAISS Johnson-Lindenstrauss引理: 如果有一组高维空间中的点,可以把它们随机映射到一个较低维空间中,并且点与点之间的距离几乎保持不变。 Faiss 优化的是“在给定距离度量下,尽量快、尽量省内存地找近邻”;但最终业务效果还取决于 embe...