AstrAI

History

ViperEkura 133a9de98f feat: _generate_streaming 支持 batch 模式 - _Result.append 存储 (idx, token) 元组，pop_all 返回对应列表 - 单 prompt: Generator[str]（向后兼容） - 多 prompt: Generator[Tuple[int, str]]，token 交错到达，调用方自行分流 - 不使用 dispatch 线程 / Queue，避免同步开销和内存积压		2026-05-10 17:42:20 +08:00
..
__init__.py	fix: 修复 CLI 参数缺失/重复、device_ids 越界、generate 参数名不一致、scheduler 时序、非流式截断等 bug	2026-05-09 14:36:42 +08:00
cache.py	feat: 推理引擎前缀缓存（KV cache 复用）	2026-05-09 23:53:57 +08:00
engine.py	feat: _generate_streaming 支持 batch 模式	2026-05-10 17:42:20 +08:00
sampling.py	refactor: 分页 KV cache 替换固定 slot，删除 PrefixCache 及相关死代码	2026-05-08 20:44:05 +08:00
scheduler.py	perf: 消除非流式推理 CPU 空转并减少 decode GPU 张量冗余分配	2026-05-10 15:32:11 +08:00
server.py	feat: GRPO CLI 接入 + on-policy，OpenAI API top_k 参数化，补充训练参数表	2026-05-09 12:22:33 +08:00