2026.07.17
长上下文开放式睡眠报告生成:难点与训练方案
从数周到数月的睡眠记录中找准事实、解释可能原因,并给出安全可执行的个性化建议:长上下文开放式睡眠报告生成的难点、推理图教师数据、weighted DPOP 与细粒度 GRPO 训练方案。
Research
记录SIL在大模型、智能体、多模态、AI Infra 与Trustworthy AI方向的研究进展。
博客
长期记忆如何成为可更新的判断系统
Agent 长期记忆的核心并非检索聊天历史,而是构建动态的状态基础设施。本文提出分层记忆与上下文编译架构,将离散信号转化为可追溯、可修正的用户状态,并通过数据血缘与反馈闭环,实现随时间持续演进的精准决策。
论文
从数周到数月的睡眠记录中找准事实、解释可能原因,并给出安全可执行的个性化建议:长上下文开放式睡眠报告生成的难点、推理图教师数据、weighted DPOP 与细粒度 GRPO 训练方案。