个性化与用户状态
把显式与隐式反馈转成可更新的信念、偏好和长期记忆。
FJAI Research Studio / Independent AI Research
研究会理解、会适应、会进化的大模型。
聚焦个性化大模型、用户反馈建模、Agent 系统与可信评测。从研究问题,到数据、方法、实验和可运行原型。
Research directions
不是按文件类型堆内容,而是沿着大模型如何理解用户、如何采取行动、如何被可靠验证来组织研究。
把显式与隐式反馈转成可更新的信念、偏好和长期记忆。
围绕规划、工具使用、长期任务和代码生成构建可运行系统。
用 simulator、benchmark、verifier 和延迟反馈检验真实适应能力。
Selected work
Feedback is an observation, not a label。用 belief state 连接反馈、记忆、控制器与生成模型。
在意图完全形成之前识别前缀信号,并明确泄漏边界、metrics 与样本诊断。
以可验证的视觉代码 episode 支撑 training-free、self-evolving 的代码记忆。
把部署前的反事实偏好原则与部署后的延迟反馈归因接成同一条学习链。
Signal desk
论文与行业信号服务于研究决策;它们是输入层,不再和研究项目混在同一层级。
AI Paper Daily / 2026-07-21
Program Synthesis for Simulation-Based Inference: Joint Model Selection and Parameter Estimation;FlashRT: Agent Harness for Guiding Agents to Deploy Real-Time Multimodal Applications;SEE: Structure-aware Exploring \& Exploiting for Long-horizon GUI Agent Trajectory Synthesis
阅读最新论文日报AI × Finance / 2026-07-21 09:00 BJT
未使用 Tavily · AI 全量资讯池 · 金融全量资讯池。保留原始来源和上下文,用于发现值得进入研究队列的变化。
阅读最新信号简报