每日技术进展追踪。
AI 每日资讯 — 2026-07-05
AI 每日资讯 — 2026-07-05 🔥 HuggingFace 每日论文 1. Program-as-Weights: A Programming Paradigm for Fuzzy Functions Wentao Zhang, Liliana Hotsko, Woojeong Kim 本文提出“模糊函数编程”范式,旨在解决日志告警、JSON修复、意图排序等难以用精确规则描述的编程任务,避免依赖云端大模型API带来的隐私、可复现性与成本问题。作者设计“程序即权重”(Program-as-Weights, PAW)方法:利用在自建1000万样本FuzzyBench数据集上训练的4B参数编译器,为冻结的轻量级0.6B Qwen3解释器生成参数高效的适配器。实验表明,PAW在MacBook M3上以30 token/s速度运行,推理内存仅为Qwen3-32B直接提示的1/50,性能却与之相当。该范式将基础模型从逐输入求解器转变为一次性函数构建工具,产出可离线、低成本复用的紧凑神经程序。 PDF · arXiv · 代码 · 项目 | ❤️ 68 2. EvoPolicyGym: Evaluating Autonomous Policy Evolution in Interactive Environments Zhilin Wang, Han Song, Runzhe Zhan 本文提出EvoPolicyGym,旨在评估自主智能体在交互环境中对可执行策略的自主演化能力。针对现有评测方法将策略优化过程简化为单一终局分数或混同于通用软件工程进展的问题,作者构建了“自主策略演化”这一受控评测范式:智能体需在固定交互预算下反复编辑并提升策略。EvoPolicyGym基于轻量级强化学习环境构建,支持16个任务的迭代策略优化评测。实验表明,GPT-5.5在整体排名与各任务前两名表现上均最优;进一步的轨迹级分析揭示,高效策略演化依赖于机制发现能力与受限反馈下的参数化调优,而非单纯任务胜率。 PDF · arXiv | ❤️ 41 3. WorldDirector: Building Controllable World Simulators with Persistent Dynamic Memory Hanlin Wang, Hao Ouyang, Qiuyu Wang...