「内容信号机制」共找到 1807 篇相关文章
CVPR 2025 Highlight | 提升自回归模型样例学习能力,Few-shot图像编辑新范式开源
当前图像编辑模型在处理新概念时泛化能力不足,为解决此难题,Meta等研究者提出自回归模型InstaManip,创新性提出分组自注意力机制和关系正则化策略,在few - shot图像编辑任务上取得优异效果。
彻底说清 Human-in-the-Loop:企业级 Agent 系统的关键挑战与LangGraph解法【上】
文章围绕企业级Agent系统中Human-in-the-Loop(HITL)展开,介绍其必要性、常见模式,以LangGraph为框架解读关键挑战与实践,涵盖核心机制、原理解析,还阐述HITL下工具调用的两种管控模式。
西湖大学张驰团队:不重训,也能让视频生成更长更稳丨CVPR 2026
AI 视频生成目前存在长视频稳定性问题,西湖大学张驰团队提出 《Free-Lunch Long Video Generation via Layer-Adaptive O.O.D Correction》。研究表明 FreeLOC 方法能提升长视频生成质量,且具跨模型通用性,还揭示了问题机制,降低算力成本。
一篇Loop+Harness的自进化Agent最新综述
本文分享清华关于经验时代,已部署的 Agent 如何将交互轨迹转化为持久能力,从自我进化到元进化的论文。介绍了 Harness、技能、记忆、环境等方面,还提及 RL 与持续学习、元进化智能体等内容。
模力工场 035 周 AI 应用周榜:AI 正在走出通用叙事,进入细分人群与真实场景
模力工场 035 周 AI 应用周榜揭晓,前十应用展示 AI 向各领域渗透,正从通用大模型转向垂直细分场景。本周上榜应用呈现多趋势,如情绪陪伴类细分、内容生产类下沉、营销商业化具象化等。
OpenClaw 之后我开始思考:Agent 最重要的两种能力是什么?
OpenClaw爆火后,作者思考AI Agent除执行能力外,还需审美判断力。介绍Seede AI,它与文生图工具不同,能将内容转化为可编辑设计文件,操作简单,效果惊艳,有独特技术逻辑,未来有风格预设等发展方向。
不改模型也能提升推理性能?ICLR投稿提出测试时扩展新范式OTV
ICLR 2026投稿论文提出单token验证(OTV),是测试时扩展新机制,让模型能边推理边判断正误。它基于并行思考思路,借助轻量内部验证器分析推理过程,实验显示其性能优于主流方法。
ChatGPT新功能Pulse,GPT-5主动给你推消息,大家玩得停不下来
本周五凌晨,OpenAI 向 Pro 订阅用户开放 ChatGPT 新功能「Pulse」预览版。它基于智能体,会根据用户信息提供个性化更新,还能异步搜索。用户可管理研究内容、提搜索请求及反馈,未来或推广告、建社交网络。
支持中文!NotebookLM自动生成播客
Google宣布NotebookLM语言摘要功能支持50多种语言,包括中文,可将上传文档转成播客对话形式。以一篇AI进化论文为例展示效果,其音频和内容质量不错,学习输入立体,还能助力AI播客创作。
谷歌把电脑操作能力塞进Gemini 3.5 Flash!自己看屏幕狂点70轮
谷歌将电脑操作能力Computer Use内置进Gemini 3.5 Flash,该AI能通过看屏幕操作电脑,可执行点击、打字等动作。其覆盖网页、桌面软件和移动端,还加入安全约束机制,在基准测试中表现良好。