「内容信号机制」共找到 1807 篇相关文章
解锁任意步数文生图,港大&Adobe全新Self-E框架学会自我评估
香港大学与Adobe Research联合发布Self - E框架,可从零训练实现任意步数文生图。它改变训练范式,用两条互补训练信号,在GenEval基准表现出色,让文生图训练更灵活且具扩展性。
10级漏洞刚补完,React又炸了!现代Web“默认底座”因一行代码缺失引发全球地震,开发者经历最黑暗一周
12月12日,React官方确认RSC里有两处新漏洞。此前React2Shell漏洞危害大,超两百万台服务器有风险,开发者服务器被入侵挖矿。该漏洞因核心通信机制缺一行校验代码,Vercel等平台受波及。
原来Scaling Law还能被优化?Meta这招省token又提效
2017年《Attention Is All You Need》提出的Transformer是主流语言模型基础范式。Meta新论文提出旋转不变型三线性注意力机制,证明其表现能改变Scaling Law系数,还证实2 - simplicial Transformer在有限token预算下更优。
万字长文图解Qwen2.5-VL实现细节
文章作者今年年初写好,为防盗版一直内部分享,时隔半年因Qwen2.5-VL已渗入MLLM开发各场景而公开。从源码抽图例助理解,涵盖window attention等内容,排版全文见指定链接。
10B超越Gemini-2.5-Pro!阶跃星辰端侧多模态天花板开源
阶跃星辰多模态智能团队开源STEP3-VL-10B多模态模型,仅100亿参数却性能惊人。它采用了独特的架构、训练策略与推理机制,在多任务上表现出色,为小模型发展提供新思路。
从HITL(Human In The Loop) 实践出发看Agent与设计模式的对跖点
本文围绕在 ReactAgent 中引入并实践 HITL 机制展开,介绍实现方案与代码设计。分析无通用人机协同时的问题,阐述 HITL 核心要点、实现效果与细节,还探讨 Agent 演进与工程设计模式的关联。
首款推理具身模型,谷歌DeepMind造!自主理解/规划/执行复杂任务,打破一机一训,还能互相0样本迁移技能
谷歌DeepMind发布新一代通用机器人基座模型Gemini Robotics 1.5系列,由GR 1.5和GR - ER 1.5组成,结合视觉、语言与动作,实现“规划 + 执行”闭环,还提出Motion Transfer机制,能跨机器人迁移技能。
DeepSeek V4 借实习生获奖论文“起飞”?梁文峰剑指上下文:处理速度提 10 倍、要“完美”准确率
ACL公布2025年获奖论文,中国作者比例超51%。DeepSeek梁文锋通讯、实习生袁境阳一作的论文获Best Paper奖。其提出NSA机制,实验显示性能优、准确率高、速度提升显著,成果或用于DeepSeek V4。
这个开源项目把视频处理与投稿接成一条流水线
Y2A-Auto是面向YouTube、AcFun和bilibili的自动化处理工具,将下载、识别、翻译等操作集成到Web管理后台。用户可手动或自动处理,支持多平台投稿,有多种功能和灵活配置,适合持续处理授权内容的用户。
在失败中进化?UIUC联合斯坦福、AMD实现智能体「从错误中成长」
伊利诺伊大学厄巴纳 - 香槟分校等团队发布论文,剖析LLM智能体失败机制,提出可自我修复的创新框架AgentDebug。研究指出智能体常见失败类型,构建错误分析体系、数据集,实验显示该框架效果显著,为AI可靠性提供方案。