「人机交互范式」共找到 1690 篇相关文章
刚刚,DeepSeek又探索新架构了,开源OCR 2
DeepSeek更新DeepSeek - OCR 2,引入DeepEncoder V2架构,实现视觉编码范式转变。模型和技术报告齐开源,在多项测试中表现出色,降低重复率,为全模态编码提供路径,但在报纸类文档识别有不足。
可攻可防,越狱成功率近90%!六大主流模型全中招 | EMNLP'25
研究人员聚焦大型语言模型(LLMs)安全漏洞,提出全新越狱攻击范式SCP与防御策略POSD。SCP基于DTD机制,在6个主流模型上平均攻击成功率达87.23%;POSD能有效抵御攻击,还提升模型泛化能力。
100 页 Agentic RL 综述!牛津、新国立、AI Lab 等联合定义 LLM 下半场
2025 年大语言模型热潮持续,但当前主流训练范式显瓶颈。牛津、新国立等 16 家机构学者发布 100 页 Agentic RL 综述,明确定义从‘会说’到‘会做’进化路径,剖析理论、结构与实践,展望未来挑战。
2025世界人工智能大会特别推荐!10国20多位艺术家邀你开启与AI的深度对话
2025世界人工智能大会特别推荐的‘提视造境:国际人工智能艺术文献展’,由上海民生现代美术馆主办,汇集10国20多位艺术家31件/组作品。分五大板块,探讨AI艺术多议题,是人机共演的艺术实验。
Google重磅上线通用世界模型Genie 3 - 此即未来。
Google发布世界模型Genie 3,它与Sora等AI视频产品本质不同,像可实时演算的模拟器。Genie 3解决了前辈无法调和的矛盾,在交互、时长、控制等方面有突破,虽有局限,但打开新世界大门。
ACL 2026 综述:从事后解释到内生解释,大模型内生可解释性的前沿进展
大语言模型强大但解释性成问题,过去多事后解释,现更多研究者转向内生可解释性。ACL 2026 接收的综述论文梳理相关代表方法,总结为五类核心设计范式,指出该方向面临挑战但趋势清晰。
阿里SkillClaw:让 Agent 技能在真实使用中集体进化
当前LLM Agent依赖可复用技能完成任务,但技能部署后静态不变,改进仅停留在当前会话。阿里SkillClaw提出中心化进化架构,将多用户交互作为技能改进信号,通过Agentic Evolver更新技能,经夜间验证后部署。
首个真正“能用”的LLM游戏Agent诞生!可实时高频决策,思维链还全程可见
超参数科技推出全新游戏智能体COTA,它由大模型原生驱动,操作似职业选手,决策如教练,推理链路清晰。在自研FPS游戏Demo中表现出色,还打破‘不可能三角’,有望重构游戏人机关系。
AI「看见」实验,哈佛颠覆性突破!一副AR眼镜,新手秒变资深专家
哈佛大学刘嘉教授团队研发人机共融智能系统,含APEX和Agentic Lab。前者用于微纳加工,后者用于生命实验。实测显示,它们能实时纠错、自动记录分析、实现技能迁移,让AI与人类在科研制造中深度融合。
OpenAI 迈出关键一步:LLM 黑盒不再是盲盒
OpenAI开源新研究成果,提出全新范式,训练权重稀疏的Transformer模型以提取人类可理解的电路。该方法分三步,关键结果显示稀疏模型优势多,但也存在训练成本高、规模有限等局限,还给出两条未来路线。