「全感交互系统」共找到 3794 篇相关文章
你的论文有novelty吗?复旦搞了个顶会论文查新系统
复旦大学NLP团队与WisPaper合作研发OpenNovelty系统,用于论文新颖性评估。系统基于大语言模型,强调证据与可验证性,有四步分析流程,已分析1360篇投稿并公开报告,有辅助作用但有局限。
0%完成率!Claude、GPT、Gemini 全灭,SWE-Bench作者新作把AI圈干沉默了
SWE - Bench创建者推出新benchmark ProgramBench,测试AI从零构建软件系统能力。结果一线模型完成率0%,暴露AI擅长局部代码生成,缺全局系统规划能力,引发对其评估方式的讨论。
推荐系统进入“大模型时刻”:昇腾NPU如何支撑千亿级生成式推荐落地
文章基于华为郭威在2025 AICon大会演讲,复盘华为推荐技术探索。介绍FuXi-α、β模型设计,解决训练和推理难题;分享“多阶段统一建模”进展,提出Performance Law;还介绍了训推系统优化及未来聚焦“强算力”“强模型”融合。
AIGC全生命周期业务风控白皮书,从备案到运营的合规与安全实践
2025年《人工智能安全治理框架》2.0版发布,凸显AI安全重要性。数美科技发布《AIGC全生命周期业务风控白皮书》,构建全生命周期业务风控体系,涵盖备案攻略、评测要点、账号与内容风控等,还有实战案例。
ACL 2025 | 让小说角色 「活」起来!复旦BookWorld打造沉浸式小说世界模拟系统
复旦大学团队主导的BookWorld系统,是ACL 2025论文成果。它能从小说提取数据构建AI世界,让角色AI互动创作故事。系统有自主和干预模式,实验表现出色,未来可成互动娱乐平台。
Claude推出多智能体代码审查系统:Anthropic内部同款,接管PR深度抓Bug
Anthropic为Claude Code引入代码审查系统,复刻内部审查机制,调度多智能体揪深层Bug。该功能面向团队和企业版用户预览,审查更彻底,虽成本高但有效提升审查质量,还能自定义规则、管控成本。
跨越智能体落地的可信鸿沟:玄甲(AgentWard)全链路防御操作系统正式发布
大模型向自主智能体演进,安全威胁全域化。当前安全方案有局限,制约产业落地。清华大学团队推出玄甲全链路安全防御操作系统,构建五层纵深防御体系,已落地应用,降低安全事件发生率,筑牢安全防线。
AI安全上,开源仍胜闭源,Meta、UCB防御LLM提示词注入攻击
Meta和UCB开源安全大语言模型Meta - SecAlign - 70B,其对提示词注入攻击鲁棒性超闭源方案,还具更好的agentic ability。介绍了提示词注入攻击背景、防御方法,该模型打破闭源垄断,开源代码助力安全AI建设。
大模型七连发,外国人馋透了!阿里云栖大会全栈升级够狠
阿里在2025云栖大会全栈升级,发布七款通义新模型,从基础大模型到各专项领域全覆盖。旗舰模型Qwen3 - Max性能超GPT - 5等,新架构Qwen3 - Next实现效率突破,多模型开源且表现出色。
生成率从8%到60%:快手智能测试用例生成系统的四阶进化
快手研发效能团队构建智能用例生成系统,实现从手动编写到审核校验的模式转变。该系统历经四阶架构演进,将用例生成率从 8% 提升至 60% 以上,成为公司测试人员日常使用的标准化生产力工具。