「多阶段推理系统」共找到 4073 篇相关文章
Linear-MoE:线性注意力遇上混合专家的开源实践
近年来,线性序列建模和混合专家(MoE)研究进步大,但两者结合研究少,相关开源实现缺失。上海人工智能实验室团队的 Linear - MoE 首次实现两者高效结合并开源技术框架,实验验证其有诸多优势。
间接提示词注入攻击(IPIA)原理、方法及案例
本文介绍间接提示词注入攻击(IPIA),它于2023年5月被认定,通过恶意三方数据攻击,适应性广。文中阐述攻击过程、方法,还以Mavy GPT日历泄露为例说明,指出虽有防护但攻击仍会持续。
一个LoRA实现GPT-4o级图像编辑!浙大哈佛新模型冲上Hugging Face榜二
随着Gemini、GPT - 4o等把基于文本的图像编辑推向高峰,提高性能常需大量数据和大参数量模型。而浙大哈佛团队提出ICEdit,用少量数据和参数实现高质量图像编辑,媲美甚至超越商业大模型。
英伟达CEO黄仁勋:错失中国AI市场,是美国巨大损失
在“Knowledge 2025”大会上,英伟达CEO黄仁勋接受CNBC专访,称中国AI市场未来2 - 3年达500亿美元,错过是美国巨大损失。还提到AI影响、与ServiceNow合作成果等,英伟达股价有波动,财报受关注。
从Chat、Code到Discovery,AI开始学着做科学家
本文报道AI发展进入全新阶段,任务从聊天、写代码拓展到自主科学发现,介绍PhAI Labs推出的DFM系统,分享架构设计与落地案例,分析行业痛点与解决路径。
人类造的最后一个AI!上交清华字节等发布递归自进化路线图
本文解读了上海交大、清华、字节跳动等机构联合发布的递归自我改进AI综述,提出五级AI自主改进框架,分析RSI发展现状、应用场景与核心挑战,指出RSI有望突破AI研发的人力成本瓶颈。
前沿模型被曝年度重大漏洞:加密思维链可被轻松提取,GPT,Claude,Gemini 无一幸免
一篇 116 页论文揭示前沿模型思维链重大安全漏洞,Anthropic、OpenAI、Google 的 API 因架构问题,模型隐藏推理过程可通过两次 API 调用被大规模提取,还会带来多种安全威胁。
独家 | 破壳机器人完成亿美元级融资:「操作」才是具身落地的最大挑战
AI科技评论获悉,通用具身智能公司破壳机器人完成亿美元级Pre - A轮融资。其聚焦机器人操作能力,采用“WAM×RL×DATA”飞轮体系实现快速迭代,还推进软硬件联合研发探索具身落地。
CUDA 20年护城河一个周末崩了 !Claude独自跑通AMD新GPU
一个周末,Claude直接把自家最前沿模型跑在全新AMD MI355X机架,人类工程师没改一行代码。AMD还给AI开发调GPU的工具,ROCm.AI可让Agent自己部署操作。Agent补生态积累短板,对CUDA生态形成降维打击。
微小目标漏检只是因为小?从数据到代码:一文读懂 AI-TOD-R 与 DCFL 如何解决旋转微小目标检测
此文指出旋转微小目标检测存在数据空白、学习偏差、特征易丢失等难题,提出AI-TOD-R数据集、全检测范式基准和DCFL框架。DCFL可缓解偏差,在8个数据集达SOTA,还给出实战代码案例。