「AI分析」共找到 10198 篇相关文章
一图胜千言被实现了!DeepSeek-OCR用图片压缩文本,10倍压缩率
DeepSeek开源DeepSeek - OCR,用图片压缩文本达10倍压缩率且几乎不丢信息。它解决了以往视觉编码器的问题,架构清晰,数据丰富,性能测试亮眼,为解决大模型‘记性差’问题提供新思路。
多模型共享 GPU 内存,Berkeley 开源新工具
GPU内存利用率低是大模型部署痛点,伯克利Sky Computing Lab团队开源kvcached工具,通过虚拟化技术让多模型共享显存。它引入虚拟内存概念,按需分配,测试显示能提升效率,安装简单、兼容性好。
骂得越狠,ChatGPT回答越准!PSU研究实锤,狂飙84%准确率
宾夕法尼亚州立大学团队研究发现,对ChatGPT越粗鲁,它回答越准。实验用含50个基础问题的数据集,改写为五种礼貌等级共250个prompt测试,非常粗鲁时准确率达84.8%,非常礼貌为80.8%。
曾拒15亿美金,超级天才Andrew Tulloch重返Meta,Thinking Machines Lab痛失联创
扎克伯格今年挖角动作不断,此前向Thinking Machines Lab开高价被拒,主角Andrew Tulloch曾拒绝超10亿美元报价。如今他离职将重返Meta,其加入能否为Meta超级智能注入新动力,值得期待。
刚刚,全球首个GB300巨兽救场!一年烧光70亿,OpenAI内斗GPU惨烈
为争夺有限GPU,OpenAI内部争斗激烈,2024年算力投入70亿美元仍不够。微软发布全球首台GB300超算专供OpenAI,可让万亿LLM数天训完。OpenAI建立资源分配机制应对挑战。
Agent下半场!比Prompt更重要的是「上下文工程」,Anthropic首次系统阐述
Anthropic发文章阐述上下文工程,指出构建语言模型重点正从提示工程转向上下文工程,探讨了其与提示工程区别、重要性,给出实践指导原则、新趋势及应对长时程任务策略。
ICCV 25 Highlight | 扩散过程「早预警」实现6x加速,AIGC生图的高效后门防御
随着AIGC图像生成技术流行,后门攻击威胁开源社区,传统防御技术难适配。本文作者来自多所高校,提出输入级防御框架NaviT2I,基于神经元激活差异检测样本,加速检测,性能优。
从BM25到Multi-Vector:6种Embedding演进路线
文章介绍从BM25到Multi - Vector的6种Embedding演进路线,涵盖Sparse、Dense等类型,分析其痛点、效果、案例及选型建议,还给出不同场景的方案选择和步骤。
具身智能能力狂飙,安全却严重滞后?首个安全可信EAI框架与路线图出炉!
具身人工智能发展迅速,但能力与安全出现“脱钩”。上海人工智能实验室和华东师范大学团队撰写论文,为“安全可信具身智能”建立理论框架与蓝图,提出成熟度模型、分析框架等。
17000 tokens的GPT-5系统提示词被意外泄露,以及八点总结~
OpenAI GPT - 5的system prompt被曝光在github,约17803 Tokens、78960 Characters。文章对提示词做八点分析总结,如互动风格、写作要求、工具使用等,还给出工具部分重点。