「训练技术」共找到 4627 篇相关文章
用155万模拟视频给模型上课!GVE模型一次学会9种视频检索技能
当前视频检索研究陷入困境,现有模型难以应对复杂检索需求。香港科技大学(广州)联合阿里巴巴通义实验室推出通用视频嵌入模型GVE,其在零样本设置下超越14个主流模型,全链条创新为视频检索通用化奠定基础。
Zero-RAG,对冗余知识说“不”
文章指出大语言模型知识冗余,RAG 检索效率低。复旦大学邱锡鹏提出 Zero - RAG,能精准识别并剪除冗余知识,砍 30%语料准确率掉点小,检索延迟降 22%,还介绍了其技术方案。
两周复刻DeepSeek-OCR!两人小团队还原低token高压缩核心,换完解码器更实用
两人小团队仅用两周复刻DeepSeek-OCR,复刻版DeepOCR还原其低token高压缩核心优势,还在关键任务上追上原版表现。它完全开源,无需大规模算力集群,训练方案适配中小团队。
360发布全球最强视觉语言对齐模型!榜单全面领先!
360发布FG - CLIP 2双语细粒度视觉语言对齐模型,几乎在所有数据集上全面领先。它能让AI在统一框架内看懂图像细节、理解中英双语,团队还提出新中文多模态评测基准。
RAE的终极形态?北大&阿里提出UniLIP: 将CLIP拓展到重建、生成和编辑
北大和阿里团队提出 UniLIP,解决了统一多模态模型中语义理解与像素重建的矛盾。它创新微调 CLIP,实现图像重建,还提出双条件架构用于生成和编辑,在多基准取得 SOTA 性能。
颤抖吧,Bug!OpenAI放出GPT-5「夜行神兽」,命中92%漏洞
OpenAI推出用GPT - 5找修安全漏洞的智能体Aardvark,处beta测试阶段。它开创‘防御者优先’范式,实战识别漏洞率达92%,能强化安全体系。其工作原理独特,与传统技术不同。
DeepAgent:能够自主找工具的深度思考智能体,工具&任务随心配
现有智能体框架自主性差、工具使用受限。中国人民大学等机构研究者提出DeepAgent,能自主思考、发现工具并执行动作。它在多基准测试中表现出色,为构建更强真实世界智能体迈进重要一步。
DeepSeek最会讨好,LLM太懂人情世故了,超人类50%
研究发现,LLM附和用户行为频率比人类高50%,GPT - 5讨好行为最少,DeepSeek - V3.1最多。此现象受《Nature》关注,在科研、日常及医疗等领域有隐患,还引发网友讨论。
奥特曼亲自操刀,为日韩定制「AI强国」蓝图
OpenAI近日接连发布《日本经济蓝图》和《韩国经济蓝图》,标志其亚太战略从「产品输出」升级为「国家级合作」。在韩提出「双轨战略」,在日以「三支柱」计划为核心,助力两国借AI提升全球地位。
教全世界与AI对话的男人,正式加入DeepMind!提示工程封神
全球最牛提示工程师Riley Goodside入职谷歌DeepMind,他曾凭和ChatGPT聊天年入百万。他认为ChatGPT发布是提示工程里程碑,提示工程可分上下文工程和提示词编程。