「视觉基础模型」共找到 8202 篇相关文章

产品应用8

Jina Reranker v3: 全新“列式”重排器,0.6B参数刷新文档检索SOTA

Jina AI推出第三代重排器Jina Reranker v3,在多语言检索基准上刷新SOTA。它参数仅6亿,有“last but not late”交互机制,能一次性处理查询和文档。还提供动态量化格式,方便不同硬件部署。

Jina AI
开源动态7

开源AI黑客Agent,自动检查代码漏洞并修复,离AI编程的全流程自动化不远了。

开源的AI Agent能自动查代码漏洞并修复,是集自动化渗透等功能于一体的安全测试平台。Strix作为开源AI安全测试工具,无需手动渗透测试,支持多类型安全评估,功能强大。

开源AI项目落地
算法论文8

从「会说」迈向「会做」,LLM下半场:Agentic强化学习范式综述

过去LLM训练多依赖PBRFT范式,但局限明显。2025年初起,Agentic RL新范式受关注。此综述论文梳理该方向,覆盖500+研究,构建理论框架,讨论未来挑战,助LLM从「会说」迈向「会做」。

机器之心
新闻资讯8

算力产业发展重心,正在改变

2025中国算力大会落幕,我国算力产业重心从规模扩张转向应用价值。数据基础设施筑牢底座,智慧运营平台奠定普惠基础,‘应用为王’成趋势,各方行动降低用算门槛推动AI落地。

芯师爷
算法论文8

从需求分析到代码生成,LLM都能干点啥?一文读懂291个软工Benchmark!

大语言模型重塑软件工程各环节,但缺乏评估其在该领域表现的系统工具。浙江大学等机构团队首次对291个软件工程Benchmark系统综述,分析现状、痛点并给出改进方向。

新智元
算法论文7

InfiniteTalk:音频驱动的从口型到全身动作同步方法

近年来视频AIGC推动音频驱动人体动画变革,但传统视频配音局限口部。中国科学院大学提出稀疏帧视频配音范式,推出InfiniteTalk生成器,结合多种技术实现全身动作与音频同步,实验表现突出。

带你学AI
新闻资讯7

7年了,OpenAI官方给出五代GPT对比,网友却怀念起「狂野」初代

OpenAI总裁分享给定相同提示下,GPT-1到GPT-5输出的差异,对比显示GPT系列在知识储备等方面不断进步,但网友看法不一,不少人怀念初代模型的‘狂野’。

机器之心
新闻资讯8

OpenAI联合创始人Greg Brockman:对话黄仁勋、预言GPT-6、我们正处在一个算法瓶颈回归的时代

OpenAI联合创始人Greg Brockman在AI.Engineer对话分享,还与黄仁勋连线。他回顾经历,从数学梦到编程,在Stripe、OpenAI发展。谈及多方面看法,如创造动机、工程研究关系、AI未来,指出算法瓶颈重回关键。

AI科技大本营
新闻资讯8

2025 WAIC落幕,深谋科技异军突起,以技术与落地破局具身智能赛道

2025 WAIC落幕,深谋科技作为精英合作伙伴首次亮相,未随波逐流,而是切入脑控、动态视觉伺服和康养场景三大底层能力领域,开拓创新赛道。其产品已商用部署,吸引众多媒体关注。

AI科技评论
算法论文8

别等GPT-5了!普林斯顿万字综述揭秘:我们要做自进化Agents!

普林斯顿大学联合多顶尖机构发表“自进化智能体”综述,描绘AI从静态工具演变成自我学习迭代智能体的过程,拆解其进化核心维度,介绍触发进化机制的时机、修炼方式及应用方向。

探索AGI