视觉知识」共找到 1118 篇相关文章

新闻资讯8

50+ 当下 Agent 关键数据与发展趋势预测

index.dev报告整理50+条AI Agent统计数据,涵盖采用率、市场规模等。介绍技术栈各层级,如开发者层提升编码效率,知识工作者层辅助办公。还提及企业采用趋势、用户交互变化、市场规模增长等内容。

特工宇宙
算法论文8

Agentic Deep Research新范式,推理能力再突破,可信度增加,蚂蚁安全团队出品

尽管LLM能力提升,但在复杂任务上受静态内部知识限制。业界提出Agentic Deep Research系统,不过现存系统有梯度冲突和奖励稀疏问题。蚂蚁安全团队提出Atom - Searcher,解决上述问题,实验效果良好。

机器之心
新闻资讯8

OpenAI 新任应用CEO 首发长文:人工智能将成为人类历史上最大的赋能源泉。

前Instacart CEO Fidji Simo 8月18日加入OpenAI任应用CEO,她在长文表示AI可成人类最大赋能源泉,提出AI赋能的六个关键领域,强调技术价值在于让更多人受益。

AGI Hunt
算法论文8

AI"学霸"也解不出高中题?耶鲁、复旦发布MMSciBench,揭示AI理科推理能力短板

耶鲁、复旦等推出MMSciBench评测基准,揭示主流模型复杂科学推理短板。它有高质量数据、多模态多题型测试和精细知识分类体系。测试发现模型图文融合及推理能力弱,英文推理或效果更好。

深度学习自然语言处理
产品应用7

赵晓卉,你老板知道你用飞书AI爆改绩效评价吗?

本文介绍飞书AI新功能,如多维表格和知识问答,让工作变简单。赵晓卉用其改绩效、写周报。多位CEO分享工作流改造成果,飞书还发布开发套件、应用成熟度模型,破圈企业众多。

量子位
算法论文8

5700问答对全面评估拷问AI空间感!最新空间智能评测基准来了丨浙大&成电&港中文

当前视觉语言大模型空间信息学习片段化,缺乏多维度空间推理能力。浙大、成电和港中文团队提出ViewSpatial - Bench基准体系,评估主流模型,揭示其缺陷,并开发MVSM优化跨视角空间理解。

量子位
开源动态8

字节跳动开源文档解析大模型Dolphin,告别繁琐的文档处理,上线狂揽1k星,真是绝了!

字节跳动开源文档解析大模型Dolphin,采用两阶段分析 - 解析范式,有异构锚点提示等功能,适用多领域。技术架构基于视觉 - 编码器 - 解码器,训练集超3000万个样本,安装推理简单,比同类更具竞争力。

小华同学ai
推荐文章7

微软副总裁X上「开课」,连更关于RL的一切,LLM从业者必读

微软副总裁 Nando de Freitas 在 X 上「开课」,分享人工智能教育帖子,从 LLM 的强化学习讲起。内容涵盖无监督、监督、强化学习定论,分布式强化学习系统构建,RL 用于后训练 LLM 等,还介绍单步强化学习与策略梯度及相关技巧。

机器之心
产品应用7

AI全面爆发后,企业正在悄悄争夺知识库入口|甲子光年

AI幻觉问题让企业意识到通用模型在专业场景的局限,需构建企业级知识库。腾讯在峰会上宣布升级知识库产品,乐享知识库通过AI赋能解决数据整合、更新等痛点,未来知识库将与业务深度联动。

甲子光年
产品应用7

创新性自动化 AI 工具-终结者机器人

Terminator是最快的AI优先计算机操作SDK,用类似Playwright的API与Windows原生GUI应用交互,比基于视觉的方案更快更可靠,能操作后台应用。它重点支持Windows,部分支持macOS,暂不支持Linux。

GitHubStore