视觉精准度」共找到 1231 篇相关文章

算法论文8

Meta提出Deep Think with Confidence:几乎啥都不用动,就能提升推理的准确性与效率

传统自一致性方法虽能提升推理准确率,但计算开销大、收益递减。Meta AI与UCSD团队提出Deep Think with Confidence(DeepConf),可在不增训练成本和不调超参数下,提升推理准确性与效率,本文对其全面解读。

深度学习自然语言处理
新闻资讯7

GPT-5系统提示词突遭泄露,17803 token曝光OpenAI小心思!

一份全新GPT - 5系统提示词在GitHub泄露,有17803 token。此提示词设计精细,覆盖用户对齐、拟人风格、输出质量等。还展示了通用关键要求、安全对齐等方面内容。

新智元
算法论文8

训练提速5倍,响应缩短50%:动态自感知能力,重塑高效LLM Reasoning范式

大型语言模型“思维链”技术有冗余,传统优化方案存在静态先验与动态能力错配问题。论文提出的DR.SAF框架赋予模型动态自感知能力,通过三模块协作,实现推理“精准瘦身”,解决根本冲突。

深度学习自然语言处理
8

AI 陪伴赛道,会诞生下一个「泡泡玛特」吗? | GAIR Live

AI科技评论组织“AI陪伴”线上圆桌,多位从业者探讨AI陪伴是否伪命题、不同人群接受、产品核心价值等,还讨论IP对AI硬件的重要性、硬件与软件优势、是否出海等问题。

AI科技评论
新闻资讯8

继AlphaFold之后,DeepMind再放“大招”:AlphaGenome直击疾病根源

谷歌DeepMind推出AI模型AlphaGenome,可预测DNA序列微小变化对基因调控的影响,已向非商业研究领域开放。它能处理长序列、输出高分辨率结果,有四大优势,在多领域有研究潜力,但也存在局限。

AI寒武纪
开源动态8

轻量级语音模型Vui开源,支持本地部署,笑声停顿全拟真,4万小时练出人类对话感!

近日,Fluxions - AI团队在GitHub开源轻量级语音模型Vui,可设备端运行。它能精准模拟语气词、笑声等,有三款模型,适用于语音助手、播客生成等场景,解决了传统模型的痛点。

开源星探
开源动态8

字节跳动开源文档解析大模型Dolphin,告别繁琐的文档处理,上线狂揽1k星,真是绝了!

字节跳动开源文档解析大模型Dolphin,采用两阶段分析 - 解析范式,有异构锚点提示等功能,适用多领域。技术架构基于视觉 - 编码器 - 解码器,训练集超3000万个样本,安装推理简单,比同类更具竞争力。

小华同学ai
产品应用7

创新性自动化 AI 工具-终结者机器人

Terminator是最快的AI优先计算机操作SDK,用类似Playwright的API与Windows原生GUI应用交互,比基于视觉的方案更快更可靠,能操作后台应用。它重点支持Windows,部分支持macOS,暂不支持Linux。

GitHubStore
产品应用7

一份PPT 创 5000万美金ARR,挑战微软和Google,这家华人创业AI公司火了丨PMF 001

本文介绍华人团队创办的AI PPT企业Gamma,它获5000万用户,ARR破5000万美金且连续盈利15个月。其精准踩中AI节点,运用PLG模式打败Tome,从AI PPT升级为创意创作平台。

鲸选AI
开源动态8

大模型开网店,谁是经营高手?E-Commerce Bench开源揭秘

为评估模型长程经营能力,联合淘天集团发布E-Commerce Bench,以10万本金、365天经营网店来评测。从多维评估18个模型,结果差异大,还发现单一指标会掩盖模型表现,评估基准潜力大。

千问大模型