多设备开发」共找到 5433 篇相关文章

算法论文8

重新思考RLVR中的熵正则:从探索不足到探索过度的破局之路

2024年以来,RLVR使大模型在推理任务有显著突破,但实践中探索机制易失衡。传统熵正则化在LRM场景易走向极端,研究团队提出SIREN方法精准调控探索,实验显示其在模型和数据集上性能提升显著。

深度学习自然语言处理
开源动态8

小红书团队开源dots.ocr:文档解析新王者,性能比肩Gemini!

文档解析领域处理语言复杂文档需高效能力,传统OCR工具存在不足。小红书HiLab开源语言文档解析模型dots.ocr,基于1.7B参数视觉语言模型,性能达SOTA,单页PDF处理快,公式识别媲美大模型。

开源星探
推荐文章7

统计学和机器学到底有什么区别?

文章探讨统计学和机器学习的区别,指出两者目的不同,统计模型重推断关系,机器学习重预测。以线性回归为例说明差异,还澄清常见误解,表明机器学习基于统计学但涉及领域,最后称选方法要看目标。

海边的拾遗者
产品应用7

Anthropic 深夜发布 Claude Design,一句话生成 UI,百亿美元市值 Figma 股价跌了 4.6%

Anthropic 发布新产品 Claude Design,由 Claude Opus 4.7 支持,以研究预览形式向部分用户开放。它定位为设计师“搭子”,覆盖设计工作流。网友评价高,但也有人指出其生成结果有同质化问题,对传统设计工具冲击待察。

InfoQ
新闻资讯7

谷歌Gemini 3.0「全家桶」年度压轴,前端不再需要人类!下周王者降临

网友爆料谷歌下一代旗舰模型Gemini 3.0将于10月22日发布。不少开发者拿到内测资格并放出demo,显示其在前端开发表现惊人,能一键直出网页、游戏等,还能原创音乐,或对前端和设计产生较大影响。

新智元
新闻资讯7

大模型热度退潮,真正的技术创新者开始被「看见」

过去两年中国大模型投资是商业模式驱动,而技术投资注重创新。DeepSeek 出圈后,独立创新成主流。今年国内大模型吸金热度下降,但智谱 AI、面壁智能仍获融资。面壁智能发布 MiniCPM 4.0,在方面优化,展现端侧优势。

AI科技评论
产品应用7

胜率直逼人类大师!这套Agent揭开中国AI「玄学真相」

在无信息泄漏的术数题库中,Claude、GPT等主流模型准确率低,而Tianfu Agent系统将准确率提至50%,逼近人类Top20选手。它采用Sub - Agent协作等策略,还在工具管理、规则使用等方面有创新。

新智元
开源动态8

2.9K Star!这个工具让 Agent 查代码快了 200 倍!节省 98% Token 消耗!

当下,Agent 在代码工作流应用广泛,但在大型代码库搜索时存在精准性、Token 效率和速度问题。Semble 是 MinishLab 团队开发的面向 Agent 的代码搜索工具,能解决上述问题,还具备方面亮点,安装和使用也简单。

开源星探
开源动态8

杨植麟亲自发布,月之暗面最强模型Kimi K2.5开源

杨植麟发布月之暗面最强模型Kimi K2.5,经约15万亿视觉与文本混合数据预训练,有顶尖编程与视觉能力及智能体蜂群范式。在基准测试表现优,成本低于对手,还能提升办公生产力。

AIGC开放社区
算法论文8

为什么给机器人装上昂贵的触觉传感器,反而让它变笨了?

伊利诺伊大学香槟分校等校合作研究发现,当前机器人学习主流的传感器融合算法(特征拼接)在处理任务时存在局限,给机器人加触觉数据会使抓取成功率暴跌。研究提出组合策略解决问题,经测试效果显著。

机器之心