「速度与准确性」共找到 7135 篇相关文章

算法论文8

Vision-Zero:零数据VLM自我进化!陈怡然团队提出零监督训练新范式

陈怡然团队提出零监督训练新范式Vision-Zero,在多模态任务表现突出。它借鉴自博弈技术,设计自博弈框架,解决数据稀缺和知识天花板问题,还缓解跨能力负迁移,开源代码与模型可供研究。

机器之心
算法论文8

华人主导谷歌SLED,论文登顶会!一键让模型学会自救

大模型常「瞎编」,传统修复代价高。谷歌在NeurIPS 2024提出SLED方法,不依赖外部知识和额外微调,将各层预测纳入考量,减少模型幻觉。实验显示,SLED能显著提升模型准确率。

新智元
开源动态8

小红书发布FireRedChat:首个可私有化部署的全双工大模型语音交互系统

小红书智创音频团队推出业内首个支持私有化部署的全双工大模型语音交互系统FireRedChat,可将半双工链路升级为全双工,提供级联与半级联服务,在多指标领先,让AI有“人感”。

机器之心
产品应用8

超10万亿Tokens的高质量数据集是怎么炼成的?专访中国电信天翼AI阮宜龙

中国电信天翼AI打造超10万亿Tokens高质量数据集,依托星辰MaaS平台构建“数据—模型—服务”闭环。其与研究院推进技术研发并落地产品,建“三全”星辰大模型体系,还在多行业展现应用价值。

量子位
产品应用7

适用所有团队研发提效|带你1分钟上手基于Claude Code的AI代码评审实践

文章介绍用Claude Code和AONE MCP Server实现智能AI代码评审。分析当前CR流程痛点,阐述解决方案架构、配置及效果,提效超50%,还给出使用方式、建议与后续优化方向,为团队AI提效提供参考。

阿里云开发者
开源动态8

0.07B大败QwenVL72B!百度开源OCR3.0"三件套"

OCR 历经四次范式迁移,工业落地存在精度与参数量等矛盾。百度开源 PaddleOCR 3.0“三件套”,含 PP - OCRv5、PP - StructureV3、PP - ChatOCRv4,各有创新点,解决了多语种识别、版面还原等问题。

CourseAI
开源动态7

刚刚,LeCun团队开源首款代码世界模型!能像程序员一样思考的LLM来了

Meta官宣发布代码世界模型CWM,将世界模型引入代码生成任务。它基于编程和世界建模数据训练,能模拟程序执行与交互。在编程基准测试中表现不错,算是Meta的概念验证,目前可看作Demo。

新智元
产品应用7

RAG性能优化:基于RAGFlow自定义解析工具实现文本结构化(含源码教学)

文章围绕RAG性能优化展开,指出RAGFlow框架中DeepDoc解析算法不足,介绍开源与商业化解析工具优劣势及API调用和本地部署特点,推荐TextIn xParse,给出RAGFlow+TextIn知识库构建方法,还探讨了RAG优化方案。

AINLPer
产品应用7

死磕即梦48小时,我发现了AI公众号封面的懒人密码

作者与即梦Agent死磕48小时,分享AI公众号封面制作经验。介绍垫图法、两个提示词模板,测试提示词反推、语义理解等功能,指出不足,认为即梦像AI作图界拼多多,瑕不掩瑜。

AI产品自由
开源动态8

中国AI高速路,华为给出开源开放方案

上周华为全联接大会展示系列创新。超节点架构带动的开源开放意义深远,开放硬件、开源软件和灵衢组件。华为发布系列超节点新品,实现全场景覆盖,同时全面开放开源,推动产业协同与生态繁荣。

量子位