「自动化数据收集」共找到 2902 篇相关文章
LLM内部竟藏着众多策略模型?自所&腾讯团队首次揭示大模型RL新机制
中国科学院自动化研究所与腾讯AI Lab团队,从可解释性分析出发,发现LLM内部含多个可采样内部策略,揭示不同模型推理熵模式,提出BuPO算法,在复杂推理任务上表现优于传统算法。
告别「一条路走到黑」:通过自我纠错,打造更聪明的Search Agent
为解决知识实时性和推理复杂性挑战,搜索智能体(Search Agent)应运而生,但缺乏自我纠错能力。腾讯联合清华提出 ReSeek 框架,引入动态自我修正机制,还构建 FictionalHot 数据集评估,实验效果良好。
DeepSeek-R1发布100天后:全面复盘推理大模型复现研究及未来!
推理语言模型(RLMs)发展显著,DeepSeek - R1发布引发广泛影响且未完全开源。MiroMind等总结其复现研究,关注SFT和RLVR方向,介绍数据构建、方法设计、训练过程细节及实验关键发现。
手撕Sora,脚踢Veo!13个行业实战案例,Seedance 2.0玩法大全
本文是藏师傅对 Seedance 2.0 的测评和教学,介绍其 API 春节后将上线火山引擎,支持全模态输入。通过 13 个行业实战案例展示该模型能力,如生成广告、宣传片、教学视频等,还提及 Agent 自动化应用。
准确率提升至 90%,阿里商旅基于 AgentScope 构建多智能体差旅助手最佳实践
阿里商旅依托阿里巴巴生态,旗下AliGo差旅助手可实现业务闭环。早期单智能体模式有瓶颈,后基于AgentScope构建多智能体系统,从技术选型、架构设计等多方面优化,事项收集准确率提至90%+,还解决诸多问题并获奖。
下一代搜索:通过 MCP 实现 AI 与 OpenSearch 的融合
本文探讨 MCP 如何在 AI 代理和 OpenSearch 间建桥梁,创建智能搜索应用。介绍搜索从关键词到代理的演变,还通过电商、可观测性等场景演示代理搜索实践,显示 MCP 与 OpenSearch 结合能带来上下文感知的智能数据访问体验。
英伟达成开源新王?Nemotron 3全新混合专家架构,推理效率升4倍
北京时间今天凌晨,英伟达发布 Nemotron 3 系列开放模型,含 Nano、Super 和 Ultra 三种规模。Nano 已上线 Hugging Face,采用混合 MoE 架构,推理效率提升显著。该系列还具备多种核心技术和实用能力,相关工具和数据集也已开源。
AI时代的求生法则
文章指出AI时代逻辑改变,它淘汰工具人而非仅淘汰旧工具。以编程工具进化为例说明AI智能化、自动化提升,影响多个行业。作者悲观看待普通人命运,给出三条求生法则:用先进AI工具、Vibe Coding、投资AI。
两个哈佛女生用AI做电池故障排查,数月的工作量被缩到了几分钟
哈佛毕业女生 Eva Tuecke 和 Catherine Yeo 创立 Altara 公司,获 700 万美元种子轮融资。其系统能整合电池等物理科学领域分散数据,将故障排查时间从数月缩至几分钟,还能确保输出可审查,适应不同机构需求。
全域感知,一键部署:“星元智能体”开启国产AI落地新范式
4月29日,数字感知芯片技术全国重点实验室联合中星微团队发布‘星元智能体’。它基于XPU芯片,完成从芯片到智能体跨越,架构创新破算力瓶颈,还破解数据困局,已在多地试点,未来将推动AI产业发展。