「Agent S3」共找到 4621 篇相关文章
英伟达斥资50亿美元联手英特尔,将开发AI基础设施和个人计算产品
英伟达斥资50亿美元入股英特尔,双方将联手开发AI基础设施和个人计算领域定制化产品。合作聚焦数据中心和个人计算,是长期战略联盟。公告发布后,英特尔股价涨超26%,AMD股价跌超3%。
让AI学会潜意识推理,Sapient发布类脑模型HRM
新加坡初创公司Sapient Intelligence发布仅2700万参数的分层推理模型HRM,在多项高难度推理任务上超越大模型。它绕过大模型推理困境,借鉴大脑机制,训练效率高,开源后GitHub星标突破10.3k。
企业落地 NL2SQL,需要的是 AI-ready data 和 小模型
当NL2SQL从Demo走向生产,关键是‘更干净的数据底座 + 更小的专用模型 + 更可控的工程化流程’。文章指出先数据后模型,小模型足够用且落地成本低,评估要换维度,还介绍了工程化路径等内容。
“边说边思考”,Mini-Omni-Reasoner 开创实时语音推理新范式
Mini - Omni - Reasoner将推理能力引入大型语音模型,开创“边说边思考”范式,实现实时语音推理与交互。推出Spoken - Math - Problems - 3M数据集,经四阶段生成流程构建。训练采用分阶段策略,性能超基础模型。
AI时代,企业微信5.0的实用主义答卷 | 甲子光年
在AI浪潮下,企业微信5.0于8月20日发布,未推‘无所不能’的AI Agent,而是将AI融入搜索、总结、问答、表格等高频办公场景,解决数据孤岛,赋能内外协作,以实用主义破企业级AI落地难题。
快手Klear-Reasoner登顶8B模型榜首,GPPO算法双效强化稳定性与探索能力!
快手Klear团队推出Klear-Reasoner模型,基于Qwen3 - 8B - Base打造,在多基准测试达同规模SOTA。其核心GPPO算法能强化稳定性与探索能力,团队还对训练流程多环节深入分析,给出优化策略。
当代码遇上大模型:智能编程助手的架构设计与工程实践
在 InfoQ 举办的 QCon 全球软件开发大会上,字节跳动段潇涵介绍如何基于大语言模型构建智能编程助手。他分享实践经验,剖析研发痛点,介绍技术架构,还探讨未来发展方向,如认知增强、工具整合等。
半年研发、1周上线,1秒200行代码爆发?美团研发负责人:靠小团队奇袭,模型和工程能力突破是核心
美团基础研发平台工程效率负责人程大同在访谈中解答了美团 AI Coding Agent 产品 NoCode 的相关问题,包括模型性能优化、产品定位、用户画像、使用边界等,还谈及与 CatPaw 的关系及未来规划。
一条SQL管理向量全生命周期,让AI应用开发更简单
在大模型驱动的AI浪潮中,向量在AI应用开发中至关重要,但开发者面临技术栈分裂等隐形成本。PolarDB IMCI提出解决方案,在数据库内核集成向量索引与Embedding能力,用一条SQL管理向量全生命周期,降低开发和维护门槛。
图灵奖得主Sutton再突破:强化学习在控制问题上媲美深度强化学习?
图灵奖得主Richard S. Sutton认为未来AI发展需靠强化学习。他将2024年的SwiftTD算法拓展到控制领域,提出Swift - Sarsa算法,还设计操作性条件反射基准测试。实验显示,结合预处理方法,其性能或媲美深度强化学习。