团队搭建」共找到 3686 篇相关文章

算法论文8

长程 Agent 越跑越乱?ContextPilot 用细粒度 RL 教会模型主动管理上下文

长程 Agent 推理时,传统方法使上下文臃肿、推理成本高。清华、腾讯等团队提出 ContextPilot 框架,扩展管理工具集、采用新采样和信用分配方法。实验显示其用短上下文获高分,降低推理开销。

深度学习自然语言处理
算法论文8

强化学习没作用?人大DelTA精准识别关键token,推理正确率大幅上升

人大高瓴研究团队提出DelTA算法,不依赖经验为强化学习目标中每个token算最优权重。实验显示它适配主流强化框架,在多任务上提升base模型效果,还能让训练更稳定。

量子位
算法论文8

给 Agent Skills 装上眼睛:MMSkills 用多模态技能包教会智能体看状态、做决策

上海交通大学和小红书团队推出面向通用视觉 Agent 的多模态技能框架 MMSkills,将可复用技能扩展为多模态程序性知识,通过 branch loading 调用视觉证据,在 GUI 与游戏任务评测中表现出色。

深度学习自然语言处理
推荐文章7

前 YC 创始人:在家带四娃,还跑着 11 个 AI Agent

前 YC 创始人现为全职妈妈,带四个娃同时运行 11 个 AI Agent,将其融入家庭教育与生活。分享 Agent 搭建经验、遇的问题及教训,还预测 AI 会逆转生育率下降趋势。

特工宇宙
产品应用8

1段话喊来13个“程序员”,阿里Qoder新模式让我躺着当CTO

作者实测阿里Qoder「专家团模式」,该模式下Qoder组织赛博工程团队,自动解析需求、分配任务,多智能体协同推进项目,解决了代码质量和效率问题,开启多智能体协同编程时代。

量子位
算法论文8

速度提升,能力却暴跌?扩散模型做智能体的残酷真相

南洋理工大学陶大程教授团队联合发布评测报告,揭示扩散语言模型在智能体能力上有系统性缺陷,落后自回归模型。还分析其失败原因,提出评测框架,明确能力边界并给出研究建议。

机器之心
推荐文章8

Anthropic 最新博客:构建 AI Agent 评估体系完整指南

Anthropic 工程团队发布博客《Demystifying evals for AI agents》,揭秘内部对 AI Agent 的评估方法,涵盖评估结构、构建原因、常见 Agent 类型评估技术、评估非确定性处理、构建路线图及与其他方法配合策略等。

AGI Hunt
算法论文8

性能不减,吞吐量提升6.4倍!英伟达用混合算子和架构定义小模型新标准

NVIDIA研究团队通过Nemotron - Flash系列模型,打破对‘深而瘦’架构迷信,修正缩放定律,用进化算法搜索混合算子、改进训练策略。该模型在性能、延迟和吞吐量上表现出色,远超同类产品。

AIGC开放社区
开源动态7

Dev Proxy v1.3.0:HAR 文件生成、LLM 使用跟踪、增强的 API 测试功能

Microsoft 365 开发团队发布 Dev Proxy v1.3.0 版,引入 HAR 文件生成、OpenAI 使用跟踪等新功能,改善调试、测试和 API 监控,还改进 OpenAPI 规范生成等,同时更新了 VS Code 工具包。

InfoQ
新闻资讯8

OpenAI Atlas等AI浏览器暴露Web Agent安全风险!南洋理工破解底层机制

OpenAI Atlas等AI浏览器提升网页自动化效率,但使智能爬虫威胁加剧。南洋理工等团队研发的WebCloak,混淆网页结构与语义,打破爬虫技术依赖,为数据安全筑防线,适用于数据敏感场景。

新智元