「Agent任务」共找到 4219 篇相关文章
刚刚,OpenAI开放GPT-4.1偏好优化DPO,ChatGPT能真正学会你的「品味」了!
OpenAI宣布GPT - 4.1全系列模型支持DPO微调,可让AI通过对比回答学会用户偏好。介绍了DPO原理、适用模型、数据格式、创建任务方法等,还提及开发者反应与技术要点。
阿里智能体多轮推理超越GPT-4o,开源模型也能做Deep Research
通义实验室推出自主信息检索智能体WebDancer,其通过系统化训练范式为构建智能体提供路径,也为在开源模型上复现Deep Research系统提供指导。它在多数据集测试中表现出色,团队还对其未来应用做了展望。
华为攻克AI推理「想太多」问题!新方法让大模型推理提速60%,准确率还高了
华为提出高效推理方法S - GRPO,突破思维链「冗余思考」瓶颈。通过“串行分组 + 衰减奖励”设计,在Qwen3上有效,推理提速60%,生成答案更精确有用,在多个推理benchmark测评中表现出色。
DeepSeek 新模型 R1-0528 悄悄开源,与o3 相当,实测来了。
DeepSeek团队悄无声息地在Hugging Face上开源推理模型新升级版DeepSeek R1-0528,基于DeepSeek-V3-0324模型,架构和训练方法有改进,性能与o3相当,实测表现不错。
只用图像也能思考,强化学习造就推理模型新范式!复杂场景规划能力Max
现有 MLLM 依赖文本处理视觉信息,会造成信息丢失。剑桥、伦敦大学学院、谷歌团队提出视觉规划范式,以强化学习框架 VPRL 提升模型规划能力,实验显示其性能优于文本规划。
『书生·端砚』全面开放全栈服务,“算、证、验”三合一,筑牢科学智能底座 | 2026浦江创新论坛
上海人工智能实验室在2026第十九届浦江创新论坛上,升级发布书生·端砚科学发现平台并全面开放全栈服务,升级三大核心能力,覆盖完整科研流程,已落地六大核心科研领域,开放给科研人员试用。
刚写完V4.1主算子就要“转业”?DeepSeek资深算子工程师深夜独白
本文整理了DeepSeek资深MLSys工程师刘胜与的公开长文,刘胜与刚交付DeepSeek V4.1核心算子,就预判AI将很快超越人类算子开发能力,分享职业转型思考与行业警示,引发技术圈热议。
独家专访临界点CEO乔天杰:机器人运动会7冠背后,灵巧手真正该比什么?|甲子光年
8月22 - 26日,第二届世界人形机器人运动会举行,灵巧手首次单独参赛。临界点携OmniHand获7金4银3铜,CEO乔天杰接受专访,探讨灵巧手能力衡量、自由度、工程化及产业应用等问题。
把PLC仿真搬进浏览器,小参数模型也能实现高工程通过率
上海交通大学联合Sema研究团队推出SemaPLC,将AI Agent与PLC工程工具链连接,让自然语言需求转化为可编译、验证、仿真的控制程序。它是面向全流程的智能工作台,实验效果优于业界方案。
北大联合阶跃星辰提出TensorCast:统一可编程管理大模型张量,推理「首字延迟」最高降低93.2%
随着模型规模增长、新应用兴起,大模型基础设施面临管理「张量状态」挑战。北大、阶跃星辰与北邮联合提出 TensorCast,解耦张量状态,复用管理能力,在多场景测试中表现出色,为大模型基建提供新范式。