「Agent S3」共找到 4613 篇相关文章
快速理解热门LLM大语言模型
本文用通俗易懂方式帮读者理解LLM、Transformer、Prompt等基本概念,介绍大模型API使用,如温度参数、角色设定等,还提及Function Calling、Agent、MCP等内容,并对AI未来发展作出假想。
爆火论文颠覆RL认知!「错误奖励」让LLM推理暴涨24.6%,学界惊了
最新爆火论文颠覆传统RL训练认知,华盛顿大学等团队证实「伪奖励」可让LLM推理性能提升。研究设置多种伪奖励形式实验,发现其对Qwen模型有效,但并非对所有模型都有效。
【万字长文】大模型开源开发全景与趋势解读
本文以蚂蚁开源团队视角,基于OpenDigger数据,分析大模型开源开发生态。呈现2025年全景图,涵盖135项目。指出训练、推理、应用侧主导领域,还探讨生态趋势、项目兴衰及近期厂商动态。
何恺明等降维打击!彻底颠覆AI生图,无需预训练一步到位
何恺明团队推出生成模型MeanFlow,它跳脱传统训练范式,无需预训练等,仅一次函数评估就能完成生成。在ImageNet 256×256上表现优越,缩小了一步与多步模型性能差距。
CoT推理大溃败?哈佛华人揭秘:LLM一思考,立刻就「失智」
新研究揭示思维链CoT会分散模型「注意力」,使大模型推理时易出错。研究指出在需遵守指令任务中,用CoT推理模型准确率下降,还总结了四大模式,并提出四种缓解策略。
OpenAI:GPT-5就是All in One,集成各种产品
OpenAI研究副总裁剧透GPT - 5将整合Codex、Operator等产品。团队分享Codex详情与未来计划,回应10大问题,如语言选择、运行方式等,还将推免费API积分,发布了Codex上手指南。
微软将大量AI功能、智能体集成在Windows11,全民AI时代来了
今天凌晨微软官网发布以AI为主题的新版Windows 11,集成诸多AI功能,如设置中的Agent、Click to Do等,还推出两款新Copilot+PC设备,目前仅支持英文,未来会扩大范围。
客服智能体走到“上岗”前夜,企业还要跨过几道门槛?|甲子光年
本文聚焦客服智能体产业发展现状,指出当前已从“能对话”阶段进入“能办事”落地期,分析了真实生产场景落地面临的挑战,同时预告iRTE2026实时智能大会企业级客服智能体专场的相关议题。
复旦上线音视频模型新裁判:一万组数据对齐人类审美
现有音视频生成领域的奖励模型多依赖局部指标打分,不符合人类整体审美感受,易让模型“刷高分”却未真正提升生成质量。复旦大学团队推出VA-Judger,基于一万组人类偏好数据训练,可从整体维度判断生成质量,对齐人类审美。
对话Persom张天翊:我想做一个人在数字世界的身份证|甲子光年
本文是甲子Builders对Intuition Lab创始人张天翊的专访,讲述他前次AI创业失败后,瞄准AI缺少用户上下文的痛点,推出开源Personal Model,即将内测AI记忆产品Persom,打造数字世界个人身份层,重构人与AI协作模式。