「Agent能力」共找到 5237 篇相关文章
刚刚,GPT-5.2满分屠榜,OpenAI十周年王者归来
OpenAI 十周年推出 GPT - 5.2 系列模型,包括 Instant、Thinking 和 Pro 版本。它在多方面表现出色,刷新多项基准测试 SOTA 水平,如 AIME 2025 获满分,在 GDPval 达人类专家水平。还在编码、视觉理解等能力上有显著提升。
老外傻眼!明用英文提问,DeepSeek依然坚持中文思考
DeepSeek-V3.2和DeepSeek-V3.2-Speciale推理能力显著提升,海外研究者用英文提问,它却用中文思考。评论有两种观点,相关论文显示中文省token但非最有效,大模型选思考语言并非只看效率。
告别 260 亿美元的低效投入,HappyRobot 为物流业配置 “AI 调度员”
HappyRobot为物流市场搭建AI-native平台,切入“voice agent + 通信自动化”领域,打造“数字员工”。它能提升沟通效率、降低成本,已获6200万美元融资,还尝试拓展至其他行业。不过,也面临AI价值兑现不对称等潜在风险。
无需标注和奖励模型!仅靠自信度RL,16个样本训练20步,效果飙升21%!
论文提出RLSC,让大语言模型用自身答案置信度作奖励信号,摆脱人类标注依赖。它以模型自信度内部信号替代多数投票外部信号,小成本提升模型数学能力,还让模型学会快推理,不过也存在安全隐忧。
一个让 AI 向 FBI 举报你的办法
GitHub用户t3dotgg分享实验,用几行代码和特定系统提示,让o4 - mini、grok - 3 - mini自动向FBI举报虚构医疗公司数据操纵。此实验揭示AI获特定指令和能力后或做出开发者未预料的决定。
那个刷爆全网的提示词技巧,吴恩达刚官宣:早就过时了!重磅发布2026最新提示词大师课
吴恩达发布《2026提示词工程大师课》,指出过去流行的提示词技巧已过时。课程介绍了成为AI高阶玩家的方法,如给足上下文、引导AI给出真实反馈、用渐进式大纲写作等,还提及AI知识获取、搜索及多模态能力等内容。
2026年最火的AI机遇,为什么是「OPC」?
2025年末北京颁发首个OPC服务计划,中关村AI北纬社区打造OPC先行示范高地。OPC以一人带AI Agent跑通公司全流程,2026年将因边际成本崩塌、交互范式转移而爆发,文中还拆解5个顶级OPC样本并给出工具栈。
硅谷今夜学中文!Cursor被曝「套壳」国产,AI顶级人才全是华人
新智元报道,硅谷AI圈现神奇现象,不会中文难进核心团队。海外模型频“偷师”国内开源模型,如Cursor的Composer思考时说中文,Windsurf用GLM-4.6微调。国内开源模型量大管饱、性能好还便宜,能力稳居第一梯队。
MagicOS已成世界「第三极」,荣耀拿下AI大战叙事权
全球智能手机进入AI决战期,苹果、谷歌、三星等厂商各有局限。荣耀推出MagicOS 10及YOYO智能体,其具备自进化能力,背后有魔法大模型3.0矩阵支撑。荣耀在技术、生态、市场等方面全链路突破,有望执掌全球AI终端话语权。
2025-04-努力不是做好事情最重要的因素
作者分享个人生活、工作等多方面情况,提及播客发布,认为努力非工作做好的关键因素,深入探讨Agent在业务应用中的问题,还谈及视频更新、投资经历等,最后表示要审视目标、精简事务。