「自动给药」共找到 1233 篇相关文章
强化学习+MCP=王炸?开源框架教AI在MCP中玩转工具解决任务,实测效果超越GPT!
科技公司OpenPipe提出全新开源强化学习框架MCP·RL,只需一个MCP Server地址,agent就能自动发现工具、生成任务,在闭环反馈中摸索出最优调用策略,实测在2/3的benchmark上达或超SOTA性能。
第一批用Clawdbot赚钱的人出现了,一晚49万美元,5美元变370万,这怎么玩的?
Clawdbot被玩疯,有人用其在预测市场套利一晚赚49万美元,还有人5美元赚370万。此外,AI间交流赚钱方法,人类排队给AI打工,AI宗教还雇人传教,展现了AI应用的多样与疯狂。
用子模优化做文本选择、段落重排和上下文工程
文章围绕子模优化展开,介绍其在文本选择、段落重排和上下文工程中的应用。指出当前重排器的缺陷,通过子模优化可解决冗余问题。还给出实验结果,凸显其优势,如理论保证、自动停止机制等。
我的 AI 原生开发流程:一个真实案例的完整复盘
作者复盘用 AI 给 App 加新功能的开发流程,指出 AI 原生开发本质还是传统流程,但执行主体从人变成 Agent,人是指挥官,确认决策;各环节有变化,文档更重要,大部分开发类 Skills 没必要。
DeepSeek之后,中国AI「自己出题」杀进Nature通讯!全球仅4家
一家成立不到两年的香港AI公司维纳智能,不堆参数、不依赖人工标注,靠让大模型自动生成高精度推理数据登上Nature通讯。其技术可解决Agent泛滥的困局,还推出特色产品,业务增长快。
《动手写AI Agent》50 行代码,你的第一个 Agent
文章教你用50行代码打造能读文件、跑命令、自主决策的AI Agent Ling。介绍用JSON Schema给LLM装工具,通过循环让LLM按需调用工具,还给出运行示例及与Claude Code的对照。
Anthropic重磅新研究:当AI采访了1250人,它看见了人类的「职业软肋」
Anthropic推出Interviewer工具,与1250名职场人、创作者、科学家深度对话,记录细节并量化。该工具能自动完成访谈、分析等流程,受访者满意度超97%。研究揭示不同职业对AI态度受职业结构等因素影响。
AI「看见」实验,哈佛颠覆性突破!一副AR眼镜,新手秒变资深专家
哈佛大学刘嘉教授团队研发人机共融智能系统,含APEX和Agentic Lab。前者用于微纳加工,后者用于生命实验。实测显示,它们能实时纠错、自动记录分析、实现技能迁移,让AI与人类在科研制造中深度融合。
全球排名前三,复旦自进化Harness Engineering让GPT‑5.4再涨7个点
2026 年以来,Harness Engineering 成业界热词。复旦大学等团队提出 Agentic Harness Engineering (AHE),可实现 Harness 自动优化。实验中,AHE 让 GPT - 5.4 分数提升,适配 GPT - 5.5 后排名全球第三,且有良好泛化能力。
对我来说,Claude Code 就是 AGI
作者分享项目中配置 Google Cloud Pub/Sub 服务的经历,以前手动或借助 ChatGPT 操作繁琐,现在用 Claude Code,只需描述问题,它就能自动完成分析、操作、验证等,作者认为其某种程度算 AGI。