「研究与产品」共找到 8037 篇相关文章
谷歌重回铁王座!Gemini 3吊打GPT-5,奥特曼发信承认技不如人
谷歌携Gemini 3和Nano Banana Pro强势回归AI王座,连奥特曼都承认谷歌「反超」。谷歌逆袭原因多样,创始人布林回归打破「大公司病」,CEO劈柴推动「AI优先」,还有自研TPU提供算力保障。
Shopify 经验贴:如何搞出一个生产级别可用的 AI Agent 系统?
Shopify 以 AI 助手 Sidekick 为例,分享从简单工具调用系统演变为复杂 AI Agent 平台的经验,包括架构设计、评估方法和训练技术等方面,还给出构建生产级别可用的 AI Agent 系统的四条核心建议。
34k star!开源多层级自主协作AI Agent,超10万开发者认证
CrewAI是超34000颗星的开源AI Agent框架,曾获Github每日增长趋势第一。基于Python,核心架构由CrewAI Crews和CrewAI Flows组成,设计灵感源于人类协作,已有超10万开发者认证。
开源AI浏览器自动化框架!14.3K+ Star,自然语言+代码,爬虫效率翻倍!
传统浏览器自动化工具维护成本高,全AI代理缺乏可控性。Stagehand是Browserbase开发的开源AI浏览器自动化框架,结合自然语言和代码控制,有多种核心功能,获14.3K+ GitHub Star。
智能体自己出现问题自己找!首次提出“自动化失败归因”课题 | ICML2025 Spotlight
LLM Multi - Agent系统失败诊断难,阻碍迭代优化。宾夕法尼亚州立大学等机构研究者首次提出“自动化失败归因”课题,构建Who&When数据集,开发评估多种归因方法,实验揭示当前方法不足。
视频生成1.3B碾压14B、图像生成直逼GPT-4o!港科&快手开源测试时扩展新范式
香港科技大学联合快手可灵团队推出 EvoSearch 方法,支持图像和视频生成。该方法无需训练和梯度更新,能提升模型生成质量,展现了 test - time scaling 补充 training - time scaling 的潜力,目前论文和代码已开源。
开源多智能体开发框架:支持MCP、Agent SDK,超2000颗星。
著名企业孵化器Y Combinator支持的开源多智能体开发框架Rowboat,支持MCP服务和Agent SDK,几分钟就能开发复杂智能体工作流。它由Agent、Playground、Copilot组成,还支持创建面向用户的助手,在Github超2000颗星。
14B检索能力超过Google Search,阿里ZeroSearch通过RL激发LLM检索推理能力~
有效信息搜索对提升LLMs推理和生成能力重要,当前RL方法有文档质量不可控和API成本高问题。阿里通义Lab提出ZEROSEARCH框架,经多步骤训练,实验显示其在检索能力和泛化性上表现出色。
用 AI 重新定义 RSS 阅读体验FeedMe
FeedMe可一站式了解多信息源新鲜事,轻量自由且可定制。具备多源RSS聚合、AI摘要生成等功能,支持多种部署方式,如GitHub Pages、Vercel、Docker本地部署,还给出开发指南,项目开源方便Fork和自部署。
刚刚开源就斩获 2.7K Star!吴恩达老师开源了一个 AI 员工 OpenWorker!
吴恩达老师开源了桌面 AI Agent OpenWorker,对标闭源 Agent。它能交付成品,本地优先、支持多模型,重要动作需审批。有 25+ 连接器,支持定时任务和角色模板,提供多方式上手。