多场景支持」共找到 5975 篇相关文章

推荐文章7

第十一章 Deep Agents 实战——数据分析与报告生成

本章介绍构建营销内容 Agent,能分析产品数据、生成营销文案等。核心技术有结构化输出、 Skill 水平组合、模拟数据分析。还对比传统营销与 Agent 流程,展示结构化输出优势及数据驱动决策方法。

CourseAI
开源动态8

去掉 VAE 之后,商汤用 8B 参数重新定义了开源生图的上限

商汤SenseNova U1开源后引发开发者社区关注,它基于NEO - unify架构,摒弃VAE,实现模态理解与生成原生统一。在项基准测试中表现出色,还针对企业办公场景优化,成为生产级任务新选择。

AI科技评论
新闻资讯7

国家队出手!AI智能体要发「身份证」,首个互联国标将落地

2026年5月8日,部门联合发布《实施意见》,推动智能体应用,加强AIP等关键国标应用。全国信标委编制的AIP系列国标将公布,现启动AIP协议应用验证先锋计划,招募伙伴开展工作并明确权益义务。

新智元
新闻资讯7

大厂AI抢人大战,从实习生开始

全球AI人才争夺激烈,国内头部厂给实习生开出高薪,但数实习生做的工作与核心技术差距大。京东开源模型JoyAI-Image-Edit,4位实习生深度参与研发。京东探院权责、资源、氛围好,还允许失败、支持发论文。

量子位
产品应用8

坏孩子浏览器来了!让AI直接用你的账号上网,好用到爆!

“坏孩子浏览器”让AI Agent直接用浏览器账号上网,无需API key和写爬虫,通过Chrome插件+CDP操控真实浏览器。支持36个平台、103个命令,与其他方案相比优势明显,还能10分钟CLI化任何网站。

GitHubStore
推荐文章7

Harness Engineering?不过是把工程常识换个名字

Chayenne Zhao 发文炮轰 harness 概念,认为它只是工程常识换个名字。她以 SGLang 社区构建智能体系统为例,阐述解决问题的方案和关键决策,还指出真正驱动改进是环境层面,而非模型。

AI工程化
产品应用8

月耗3000美金的Skills重度用户,实测MiniMax M2.7:国产Agent模型的天花板?

AI产品黄叔作为月耗3000美金的Skills重度用户,实测MiniMax M2.7,从Agent协作、Coding能力、办公自动化等方面测试,发现其表现出色,虽有不足,但在维度已是国产模型天花板。

AI产品黄叔
新闻资讯7

特朗普刚下禁令,美军动用Claude空袭!军用版或已达Opus 5.5水平

WSJ报道,特朗普刚封杀Claude,美军就用其空袭伊朗。美军司令部用Claude做情报评估等。Anthropic为军方定制版或达Opus 5.5水平。Anthropic曾因隐私等问题与五角大楼谈判破裂。

新智元
算法论文8

LLM-in-Sandbox:给大模型一台电脑,激发通用智能体能力

来自中国人民大学、微软研究院和清华的研究者提出LLM - in - Sandbox范式,让大模型在代码沙盒完成任务,实验显示其能提升领域表现,无需额外训练,还能减少token消耗,研究者认为应取代纯LLM推理。

机器之心
算法论文8

Anthropic、Thinking Machines Lab论文曝光:30万次压力测试揭示AI规范缺陷

Anthropic和Thinking Machines Lab等机构研究人员提出模型规范压力测试法,基于细粒度价值体系生成超30万个查询场景,分析12个前沿大模型回答,揭示模型规范存在原则冲突、解释歧义等缺陷。

机器之心