产品测试」共找到 3216 篇相关文章

产品应用7

OpenClaw 引爆 AI 安全焦虑,Armadin 的 Agent 攻防闭环会成为新范式吗?

OpenClaw走红使agent自主执行任务能力受关注,也带来网络安全风险。传统安全体系难应对,Google高价收购云安全公司释放信号。Armadin构建agent swarm系统形成自主防御闭环,介绍其理念、产品、案例及面临的技术挑战。

海外独角兽
开源动态8

SGLang Hierarchical Sparse Attention 技术深度解析

阿里云等团队推出面向 Sparse Attention 的分层稀疏化框架,介绍其架构、机制与实践。此框架破解了长上下文推理时的计算与容量瓶颈,以 DeepSeek DSA 集成测试,使推理性能大幅提升,目前项目处于开发阶段。

阿里云开发者
新闻资讯7

谷歌推出 Jules:一款基于 Gemini 2.5 的异步编程智能体

谷歌将异步智能编程助手 Jules 正式发布,它基于 Gemini 2.5 Pro 模型,可执行多种编程活动。采用异步模式,直接接入代码库。测试阶段开发者反馈多,正式版有三种访问层级,但部分用户对其界面和输出质量不满。

InfoQ
新闻资讯7

一文看尽世界机器人大会,不用去现场人挤人了

2025世界机器人大会精彩纷呈,有200余家企业及百余款新品参展。大会分ABC三区,展示全场景覆盖与全行业应用的机器人。除展品,园区还有五大活动。文章带读者云逛展,介绍各馆特色机器人与产品

量子位
算法论文8

英伟达、港大等发布创新KV缓存,实现扩散模型无训练加速

多数开源扩散语言模型推理效率不如自回归模型,英伟达、港大、麻省理工研究人员联合提出Fast - dLLM。它用近似KV缓存机制减少冗余计算,还提出基于置信度的平行解码策略,测试显示能加速且保持生成质量。

AIGC开放社区
新闻资讯7

刚刚,LMArena最新模型榜单出炉!DeepSeek-R1网页编程能力赶超了Claude Opus 4

LMArena最新模型榜单出炉,DeepSeek - R1(0528)表现亮眼。在文本基准测试中整体排第6、开放模型中排第一,细分领域也成绩优异,在WebDev Arena平台与闭源大模型并列第一,超Claude Opus 4。

机器之心
产品应用7

对话陈炜鹏:Loopit 有了 1500 万件作品之后,我们决定做自己的互动世界模型

Loopit 今年 2 月上线,已积累近 1500 万作品,北美数十万青少年成稳定用户。在此基础上,团队发布互动世界模型 Zing - 0.5,探索互动内容新形态。陈炜鹏认为模型与应用应结合,自研是为拓展产品边界。

Founder Park
新闻资讯8

Qwen3.8-Max 正式版终于发布了,能不能打过 GPT 看这里

Qwen 3.8 Max 正式发布,沿用 Qwen 3.5 架构,参数量扩展,重点提升 Coding、Work 和 Agent 能力。它将开放权重,价格有优势。在多项测试中表现出色,还新增多模态能力,已可使用并有优惠。

MacTalk
算法论文8

一个问题几百美元,DeepMind智能体一次搞定了9个Erdős问题

DeepMind团队的大模型在一次‘测试’中解决9个开放的Erdős问题,还自动验证,解法通过人工审查。其框架AlphaProof Nexus结合大模型与Lean编译器,研究展示了AI辅助正式证明搜索技术潜力。

机器之心
产品应用7

美团面试题:如何设计多轮对话智能客服Agent。评论区吵翻了,但答案可能就一句话。

文章围绕美团面试题,探讨如何设计多轮对话智能客服Agent。指出AI Agent核心是Context Engineering,介绍业内架构,强调给AI不同容忍度、分步骤处理复杂问题,还提及解决体验问题,认为产品要知边界。

探索AGI