评估工程」共找到 1392 篇相关文章

开源动态8

LLaVA-OneVision-1.5全流程开源,8B模型预训练只需4天、1.6万美元

灵感实验室团队联合 LMMs - Lab 推出 LLaVA - OneVision - 1.5,全流程开源。其 8B 模型预训练 4 天、成本 1.6 万美元,在多模态基准上性能优,还公开数据构建与训练策略等细节,复现简单。

机器之心
推荐文章7

Anthropic:怎么才能控制模型的行为,做好Agents?

Anthropic发关于AI Agents博客,围绕如何配置上下文让模型输出期望行为展开。指出上下文是有限资源,有Context Rot现象,介绍了上下文工程概念、构成,还提及即时策略、长时间任务处理方法及实践建议。

探索AGI
算法论文8

协同加速,多机器人协作不再「慢半拍」!软硬一体化框架ReCA破解具身智能落地效率瓶颈

佐治亚理工学院等团队推出集成加速框架 ReCA,针对多机协作具身系统,从算法、系统、硬件跨层协同优化,经评估,实现 5 - 10 倍速度提升且成功率升 4.3%,为具身智能落地奠基。

机器之心
开源动态8

把AI装进数据库:PostgresML和Korvus的新思路

当下机器学习应用开发流程复杂,开源数据库Postgres带来惊喜。PostgresML团队让AI模型跑在数据库中,介绍了PostgresML和Korvus两个关键项目,二者结合降低复杂度,让‘在SQL里跑AI’成工程现实。

AI工程化
新闻资讯7

当智能醒于物理世界,英伟达副总裁: 下一个十年属于物理AI!|新智元十周年峰会

在新智元十年峰会上,NVIDIA副总裁赖俊杰揭示公司下一个十年战略核心——物理AI,它是继生成式AI和智能体AI后的下一波浪潮。物理AI与现实物理世界交互,但面临诸多挑战,英伟达为此开源Cosmos世界基础模型。

新智元
算法论文7

从 Prompt 到 Context:基于 1400+ 论文的 Context Engineering 系统综述

本文围绕Context Engineering展开,介绍其定义、与Prompt Engineering区别,从LLM OS视角说明其重要性,指出context处理不当的问题,对其分类及处理管理过程进行探讨,还提及面向LLM Context开发的变化。

阿里云开发者
新闻资讯7

GPT正面对决Claude!OpenAI竟没全赢,AI安全「极限大测」真相曝光

OpenAI和Anthropic罕见合作,测试双方模型在幻觉等四大安全方面的表现。这场合作是AI安全的里程碑,百万用户每天的互动推动安全边界扩展。文中详细对比了GPT和Claude模型在各安全测试中的表现。

新智元
产品应用7

狂肝一周,测评十余款 PPT AI 生成产品的真实反馈

评估 Agent 产品能力复杂,以 PPT 生成为例,有 Agent 和模板化两种流派。作者选前者投票测评、后者全方位测试。给出方案,还推荐不同需求适用产品,附总榜单和细致体验描述。

特工宇宙
产品应用7

阿里,悄咪咪在海外上线全新 Agent Coding 产品

阿里在海外推出 Agent Coding 产品 Qoder,个人版免费试用。随着 LLM 技术发展,AI 辅助编码范式改变。Qoder 探索发挥 AI 潜力、解决开发挑战,有透明化等功能及增强上下文工程理念,还能自动选模型。

特工宇宙
推荐文章8

Data Agent 落地挑战:忽略技术框架、语义能力和运营体系,投入可能打水漂

Data Agent 看似易上手,落地却充满挑战。腾讯数据工程专家虎兴龙指出,90% 难点源于软件工程,统一语义层建设是关键。企业若忽略相关要点,投入或打水漂,掌握关键要素可提升数据智能化效率。

InfoQ