「双维度评估框架」共找到 2373 篇相关文章
深度拆解 DeepSeek Harness 架构:AGI 的自进化,终于有了「后悔药」
8月13日,DeepSeek开放DeepSeek Harness v0.1开发者预览版,在Github获4.5万星。它提出“一切皆插件”概念,核心组件可插拔。还联合北大提出Cordis框架,解决组件插拔问题,但面临价格与组件膨胀挑战。
烧了1万块横测,你用的模型可能掉队了
作者花大成本从后端、人味、前端、推理等维度,对glm 5.2、kimi k3等国产模型进行测试,展示各模型在不同测试中的结果,指出国模2T俱乐部的kimi和qwen下限高,且刻板印象需改变。
AMS| 西工大史子颉,高传强,王旭,林海涛,张伟伟:数据驱动的涡激振动标度律发现
涡激振动最大振幅是评估结构安全的关键指标,现有理论模型有局限,常用数据驱动方法也面临挑战。本文提出两次应用符号回归的“白箱”标度参数VIV建模方法,验证了其鲁棒性与泛化能力,还给出物理层面解释。
AI可以用任何手段、写任何东西,但你得是个“中年老登”
PingCAP 黄东旭称做 db9 项目未看到 AI 边界,语言、框架、数据库选型不再长期锁定,AI 能写任何软件。徐昊认为软件知识比代码重要,‘重写’概念或过渡。滕昱指出 AI 需‘老登’掌舵,企业软件维护仍存难题。
一句话生成可上线的动效,这个项目真不错!
Github上的`Text-to-lottie`是开源Skill框架,可让Claude Code或Codex当动效设计师,按Lottie规范生成标准`lottie.json`。它有Coding Agent直出Lottie JSON、内置预览播放器等特色,助开发者快速产出合规Lottie资产。
3.3k星星!用AI做前端动效最好的开源项目,给AI写前端代码注入灵魂
现在AI编程做的前端效果不佳,页面不生动、特效生硬。而Text-to-Lottie开源框架可通过AI编程Agent快速生成生产级Lottie动画,支持多种输入,有实时预览与编辑功能,还能集成多平台,简化动效开发。
英伟达开源深度研究引擎:企业级数据不出门,研究自动做
NVIDIA推出AI-Q Blueprint,将深度研究流水线打包成Agent Skill,解决企业级数据处理难题。它能让企业数据不出门,代理框架可派任务并获报告,还支持多种认证模式,代码库可本地部署,专为深度研究打磨。
20刀月费秒变API!Hermes一行命令就能用上Claude、ChatGPT订阅
两大开源Agent框架有硬核更新。Hermes Agent v0.14用一行命令把模型订阅变API,零成本驱动开发工具,还接入Grok。OpenClaw 5.18修复问题,适配Grok。20美元月费可喂饱工具链,打破生态闭环。
人形机器人绕不开的坎:续航问题怎么破?
人形机器人续航问题常被忽视,但它面临电池重量、行走能耗、脉冲负荷三个维度约束,标称续航在实际工况会打折,工程上可通过快速换电和提升单次充电电量应对,固态电池有潜力但有待验证。
港大×复旦×上交:视触觉融合+闭环纠错,让机器人双臂协作不再「盲操」
港大联合复旦、上交大提出TAMEn,在UMI框架上全方位升级,构建视触感知融合等数据闭环,打通数据采集到再训练链路。其三层闭环让机器人学得更快准高效,在双臂协作任务中提升成功率。