「结构化评估」共找到 1779 篇相关文章
Mini-sglang-01:从Client到Scheduler的消息流转之旅
文章围绕轻量化大模型推理系统mini - sglang,详细介绍消息从客户端经APIServer、Tokenizer到Scheduler的流转过程,分析核心组件功能、消息体系、正反向链路及优化策略,还预告后续分析调度和模型实现逻辑。
上海交大团队发布首篇「搜索智能体」综述!四个维度深度剖析搜索智能体
上海交大团队发布首篇「搜索智能体」综述,从如何搜索、优化、应用、评估四个维度剖析。随着LLM兴起,搜索从传统模式向搜索智能体转变,虽有潜力但缺统一研究视角与评估框架,该综述提供了路线图。
ICLR 2026 Oral | 西湖大学发布Real PDE Bench
复杂物理系统时空演化预测是核心问题,当前AI模型多在数值仿真数据上训练,难以评估其在真实数据上的表现。西湖大学等实验室提出RealPDEBench,含真实与仿真数据,设三类任务、九个评估指标和十个基线方法。
特斯拉OpenAI数据路线遇挫!8千平具身「兵工厂」+ego众包狂飙
2024年特斯拉和OpenAI在机器人数据采集上路线不同,前者重资产高精度,后者低成本众包。当前数据采集方式各有优劣,难以兼顾质量与成本。数据堂提出分层采集架构,通过场内工厂化和场外众包化双轮驱动解决难题。
醒醒吧!CEO猛吹AI写95%代码,绩效考核却还在拼程序员手速?
本文是对 Superhuman 工程负责人 Loic Houssier 的深度访谈。他分享了 AI 时代团队管理、开发流程、绩效评估等方面的变化,指出 AI 虽提升效率,但在质量评估、人才适配等方面仍需探索,还强调观望 AI 发展会有职业风险。
SEO是什么?SEO一般指搜索引擎优化
搜索引擎优化(SEO)是通过分析搜索引擎排名规律,优化网站内容,提高自然排名的技术。它关乎网站能否在行业内占据领先地位,获取品牌收益。但SEO方法有黑白帽之分,选择不慎可能面临搜索引擎惩罚。
开源版AlphaXIV
开源版AlphaXIV可实现与arXiv论文智能对话,打破传统文献阅读壁垒。它利用微软Markitdown转换PDF,用MiniRAG索引内容,借助Google的Gemini API对话,还介绍了功能、问答流程、安装使用等。
FlowUs 创始人创立 Kollab,要为 AI 构建团队大脑
AI 从对话框向 Agent 等形态演变,完成单个任务能力增强,但工作场景中仍有协作断裂问题。Kollab 产品想解决此问题,让任务在组织自动流动,切中 Team - level AI,有共享工作空间等 4 个层级。
OpenAI凌晨放大招,免费Prism颠覆科研!从摘要到致谢,GPT-5.2包圆
OpenAI深夜推出新一代科研利器Prism,由GPT - 5.2加持,是基于云的「AI原生」LaTeX工作区。它能解决科研工作碎片化痛点,免费且不限协作人数,或为OpenAI在科研领域发力之举。
3天狂揽23.1k星!把代码库变成知识图谱,AI编程成本降低35%
CodeGraph是开源本地代码知识图谱工具,提前为项目建索引,组织代码信息,让Agent直接查询。能减少token消耗与工具调用、提高响应速度,数据本地保存,还具备多语言支持等特点。