同质化评估」共找到 1447 篇相关文章

新闻资讯7

刚封杀就反杀!Claude逆天1400亿暴击OpenAI,250万人抛弃ChatGPT

Anthropic一路狂飙,全美市场份额飙至70%,年收入近200亿美金。Claude表现强大,Claude Code爆火,众多巨头排队付费。但Anthropic与五角大楼冲突,或失去Palantir合作。同时,250万人“退订”ChatGPT,OpenAI紧急修约。

新智元
推荐文章8

Shopify 经验贴:如何搞出一个生产级别可用的 AI Agent 系统?

Shopify 以 AI 助手 Sidekick 为例,分享从简单工具调用系统演变为复杂 AI Agent 平台的经验,包括架构设计、评估方法和训练技术等方面,还给出构建生产级别可用的 AI Agent 系统的四条核心建议。

Founder Park
开源动态7

开源沉浸式「AI 教师工具」,学生还上什么补习班?

介绍开源项目ChatTutor,它是面向理工科的智能可视教学助手,结合对话式AI与多类型可视知识画布,能图文并茂讲解知识点,让复杂知识图形呈现,提升学习效率,有望推动AI教育落地。

开源AI项目落地
开源动态8

MemOS:一种用于 AI 应用的记忆操作系统

大型语言模型缺乏记忆管理系统,限制其发展。MemTensor与高校联合开源MemOS,它将记忆视为可管理资源,有三层架构,系统三种记忆类型。评估显示其在推理、检索、加速等方面表现优异。

PaperAgent
产品应用7

一键搞定百万行Excel和PPT排版!这家杭州电力AI初创要给打工人减负

AI生产力革命被困云端,本地智能体工作台XMO - AgentBox应运而生。它由杭州曦谋决策打造,集成DeepSeek模型,能处理复杂场景,有平台能力、核心价值,适合专业人士,现可免费下载桌面版。

量子位
产品应用7

阿里,悄咪咪在海外上线全新 Agent Coding 产品

阿里在海外推出 Agent Coding 产品 Qoder,个人版免费试用。随着 LLM 技术发展,AI 辅助编码范式改变。Qoder 探索发挥 AI 潜力、解决开发挑战,有透明等功能及增强上下文工程理念,还能自动选模型。

特工宇宙
算法论文7

会解题不等于懂人心,腾讯混元提出Sentient Agent,提高高阶社交认知能力

过去评判LLM像考核‘做题家’,但会解题不等于懂人心。腾讯团队提出SAGE框架,用会闹情绪的agent评委评估模型高阶社交认知能力。实验显示不同模型表现差异大,未来需懂人心的AI。

深度学习自然语言处理
推荐文章7

鹅厂员工怎么看Agent自动持续进

落地一个Agent容易,但让其自动持续优很难。文章分享了9位鹅厂同事对“Agent如何自动持续进”的看法,如建立评估体系、记录真实任务反馈、结合强学习等。

腾讯技术工程
新闻资讯8

Open Responses 规范实现智能体式 LLM 工作流的统一

OpenAI发布Open Responses开放规范,获Hugging Face等支持,为智能体式AI工作流制定统一标准,减少API碎片,支持多模态输入等,引发行业对厂商锁定和生态成熟度的讨论。

InfoQ
开源动态8

阿里开源SmartResume,简历解析无需手工

阿里在Hugging Face和ModelScope上开源智能简历解析系统SmartResume,能将多种格式简历转为结构数据,分三阶段工作,性能优于基线方法,为HR和开发者提供工具。

AI工程化