「评估模型」共找到 8121 篇相关文章
真正能离线跑的完全开源翻译工具
Argos Translate是用Python写的开源离线翻译引擎,底层靠OpenNMT,推理用CTranslate2。可当库、命令行、桌面软件用,模型是本地zip包,不联网也能用。支持主流及小众语言,有多种使用方式。
豆包官宣手机助手:AI 还能带来哪些新体验?
字节豆包团队官宣做手机助手,它基于操作系统层面授权,背靠豆包大模型带来交互创新。虽无自研手机计划,但正与多家厂商洽谈合作。开放体验机型是与中兴合作的nubia M153。
4K超分Agent修图师来了!一键救活所有模糊照片
传统图像放大模型应对复杂情况力不从心,4KAgent应运而生。它基于多智能体设计,有感知、复原等模块,能为图像定制4K超分方案,在多领域测试中表现出色,无需特定领域再训练。
arXiv开始拒收综述论文了?「论文DDoS」这事,这篇NeurIPS论文早有讨论
近日,arXiv宣布拒收未通过同行评审的综述和立场性文章,危机源于生成式AI与大模型。上海交大团队中稿NeurIPS的论文,精准预见此危机,提出“综述论文DDoS攻击”概念,还给出应对策略。
游戏研发中的 AI 转型:网易多 Agent 系统与知识工程实践
本文整理自网易游戏高级技术经理林香鑫分享,其团队通过代码知识谱图构建、多 agent RAG 召回等技术打造超级助手,在多业务场景落地效果好。还介绍知识工程、多 Agent 赋能代码编写、AI 审查等实践及未来展望。
3A大作!阿里ROLL团队从基建->算法->机理,推动RL4LLM全栈协同优化
阿里巴巴ROLL团队联合高校推出「3A」协同优化框架,推动「强化学习用于大语言模型(RL4LLM)」迈向新范式。Async架构提升GPU利用率,AsyPPO降低计算资源消耗,Attention机制提升训练效率与可解释性。
AI 浏览器压根不可能成为新的操作系统
近期AI浏览器成大模型主战场,营销中模糊Browser和OS边界。文章指出‘AI Browser = OS’不成立,分析原因,还提出定义为Agent操作层更合适,未来或走向能力优先、标准互通的‘通用容器’模式。
Sam亲自泼冷水,GPT-5意外失手:我们对AI的期待,是否已被整个行业误判?
科技行业集体转向 AI,高管强调其变革性,可 OpenAI 的 Sam Altman 却泼冷水,提醒投资者高估回报。文中围绕‘AI 是否放缓’展开讨论,还分析了 GPT - 5 发布遇冷原因、AI 对就业影响等,指出 AI 发展多且快,未来潜力巨大。
拜拜了GUI!中科院团队“LLM友好”计算机使用接口来了
中科院软件所团队研究指出,现有LLM智能体成功率低、效率差的瓶颈在于GUI。其设计与LLM能力错配,团队提出声明式接口GOI,实现策略 - 机制分离,经测试性能提升显著。
MIT成果登Nature正刊:90天,「AI科学家」完成3500次电化学测试
美国麻省理工学院李巨团队在Nature发表论文,展示多模态机器人平台CRESt。它结合多模态模型驱动的材料设计与高通量自动化实验,大幅提升催化剂研发速度和质量,还解决了实验结果可重复性不足问题。