工作成果验证」共找到 2390 篇相关文章

新闻资讯7

600万奖池尘埃落定,有人靠DeepSeek网页版拿下冠军

TAAC × KDD Cup 2026大赛落幕,600万奖池揭晓归属。大赛吸引52国13913名选手,竞争激烈。冠军团队分别用DeepSeek网页版等工具,在赛题“统一建模”难题上各展方案,其成果或助广告外的LLM研究。

机器之心
推荐文章8

让AI自我进化,斯坦福新课免费教

斯坦福开设新课CS329A《自我进化AI智能体》,被奉为Agent学习新晋资源宝库。课程由实战派教授授课,介绍扩大模型规模、养成能听懂人话的AI、提升AI能力等内容,还探讨AI自我改进及智能体工作流等。

量子位
开源动态8

爆火的腾讯WorkBuddy发了篇论文,公开了自家底牌

腾讯 WorkBuddy 团队将内部模型选型评测等开源成 Benchmark,公开多模型 Agent 工作台选型底牌。Bench 优点是任务分布真实且开源可审计,论文介绍了核心方法论、四大赛道拆解、榜单结果,还对比了现有工作

PaperAgent
推荐文章8

人类研发时代结束?XYZ最强Search Agent横扫七大榜单,300个Agent跑通AI4AI全栈闭环

近日,XYZAI Lab发布两款Deep Search Agent,刷新多项评测SOTA成绩。其背后是新型AI4AI研发范式,让AI驱动研发闭环。XYZ团队用AI解决多方面问题,在Deep Search验证,未来有望拓展更多场景。

机器之心
新闻资讯8

阿里安全AGI一次发布3款LLM,8B多维度领先GPT-5.4

近期,阿里安全AGI实验室发布3款Yuvion LLM,在AI安全与内容安全领域多维度领先。它以‘对抗即智能’为原则,构建五类数据体系,采用三阶段训练范式,通过YLRE四级评测体系验证能力。

PaperAgent
新闻资讯7

刚刚,OpenAI首席未来学家离职!曾被马斯克骂蠢驴

OpenAI首席未来学家Joshua Achiam宣布7月24日离职,他在该公司工作9年,曾领导使命对齐团队。他未透露离职原因,称思考已久。此前他曾打断马斯克,被骂“蠢驴”。OpenAI安全线近年人员变动频繁。

量子位
新闻资讯7

GitHub 的旧模式被 AI 击穿,Cursor、GitLab、Zed 各自开打

2026年6月16日,SpaceX以600亿美元收购Cursor。同日,Cursor宣布新项目Origin,是与Git兼容的代码托管平台。GitHub受AI冲击,处理代码提交压力大,而Cursor、GitLab、Zed等公司纷纷推出应对方案。

InfoQ
开源动态8

小模型推理极限在哪里?微博开源3B小模型,比肩顶级闭源

微博新开源的VibeThinker - 3B小模型,将特定能力维度性能推向极限。它在数学竞赛、编程等可验证推理基准上表现优异,成绩直逼顶尖大模型。其训练流程层层叠加,还提出参数压缩 - 覆盖假说。

AIGC开放社区
产品应用8

verify-data:一个端到端的数据验数 Agent Skill

本文介绍端到端数据验证 Agent Skill——verify-data,它能自动完成从表结构获取到报告发布全流程,将传统手工验数升级。文章从多方面展开介绍,还给出未来演进方向,为开发者提供参考。

阿里云开发者
算法论文8

NUS、牛津等联合发布音视频智能综述:系统梳理大模型时代的AVI全景图

NUS领衔近10家机构发布音视频智能综述,系统梳理大模型时代AVI发展全貌,涵盖感知、生成与交互,复盘子方向工作,构建任务蓝图,整理评测体系,总结基础技术,还探讨应用、安全及未来研究方向。

新智元