维苏威挑战赛」共找到 1111 篇相关文章

算法论文8

上海交大团队发布首篇「搜索智能体」综述!四个度深度剖析搜索智能体

上海交大团队发布首篇「搜索智能体」综述,从如何搜索、优化、应用、评估四个度剖析。随着LLM兴起,搜索从传统模式向搜索智能体转变,虽有潜力但缺统一研究视角与评估框架,该综述提供了路线图。

AI科技评论
7

AI越来越强大,如果客户都去自研了,那企业软件市场会怎么样?

AI能力变强、门槛降低,引发企业软件开发是否会被颠覆的讨论。企业不会自建核心系统,因要专注核心业务且不想承担护等成本。真正威胁是用AI重新设计产品的同行,技术更替规律下传统SaaS公司需警惕。

AI工程化
算法论文8

从Debugger到Developer : 低代码时代新基准NoCode-bench,SWE-Bench作者力荐

浙江大学牵头联合多机构推出全新评估基准NoCode - bench,直面自然语言驱动功能添加任务,发现当前最佳LLM成功率仅两成。它构建严谨,任务挑战大,指明AI软件开发改进方向,且已开源。

机器之心
推荐文章7

在 AI 时代构建 MVP

文章围绕AI在构建最小可行产品(MVP)中的作用展开。它能在理解QARs、推动架构决策等多方面提供帮助,如提出被忽略的需求、缩小技术搜索范围等,但不能完全替代人类做决策。

InfoQ
开源动态7

Distilabel DeepSeek-R1 模型蒸馏教程

文章介绍结合distilabel与QLoRA技术定制专属大模型的路径。先用distilabel框架利用DeepSeek - R1生成医疗指令数据集,再用QLoRA技术微调Qwen3 - 4B模型,还给出实战路线图和代码示例。

机器学习AI算法工程
新闻资讯7

稚晖君和王兴兴,打起了人形机器人关键一仗

科技圈风口聚焦人形机器人,宇树科技和智元机器人争夺“人形机器人”第一股。两者虽产品线和应用场景有共性,但商业化进程、战略打法和组织结构差异大,代表不同具身智能发展路径。

芯师爷
新闻资讯7

2025 IMO真题撕碎AI数学神话,全球顶尖模型齐翻车!冠军铜牌都拿不到

2025 IMO数学竞赛中,全球顶尖AI模型均翻车。冠军Gemini 2.5 Pro仅得31分,连铜牌都拿不到。Grok - 4表现糟糕,DeepSeek - R1也令人失望。AI虽有思路,但逻辑细节不足,离成奥数大师尚远。

新智元
推荐文章8

狼人杀AI对决:手把手教你打造高分Agent

作者参加AI狼人杀比赛,分享构建高分Agent全过程。介绍比赛规则、题目挑战及解题思路,阐述Agent基础能力,如缓存、并发集成等,还提及模型调优、战术策略,最后开源代码,分享心得体会。

阿里云开发者
算法论文8

首次综述「边-云协同计算」,分布式智能与模型优化的最新进展

边缘 - 云协同计算整合边缘节点和云端资源,解决传统云计算问题。最新综述论文系统梳理其架构设计、模型优化等方面,提出统一框架,还指明未来研究方向,如大语言模型部署、6G整合等。

新智元
开源动态8

文档秒变演讲视频还带配音!开源Agent商业报告/学术论文接近人类水平

澳大利亚和英国多所高校团队提出多模态智能体PresentAgent,能将文档转化为配有语音讲解和同步幻灯片的视频演示。其模块化生成框架有可控性和领域适应性,评估显示它在各指标上接近人类水平。

量子位