等本位和轨迹」共找到 8079 篇相关文章

算法论文8

从Debugger到Developer : 低代码时代新基准NoCode-bench,SWE-Bench作者力荐

浙江大学牵头联合多机构推出全新评估基准NoCode - bench,直面自然语言驱动功能添加任务,发现当前最佳LLM成功率仅两成。它构建严谨,任务挑战大,指明AI软件开发改进方向,且已开源。

机器之心
新闻资讯7

用户集体大逃亡!Cursor“自杀式政策”致口碑崩塌:“补贴”换来的王座,正被反噬撕碎

很多开发者吐槽并弃用 Cursor,因其付费后砍功能、技术变差、营销像‘障眼法’,引发信任危机。部分用户转向 Claude Code,不过企业侧使用情况有差异。AI 编程工具竞争激烈,需多维度构建优势,市场未来趋势明显。

AI前线
算法论文8

一篇120页AI4Research(科学研究AI)最新系统性综述

为填补AI在科学研究应用缺乏全面综述的空白,提出AI4Research调查。其主流流程和分类分五个关键领域,各领域细分任务,凸显AI在研究中多样角色,还介绍多学科应用。

PaperAgent
算法论文7

ACL 2025 | 大语言模型正在偷改你的代码?

本文聚焦大语言模型在代码推荐中的「供应商偏见」,通过分析7个主流大模型在30个场景的59万次响应,发现模型会偏好特定供应商,甚至擅自修改代码,还探讨了风险、局限并给出展望。

机器之心
开源动态8

万帧?单卡!智源研究院开源轻量级超长视频理解模型Video-XL-2

长视频理解是多模态大模型关键能力,当前开源模型有短板。智源研究院联合发布 Video-XL-2,多维度优化长视频理解能力,还设计效率优化策略,在主流评测基准表现出色,有广泛应用潜力。

机器之心
产品应用7

Multi-Agent 的灵活编排之路

文章从Copilot 3.0架构规划模块出发,结合DeepSeek R1强化学习训练实践,探讨多智能体架构下大模型编排智能体解决问题。分析Copilot 2.0局限并介绍3.0升级,指出难点,展示效果对比及解决方案。

阿里云开发者
新闻资讯7

AI开源狂飙,OpenAI们慌了!GenAI大洗牌,2025趋势深度解读

2025年,ChatGPT仍领跑,但DeepSeek、Qwen开源模型加速追赶。独立机构报告总结六大趋势,涵盖技术突破与市场格局演变,如推理模型实用化、MoE架构普及,开源势力挑战闭源巨头。

新智元
7

干货 | 算法岗校招经验分享+吐槽

作者分享算法岗校招经验与吐槽,涵盖个人背景、校招结果、面经。分析算法岗就业、算法与开发差异情况,给出刷题、实习方面建议,鼓励校招失利者别灰心。

海边的拾遗者
新闻资讯8

“整个行业骗了公众太久!”Anthropic CEO自爆内幕:私营大厂掌控人类命运,我也深感不安

本文梳理了Anthropic CEO呼吁AI研发限速后引发的全行业论战,梳理提案细节、各方核心质疑,揭露私营AI大厂掌控技术背后的权力与监管分歧。

AI科技大本营
开源动态7

Uno Platform 6.6 发布:Android 启动性能最高提升 61%

Uno Platform 6.6发布,在五平台引入原生AOT发布、可选Vulkan渲染后端。聚焦运行时性能,提升多平台启动速度,还简化XAML编写,增强AI辅助、无障碍及多语言支持

InfoQ