长任务时代」共找到 3532 篇相关文章

推荐文章7

Vibe Coding 在代码生成与协作中的实践与思考

本文整理自阿里专家向邦宇的分享。探讨构建 Vibe Coding 工具,介绍其分类、在阿里现状。指出用户使用中面临代码质量等问题,产品自身有设计、安全挑战。还分享 Agent 建设经验,强调适配国产模型及模板化的作用。

InfoQ
算法论文7

VL-LN Bench:模拟「边走边问找具体目标」的真实导航场景

上海人工智能实验室等研究者完成VL - LN Bench,模拟真实导航场景。它构建自动化数据收集管线,依托InternVLA - N1训练评测。结果显示主动对话可提升表现,但当前方法在实例感知对齐等环节有短板。

机器之心
新闻资讯7

Anthropic深夜再出杀招!编码AI一键清空桌面,白领末日来临?

Anthropic推出办公神器Cowork,复用Claude Code底层逻辑,可完成日常任务,如整理桌面、处理文件等。它上手门槛低,主动性强,还能持续升级。不过其诞生或冲击初创公司,也需留意使用权限和安全问题。

新智元
开源动态8

港大开源视频版RAG,像聊天一样看完百小时纪录片。

港大HKUDS团队开源超视频理解框架VideoRAG,突破传统模型时限制,支持对数百小时视频精准检索和问答。还有桌面应用Vimo,使用简单高效。介绍了其切片索引、混合检索、生成回答的实现逻辑。

开源AI项目落地
产品应用7

Deepseek是被降智了吗?

作者认为Deepseek被降智,存在诸多问题,如不懂用户意图、文理解差、措辞怪异、提示词调教难、无脑捧杀、幻觉率高、深度思考弱等,还对比了与GPT在人际交往话题回复上的差异。

深度学习自然语言处理
新闻资讯7

穿越周期的早期投资:从赛道思维到认知红利|甲子引力

2025 年 12 月 3 日,「甲子光年」举办年终盛典,科技产业投资专场圆桌对话探讨早期投资从“赛道思维”到“认知红利”转变。英诺王晟主持,红杉张涵等嘉宾参与,指出决胜点在对人、周期和非共识的理解。

甲子光年
算法论文8

模型大一统?1100多个模型殊途同归,指向一个「通用子空间」!

约翰斯・霍普金斯大学研究发现,1100多个不同神经网络,即便训练条件不同,最终权重会收敛到共享低维子空间。此研究为神经网络参数空间“通用性”提供严谨实证,虽成因待探索,但意义深远。

AINLPer
新闻资讯7

没了遥控器,还被扔进荒野,具身智能该「断奶」了

在第五届ATEC科技精英赛上,人形机器人在户外场景状况百出,如摔倒、罢工等。专家认为过去高估其通用能力,五年内走进家庭承担家务较难。具身智能面临感知、决策、硬件等难题,但也有队伍取得成果。

机器之心
产品应用7

AutoDev Review Agent:应对 10 倍代码量的 Agentic 代码审查

文章介绍 AutoDev 的新 Agent——基于多端架构的 Code Review Agent,应对 Vibe Coding 时代 10 倍代码量审查压力。它采用 Agentic 多步骤审查,能在多端运行,串联多环节,虽有不足但奠定自动化审查基础。

phodal
产品应用8

阿里发了个简历AI神器,大小仅0.6B

阿里巴巴集团研究团队开发出基于布局感知的简历解析框架,在简历解析任务准确率逼近Claude - 4等顶尖大模型,处理仅需1 - 2秒,直击自动化简历解析痛点,已在阿里HR系统全面部署。

量子位