新能安」共找到 7785 篇相关文章

开源动态8

Clawdbot爆火:Karpathy点赞的开源AI助理,到底是什么?

这两天AI圈被Clawdbot项目刷屏。它是在手机已有应用中工作的AI助理,有记忆、会主动联系用户、执行任务。它可在廉价云服务器运行,力分两层级,成本每月25 - 150美元。

AI寒武纪
新闻资讯8

刚刚,Anthropic分享了他们在AI Agents评估的最佳实践

Anthropic发布blog《揭秘AI Agents评估》,指出良好评估助团队信心发布AI智体,介绍评估结构、构建原因、评估方法、从零到一的路线图,还提到评估需与其他方法配合,全面了解智体性

PaperAgent
新闻资讯7

御三家格局松动:Google和Meta同日发布模型,第三名不再稳了?

2026年9月2日,Google推出Gemini 3.8 Flash,Meta发布Muse Spark 1.3。此前Google经历人事调整、旗舰延期,靠Flash维持节奏;Meta则重建团队、收窄战略。二者产品定位相似,各有优劣。

DeepTech深科技
产品应用8

编程王Composer 2.5来了,逼近Opus 4.7!成本仅为1/10

Cursor推出全AI编程模型Composer 2.5,在部分编程基准测试上接近Claude 4.7 Opus和GPT - 5.5,运行效率最高提升10倍,成本仅为竞品一小部分。其采用定向文本反馈RL等机制,还与SpaceXAI合作冲击百万H100集群算力。

新智元
算法论文8

真·开外挂!MIT研究:架构0改动,让大模型解锁千万级上下文

MIT CSAIL团队提出递归语言模型RLM,不改动模型架构,让GPT - 5、Qwen - 3等模型具备千万级token超长文本处理力。它将上下文处理“外包”,实验显示其处理规模超前沿模型,复杂任务优势显著,多数场景性价比高。

量子位
算法论文8

GUI 精准定位 SoTA:LASER 让模型从“看全图”走向“锁重点”

多模态大模型在高分辨率、元素密集的 GUI 场景易误判。苏州大学 OpenNLG 团队提出 LASER 方法,让模型学会主动推理,通过关键区域聚焦等提升定位精度,在基准测试中表现出色。

深度学习自然语言处理
产品应用8

英伟达联手QCI搞大事:量子应用在真机前先模拟纠错

量子电路(QCI)公司联合NVIDIA,将CUDA - Q编程力集成到Aqumen软件套件。QCI的双轨量子比特设计易纠错,有检测、控制流、处理错误三大功。二者结合让开发者在真机前模拟纠错,加速量子计算商业化。

AIGC开放社区
算法论文8

调整训练数据出场顺序,大模型就变聪明!无需扩大模型/数据规模

微软亚洲研究院提出全文本数据组织范式DELT,通过引入数据排序策略,充分挖掘训练数据潜力,优化训练数据的组织方式,在不同模型尺寸与规模下都达到了良好性,且不用增加数据量或扩大模型规模。

量子位
产品应用7

用AI把一段视频变成可视化网页,Google的模型又卷飞了。

Google将Gemini 2.5 Pro更为05 - 06版,此版代码力在WebDev Arena盲测竞技场登顶,还提升视频理解力,可将视频变成可视化网页,虽产品有不足,但模型进步值得肯定。

开源星探
推荐文章7

The Batch: 893 | 从预测到执行

2026 年 AI 研究应认识到预测的模型不等同于行动的系统。过去十年在被动预测和生成建模成就非凡,但现实任务需系统执行一系列动作。转向长周期任务和目标导向 AI 系统有两大好处。

DeeplearningAI