「大模型数据」共找到 10189 篇相关文章

开源动态8

Python逆天改命!开源Hermes首次击败OpenAI Codex

纯Python写的开源项目Hermes Agent,在11项基准测试中以6:5战绩击败OpenAI用Rust写的Codex。它通过三大工程优化,将启动时间从701ms降至258ms。这表明在AI Agent领域,架构比语言性能更重要。

新智元
新闻资讯8

AI进入深水区:资本如何重新定义下一轮生产力跃迁?|甲子光年

2026年3月29日,“AI未来论坛:跃迁·投资·共生”将在中关村国际创新中心海慧厅举办。论坛聚焦AI从数字原生向物理世界渗透、资本投资逻辑等问题,有投资大咖对话、前沿项目展示等环节,海淀区还将发布投资生态伙伴计划。

甲子光年
新闻资讯7

The Batch: 872 | 机器藏羚羊混入羊群

中国科学院联合云深处科技等,将云深处科技的 X30 型四足机器人伪装成藏羚羊,引入可可西里保护区藏羚羊群,在不打扰它们的情况下进行观察。该机器人适应复杂地形和极端环境,还能跟踪羊群并传输数据。

DeeplearningAI
开源动态8

DeepSeek V4即将发布?先读懂梁文峰这份86页的技术底牌

据报道,DeepSeek计划2月中旬发布V4,此前将R1论文从22页扩充到86页。新增内容涵盖训练细节、成本、数据配方等,还公开失败案例、基础设施和安全报告,或为V4铺路并回应质疑。

花叔
产品应用8

以孔子命名,超越Claude 4.5 Opus,Meta发布工业级自我进化AI软件工程师CCA

Meta与哈佛联合推出工业级软件工程师CCA,它是一套让AI在工业级代码库协作的方法论,解决长上下文推理等难题。其三维解耦设计、精细记忆机制、自我进化能力获数据验证,还适合引入强化学习。

AIGC开放社区
新闻资讯7

Forbes 报道:2.5 亿美元年化收入,硬件销量超百万,Plaud 是怎么赚钱的?

AI硬件创企Plaud创始人许高透露,公司年化收入将达2.5亿美元,约半数收入来自年度AI订阅服务。Plaud采用“深圳硬件+硅谷AI”模式,专注海外市场,以“硬件+软件订阅”盈利,同时面临大厂竞争。

Founder Park
产品应用8

顶级邪修倾囊相授!藏师傅教你速通Nano Banana

作者歸藏教大家发掘图片编辑模型Nano Banana潜力。它上线后可白嫖,让Adobe等修图软件失色。介绍使用方法、多种修图玩法及在电商、动漫修复等场景应用,称相关生意都值得用它重做。

歸藏的AI工具箱
新闻资讯7

The Batch: 865 | 机器人外科医生的切割与夹闭

约翰·霍普金斯大学等团队开发Hierarchical Surgical Robot Transformer(SRT - H),结合两个transformer模型,通过模仿学习训练,用达芬奇机器人完成胆囊切除关键步骤。虽在体外组织测试表现好,但应对人体手术仍有挑战。

DeeplearningAI
算法论文8

综述 | 从“说出来”到“脑中算”:Latent Reasoning的范式跃迁与无限可能

大型语言模型用显式思维链推理有局限,潜在思维链(Latent CoT)让推理在连续隐藏状态空间进行。论文梳理该领域,建立框架,介绍方法,探讨可解释性与无限深度推理,指出价值、挑战与未来方向。

深度学习自然语言处理
算法论文8

别再乱调图像塔了!浙大 IJCAI 论文揭露 VLM 非对称性真相,给 CLIP 微调「踩刹车」

浙大陈静远教授课题组等提出自适应非对称适配器,放弃对图像分支硬性微调,引入预测置信度自动给视觉塔‘踩刹车’。经实验总结出微调三大核心洞察,在多个数据集测试中表现优异。

AI科技评论