新词新站」共找到 3982 篇相关文章

算法论文8

蚂蚁 | 提出代码检索/重排基准:CoREB,揭开高分榜背后的三大幻觉,现已接入MTEB

蚂蚁研究人员提出代码检索与重排评测基准CoREB,解决现有基准相关性软、数据污染、任务方向单一问题。它已集成进MTEB,收录19个模型×6个任务评测结果,为代码检索模型评估提供基线。

AINLPer
新闻资讯8

LiblibAI 母公司完成近 3 亿美元融资:AI 应用层开始进入「收入说话」的阶段

近日,演语科技披露近3亿美元B+轮融资,投后估值超20亿美元。其旗下有LiblibAI、LibTV、星流等业务,已构建AI创意内容生产应用矩阵。截至2026年5月,ARR达3亿美元,收入年同比增超3000%。

AI科技评论
推荐文章7

2026年了,我们还在用爱迪生试灯丝的方式评估World Model

文章围绕World model展开深度讨论,界定其概念,分析生成派、JEPA派、空间智能派三条技术路线,指出评估比LLM难,提及游戏化benchmark可能是破局点,还强调具身进展由数据驱动,Ego - View或为泛化关键。

五源资本 5Y Capital
7

刚刚,Ilya又发神图「思考者」!AI芯片海洋上在想啥?

AI圈神秘领袖Ilya在Instagram上传画,画面是「思考者」踩在芯片Die Shot上,引发全网解读。同一时间,OpenAI公布数学成果、升级Codex,还传准备秘密提交IPO招股文件,引发一轮狂欢。

新智元
算法论文8

Karpathy加入Anthropic要做的事,被Google提前做了

Karpathy官宣加入Anthropic要组建团队‘用Claude加速预训练研究’,话音未落,Google&Meta等发论文‘LLMs Improving LLMs’验证了该思路。论文让Claude Code搜索最优推理策略,结果全面超越人类设计。

PaperAgent
产品应用7

模型都一样了,AI Agent 真正的差距在 Harness 层!

如今各平台接入模型趋同,AI Agent 差距体现在 Harness 层。以天工超级智能体为例,其有约束先行、任务并行编排等亮点,还提供 Skill 粒度思路,且云端运行降低使用门槛。

探索AGI
开源动态8

别再给AI送钱:10款开源工具省80%Claude Code Token,大项目直接砍49倍

使用Claude Code等AI编码工具常遇额度用完、账单超预期问题,80%钱浪费在冗余输出等。社区博主整理10款开源工具,适配主流AI编码工具,最高能将大项目Token消耗砍到1/49,还介绍省Token习惯及互助项目。

AI工程化
新闻资讯8

从「自我进化」到「DAA」,百度给出 Agent 时代系统答案

2026 年 AI 行业发展微妙,模型能力增强但转化为生产力的企业不多。Create 2026 上百度给出两层答案,构建系统能力,提出 DAA 度量 AI。这是过去三年判断的收束,将非共识整合成面向 Agent 时代的方法论。

AI前线
推荐文章8

深度拆解 Hermes Agent 的记忆系统:它如何修正 OpenClaw 的误区

文章深度拆解 Hermes Agent 记忆系统,介绍其四层记忆系统,包括提示记忆、SQLite 历史会话存档、智能体技能管理和用户建模。与 OpenClaw 对比,Hermes 更关注缓存效率,遵循冷热分离、缓存优先等原则。

宝玉AI
开源动态8

首发Omni-Flow流式全模态架构,消费级显卡就能跑

面壁智能等联合发布MiniCPM-o 4.5技术报告,公开Omni-Flow流式全模态框架。该模型凭9B参数实现端到端全双工全模态,可在消费级显卡运行,还推出在线体验Demo等,性能表现佳,应用潜力大。

CourseAI