能力暴露」共找到 3267 篇相关文章

开源动态8

5Y News|Kimi发布并开源 K2.5 模型,带来全新视觉理解、代码和Agent集群能力

2025年1月27日,月之暗面发布并开源Kimi K2.5模型,它是迄今最智能全能的模型,在多任务有出色表现。支持多模态输入,具备新能力,还推出Kimi Code工具,集群能力也开启Beta测试。

五源资本 5Y Capital
产品应用8

Claude Code迎来大更新:Agent能力增强

Claude Code 2.1.0正式发布,围绕Agent能力、开发者体验和安全性全面升级。有大量功能新增,如技能与Agent的热重载、上下文分叉等;修复诸多问题,还进行了性能、可靠性等方面的优化。

AI寒武纪
算法论文8

让大模型异步地增强推理能力

在大模型推理时代,Test - Time Scaling成提升能力重要方向,但面临效率问题。ATTS提出异步框架,加入共形预测筛选候选路径,实验显示其加速显著,将测试时扩展推进到‘有原则加速’阶段。

深度学习自然语言处理
算法论文8

ICML 2025 Spotlight | 多模态大模型暴露短板?EMMA基准深度揭秘多模态推理能力

最新研究推出 EMMA 基准测试,揭示顶尖多模态大语言模型在深度视觉与文本融合的复杂多模态推理上显著不足。该研究已被 ICML 2025 接收,代码数据开源。实验表明,现有模型与人类专家差距大,视觉推理是核心瓶颈。

机器之心
新闻资讯7

Helidon 引入 Agent 能力,Java 框架开始内建 AI 编排

Oracle 发布 Helidon 4.4.0 版本,对齐 OpenJDK 发布节奏,纳入 Java Verified Portfolio。引入新核心能力、Helidon JSON 库,还增强与 LangChain4j 集成,支持智能体编排。

InfoQ
产品应用8

刚刚,DeepSeek官宣V3.1发布,Agent 能力较大提升

DeepSeek官宣V3.1发布,核心特性有混合推理架构、思考效率提升、Agent能力增强。产品形态含官方App/网页端和API升级。性能在编程、搜索智能体及思考效率上显著提升。

PaperAgent
产品应用7

让Claude Code更强大:解锁符号级代码检索能力

文章推荐一款免费工具Serena,它通过MCP与Claude Code对接,利用LSP协议统一调度语言服务器,让Claude Code获得符号级理解能力,极大提升处理代码的效率和准确率,安装使用也很简单。

newtype AI
新闻资讯7

对话阶跃星辰段楠:“我们可能正触及 Diffusion 能力上限”

阶跃星辰段楠指出当前视频生成技术或触天花板,真正有深度理解能力的模型尚待突破。他预测未来1 - 2年视觉领域基础模型有望出现,还分享视频生成及多模态AI未来核心洞察。

AI科技大本营
新闻资讯8

OpenAI Astra发布在即,全自动网络攻防能力已突破天际!

OpenAI即将发布的模型Astra,在内部评测中获ExploitBench满分,还发现两个零日漏洞。它能力远超上一代GPT - 5.6 Sol且更听话。不过为安全考虑,OpenAI部署监控,还放慢其研究速度。

新智元
产品应用7

OpenClaw 之后我开始思考:Agent 最重要的两种能力是什么?

OpenClaw爆火后,作者思考AI Agent除执行能力外,还需审美判断力。介绍Seede AI,它与文生图工具不同,能将内容转化为可编辑设计文件,操作简单,效果惊艳,有独特技术逻辑,未来有风格预设等发展方向。

特工宇宙