「AI能力提升」共找到 12332 篇相关文章

开源动态8

超越O4-mini,多模态大模型终于学会回头「看」:中科院自动化所提出GThinker模型

现有多模态大模型在通用场景推理有瓶颈,缺乏对视觉线索校验与再思考能力。中科院自动化所提出GThinker模型,有创新的「线索引导式反思」模式,经两阶段训练,性能超O4 - mini,论文等已开源。

机器之心
产品应用7

实测美团 LongCat:快到极致,但是别说追平 DeepSeek

AI科技评论实测美团LongCat-Flash-Chat,它是中量级对话模型,主打“快”,几乎零延迟。但在推理、抗污染能力等测试中,相比DeepSeek-V3.1,逻辑链条松散,缺乏清晰判断。速度与逻辑哪个更重要,值得思考。

AI科技评论
新闻资讯7

机器人成精了?Figure 03下厨房,不经意关抽屉那一下,太像人了

新智元报道,Figure AI推出搭载Helix 02系统的机器人Figure 03。视频中它在厨房自主干活,如用胯顶抽屉、用脚抬门,还展现多核心能力。其突破传统难题,实现行走与操作统一,能胜任家庭细活。

新智元
产品应用7

MCP进阶:一键批量搞定MCP工具部署

在AI应用复杂当下,传统MCP工具集成有痛点。文章提出基于阿里云计算巢的一站式方案,可多MCP工具批量部署,首创双通道调用能力,还介绍部署、使用、增减工具及问题排查等内容。

阿里云开发者
8

Cloudflare CEO 警告:未来两年,Agent 会让互联网每周爆出一个 Log4j

Cloudflare CEO Matthew Prince在播客中指出,互联网上Bot流量已超人类,未来五年或暴涨1000倍,旧商业模式将崩塌。他还谈到AI对安全、工作的影响,以及公司转型、互联网未来商业模式等问题。

InfoQ
产品应用8

jina-reranker-v3刷新全球重排榜,效率狂飙4.79%

jina-reranker-v3作为LLM时代向量模型,提出“最后但不晚”交互机制,解决文档检索效率与效果权衡、多语言文档重排性能与效率平衡、模型泛化能力和适应性等问题,架构与训练方案有创新。

CourseAI
算法论文8

EAAI | 香港理工大学王旭等:一种增强MFNN的多源气动数据重构方法

飞行器气动压力分布获取依赖风洞试验或数值模拟,多源数据差异为气动数据重构带来挑战。本研究提出增强型多保真神经网络,通过差分运算提升模型泛化精度,在跨声速压力分布重构中效果显著。

力学与人工智能
算法论文8

数学推理热潮下的冷思考!如何训练真正"全能"的推理模型?

论文评估20余个开源推理模型在多领域表现,发现多数模型数学成功难迁移。揭示微调方法(RL vs SFT)决定能力泛化,SFT像‘填鸭’,RL似‘思维健身’,为构建通用推理智能体提供新路径。

深度学习自然语言处理
新闻资讯8

GPT-5.6曝光了!OpenAI砸钱宣战:换掉Claude Code

GPT-5.5发布三周,GPT-5.6曝光且进入开发全速阶段,预计下月亮相。OpenAI本周四将上线「ultrafast模式」,速度提升2 - 3倍。Codex与Claude Code全面开战,OpenAI砸钱吸引开发者,AI自我加速与商业化形成正反馈。

新智元
开源动态8

jina-embeddings-v5-omni 发布!全模态向量小模型

Jina AI发布`jina-embeddings-v5-omni`,将`v5-text`能力拓展到多模态。`v5-omni-small`参数量小却追平LCO - 7B,在多模态评测中表现优异,但视频是短板。其采用‘冻结 + 投影’架构,训练快、省显存。

Jina AI