「模型能力」共找到 9120 篇相关文章

产品应用8

深夜突袭!谷歌Gemini 2.5 Pro更新蝉联榜一:推理超越o3,编程超越opus4

深夜谷歌对Gemini 2.5 Pro模型重大更新,在编码、推理等测试中超越o3,几周内成稳定版。其价格优势大,还增加思考预算,输出风格和结构改进,用户实测反馈佳,但发布不久被越狱攻击。

机器之心
开源动态8

单目3DGS迎来突破:影石开源UniSHARP实现全相机适配

影石研究院发布单目新视角合成模型UniSHARP,可通过单次推理秒级获场景高斯点云,支持混合相机训练与免标定推理,适配所有相机。团队还构建数据集、设benchmark,代码等均已开源。

机器之心
产品应用7

10万智能体同场模拟,YuLan-OneSim带来真正的大社会实验

YuLan-OneSim是大语言模型驱动的社会模拟器,能模拟人类社会行为。它可零代码构建场景,有50个默认场景,具分布式架构,支持10万智能体同场模拟,还推出AI社会研究员,自动完成社会科学研究流程。

带你学AI
产品应用7

Claude后台接管电脑,真·赛博替身!人机并行时代来了

Anthropic宣布全面升级Claude「计算机使用」能力,操作可在后台完成。该功能处于Beta测试,已向Claude Pro和Max订阅的macOS用户开放。Claude此次更新覆盖多场景,人机并行时代或来临。

新智元
新闻资讯8

王阳明心学,被Anthropic用来教Claude做人了

UT Austin哲学教授Harvey Lederman研究王阳明心学十年,现加入Anthropic做Claude对齐训练。他用分析哲学拆解“知行合一”,发现AI模型存在“信念冲突”,Anthropic用类似阳明心学方法解决问题。如今硅谷AI公司争抢哲学家。

量子位
新闻资讯7

OpenClaw危了?Claude Code迎来最激进升级:AI 开始直接操控电脑,正面挑战 OpenAI

北京时间昨日夜里,Anthropic 宣布对旗下 Claude Code 与 Claude Cowork 进行关键更新,AI 可直接操控电脑。同日 OpenClaw 也迎来重大更新,重构插件系统、升级模型等。二者更新引发关注,各有优劣。

InfoQ
新闻资讯7

突发!阿里Qwen深夜地震,林俊旸官宣「下台离开」

深夜,Qwen负责人林俊旸宣布离开Qwen团队,未透露去向和接任者。他是阿里最年轻P10技术高管,跨学科背景,在阿里6年连升四级,推动Qwen开源模型发展,还关注AI未来。

机器之心
算法论文7

Anthropic 新研究:AI出错是“热混乱”

Anthropic研究团队发现AI可能无一致目标,只是瞎搞。他们将AI错误分类,测试发现推理越久越混乱,大模型复杂任务易失控。此发现改变对AI风险的认知,论文已在arXiv发布。

AI工程化
开源动态7

DragonMemory:16倍语义压缩,为RAG应用瘦身

介绍GitHub项目DragonMemory,它针对RAG应用上下文压缩,核心是Dragon v7模型,从序列维度压缩,压缩比达16倍。本地测试效果好,有图形界面,支持多格式文档,开源但非成熟商业产品。

AI工程化
推荐文章7

从“铁三角”到“六有”组织,北银金科如何打造千人高密度数智化团队?| 极客时间企业版

在2025 DTDS全球数智人才发展大会上,北银金科赵瑞兰介绍数智化转型实践。北银金科构建“ACT”模型,打造“六有”组织文化,开发人力看板等成果,未来愿与伙伴探索AI时代。

InfoQ