技术能力」共找到 5494 篇相关文章

新闻资讯7

刚刚,Anthropic王炸Claude泄露!全面碾压Opus 4.6引爆全网

因「人为配置」错误,Anthropic最强模型Claude Mythos细节泄露。它编程、推理能力超Claude Opus 4.6,还具备网络攻防能力,但也带来安全风险,Anthropic因担心被黑客利用暂未发布。

新智元
新闻资讯8

ChatGPT默认模型大升级,GPT-5.5 Instant正式上线:新增记忆来源功能

OpenAI宣布ChatGPT默认模型升级为GPT-5.5 Instant,面向所有用户开放。升级核心是准确性,在高风险领域幻觉内容减少,能力全面提升,回复更简洁。还提升了个性化能力,引入记忆来源功能。

AI寒武纪
新闻资讯8

OpenAI深夜祭出GPT-5.4,暴击Claude!原生操控电脑,打工人悬了

OpenAI发布GPT - 5.4,全面反击Gemini 3.1 Pro和Claude Opus 4.6。它是首个有「原生电脑使用」能力的通用模型,各维度无短板,成绩炸裂,定价也创新高。

新智元
算法论文8

Anthropic:大模型开始意识到自己在想什么!

Anthropic的Jack Lindsey论文《Emergent Introspective Awareness in Large Language Models》对大模型做神经科学受控实验。发现Claude Opus 4/4.1能感知内部念头,区分内外状态,通过检查内部状态一致性判断输出意图。

深度学习自然语言处理
新闻资讯7

FUTURUS未来黑科技徐俊峰:侧翼突围,构建AR全栈解决方案|甲子光年

2026崇礼论坛上,FUTURUS未来黑科技徐俊峰指出AI产业面临瓶颈,创业者应‘侧翼突围’。他认为以汽车挡风玻璃为介质的AR技术是数据闭环关键切口,还描绘了AR全栈解决方案赋能车厂的商业蓝图。

甲子光年
新闻资讯7

关于中美 AI 竞争的差距,我可能真的说错了

作者因读者反馈,意识到自己对中美AI竞争差距理解不全面。基模能力中国整体落后美国,但部分领域领先。模型能力提升难被多数用户感知,且中美在商业模式、模型开源等方面差异大。

MacTalk
新闻资讯7

当百年光电巨头按下“中国引擎”键

2025艾迈斯欧司朗探索者大会在深圳举办,以‘中国引擎’为主题。艾迈斯欧司朗表示中国市场成全球技术演进核心驱动力,还携手零跑探索‘技术平权’,并在多业务发力,将命运与中国市场紧密绑定。

芯师爷
算法论文7

“扁平+拓扑”双索引,85页PDF"秒级"推理,MMRag幻觉率骤降76%

多模态长文档视觉问答常见于科研论文等场景,现有技术路线有大视觉 - 语言模型直接端到端和检索增强生成,但各有缺点。MMRAG - DocQA引入新方案,解决多模态连接和跨页证据链接问题。

PaperAgent
开源动态7

视频推理界的“福尔摩斯测试”:所有大模型,统统不及格 | 论文代码开源

腾讯ARC Lab和香港城市大学推出Video - Holmes,这是视频推理界的‘福尔摩斯测试’,能展现多模态大模型复杂视频推理能力的边界,规避现有Benchmark痛点,测试中所有大模型全部不及格,代码已开源。

量子位
算法论文8

AI 会笑吗?BIGAI & 上交大团队:多模态大模型是否真的能 get 到视频笑点|ACL 2026

上海交通大学等团队构建v-HUB评测基准,分析多模态大模型视频幽默理解能力。评测7个前沿模型发现,模型依赖文字、主动发现笑点能力弱,声音作用有限,还需考虑隐形线索。

AI科技评论