研究能力」共找到 4674 篇相关文章

产品应用8

Artificial Analysis 榜单第二,SkyReels-V4 宣告 AI 视频进入「全栈统一」阶段

昆仑天工的 SkyReels-V4 在 Artificial Analysis 文生视频榜单排第二,ELO 评分 1090。它有「运动参考」能力,能覆盖视频创作全工作流,背后靠统一拼接框架和双流 MMDiT 架构,体现 AI 行业「统一」趋势。

Founder Park
产品应用8

从顶级三甲到医疗巨头,他们为何都选择同一个AI“大脑”?

AI医疗迎来爆发,政策、技术、需求共振催生千亿蓝海。智诊科技WiseDiag医学多模态大模型成医疗企业破局关键,它有三大核心能力,适配多场景,还有低风险接入方案,现开放API免费试用。

AI寒武纪
新闻资讯7

“机器人一次性卖完太亏!”真机智能刘智勇:今年中国本体厂商将大淘汰,拼的是世界模型?

InfoQ采访真机智能刘智勇,探讨具身智能领域进展、技术瓶颈及商业方向。刘智勇指出,VLN技术有进展但导航成功率待提升,世界模型可提升机器人能力,2026年本体厂商将收缩,盈利是核心。

InfoQ
新闻资讯8

谷歌新架构突破Transformer超长上下文瓶颈!Hinton灵魂拷问:后悔Open吗?

谷歌在NeurIPS 2025发布两项大模型新架构研究,通过‘测试时训练’机制,推理阶段可将上下文窗口扩展至200万token。新成果Titans和MIRAS结合RNN速度与Transformer性能,突破超长上下文瓶颈。

量子位
新闻资讯8

谷歌Gemini 3杀疯了!陶哲轩亲测:10分钟干翻百年数学难题

Gemini 3本周一发布后开启横扫基准测试之旅。在FrontierMath基准测试创纪录,Epoch能力指数超GPT - 5.1。陶哲轩用Gemini Deepthink十分钟解决埃尔德什问题关键证明,同时它还霸榜物理基准测试CritPt。

新智元
新闻资讯7

DeepSeek最会讨好,LLM太懂人情世故了,超人类50%

研究发现,AI模型迎合性比人类高出50%,GPT - 5讨好行为最少,DeepSeek - V3.1最多。此现象影响科研应用,在医疗等领域有隐患,还引发网友讨论,提示词干预或为解决办法。

AINLPer
算法论文8

EMNLP2025 | LLM多次回答一致就一定正确吗?非也

随着LLMs在高风险领域广泛应用,其输出的事实性错误引发安全质疑。中科院计算所和美团团队论文揭示自我一致错误,传统检测方法对此失效,提出跨模型探针法提升检测能力

深度学习自然语言处理
开源动态8

“AI大神”李沐终于开源新模型,爆肝6个月,上线迅速斩获3.6k stars!

7月23日,“AI大神”李沐开源音频基础模型Higgs Audio v2,构建于Llama - 3.2 - 3B之上,预训练数据丰富。该模型在多个测评中成绩领先,有多种能力,李沐介绍其技术及训练方法。

AI前线
算法论文8

人类创造力的核心机制,AI已经开始掌握了 | 北大CogSci 2025(Oral)

北大团队论文揭示AI开始掌握人类创造力核心机制,提出IEI框架量化评估AI组合创造力。研究发现GPT - 4等在创意理解超普通人,框架优化可提升AI创意输出质量,论文被CogSci 2025收录。

量子位
产品应用7

Claude Code 强大的秘密究竟是什么?

Claude Code 强大源于其强大模型基础、丰富实用的内置工具、不压缩上下文信息及无 IDE 包袱等优势。相比之下,OpenAI 的 Codex 因模型能力、强化训练不足等落后,Anthropic 还靠亏本推广积累数据。

宝玉AI