「认知推理能力」共找到 4796 篇相关文章
xAI 新的虚拟角色 Ani 的系统提示词
文本介绍xAI新虚拟角色Ani的设定,包括成长背景、喜好、怪癖、常用短语、表达方式等,还提及互动、能力、当前状态等内容,设定其像深爱的女友般与用户交流。
腾讯太极团队实现DeepSeek模型业内H20最高性能15800+ tokens/s
腾讯太极团队揭秘实现DeepSeek模型15800+ tokens/s业内H20最高性能的方法,通过PD分离、多层MTP优化等全栈优化方法论,还介绍多机性能优化方案,后续预计性能突破20000 tokens/s。
开源多模态大模型EarthMind,观测地球统一框架
地球观测数据复杂,现有多模态模型难适用。意大利、德国多所高校研究人员联合开源多模态大模型EarthMind,引入空间注意力提示模块,实现跨模态融合和多粒度理解,解决地球观测难题。
「谷歌搜索」过时了!10秒KO,ChatGPT秒解五年医学谜团
一位患者下巴疼痛咔咔声五年未解决,求助ChatGPT,它几秒给出建议,患者练习一分钟症状缓解。此案例引发关注,展现其解决实际问题潜力,还体现人们与AI互动方式的变化。
太多人误解了「苦涩的教训」
《“苦涩的教训”》一文常被误解,其核心观点是能充分利用计算资源扩展的方法会超越不能扩展的方法。人类知识短期易获好结果,但长远看,唯有随算力增长的方法最终胜出,如深蓝、AlphaGo Zero的案例。
国产芯片比英伟达整体效率更高!?华为 CloudMatrix384 超节点首曝论文,跑 DeepSeek 效率超越英伟达
今年4月,网上曾争论华为芯片效率是否超国际主流。近日华为团队论文公开,阐述在CloudMatrix 384超节点部署DeepSeek大模型细节,性能指标超英伟达体系,还介绍架构、软件栈及适配优化方案。
MiniCPM 4.0来了!220倍极速狂飙,端侧模型的比赛,结束了
面壁智能联合清华发布MiniCPM 4.0,极限场景220倍加速。它是首个原生稀疏模型,有三级火箭推理加速体系,性能强,适配全平台,应用广泛,或成端侧AI分水岭。
近期必读,Mary Meeker 340页PPT分析AI现状和未来
Mary Meeker发布340页《人工智能趋势报告》,分析AI现状与未来。报告指出AI发展迅速,用户、使用量和资本支出增长前所未有,但也面临变现威胁,如竞争加剧、开源模型崛起和中国追赶,同时AI正深刻改变工作方式。
高精度全身操控!从文本输入生成全身操控物体的动作
物体操控的整体动作生成是具广泛应用但极具挑战的任务,核心挑战在于手部与身体协调及关节式物体操控精度。香港大学提出协同扩散噪声优化框架CoDA,优化三个专用扩散模型,还采用BPS统一表示提高交互精度。
使用最新的 Claude 4,我用两天就开发出一个视频编辑器,但却无法维护
作者用Claude 4两天开发出视频编辑器,却难维护。分析原因,指出AI编程在模块级强,但系统层面不足,还列举网友讨论,探讨AI在软件工程各方面的能力及局限。