「模式感知推理」共找到 3099 篇相关文章
DeepSeek-OCR 2再进化,对图像理解已经像人一样逻辑推理了
DeepSeek-OCR 2升级,保持前代高效压缩率和解码效率,引入DeepEncoder V2,模仿人类视觉因果流机制,将图像理解转为逻辑推理,在文档解析领域实现逻辑重构,性能显著提升。
被OpenAI开除的天才少年:联手谷歌,围剿英伟达!
为打破英伟达算力垄断,谷歌扶持云服务商Fluidstack分发自研TPU芯片,该公司正洽谈7亿美元融资,潜在领投方是被OpenAI开除的天才研究员阿申布伦纳。谷歌与Fluidstack合作深化,不过市场对芯片租赁盈利模式存疑。
Murati翁荔陈丹琦公司发布首个产品,让大模型微调门槛暴降,要重新发明一个OpenAI
Thinking Machines Lab发布首个产品Thinker,让模型微调像改Python代码一样简单。它是用于微调语言模型的灵活API,降低了大模型微调门槛,受到业界关注。此外,该公司还尝试重新发明OpenAI,而OpenAI正打造社交模式。
Cursor调价风波背后:商业逻辑与用户期待的错位
Cursor在6月16日调整Pro计划收费模式,从请求数限制改为计算量限制,虽称优化却引发用户不满。用户发现服务缩水且沟通模糊,社交媒体上一片失望愤怒声。7月4日Cursor道歉并推出补救措施,但信任修复不易。
说句话,造个3D世界!腾讯VibeWorlding氛围造世界
香港科技大学(广州)和腾讯团队开源VibeWorlding框架,实现说句话造3D世界。它由VWE - Bench和VibeWorlding - Gym组成,开源模型经强化学习训练后成绩逆袭,证明强化学习解锁3D推理潜力巨大。
Transformer上限触顶,Mobius能否引发下一代模型架构的革命?
自ChatGPT问世,Transformer上限备受关注。前OpenAI、Google负责人称其走到尽头。国内改进架构受算力限制。上海人工智能实验室的书生Mobius团队提出分离知识与推理的架构,有望解决商用等关键问题。
CVPR 2026 Oral|横扫室内3D场景,港科大(广州)打造单目开放词汇占据预测新SOTA
具身感知核心难题待解,传统占据预测方法有局限。港科大(广州)陈昶昊教授团队提出 LegoOcc,首次实现单目开放词汇三维占据预测,在多方面展现优势,未来或让家用机器人精准定位目标。
1400亿,他带走AI芯片独角兽的核心班底
平安夜英伟达官宣200亿美元与AI芯片初创公司Groq交易,后澄清是技术许可协议。英伟达获技术授权并整合产品,Groq核心团队加入,其继续独立运营,这或为“人才收购”,剑指AI推理市场。
探索文本压缩极限!C3纯文本压缩pipeline:20倍压缩解码准确率98%
DeepSeek团队的DeepSeek - OCR技术引发关注,研究者重新审视视觉压缩路径后提出C3技术。C3采用纯文本压缩管道,实验表明其压缩精度远超DeepSeek - OCR,还具独特遗忘模式,代码模型均已开源。
阿里发了个简历AI神器,大小仅0.6B
阿里巴巴集团研究团队开发出基于布局感知的简历解析框架,在简历解析任务准确率逼近Claude - 4等顶尖大模型,处理仅需1 - 2秒,直击自动化简历解析痛点,已在阿里HR系统全面部署。