「深度思考大模型」共找到 8409 篇相关文章
Ilya:扩展时代已经结束了,研究的时代已经开始
Ilya Sutskever 在播客访谈中深度探讨AI问题。他指出模型考试强但应用差,是因泛化能力不足;认为AI扩展时代结束,研究时代来临;还谈及AGI应是学习者,以及AI部署、安全对齐等观点。
“天下苦CUDA久矣!”KernelCAT率先掀桌,实现国产芯片无痛适配
中国AI产业与英伟达GPU及CUDA生态深度依赖,国产AI根基脆弱。KernelCAT作为AI Agent,能开发高性能算子,在昇腾芯片调优测试中表现出色,还能让国产模型在昇腾芯片上高效部署,实现35倍加速。
与Gemini Diffusion共振!首个扩散式「发散思维链」来了
西湖大学齐国君教授团队提出扩散式「发散思维链」,这是面向扩散语言模型的新型推理范式。它与传统思维链不同,能非线性生成,已应用于两种模型,增强后的模型在相关任务上超越现有模型。
退隐3年后回归,周末写的AI一夜刷屏、一周拿下10万Star增速超Linux,Clawdbot之父首次长谈:如今几乎不看自己发布的代码
本文是对OpenClaw开发者Peter Steinberger的深度专访。他曾打造PSPDFKit,隐退三年后回归,用大模型工具开发出OpenClaw。他分享了开发历程、工作方式,探讨AI对编程的影响,还指出大公司采用AI的难点及对开发者的建议。
前端工程化演进之路:从手工作坊到AI驱动的智能化开发
本文回顾前端开发从jQuery到AI的变革,剖析工程化演进、性能优化进化,展示AI与前端深度融合新范式。还预测未来趋势,为开发者提供成长路径指导,强调工程化、性能优化、AI应用及持续学习的重要性。
每个人的AI科学助手!全球首个通用科学智能体来了,全网资源+1.7亿学术文献让科研效率狂飙
全球首个通用科研智能体SciMaster在WAIC亮相,由上海交大与深势科技共同发布。它能结合全网资源和1.7亿科学文献,有深度调研等功能,免费且可用于工作生活多方面,还将重塑科研范式。
ICML2025 | 揭示MLLM的图文联动推理能力
当前多模态大语言模型(MLLMs)在图文深度融合推理能力上面临挑战,现有评测基准无法真正检验该能力。EMMA基准应运而生,它从四大领域精选题目,采用双重过滤机制和细粒度标注体系,评测发现MLLMs存在多模态推理危机。
别让故障复盘流于形式:用AI挖掘每一次“跌倒”的价值
文章指出传统故障复盘存在诸多问题,借助AI能力可解决专业性和深度问题。介绍了智能复盘Agent,包括其核心使命、目标用户、核心价值和解决方案,还阐述了核心技术架构、实现方式及评测机制等,最后给出实战案例。
Granola:ChatGPT、Notion 都入场的 AI 纪要,能真正沉淀工作流吗?
AI 发展带动大量 AI 纪要工具兴起,Granola 凭借新颖 AI 交互方式和对 AI 产品的深入思考,成为领域后起之秀。它提供 AI 补充人工笔记功能,改变了很多知识工作者工作流,但也面临用户习惯和大模型公司切入等挑战。
让AI像人类一样认知真实世界!UCLA谷歌强强联手,长时记忆+3D空间理解超越基线16.5%
如何让AI在3D环境中像人类一样思考,是具身智能领域难题。UCLA与谷歌团队带来3DLLM - MEM模型与3DMEM - BENCH基准,让AI有构建、维护和利用长时记忆能力,实验超基线16.5%,但有依赖模拟器预设的局限。