「扩展思考模式」共找到 1877 篇相关文章
识别1600+种人类语言,支持少样本扩展到5400+种语言,Meta自动语音识别模型开源
Meta AI发布Omnilingual ASR自动语音识别模型并开源。它能转录超1600种语言,含500多种首次被AI理解记录的语言,还可通过少样本扩展到5400多种,改变了多语言ASR构建范式。
在上海,与4位国际大咖一起追问未来:人机协作时代,艺术何为?
在人机协作时代,艺术意义引人深思。上海一场论坛邀四位大咖探讨创作,将不可见存在转化为美学体验,跨越学科界限,思考人类创造力、责任及艺术共情作用。
首次公开!奥特曼重新发明了浏览器
OpenAI首个浏览器Atlas背后技术秘密公开,关键创新是全新架构OWL。它将Atlas应用与Chromium运行时分离,带来即时启动等优势,还为AI智能体用例奠定基础,重构了UI体验。
刚刚,Claude 正式杀入华尔街!
Anthropic 宣布推出 Claude for Financial Services,扩展金融服务功能,有 Excel 插件,还与 Moody's、LSEG 等金融数据平台整合。Citi、RBC Capital Markets 等华尔街巨头纷纷入局。
DeepSeek开源新模型,提出上下文光学压缩:LLM的新记忆方式
DeepSeek开源OCR模型,探索用多少视觉信息让LLM理解文本。实验表明1000字文档约需100个vision tokens,压缩比10倍、准确率97%。还提出模拟人类遗忘等想法,有多种应用场景,且完全开源。
Nature重磅研究:大模型让你变得更聪明还是更笨了?创造力增强还是扼杀了?
《自然》研究表明,大语言模型对创造力的影响取决于任务。简单任务中,它像灵感助推器,分担认知负荷;复杂任务里,易致‘创意固化’,长期依赖还可能使大脑‘变懒’。需按需调节使用。
深度体验|京东开源轻量化通用Agent产品 jdgenie,开箱即用!二次开发及踩坑指南。
本文体验京东开源的端到端多智能体系统JoyAgent - JDGenie,它是产品级多智能体协同系统,开箱即用、支持本地部署。介绍其原理架构、本地部署测试步骤、二次开发方式,还指出特点与不足。
微软开源浏览器Agent,可实时跟踪、控制智能体,超4000颗星
微软在官网开源用于浏览器网络任务的Agent——Magentic - UI,基于Magentic - One开发,支持人机协同。GAIA测试显示其能提升任务完成率和准确率。它以人为本,有独特机制,框架含多阶段,在Github超4000颗星,支持MIT许可证商用。
北大校友,OpenAI前安全副总裁Lilian Weng最新万字博客文章:Why We Think
北大校友Lilian Weng新发布万字博文《Why We Think》,系统梳理让AI模型‘多想一会儿’的前沿方法及逻辑,深入剖析多种机制突破AI性能瓶颈的理论、技术与进展,还提出一系列待解决的开放性问题。
JManus - 面向 Java 开发者的开源通用智能体
在Manus火热背景下,Spring AI Alibaba JManus诞生,它是用Java实现的开源OpenManus。可集成多个大模型,功能完善,能让Java开发者低门槛搭建智能体系统,还给出了运行方法及共建思路。