「在离线混部」共找到 8255 篇相关文章
沈向洋解读AI演进五大维度!IDEA研究院发布“万物可抓取”模型,GPU渲染器打破国外垄断
沈向洋分享梳理智能演进的五个维度,包括算法范式、智能载体等,指出机会不仅来自技术本身。此外,IDEA研究院还发布“万物可抓取”DINO - X Grasp模型、MoonBit编程语言、GPU渲染器Smart等创新成果。
ReAct范式深度解析:从理论到LangGraph实践
文章深度解析ReAct范式,从理论出发,介绍其原理及解决的传统AI问题。分析LangGraph中ReAct实现机制,结合智能解决方案系统案例展示应用价值,还给出手写实践及使用ReAct范式的总结建议。
这款OCR神器绝了,PDF、表格、手写体通吃,20+文档支持,9.4K Star!
开源君在Github发现开源OCR工具Zerox,由Omni - AI团队开发,利用AI视觉模型“阅读”文档,将多种格式文档转Markdown。它功能强大,处理复杂文档优势明显,在Github获9.4K Star。
Meta AI大裁员20%!田渊栋等600人一夜被裁
Meta在超级智能实验室裁掉600人,著名AI大佬田渊栋及其团队在列。PAR和Infra部门是重灾区,FAIR裁员比例仅约5%。Meta或更关注前沿模型研发,减少成果转化考量。
想清楚再动手:具身智能也要学会脑补未来和择优执行 | RSS 2025
近年来基础模型在具身智能领域能力惊人,但在真实部署中常‘用不好’。卡耐基梅隆大学与伯克利人工智能研究院团队提出 FOREWARN 框架,结合‘世界模型’与‘多模态语言推理’,解决部署智能难题。
真急了!AI落后、Siri彻底输给ChatGPT,拯救苹果全靠她?
据彭博报道,苹果今年接触OpenAI前CTO Mira Murati,讨论与Thinking Machines Lab交易意向。苹果收购策略保守,但AI浪潮下自研已落后,它或需收购补足短板,除该实验室,还关注Cohere等小公司。
苹果放王炸!开放大模型访问权、全家桶集成ChatGPT,人人能开发AI应用
苹果在“WWDC 2025”大会宣布在多设备集成Apple Intelligence功能,含ChatGPT图像生成等。开放基础模型访问权,开发者可开发适配应用。新功能将逐步开启测试,今年秋季部分用户可用。
谷歌之后,英伟达入局扩散大语言模型,Fast-dLLM推理速度狂飙27.6倍
大语言模型领域,推理效率制约实际应用。谷歌Gemini diffusion曾展扩散模型并行潜力,但开源扩散LLM推理慢。近日,NVIDIA等推出Fast - dLLM,无需训练即插即用,推理速度狂飙27.6倍,兼顾速度与精度。
四大顶尖模型对决!6000 字测评带你看Deepseek R1有多强
昨天 Deepseek-R1 0528 正式开源,作者让它与 Claude Opus 4、Sonnet 4、Gemini 2.5 Pro 在六个前端开发任务中对决。结果显示,Deepseek-R1 在多数测试表现出色,且价格优势明显。
爆火论文颠覆RL认知!「错误奖励」让LLM推理暴涨24.6%,学界惊了
最新爆火论文颠覆传统RL训练认知,华盛顿大学等团队证实「伪奖励」可让LLM推理性能提升。研究设置多种伪奖励形式实验,发现其对Qwen模型有效,但并非对所有模型都有效。