「上下文供给能力」共找到 3753 篇相关文章
印奇的智驾困局|甲子光年
2026年初,印奇身兼千里科技与阶跃星辰董事长。千里科技转型后目标是让千里智驾上车量达百万辆,但面临市场反馈不佳、财务亏损等困局。他选择整合两家公司,借助阶跃星辰突围。
刚刚,创智+模思发布开源版Sora2,电影级音视频同步生成,打破闭源技术垄断
今天上午,上海创智学院 OpenMOSS 团队与模思智能发布端到端音视频生成模型 MOVA,它是中国首个高性能开源音视频模型,能实现音画同出,全栈开源打破闭源技术垄断。
硅谷AI战火烧进医院!终于可以告别「天书」化验单了
OpenAI和Anthropic的战火燃至医疗领域,OpenAI发布ChatGPT健康,Anthropic推出医疗健康版Claude,还打通数据壁垒,提供个性化健康解答。其还在提升模型能力,保障隐私安全,且各有应用场景。
王小川:30亿现金在手,明年IPO,toC产品马上就发
百川智能CEO王小川明确发展主线,百川开源新一代医疗大模型Baichuan-M3,在医疗评测中表现优异。公司约30亿资金,预计2027年IPO,今年将发两款to C医疗产品,重点在院外诊疗。
DeepSeek深夜炸场,开源了一个新项目&论文,V4打前站?
凌晨,DeepSeek开源新项目Engram并公开论文。Engram用可扩展的O(1) N - gram记忆替Transformer早期层节省算力,在多方面实验表现出色,如推理任务增幅大于知识任务,还分析了其机理和系统效率。
AI工程vs传统工程 —「道法术」中的变与不变
本文从“道、法、术”三个层面对比AI工程与传统软件工程异同,指出AI工程是在传统工程基础上,为应对大模型不确定性进行的架构升级,还结合淘宝AI搜索实践提出AI工程应对策略。
AI Coding 长文分享:如何真正把工具用起来,从原理到实践
本文系统分享高效使用AI编程工具的方法,涵盖底层机制、提升对话质量的方式、实际应用场景,还推荐结合AI的编码最佳实践,旨在助开发者用好AI工具。
Meta详细阐述基于LLM级训练、混合并行计算与知识迁移的GEM广告模型
Meta发布生成式广告模型GEM详细信息,旨在改善平台广告推荐能力。它处理海量用户 - 广告交互数据,用三种方法构建系统,还实施GPU级优化,采用两种知识迁移策略,获业内人士认可。
对话付昊桓:数值模拟不能被替代,AI 应该放在哪里丨GAIR 2025
在GAIR 2025大会上,付昊桓教授结合地球系统模型与超算实践,探讨数值模拟与AI的边界和可能。他认为数值模拟是基础,AI可补充,二者应深度融合,还谈及气象领域商业价值和未来期待。
大模型可否胸有成竹?探索LLM推理与自信心的关系 | 直播预约
本次全英文直播将探讨大语言模型推理能力扩展瓶颈,介绍以置信度为核心的推理视角,展示“自确定性”指标及应用,还会讨论方法有效性和“基于置信度的推理”意义。