存在论」共找到 8288 篇相关文章

新闻资讯7

Meta出走华人创业团队,种子轮800万美元,要打造视觉AI记忆大脑

由前Meta顶尖科学家创立的Memories.ai获800万美元种子轮融资。其大视觉记忆模型LVMM解决AI‘记忆缺失’问题,多领域刷新SOTA基准,应用潜力大,还开放API及网页应用。

机器之心
产品应用8

MiniMax Agent 再进化!正式走向商业级全栈开发

MiniMax Agent 升级成‘全栈开发师’,建立完整交付标准,构建技术生态。它能完成多任务,配置顺滑,可处理前端问题。还 MCP 生态、支付集成等方面革新,从工具迈向数字化商业引擎。

特工宇宙
开源动态7

阿里达摩院开源多模态医学大模型—灵枢

大模型医疗领域应用有医疗知识覆盖不足、幻觉风险高、推理能力欠缺三大难题。阿里达摩院开源统一多模态医学大模型灵枢,介绍其数据体系、清洗流程及四阶段强化训练方法。

AIGC开放社区
推荐文章8

吴恩达来信:AI项目时间紧任务重?不妨简化你的构想

吴恩达分享AI项目中获取实践经验的技巧,若时间有限,可缩小项目规模。他以构建“听众模拟器”为例,展示如何有限时间利用编程助手完成基础版本,还能获反馈推进项目。

DeeplearningAI
开源动态8

谷歌开源Gemma 3n:2G内就能跑,100亿参数内最强多模态模型

本周五凌晨,谷歌正式发布、开源全新端侧多模态大模型 Gemma 3n。它有多模态设计、专为设备端优化等特性,核心是 MatFormer 架构,还采用了 PLE 技术等,多方面实现质量提升。

机器之心
算法论文7

The Batch:826 | 提高输出准确性的记忆层

通常提高大语言模型事实准确性需更大模型规模,会增加计算成本。Meta研究人员transformer架构加可训练记忆层,可高效储提取信息,提升计算效率,测试显示其能提升模型输出质量。

DeeplearningAI
产品应用7

用AI把一段视频变成可视化网页,Google的新模型又卷飞了。

Google将Gemini 2.5 Pro更新为05 - 06版,此版代码能力WebDev Arena盲测竞技场登顶,还提升视频理解能力,可将视频变成可视化网页,虽产品有不足,但模型进步值得肯定。

开源星探
算法论文8

ICML 2025 | M+框架来了,增加LLM隐空间记忆,不再受上下文窗口限制

本文提出M+长期隐空间记忆扩展框架,MemoryLLM之上,将8B级模型有效记忆跨度从不到20k提升到160k+,显占用不变。它解决了现有记忆模型冗余、冲突难解等问题,为下一代语言模型提供支撑。

机器之心
算法论文8

单卡即可微调大模型!内占用仅1/8,性能依然拉满 | ICML 2025

基础大模型应用于下游任务时微调成本高,低秩适应(LoRA)方法虽降低成本,但性能不及全量微调。华中科技大学和香港中文大学团队提出GOAT框架,25个多领域任务验证效果好,内占用仅1/8。

量子位
产品应用7

The Batch: 978 | DeepSeek-V4-Pro 更新了

DeepSeek发布旗舰模型DeepSeek-V4-Pro-0813正式版,性能提升,还发布开源agent harness开发者预览版并提价。模型多指标表现佳,编码能力改进明显,公司公开基准测试框架意义大。

DeeplearningAI