「开放模型」共找到 8131 篇相关文章
用3D几何先验驱动视频扩散,实现更一致的世界生成
视频扩散模型生成新视角视频时,现有方法缺显式3D结构。智象未来提出DreamWorld,用3D先验与两阶段框架,结合结构和生成能力,在多基准测试表现领先。
让Agent真正“行动”起来,Agent Skill开发者大赛火热报名中!
人工智能下半场聚焦‘行动’,Agent Skill成关键桥梁。为推动AI落地,AIGC开放社区与算泥社区联合主办Agent Skill开发者大赛,设双赛道,官方提供支持,有丰厚奖励,报名通道已开启。
清华团队首发OpenClaw研究报告!
清华沈阳教授团队发布《OpenClaw发展研究报告1.0》和《OpenClaw自我研究报告1.0》,对OpenClaw做深度解读。团队在OpenClaw领域形成完整闭环,包括理论研究、模型研发等多方面工作。
清华新研究,Nature+Science双杀!
清华大学李勇团队分析2.5亿篇科学文献,揭示AI for Science领域矛盾:虽助科学家个体加速,却致科学界群体注意力窄化。这由当前AI模型缺通用性导致,团队推出OmniScientist系统破局限。
谷歌Dreamer大神离职!「辛顿门徒」自曝错过Transformer
谷歌世界模型大牛Danijar Hafner宣布离任,他自2016年起在谷歌相关团队工作近十年,曾获辛顿指导,主导开发Dreamer系列。他还自曝曾错过Transformer,当时未在意其优势。
谷歌放大招了,开源命令行AI编程Agent,每天1000次免费调用,编程只是基础功能。
Google推出开源命令行AI编程Agent——Gemini CLI,基于Gemini 2.5 Pro模型,免费提供每日1000次调用额度。它不仅能编程,还具备多模态能力、实时信息整合等功能,支持定制与自动化。
Qwen2.5VL又多一个娱乐场景,看电影讲故事
文章聚焦Qwen2.5VL新娱乐场景“看图讲故事”。介绍视觉叙事目标、挑战,讲述基于StoryReasoning数据集微调Qwen Storyteller模型的解决思路,含核心技术,还给出实战代码及相关链接。
重磅!OpenAI深夜发布GPT-6 Astra,总裁Brockman:这就是AGI
OpenAI发布GPT-6 Astra,总裁称实现了AGI。它在多基准测试成绩优异,能独立完成复杂工作,网络安全能力强。但推理难监控,其即日起向特定机构开放,有使用价格标准。
Claude一夜吞掉所有APP,全球打工人变天!AI时代「操作系统」诞生
Anthropic官宣十大办公神器可在Claude中交互,集成「MCP Apps」打破AI与软件工具隔阂。Claude从单一对话助手向「AI工作站」演进,新功能已向部分用户开放,MCP Apps带来交互革命。
OpenAI公开大规模稳定训练的秘密,英伟达AMD英特尔都受益
OpenAI通过OCP开放超大规模AI训练用的网络协议MRC,它能确保大规模训练环境下网络通信稳定。该协议由OpenAI联合英伟达等厂商花两年完成,从拓扑、传输、路由维度保障网络可靠性。