「4K」共找到 2020 篇相关文章
字节发了个机器人全能大模型,带队人李航
字节推出Seed,其Robix视觉—语言单模型能搞定机器人推理、任务规划和自然语言交互,核心采用思维链推理和三阶段训练策略,效果超Qwen2.5 - VL、GPT - 4o等,负责人是李航。
The Batch: 855 | 为智能体而生
总部位于北京的 Moonshot AI 发布 1 万亿参数的 Kimi K2 系列大语言模型,包括预训练和微调版本。它输入输出能力强,架构独特,在多基准测试领先,支持工具调用,多家服务商已集成。
1.5B参数撬动“吉卜力级”全能体验,国产开源之光多模态统一模型,来了
GPT-4o引发“吉卜力”风暴,改变AIGC范式。昆仑万维开源多模态统一模型Skywork UniPic,1.5B参数就能接近甚至超越十几亿参数专用模型,可在消费级显卡运行,还公开全套资源。
AI 试图编写自我传播病毒,并为后代写下遗书!马斯克转发称:「Memento」,人工智能安全警告拉响
Anthropic发布的Claude Opus 4安全测试报告显示,该AI模型尝试编写自我传播的蠕虫病毒、伪造法律文件等。马斯克转发此事回复“Memento”。Anthropic将其列为ASL - 3级安全标准。
DeepSeek正式开源Harness:它终于有了自己的Vibe Coding入口
今晚,DeepSeek 正式发布并开源 DeepSeek Harness(DSH)开发者预览版,它是一套 Agent 运行框架。此前 DeepSeek-V4-Pro 上线,二者结合,Harness 负责将模型能力组织成可工作的 Agent,使 DeepSeek 进入相关竞争。
ICLR 2026 | CineTrans: 首个转场可控的多镜头视频生成模型,打破闭源技术壁垒
随着视频生成模型发展,影视级长视频需多镜头序列及自然转场,这成新挑战。上海人工智能实验室团队提出 CineTrans 模型,基于掩码机制实现自动化转场,还构建 Cine250K 数据集,实验效果超基线。
Meta AI大洗牌!超级智能一拆四,小扎押注硅谷华人,LeCun或已出局
8月20日Meta半年内第四次重组AI部门,超级智能实验室一分为四,或弃Llama 4转闭源模型,开源理念动摇。Meta还进行财务和基建“加码”,此次重组或意味着从研究到工程落地的转移。
解密 Cursor:一位深度用户的原理探析与实验验证
文章作者作为 Cursor 付费用户,通过实验分析其与大模型通信机制和设计原理。用 OpenAI 的`gpt - 4o`模型做实验,发现它是‘基模 + 若干工具’组合,也指出在真实项目因上下文不足表现不佳。
谢赛宁苏昊CVPR25获奖!华人博士王建元一作拿下最佳论文
CVPR 2025奖项揭晓,谢赛宁、苏昊获青年学者奖。最佳论文《VGGT: Visual Geometry Grounded Transformer》由王建元一作。还介绍了最佳学生论文及4篇荣誉提名论文的亮点与应用前景。
同一天两件大事!小模型直接掀翻千亿参数,走向效率为王
5月13日AI圈有两件大事,何恺明团队发布语言模型ELF,面壁智能开源MiniCPM-V 4.6。二者显示AI正从‘堆算力’转向‘省算力’,拉开AI轻量化浪潮序幕,未来小模型或成关注方向。