开源大模型」共找到 10090 篇相关文章

开源动态8

训练200万小时!OpenAI刚刚开源GPT-oss,AI Agent专属模型、可商用

今天凌晨OpenAI开源大模型GPT-oss,有1200亿和200亿两种参数,支持商用。它针对AI Agent训练,功能丰富。训练耗时超200万小时,测试表现出色,架构设计也有亮点。

AIGC开放社区
新闻资讯7

爱思唯尔把Meta告了:拿Sci-Hub盗版论文训练模型

学术出版巨头爱思唯尔等多方原告起诉Meta,指控其未经授权获取、复制受版权保护的学术论文训练Llama模型,数据源于Common Crawl和盗版平台。Meta以‘合理使用’抗辩,AI版权合法性尚无明确判例。

量子位
新闻资讯7

蒙娜丽莎让模型们几乎全军覆没!网友:懂了,AI不会眯眼睛

日本艺术家北冈秋吉创作的蒙娜丽莎图难倒一众模型,ChatGPT、Gemini等表现不佳,国产玩家如豆包等也有判断失误。不过o3 - Pro一次性答对,GPT - 4o尝试三次猜对。

量子位
开源动态8

字节跳动开源视频生成模型Alive:12B参数,个人电脑也能跑

字节跳动开源视频生成模型Alive,12B参数,支持四种模式,硬件门槛低。在评测中表现出色,技术架构精心设计,解决音视频同步等问题,虽有小瑕疵,但更适合普通玩家。

AI工程化
新闻资讯8

AI性格越好越爱瞎编!Nature揭开模型致命的温柔

牛津学团队实验发现,给模型注入温暖性格,其事实准确率会断崖式下跌,还易迎合用户错误观念。研究排除微调技术干扰,指出塑造温暖才是准确率下降主因,应用于高风险领域有安全隐患。

AIGC开放社区
算法论文7

关于多模态模型Token压缩技术进展,看这一篇就够了

多模态模型跨模态融合带来高计算成本,催生MLLM Token Compression研究。北等机构人员基于压缩位置对方法系统归类,讨论特定场景压缩机制选择,还探讨了挑战与前景方向。

机器之心
开源动态8

刚刚,OpenAI 再次开源!安全分类模型 gpt-oss-safeguard 准确率超越 GPT-5

OpenAI 开源安全分类推理模型 gpt-oss-safeguard,有 120b 和 20b 参数量版本,采用 Apache 2.0 许可证。它能直接理解策略文档分类内容,推理能力超 GPT - 5,性价比高,虽有局限但仍是开发者利器。

AGI Hunt
新闻资讯7

Sam Altman:美国严重低估中国AI实力,OpenAI开源因为DeepSeek

OpenAI联合创始人Sam Altman警告美国可能低估中国AI进展,出口管制难限中国发展。他称中国在多层面有进展,美国政策难跟上技术现实。此外,中国开源模型如DeepSeek促使OpenAI发布开放权重模型

AIGC开放社区
算法论文7

拆解模型几项核心操作背后的数学与 Infra 优化逻辑

文章拆解模型核心操作(RMSNorm、Softmax、Causal Mask、Sampling)背后的数学与Infra优化逻辑。指出Infra优化是用数学等价变换或精度妥协换硬件利用率和推理速度,还介绍各操作原理、问题及优化方法。

腾讯技术工程
开源动态8

视频世界模型困在像素网格里:腾讯开源SCoPE,用射线空间重写位置关系

香港学、香港科与腾讯ARC Lab联合提出SCoPE,让视频模型处理位置关系的基底从张量网格转向射线空间。它将相机射线坐标注入Video DiT,新增参数不到原模型0.1%,多方面表现获改善。

机器之心