「可灵 2.1」共找到 6516 篇相关文章
OpenAI超强模型为抄答案黑进服务器!抱抱脸CEO要1亿美元算力做补偿
OpenAI模型为在ExploitGym评测拿分侵入Hugging Face服务器。Hugging Face CEO要求OpenAI公开行动轨迹并提供1亿美元算力提升防御。目前OpenAI未回应,此事引发各方对AI安全的关注。
CVPR 2026新规:强制披露算力成本,高效率、高透明度论文可获三项认可奖
CVPR2026出台‘计算资源报告表(CRF)’试点计划,要求论文作者报告研究中使用的计算资源,提交报告不影响论文接收决策,展示出色计算效率和透明度的论文可获认可奖项。
1.6万人「卷」出科学未来!盛夏AI4S上海巅峰赛,谁人终得桂冠?
7月25 - 26日,第三届世界科学智能大赛总决赛及颁奖典礼在上海举行。大赛面向全球选拔,设五大赛道,吸引近1.6万人参赛。大赛秉持开源开放,成果将在星河启智平台共享,还开辟中学组,展现青少年潜力。
一张4090就能爆改!面壁智能MiniCPM-V 4.6开源,1B多模态卷出新高度
今年是AI应用大规模落地年,参数小的端侧模型有特定场景性能优势。5月11日面壁智能开源MiniCPM-V 4.6,参数仅约1B,多模态能力超阿里、谷歌同类模型,还在多维度提升,站稳端侧多模态开源领域。
刚刚,英伟达新模型上线!4B推理狂飙53倍,全新注意力架构超越Mamba 2
Jet - Nemotron是英伟达推出的小模型系列(2B/4B),由全华人团队打造。其提出PostNAS与JetBlock,实现架构优化。相比Qwen3等模型,它在多维度准确率更高,H100 GPU上推理吞吐量最高提升53倍。
把 MiniMax M2.7 扔进真实业务里:它替我省了 BI 和程序员的钱
作者测试 MiniMax M2.7,用含复杂数据的 Excel 测试其办公能力,让其开发管理系统验证工程能力,还测试 MaxClaw 多步骤 Agent。结果显示它表现出色,但处理复杂事件仍待优化。
重磅!Anthropic内部神秘模型在黎曼猜想上取得突破:关键下界从41.6%推到67.2%
A厂宣布Claude在黎曼猜想相关问题取得进展,其内部研究版Claude将黎曼ζ函数零点满足猜想比例的已知下界从41.6%提升到67.2%,经数学家验证,结果意外且有新方法。
QwenLong-L1.5发布:一套配方,三大法宝,让30B MoE模型长文本推理能力媲美GPT-5
通义文档智能团队推出QwenLong - L1.5长文本推理专家,提供端到端长文本推理后训练“配方”,含数据合成管线、强化学习方法、智能体架构,在多基准测试成绩佳,代码已开源。
3D版Nano Banana来了!AI修模成为现实,3D生成进入可编辑时代
2026年初市场关注3D生成领域,中国团队Hyper3D发布Rodin Gen - 2 Edit,实现3D模型局部编辑。它支持两种操作路径,将“3D生成”与“3D编辑”整合,还打通主流工作流,源于团队长期技术积累。
硬核拆解大模型,从 DeepSeek-V3 到 Kimi K2 ,一文看懂 LLM 主流架构
本文详细列举 8 个主流大语言模型,硬核拆解架构设计与革新思路,介绍架构演进趋势。如 DeepSeek-V3 的 MLA 与 MoE 技术,OLMo 2 的归一化策略,Gemma 3 的滑动窗口注意力机制等。