「前缀和计算」共找到 7301 篇相关文章
破局大模型训练黑盒,MegatronApp开源实现万亿参数「可视可控」训练
在2025上海QCon大会上,算秩未来赵伯罕博士指出万亿级大模型训练困境。上海期智研究院和算秩未来联合研发MegatronApp,以低入侵方式补齐链路,其四个模块形成闭环,让训练从黑盒变白盒,项目已开源。
创智&交大发现AI能动性新规律, 78样本胜GPT5实现软件+科研自动化
上海创智学院和上海交大刘鹏飞老师团队发现AI能动性新规律,LIMI仅用78个样本就超越GPT - 5达14.1%,提出能动性效率原则,即AI能动性不仅源于数据丰富性,更来自战略性构建,为AI系统开发开辟新路径。
升级版Qwen3开源模型深夜来袭,超越Kimi-K2、DeepSeek-V3
深夜阿里千问推出 Qwen3-235B-A22B-Instruct-2507-FP8 版本。新模型通用能力显著提升,在多测评中表现出色,超 Kimi-K2 等模型。还增强多语言知识覆盖等性能,已在魔搭和 HuggingFace 开源。
一键实现PPT演讲自由!「解说音频+视频」同步生成,效果逼近真人
澳大利亚与英国研究人员提出文档到演示视频生成任务,推出PresentAgent系统。它能将长文档转为带语音和同步幻灯片的视频,流程可控且适应多领域。实验显示其生成视频接近人类表现,还设计了双路径评估策略。
卡帕西点赞Transformer内置计算机!每秒3万Token吞吐,拿下世界最难数独
当前大模型推理顶尖但精确计算不足,Percepta团队在Transformer权重里内嵌可执行程序,通过2维注意力头设计提升推理效率,能在普通CPU上实现每秒3万+Token的流式输出,还精确求解了世界最难数独。
英伟达半数打工人身家过亿!难怪离职率低
一份调查显示英伟达约半数员工身家超2500万美元,超78%超百万美元。管理层富翁数字更惊人,公司离职率仅3.7%。其造富源于员工持股和限制性股票计划,近期又宣布芯片量产。
冷战核废墟变8吉瓦AI超级工厂!黄仁勋押15亿,OpenAI独霸20年
英伟达、OpenAI和软银要将美国俄亥俄州冷战核废墟改造成全球最大AI超级工厂,终极电力规划达8吉瓦。黄仁勋宣布注资、担保,OpenAI签长约,孙正义改造电网,这或成稳赚买卖。
梁文锋突袭马斯克!DeepSeek V4 Pro对战Grok 4.6,首测夯爆了
梁文锋凌晨发布DeepSeek V4 Pro正式版,马斯克推出Grok 4.6,二者在多项评测中表现出色,直逼OpenAI和Anthropic顶尖模型,还降低了前沿智能价格。首测中,二者在真实任务场难分伯仲。
能让DeepSeek自进化的Harness!LlamaFactory作者开源新工具:0.2元自动造Agent
LlamaFactory作者郑耀威团队开源的PenguinHarness,是全球首个支持多Agent自进化的Harness,能自动构建、评测和改进Agent。它成本低、速度快,适配众多模型,还有严格契约保障安全。已在生产场景应用,效果显著。
RAG外部检索是多余的,英伟达最新成果颠覆认知
英伟达INTRA论文指出RAG架构中检索器和生成器在不同表示空间工作,存在retriever - generator mismatch问题。INTRA让模型用注意力查询检索自身编码表示,训练量小,在多跳QA上超越多种检索基线。