当下的力量」共找到 10803 篇相关文章

算法论文8

大突破!实验证明,RL能为LLM注入“创新”能力

此研究挑战‘RL不教新技能’观点,通过‘字符串转换预测’实验证明,RL能让LLM学会组合已有原子技能,形成可泛化、迁移元技能,还给出模型能力提升路径。

深度学习自然语言处理
算法论文8

用子模优化法为DeepResearch生成多样性查询

开发DeepResearch时,生成多样化查询是关键。多数开源项目处理方法粗放,本文提出结合句向量与子模优化方法,设计子模目标函数,给出代码实现,实验显示该方法生成查询组合多样性更高。

Jina AI
开源动态8

基于闪电注意力机制,创新高效开源大模型

传统Transformer架构处理长文本和复杂推理任务有效率瓶颈,多数领先模型仍依赖传统注意力设计。MiniMax开源基于闪电注意力机制专家混合模型Minimax,从架构、创新模块、训练框架等多方面优化,表现突出。

AIGC开放社区
算法论文8

GraphRAG太慢LightRAG延迟高?华东师大新方法一招破解双重难题

华东师大李翔老师带领Planing Lab团队推出E²GraphRAG方法,解决GraphRAG索引慢、LightRAG查询延迟高问题。该方法用SpaCy识别实体,结合图和树查询,在构建和查询时间上表现出色。

量子位
新闻资讯8

Claude王座失守!OpenAI一夜反超,神秘GPT‑6 Sol偷跑

本文报道AI大模型领域最新战局,OpenAI在OpenRouter平台开发者Token消耗付费流水,首次超越Anthropic Claude,终结了Claude两年半统治,同时神秘GPT-6 Sol偷跑曝光,双方开启终极对决。

新智元
新闻资讯8

中国团队首次在Nature子刊发布医疗AI标准,未来医生MedGPT摘得全球桂冠

中国AI医疗公司“未来医生”协同专家制定CSEDB,首次提出评估医疗大模型临床能力系统性框架,被《npj Digital Medicine》收录。在其评估下,未来医生MedGPT在主流大模型中夺冠。

量子位
推荐文章7

IDE消亡之年?Steve Yegge两句狠话:2026年还用IDE就不行,每天烧500–1000美元Token才合理

Steve Yegge和Gene Kim认为,从2026年1月1日起,依赖传统IDE工程师会被拉开差距,这是‘生产方式换代’。他们还提到AI将重塑软件开发,无开发或成现实,新开发方式价值更优。

InfoQ
新闻资讯7

2027年,人类最后一次抉择

Anthropic首席科学家Jared Kaplan预警,2027 - 2030年人类要抉择是否让AI递归自我进化。还介绍了AI进化三阶段,以及2027年关键技术和硬件因素,同时Anthropic报告揭示AI对工程师工作重塑。

新智元
新闻资讯7

一边秀肌肉,一边设围墙,NVIDIA 发布 OmniVinci,性能碾压 Qwen2.5-Omni,却被骂“假开源”

NVIDIA 推出多模态大语言模型 OmniVinci,结合架构创新与数据合成流水线,训练 token 仅为 Qwen2.5 - Omni 六分之一,却在多项基准测试表现更佳。但采用限制商业用途许可证,引发争议。

AI前线
产品应用7

jiSGLang集成ktransformers:2TB内存运行Kimi K2 Thinking模型

对于内存多但GPU资源有限用户,SGLang集成ktransformersCPU内核,支持直接运行Kimi K2 Thinking模型。它无需等量化,还能微调,虽性能与GPU方案有差距,但给用户新选择。

AI工程化