新全栈」共找到 5133 篇相关文章

新闻资讯7

100亿美元押注AI:红杉换帅后,寻找“白天鹅”

2026年8月,红杉资本募得约100亿美元。掌舵人林君睿和帕特接受专访,称当下是“白天鹅”市场。此前红杉经历领导层更替,团队调整投资决策,还补仓Anthropic,布局AI多环节。

DeepTech深科技
算法论文8

VLA模型为何忽视语言?破解指令跟随幻觉,分布外场景泛化突破

当前VLA模型常依赖视觉线索而非语言指令,导致场景表现不佳。论文提出LangForce方法,引入对数似然比损失,强化模型对语言的依赖,提升分布外泛化能力,还保留语言核心功能。

新智元
算法论文8

CVPR 2025 Highlight | 提升自回归模型样例学习能力,Few-shot图像编辑范式开源

当前图像编辑模型在处理概念时泛化能力不足,为解决此难题,Meta等研究者提出自回归模型InstaManip,创性提出分组自注意力机制和关系正则化策略,在few - shot图像编辑任务上取得优异效果。

机器之心
开源动态8

文本已死,视觉当立!Karpathy狂赞DeepSeek模型,终结分词器时代

DeepSeek成果DeepSeek - OCR以像素处理文本,压缩率小于1/10,基准测试领跑,开源一夜获4.4k星。Karpathy力挺,认为应赶走分词器,展望视觉成通用输入前景,马斯克有更科幻猜想。

新智元
算法论文8

谷歌DeepMind「粪坑淘金」方法,暗网毒数据也能训出善良模型

谷歌DeepMind研究团队发表论文提出生成式数据精炼(GDR)方法,不直接生成数据,而是用大模型净化原始数据,保留有用信息。该方法能解决数据枯竭、隐私等问题,实验显示效果良好。

新智元
新闻资讯7

“SOTA”推理模型避战Qwen和R1?欧版OpenAI被喷麻了

“欧洲的OpenAI”Mistral AI发布首款推理模型Magistral,却再遭质疑未与最版Qwen和DeepSeek R1对比。该模型亮点是支持多语言推理,以纯RL方式训练,为LLM强化学习提供范式。

量子位
算法论文8

OpenClaw代码越改越崩?研究EvoClaw揭示:Agents持续开发成功率仅13.37%

USC邓港大等联合发布评估基准EvoClaw,揭示AI在持续开发场景下表现不佳,成功率仅13.37%。研究还指出当前评测易高估AI能力,提出DeepCommit重构演进历史,分析各模型在持续演进中的局限与问题。

量子位
开源动态7

致敬Kimi K2:基于slime的流程INT4量化感知RL训练

受Kimi K2团队启发,SGLang RL团队落地INT4量化感知训练流程方案,在强化学习多方面取得进展,还在slime框架复现流程方案,实现媲美BF16精度,提高Rollout效率,为社区提供开源参考。

机器之心
算法论文8

Vision-Zero:零数据VLM自我进化!陈怡然团队提出零监督训练范式

陈怡然团队提出零监督训练范式Vision-Zero,在多模态任务表现突出。它借鉴自博弈技术,设计自博弈框架,解决数据稀缺和知识天花板问题,还缓解跨能力负迁移,开源代码与模型可供研究。

机器之心
开源动态8

Qwen3技术报告首次公开!“混合推理模型”是这样炼成的

本文首次公开Qwen3技术报告,介绍其模型架构、预训练及后训练过程、性能表现等技术细节。Qwen3整合两种模式,引入思考预算机制,降低轻量级模型计算资源,在多基准测试领先,多语言支持扩展至119种,所有模型开源。

通义千问Qwen