双预训练架构」共找到 3645 篇相关文章

新闻资讯7

OpenAI最强对手出现!马斯克发布Grok-4,性能碾压Claude 4两倍!

半小时前马斯克发布Grok - 4,虽Grok3.5跳票、直播迟到被吐槽,但它训练量和算力投入大。在多项基准测试中碾压Claude Opus 4,还具备原生工具调用等能力,xAI目标是让其更快更智能。

探索AGI
算法论文8

边画边想!多模态Reasoning迎来巨大提升!

论文指出文本无法精准表达空间关系,现有视觉语言模型(LVLM)在空间推理上是短板。ViLaSR让模型直接画图推理,经三阶段训练,在五大空间推理测试中表现出色,还开源资源,有望带来机器认知升维。

深度学习自然语言处理
开源动态8

对标GPT-4o和香蕉!浙大开源ContextGen:布局身份协同新SOTA

浙江大学ReLER团队开源ContextGen框架,攻克多实例图像生成中布局与身份协同控制难题。基于Diffusion Transformer架构,用双重注意力机制实现布局精准锚定与身份高保真隔离,在基准测试中超越开源SOTA模型,对标GPT - 4o等闭源系统。

新智元
新闻资讯8

定义RAG新基准?谷歌发布 Gemini Embedding 2:首个原生多模态嵌入模型,延迟骤降70%

谷歌昨夜推出首个基于 Gemini 架构的原生多模态嵌入模型 Gemini Embedding 2,通过 Gemini API 和 Vertex AI 向开发者公开预览。它可将多类型数据映射到统一嵌入空间,多项基测排名第一,还获早期合作伙伴高度评价。

InfoQ
算法论文8

40倍推理加速!复旦&微软:用「非线性流」拟合复杂轨迹,2步生成媲美原画

ArcFlow是复旦与微软提出的图像生成加速方案,引入非线性流拟合复杂轨迹。它在仅2步推理下保持画质,实现约40倍推理加速和4倍训练收敛加速,微调极少参数,在多模型验证效果出色。

量子位
新闻资讯8

对话蚂蚁灵波首席科学家沈宇军:2万小时真机数据,用“慢功夫”做具身智能|甲子光年

蚂蚁灵波首席科学家沈宇军接受专访,称具身智能处于‘GPT - 1时刻’。团队选‘慢’路,积累2万小时真机数据,发布四个具身智能模型并开源。介绍模型架构、优势、问题及未来计划,还谈了开源考量等内容。

甲子光年
推荐文章7

Clawdbot 之后,我们离能规模化落地的 Agent 还差什么?

OpenClaw爆火,但在企业和商业环境中存在昂贵、不可控等问题。Monolith砺思资本技术沙龙探讨Agent规模化落地难题,指出需关注稳定性等指标,还分析了数据成本、训练速度、基础设施、状态管理等方面的困境与解决思路。

Founder Park
新闻资讯8

比肩英伟达H20!阿里自研PPU浮出水面

1月29日,阿里旗下平头哥官网公布高端AI芯片“真武810E”信息,标志“通云哥”协同体系亮相。该芯片全栈自研,已服务超400客户。其PPU架构性能比肩英伟达H20,性价比更高,阿里还支持平头哥探索独立上市。

芯师爷
开源动态8

开源模型首次物理奥赛IPhO夺金!上海AI Lab 235B模型击败GPT-5和Grok-4

上海AI Lab的P1 - 235B - A22B在国际物理奥林匹克竞赛夺金,在HiPhO基准测试获12金1银,超越GPT - 5等闭源模型。团队构建HiPhO基准测试,用多阶段强化学习训练模型,开发PhysicsMinions系统提升推理能力。

量子位
新闻资讯7

我们都错怪GPT-5了,路由统一算力,免费用户也能创造收益

GPT - 5发布后,其路由架构备受关注。开源社区的Arch - Router类似其路由系统,能结合任务领域和动作制定策略。GPT - 5路由框架可平衡成本与性能,还能转化免费流量,未来想掌控用户与模型交互路径。

量子位