「应用视觉团队」共找到 5641 篇相关文章

算法论文7

Reasoning模型可以Self-Train!

当前大模型依赖人类标注数据,成本高且扩展难。论文探讨模型自我纠错、自主进化可能,提出自我奖励训练(SRT),用投票共识代替人类标注。在数学数据集上有效果,但高难度数据集出现问题,作者给出解决办法并开源代码。

深度学习自然语言处理
新闻资讯8

微软 CEO 萨提亚·纳德拉:智能体即产品,SaaS 已死?

微软 CEO 萨提亚·纳德拉在 Build 大会后接受专访,称正经历软件与智能范式巨变,AI 驱动的智能体网络将重塑企业软件未来,SaaS 会融入其中。他还分享了 AI 时代软件与商业模式变革的核心洞察。

AI科技大本营
新闻资讯7

小米的中国芯,与雷军没说的“四个秘密”

本文围绕小米玄戒芯片展开,介绍其推出背景、工艺选择、研发成本及应用前景。指出华为、OPPO调整业务给小米带来契机,3nm工艺因品牌与成本平衡成首选,还分析了自研成本和知识产权等挑战。

芯师爷
新闻资讯8

Gemini 2.5 Pro强势更新并霸榜,Claude 3.7首次遭遇全方位碾压!

Google DeepMind推出的Gemini 2.5 Pro在LMArena各大排行榜全面登顶,实现文本、视觉、Web开发全方位霸榜,编码能力也大幅升级。虽有质疑,但短期内难有对手,还引发对Google I/O大会更多惊喜的期待。

AGI Hunt
新闻资讯9

Meta 再次上桌!个人AI产品爆红,扎克伯格身价直涨2000亿

本文报道Meta推出独立个人AI助手Muse,上线两周登顶美国iOS应用商店免费榜,累计下载超250万次。Meta调整AI战略转向个人AI Agent赛道,依托社交网络与可穿戴硬件底牌冲击个人计算入口,同时面临多重竞争。

DeepTech深科技
新闻资讯7

人形机器人开始打国球了!两台机器人完整打完11分制比赛

第二届世界人形机器人运动会8月22 - 26日将在「冰丝带」举行,港大超维战队的两台人形机器人按11分制自主打完一局。其采用自主研发的SMASH 2.0系统,团队还探讨技术难点、系统升级等问题。

量子位
开源动态8

114B参数、6B激活,Sand.ai刚刚把全球首个千亿MoE视频生成模型开源了

Sand.ai团队开源全球首个千亿MoE视频生成模型MAGI - 2 - preview,总参数114B,单次前向激活约6B,成本低效果好。该模型解决了视频生成Scaling难题,架构、系统设计出色,开源将改变行业规则。

量子位
开源动态8

Codex给V4-Flash装上眼睛,DeepSeek也会文档OCR

GitHub上的项目codex-vision-proxy让接进Codex的DeepSeek能看图,不用换模型或等官方,装本地代理即可。它还附带视觉工具包,在智能文档解析和OCR上潜力大,证明多模态能力可长在管道上。

CourseAI
新闻资讯7

智元下架了首席科学家罗剑岚

量子位发现智元机器人官网合伙人团队名单中,原首席科学家罗剑岚名字不见。此前社媒已有其离职传闻,其个人主页也不再提及智元。此次人事变动时间点微妙,智元刚启动赴港上市流程,具体待官方确认。

量子位
新闻资讯7

AMD终于有机会撬动CUDA了吗?

过去AMD GPU虽性能强但难敌英伟达CUDA生态。2024年有机构认为其缩小软件差距概率为0,但如今判断改变,AMD软件团队进步,客户回归,可它仍需解决软件集群稳定性和Helios量产问题。

DeepTech深科技