大厂工作」共找到 5815 篇相关文章

开源动态8

超越O4-mini,多模态模型终于学会回头「看」:中科院自动化所提出GThinker模型

现有多模态模型在通用场景推理有瓶颈,缺乏对视觉线索校验与再思考能力。中科院自动化所提出GThinker模型,有创新的「线索引导式反思」模式,经两阶段训练,性能超O4 - mini,论文等已开源。

机器之心
产品应用8

懂方言,通诗词,精通30国语言,阿里发布语音识别模型Fun-ASR1.5

阿里发布语音识别模型Fun - ASR1.5,可精准识别30种语言,覆盖中文七方言体系及二十余种地方口音,强化古诗词诵读专项识别,后处理环节优化标点预测和文本归一化,降低人工成本。

千问大模型
开源动态8

谷歌痛失王座?港科贾佳亚团队DreamOmni2开源,超强P图暴击Nano Banana

港科贾佳亚团队开源DreamOmni2,该模型基于FLUX Kontext,能处理多参考图像,在多模态编辑与生成上表现出色,超越谷歌Nano Banana等模型,还构建了新测试集与数据构建范式。

新智元
新闻资讯7

马斯克xAI正式入局世界模型,目标:明年搞出个AI生成的游戏

马斯克的xAI入局世界模型开发,对手是Meta和谷歌等。其从英伟达挖专家,目标是开发先进AI系统,还计划明年底前发布AI生成游戏。不过构建世界模型挑战,游戏行业有人对此谨慎。

AI寒武纪
算法论文8

ACL 2026 Main | 不只是调用地图API,Spatial-Agent让模型生成可执行地理分析工作

语言模型在空间领域应用广泛,复杂地理分析问题需组织自然语言成可执行流程。Spatial - Agent 加入 GeoFlow Graph 中间层,借用 GIScience 理论,实验显示能提升准确率,不过仍受数据质量等限制。

机器之心
产品应用8

Agent、图像、视频全是版本升级:春晚还没开,豆包AI就火了

2026年AI市场竞争激烈,海外公司密集发布新模型致华尔街震动。国内腾讯、阿里、字节参战,字节官宣豆包参与春晚互动。2月14日火山引擎宣布豆包系列模型全面升级,含模型2.0、图像模型Seedream 5.0 Lite、视频模型Seedance 2.0。

机器之心
新闻资讯8

4.3亿听障人士的福音,哥团队研发脑控助听器,最高增益12分贝

哥伦比亚学等机构团队研发实时闭环脑控听力系统,发表于Nature Neuroscience。该系统解码脑注意力信号,放目标人声、压制杂音,打破传统助听器瓶颈。经多项测试,效果显著,临床应用潜力

DeepTech深科技
新闻资讯8

Claude 4 核心成员访谈:提升 Agent 独立工作能力,强化模型长程任务能力是关键

Anthropic 两位研究员在采访中表示 2025 年强化学习在语言模型训练奏效,如 Opus 4 能处理长周期任务。还探讨模型发展方向,如用户与多模型交互、模型可解释性等,认为未来会有白领 AI 员工。

Founder Park
开源动态7

FLUX.2开源了,但是我好像也看到了小公司的无力。

AI绘图曾经的王者FLUX.2部分模型开源,包括dev和即将开源的klein。但与Nano Banana Pro对比,其生图、改图及世界知识表现欠佳。这凸显小资源碾压下的无力,但开源仍有价值。

数字生命卡兹克
产品应用8

每2秒吃透一道高数题!华为终于揭秘准万亿MoE昇腾训练系统全流程

华为揭秘准万亿MoE昇腾训练系统全流程,通过“昇腾+Pangu Ultra MoE”实现国产算力与模型自主可控训练闭环,从集群利用率、单节点算力、后训练技术三方面突破,实现模型高效训练。

量子位