工业代码大模型」共找到 8731 篇相关文章

开源动态8

华为新开源!扩散语言模型突破32K上下文,还解锁了「慢思考」

今年文本生成领域从自回归向扩散语言模型转变,但长序列训练不稳定是痛点。华为发布 openPangu-R-7B-Diffusion,将上下文长度扩至 32K,在多基准创 7B 参数量级 SOTA,还解析了其技术革新。

机器之心
产品应用8

谷歌DeepMind深夜放核弹:世界模型Genie 3登场,重新定义“生成式AI”

谷歌DeepMind推出第三代通用世界模型Genie 3,能生成多样化交互式环境,可实时导航。它较前代有诸多突破,有模拟物理特性等核心能力,能赋能具身智能体研究,但也存在行动空间有限等局限。

AI寒武纪
算法论文8

国内首篇!融合语言模型的多模态触觉传感器,推动机器人触觉迈向人类水平

清华大学丁文伯团队联合多机构,受鸽子感知机制启发研发仿生多模态触觉传感器 SuperTac,构建 8.5B 参数触觉语言模型 DOVE,成果发表于《Nature Sensors》,推动机器人触觉迈向人类水平。

机器之心
推荐文章7

DeepSeek-R1发布100天后:全面复盘推理大模型复现研究及未来!

推理语言模型(RLMs)发展显著,DeepSeek - R1发布引发广泛影响且未完全开源。MiroMind等总结其复现研究,关注SFT和RLVR方向,介绍数据构建、方法设计、训练过程细节及实验关键发现。

PaperAgent
算法论文9

从自己出题到自己选题:耶鲁新方法让大模型 Self-Evolution 又进一步

本文解读了耶鲁、斯坦福等多机构联合提出的INFUSER大模型自进化新方法,针对现有方法仅以难度筛选训练数据的缺陷,提出用影响力分数筛选高价值训练题,实现双模型协同动态进化,实验验证效果显著。

深度学习自然语言处理
新闻资讯7

奥特曼摊牌:别再比模型跑分了,苹果才是真宿敌

2025年模型发布密集,但方向一致在补短板,更像基础设施建设。2026年各玩家或集体解锁,真正换代要让AI成文明基础设施。奥特曼称OpenAI长期对手是苹果,还拉Jony Ive造秘密设备。

新智元
开源动态7

腾讯Youtu-agent 不会代码,也能搞定数据分析+深度研究+HTML报告

腾讯开源的Agent框架Youtu - agent灵活高性能,可用于数据分析等多任务。基于openai - agents构建,适配多种模型API等。突出优势是能自动化生成智能体及其配置,采用YAML配置方案,有内置‘元智能体’,还完全异步。

CourseAI
产品应用7

仅用10天?Anthropic最新智能体Cowork的代码竟然都是Claude写的

Anthropic发布智能体工具Cowork,仅耗时一周半,其代码由Claude Code所写。它是Claude Code简化版,向特定用户开放,有多种功能。有用户称效率提升巨大,也引发创业圈震动,部分类似产品开源。

机器之心
产品应用8

世界最强医疗模型百川M3发布:AI医疗,奇点已至

百川智能发布并开源全球最强医疗模型Baichuan - M3,各项指标SOTA且超越人类医生平均水平。它告别机械‘背医书’,学会主动追问、排查病因,解决AI‘胡说八道’问题,准确度超GPT - 5.2 - High。

新智元
推荐文章8

我用 AI 翻译的三个阶段:提示词时代 → 推理模型时代 → Agent 时代

作者分享近 2 年 AI 翻译经验,将其分为提示词、推理模型、Agent 三个时代,介绍 Agent 翻译与提示词翻译区别,还阐述 Skill 创建迭代、三种翻译模式由来等,给出解决一致性问题等方法。

宝玉AI