「领域特定语言」共找到 2868 篇相关文章
Emu3.5:能够原生预测下一状态的多模态世界模型,媲美Nano Banana
北京智源研究院推出多模态世界模型Emu3.5,能原生预测视觉和语言下一状态。用超10万亿token数据预训练,后经强化学习训练。团队提出DiDA提升推理效率,其性能媲美Nano Banana,项目已开源。
「美队」老黄深夜扔出地表最强GPU!算力百倍狂飙,下次改演雷神
凌晨,老黄GTC主题演讲华盛顿首秀,亮出下一代GPU核弹Vera Rubin,性能狂飙100倍。目前,Blackwell已全面量产,2026年底两大GPU王牌预计爆赚5000亿美金。此外,英伟达还公布了一系列合作与技术创新。
GAIR Live 预告|从 IROS 2025,看智能机器人前沿趋势
IROS 2025 近日在杭州闭幕,作为全球机器人领域盛会,展示具身智能新突破与方向。GAIR Live 将携手学者与产业领军者,通过线上直播解读其核心趋势,拆解研究范式转向,还设有多个热门话题探讨。
可攻可防,越狱成功率近90%!六大主流模型全中招 | EMNLP'25
研究人员聚焦大型语言模型(LLMs)安全漏洞,提出全新越狱攻击范式SCP与防御策略POSD。SCP基于DTD机制,在6个主流模型上平均攻击成功率达87.23%;POSD能有效抵御攻击,还提升模型泛化能力。
2025谷歌奖学金公布,37位华人上榜!Jeff Dean祝贺,清华入选最多
2025谷歌博士奖学金公布,来自35个国家、12个研究领域的155名博士生上榜,分享超1000万美元资金,入选人数创历史新高。今年有37位华人博士生入选,来自清华、北大等知名学府。谷歌DeepMind首席科学家Jeff Dean祝贺。
Browser Use 推出 Code Use:直接用代码控制浏览器
Browser Use 发布 0.9.0 版本,推出专为爬取数据设计的 Code Use。它开发特殊 Agent 和定制 LLM 输出特定代码,通过 CDP 直接操控浏览器,效率和准确性理论上更高,还给出使用示例,同时提醒了安全问题。
医生版 ChatGPT 3 年估值 60 亿美金,被低估的 AI 硬件新玩法:相框
OpenEvidence被称为医学领域的Google和医生版ChatGPT,成立3年估值达60亿美金。它用高质量数据训练小而专模型,有“无幻觉”机制,直接面向医生推广,产品进化为临床决策助手,收入来自制药广告。
Dexmal原力灵机开源Dexbotic,基于PyTorch的一站式VLA代码库
Dexmal原力灵机推出基于PyTorch的开源视觉-语言-动作模型(VLA)代码库Dexbotic,面向具身智能研究者。其架构含三大核心组件,有五大特征,还推出开源硬件,未来将持续投入生态建设。
告别 260 亿美元的低效投入,HappyRobot 为物流业配置 “AI 调度员”
HappyRobot为物流市场搭建AI-native平台,切入“voice agent + 通信自动化”领域,打造“数字员工”。它能提升沟通效率、降低成本,已获6200万美元融资,还尝试拓展至其他行业。不过,也面临AI价值兑现不对称等潜在风险。
我是微软工程师,编程了30多年,如今我几乎不再编程了
微软资深工程师 Paul Payne 分享编程 30 多年感受,认为 AI 正颠覆软件工程领域。他所在团队研究 LLM 驱动系统,系统从程序员手中接走大量工作,Amplifier 等工具让编程变得更简单,人类程序员价值将升华。