语言智能体」共找到 4319 篇相关文章

产品应用7

突然发现,谷歌的 AI Mode “免费、全面”地开放了

上个月谷歌在 iOS 和安卓的 Google App 全面开放 AI Mode,现几乎对所有能访问 google.com 的地区免费开放。它基于 Gemini 2.5 等模型,能智能答问、对话交互,还植入 Agent 功能,变革搜索验。

MacTalk
算法论文8

邱锡鹏团队新作:让机器人学会「察言观色」

复旦大学邱锡鹏团队等发布全新操作框架 RoboOmni,突破传统 VLA 依赖显式指令局限。它融合多模态信号,构建数据集,在成功率等方面超基线,以跨模态指令让机器人主动推断意图,开启具身智能‘共情时代’。

AI科技评论
算法论文8

一个模型装下整个物种树!伯克利GPN-Star斩获基因预测双料冠军

加州大学伯克利分校等机构推出基因组语言模型GPN - Star,可将全基因组比对和物种树信息装进大模型。它克服传统GLMs短板,实现三点升级,在多基准测试表现出色,是强大的全基因组变异解读框架。

新智元
产品应用8

Jina Reranker v3: 全新“列式”重排器,0.6B参数刷新文档检索SOTA

Jina AI推出第三代重排器Jina Reranker v3,在多语言检索基准上刷新SOTA。它参数仅6亿,有“last but not late”交互机制,能一次性处理查询和文档。还提供动态量化格式,方便不同硬件部署。

Jina AI
算法论文7

刚刚,OpenAI发长篇论文:大模型幻觉的原因找到了~

OpenAI发论文揭示语言模型出现幻觉的根本原因,即训练和评估过程奖励猜测而非承认不确定性。预训练阶段就埋下幻觉种子,后训练阶段‘考试机制’强化幻觉,还给出改评分规则的解法。

PaperAgent
开源动态8

刚刚,大模型装上「鹰眼」!首创高刷视频理解,谷歌Gemini 2.5完败

面壁智能开源MiniCPM-V 4.5多模态端侧模型,8B参数越级反超72B巨无霸,在多领域达SOTA。它首创高刷视频理解,性能强、效率高、适合端侧部署,还实现多技术创新,是开源端侧多模态AI的革命。

新智元
产品应用8

长得好看又会「看脸色」,这家具身公司不卷「干活」卷「懂你」,天使轮再获数千万战略加注

2026年具身智能转向家庭场景,深穹星核认为面向C端核心是意图理解,推出VLIA模型。其与头部公司合作获意图数据,还与星闪联盟合作推动产品落地,有三层技术护城河,探索长期陪伴机制。

机器之心
新闻资讯7

The Batch: 938 | Gemini 的音乐生成器

Google将音乐生成器Lyria 3加入Gemini和YouTube,它接收文本或图像生成30秒音频,支持多语言歌词。在质量和遵循提示上优于前身,采取版权保护措施,对特定用户免费或提供高额度使用。

DeeplearningAI
推荐文章7

Harness Engineering?不过是把工程常识换个名字

Chayenne Zhao 发文炮轰 harness 概念,认为它只是工程常识换个名字。她以 SGLang 社区构建多智能系统为例,阐述解决问题的方案和关键决策,还指出真正驱动改进是环境层面,而非模型。

AI工程化
开源动态8

让机器人「秒懂人话」!中国电信TeleAI发布首个实时文本驱动人形机器人控制框架TextOp

中国电信人工智能研究院(TeleAI)具身智能团队推出人形机器人TextOp通用小脑,首创流式文本驱动的实时小脑控制范式。用户发文本指令,机器人就能实时理解、无缝切换动作,在多场景有应用潜力。

机器之心