「科学智能2.0」共找到 5582 篇相关文章
百度网盘的阵势真不小
作者参加百度AI开放日,看到百度文库和网盘发布一系列AI新功能,已发展成一站式AI内容生产力平台。如全新AI相机功能多,GenFlow 2.0体验流畅,背后依托沧舟OS打通全链路。这反映泛内容创作降门槛趋势。
WPS没有忘记WPS|甲子光年
在世界人工智能大会上,多家企业推出AI PPT类产品,但大多只能生成,不会使用PPT。金山办公发布WPS AI 3.0版本——WPS灵犀,它是原生Office办公智能体,能像人一样使用办公软件,还带来灵犀语音助手和WPS知识库。
对话王小川:换个身位,做一家「医疗突出」的模型公司
百川智能创始人王小川与极客公园创始人张鹏长谈。百川曾快速扩张后调整,聚焦医疗。其新发布的医疗大模型Baichuan - M2性能优异,超OpenAI两开源模型。王小川认为造AI医生复杂,且AI家庭医生会比无人驾驶更早到来。
香港科技大学、Manycor开源空间大模型,超3000颗星
香港科技大学、Manycore联合开源空间大模型SpatialLM,用于处理3D点云数据。它结合点云特征提取、对齐和语言生成,实现高效转换。研究团队经多种尝试选定基于点的方法及Sonata编码器,还选Qwen2.5 - 0.5B为基础模型。
把 Gemini 和 GPT 放到《我的世界》当教练,谁能看懂机器人的微操?
国立清华与英伟达团队研究《VLM-AR3L》,把Gemini 2.0、GPT-4.1等拉进考场,评估视觉裁决能力。结果显示Gemini综合最稳,开源小模型特定场景反超。还提出VLM-AR3L框架破使用瓶颈,实战超人类手写奖励。
AI圈再颠覆!中国AI翻译耳机通话翻译,实测震撼
科大讯飞发布全新AI翻译耳机,上海与迪拜连线对话实测表现震撼,响应延迟低至两秒。其集成“端到端语音同传”技术,采用“骨导+气导”设计。此外,翻译机2.0也升级,科大讯飞在AI翻译领域优势显著。
国产「3D版Anthropic」再获数亿融资!60人初创,卡住全球3D脖子
影眸科技完成数亿元新一轮融资,发布全球首个具千万面级生成能力、引入‘先思考、再生成’逻辑的3D大模型Hyper3D Rodin Gen - 2.5。其有诸多优势,获多巨头认可,目标是定义空间智能底层规则。
准确回答视频细节!11B模型挑战视频理解「证据级」任务,开源可商用
近日,复旦大学邱锡鹏教授领衔的OpenMOSS团队联合模思智能开源11B参数的多模态视觉理解模型MOSS-VL。它能准确回答视频里可被验证的细节、时间、过程和空间关系,有六项证据级能力,架构设计独特,采用Apache2.0开源许可。
多模态AI黑马刷榜后再造神器:一个产品搞定图片视频播客生成,自带百种特效,大牛梅涛团队出品
AI大牛梅涛创立的智象未来公司推出vivago2.0(智小象AI),支持图片、视频、播客生成,有上百种特效模板,生图还能自动优化prompt。其依托HiDream - A1,结合HiDream - I1和HiDream - E1能力,团队技术实力强且融资顺利。
xAI解散,但Grok还在上新,马斯克官宣新模型
xAI 解散、大批成员离职后,马斯克透露 Grok 最新模型进展,参数量 1.5T 的 Grok V9 - Medium 已完成训练,预计两到三周内发布。他还宣布现有 0.5T 模型年底前开源,此外首款编码智能体 Grok Build 也备受关注。