新能安」共找到 7785 篇相关文章

新闻资讯7

OpenAI模型Day0就被嫌弃!排名拉垮,不如一月底发布的国产模型

OpenAI推出GPT - 5.4 mini和nano模型,主打快速经济,针对编程等优化。但评测中GPT - 5.4 mini排名不佳,不如国产Kimi 2.5,且价格对比有争议。不过与自家旧版比有提升,网友测试有亮点。

量子位
产品应用8

抖音+Claude Code=?马斯克都要转发的产品!一句话,就做一个中国风福尔摩斯游戏!

Loopit被称为‘AI编程版的抖音’,用户说句话就做互动内容,如解谜游戏等。它让编程像拍视频一样成消费品,有创作和社区,结合抖音轻量与游戏互动感,粘性更高。

AI产品自由
开源动态8

AI 真看懂物理世界吗?FysicsWorld:填补全模态交互与物理感知评测的空白

多模态大语言模型正经历范式转变,目标是实现全模态协同交互。但现有评测体系难跟上模型发展。飞捷科思和复旦团队推出 FysicsWorld 基准,可评测模型多力,还提出 CMCS 策略,为全模态智发展提供指引。

机器之心
产品应用7

Gemini CLI 升级:深度集成 VS Code,终于不用在终端和编辑器之间反复横跳了

Google发布Gemini CLI重要更,实现与VS Code深度集成,从架构层面解决AI编程助手的上下文感知问题。版本有工作区上下文感知和原生差异对比界面两个核心功,还给出部署要求。

AI工程化
开源动态8

AI 本地跑?Google 开源模型上线,本地量化后占用不到 200MB 内存,支持百余语言

Google DeepMind推出开源嵌入模型EmbeddingGemma,专为本地设备高效运行设计。它用Matryoshka方法和量化感知训练,提升效率。在MTEB测试中成绩佳,支持百余种语言,内存占用少,已集成多种工具。

InfoQ
新闻资讯7

马斯克宣布:Grok学会看片了!无字幕看懂陶哲轩菲奖级难题

马斯克宣布Grok可分析任何视频。它对伪造视频鉴假溯源,但也有处理画面靠字幕、有幻觉问题和效果不稳定的缺陷。实测中它理解无字幕视频,还整理访谈内容。这功虽便利,但引发人类力退化担忧。

新智元
产品应用8

“天下苦CUDA久矣!”KernelCAT率先掀桌,实现国产芯片无痛适配

中国AI产业与英伟达GPU及CUDA生态深度依赖,国产AI根基脆弱。KernelCAT作为AI Agent,开发高性算子,在昇腾芯片调优测试中表现出色,还让国产模型在昇腾芯片上高效部署,实现35倍加速。

InfoQ
算法论文8

用两个简单模块实现分割理解双重SOTA!华科大白翔团队等推出多模态框架

华中科技大学和金山办公团队联合提出语义增强特征提取器(SEFE)和交错局部视觉耦合(ILVC)模块,构建多模态大模型LIRA,解决现有模型分割不精确和理解有幻觉问题,在分割和理解任务上达SOTA。

量子位
算法论文8

苹果研究:不微调、不重训,如何让AI提问效率暴增6.5倍?

苹果与牛津、港城大合作提出 BED - LLM 方法,让 AI 解决问题力提升 6.5 倍,无需微调重训。它基于序贯贝叶斯实验设计框架,通过三重智慧设计,经测试全面超越基准方法,或开启‘智慧对话’时代。

机器之心
推荐文章7

“都什么年代了程序员还在手搓代码,连小白都写 Prompt 生成代码了”

现在很多人标榜用 AI 写代码高效,贬低手搓代码。作者认为两者都是写代码的手段,不是目的,不对立。并从多方面分析适合 AI 或手搓代码的场景,强调二者搭配使用事半功倍。

宝玉AI