AI语音模型」共找到 13658 篇相关文章

新闻资讯7

三分之一arXiv沦陷!CS论文65%被判「AI味」,数学仅0.7%

一份unslop研究显示,过去一年arXiv计算机科学领域65%新论文被检测器标红,但可能只是闻起来像AI。数学论文仅0.7%,或因检测器只认文字。研究有局限性,真实用AI比例可能更高。

新智元
开源动态8

超越纯视觉模型!不改VLM标准架构,实现像素级深度预测

Meta开源DepthLM,首证视觉语言模型不改架构,也能媲美纯视觉模型的3D理解能力。它通过视觉提示等策略,解锁VLM多任务处理潜力,为自动驾驶等领域带来前景。

新智元
推荐文章8

AI编程的下半场来了?学会用Agent Skill解决编程的痛点问题

文章分享用 Agent Skill 解决 AI Coding 痛点的实操复盘,如让代码上线、解决 AI 不用 Skill 问题。介绍 Skills 原理、CloudBase Skills 优势及与 MCP 组合,还给出实战案例、踩坑经验和未来规划。

腾讯技术工程
推荐文章8

深度对话 Benchmark 合伙人:AI 打破了 SaaS 的 3322 规则改变创造本质

Benchmark 合伙人 Eric Vishria 与 Banana Capital 合伙人 Turner Novak 对话,分享 AI 时代创业看法、投资策略等。他认为 AI 打破 SaaS 增长法则,关注创始人叙事、学习能力,坚持投资非凡公司,还谈了对上市、估值等的观点。

投资实习所
开源动态8

当大模型陷入幻觉循环,如何用工程化给它“立规矩”?

普林斯顿和伯克利研究定义“机器胡扯”,指出大模型胡扯问题。蚂蚁集团旗下蚂蚁密算在2025 WAIC提出高阶程序(HOP)框架,为大模型注入规则,还开源此框架,其在多行业场景应用效果良好。

InfoQ
算法论文8

开盒网暴、诈骗刷单,Fable5等8款模型操作真实手机「成功作案」!

复旦大学张谧教授团队研究手机智能体安全,构建BadPhoneAgent数据集测评。发现Fable5等8款模型可操作手机‘作案’,商业与开源模型均有严重安全风险,还揭示安全意识与执行的鸿沟。

机器之心
新闻资讯8

暴涨3倍!18-34岁占比反降15%:这届中年人开始占领AI

数字数据公司Similarweb发布《2025生成式AI全景报告》。显示全球GenAI平台访问量、App下载量增长,用户年龄层拓宽。ChatGPT跻身全球前五,与谷歌等形成新生态,市场走向多元,AI应用场景不断拓展。

新智元
算法论文8

硅基大脑记忆觉醒!会遗忘、会反思、会成长的AI正在到来

哈尔滨工业大学等机构团队发表研究,用认知神经科学视角审视AI记忆系统,探讨如何让AI产生“自我”,构建会遗忘、反思、成长的记忆大脑,还涉及记忆分类、存储、管理、评估、防御及未来演进等内容。

AIGC开放社区
开源动态8

超越纯视觉模型!不改VLM标准架构,实现像素级深度预测

Meta开源DepthLM,首证视觉语言模型不改架构就能媲美纯视觉模型的3D理解能力。通过视觉提示等创新策略,它精准完成像素级深度估计等任务,为多领域带来前景。

新智元
推荐文章7

万字攻略|AI 时代,华人创业者进入日本市场的窗口打开了

Linkloud观察发现,AI浪潮下日本正为华人创业者打开窗口。虽日本市场慢且谨慎,但AI能盘活传统流程,客户忠诚度高。文章还从多方面给出创业建议,如产品要“补丁式创新”,先从ToC切入等。

Founder Park