上科大」共找到 6447 篇相关文章

新闻资讯7

AI 视频生成时代,留给人类的只有演技?

社交媒体疯传AI换脸视频,可实现零成本「无限角色互换」,还能精准捕捉微表情。快手Kling Motion Control等工具受关注,能低成本完成专业镜头。价格亲民,技术进步,但也引发诈骗等担忧。

机器之心
产品应用7

Deepseek是被降智了吗?

作者认为Deepseek被降智,存在诸多问题,如不懂用户意图、长文理解差、措辞怪异、提示词调教难、无脑捧杀、幻觉率高、深度思考弱等,还对比了与GPT在人际交往话题回复的差异。

深度学习自然语言处理
产品应用8

真情实感体验了阿里「千问APP」后,为什么说它是「中国的ChatGPT」?

近日阿里推出面向全球的千问APP。从产品定位、模型能力、效果来看,它接近ChatGPT,是“中国的ChatGPT”。它打通Qwen模型和应用,界面极简,功能多,体验佳,有望让家重新认识阿里模型应用。

机器之心
开源动态7

付费Mathpix公式识别不香了~不要钱舒服!

复杂学文献中公式识别问题重要,但现有模型有局限。DocTron - Formula通过简单微调在多场景达先进水平,还引入CSFormula数据集。它基于Qwen2.5 - VL微调,在多个数据集效果佳。

CourseAI
产品应用7

从天价咨询到免费AI,夸克能改变志愿填报这门生意吗?

高考报志愿难题一直存在,天价咨询服务并非人人能享。夸克推出国内首个高考志愿模型,免费生成志愿报告。它能理解复杂规则、把握考生需求,经多阶段训练优化,还搭载高考知识库,产品体验简便。

量子位
算法论文7

全面评估多模态模型视频OCR能力,Gemini 准确率仅73.7%

MME - VideoOCR团队评估多模态模型(MLLM)视频OCR能力。构建精细任务体系和高质量数据集,评测18个主流MLLM。即便如Gemini - 2.5 Pro,准确率仅73.7%,暴露出MLLM在视频OCR领域能力局限。

量子位
算法论文7

苹果新论文发出惊人一问:What do your logits know?

苹果AI研究团队提交论文《你的logits知道些什么?(答案可能会让你惊讶!)》,触及模型底层逻辑及苹果看重的用户隐私与数据安全。研究通过实验揭示模型信息留存状态,指出存在隐私泄露隐患。

机器之心
新闻资讯7

Karpathy戳破强化学习神话,首提AI复盘式进化!暴力试错将死

AI神Karpathy发文指出强化学习(RL)有局限,效率随任务时长下降,与人类学习机制差异。他提出复盘式进化Scaling范式,虽有很多细节待完善,但认为还有更多S型增长曲线待发现。

新智元
新闻资讯7

纽约时报:OpenAI或将在18个月内现金流枯竭

纽约时报报道,OpenAI虽融资400亿美元,但内部预测2028年亏损将扩至450亿美元。独立AI公司受成本爆炸困扰,未来18个月OpenAI或资金枯竭,可能被厂吞并,AI泡沫时代将硬着陆。

新智元
新闻资讯7

顶级商战往往采用最朴素的方式:你叫「微软」,我叫「巨硬」

2026决战前夜,AI成抢夺电力与地皮的「物理战争」。谷歌要5年内算力拉升1000倍,抠能效;马斯克自建电厂、买仓库,手搓算力中心,还在名字挑衅微软,不过也引发环保抗议。

新智元