任务交付引擎」共找到 2420 篇相关文章

产品应用7

DeepSeek有点含蓄了,实测V3.1有进步,编程等个别场景硬刚GPT-5

DeepSeek悄悄更新V3.1,官方仅提及上下文长度拓展至128K。实测其代码能力与前端审美提升,逻辑推理也有进步,在编程等个别场景能硬刚GPT - 5,但处理复杂任务还有距离,更新不大却有进步且降价。

鲸选AI
算法论文8

解决扩散模型过拟合的创新框架T-LoRA

预训练大型文本到图像扩散模型定制化时,样本有限易致过拟合。AIRI和HSE大学团队提出T - LoRA框架,动态调整训练能力、用正交初始化,实验显示其在单图像和多图像任务表现优,用户更偏好其生成图像。

AIGC开放社区
开源动态7

多模态需求井喷,智能视频云如何靠分布式处理破局?

国内多模态AI发展中,模型层火热但应用层落地慢。多模态应用落地面临体验升级、视频化扩展、大模型部署下沉挑战,催生智能视频云升级需求。火山引擎在FORCE大会展示分布式多媒体处理实践,推出MIPP平台,未来将开源并推商业化产品。

InfoQ
8

12月首炸!可灵 O1 正式发布,全球首个统一多模态视频大模型,强得可怕!

12月快手旗下可灵发布全球首个统一多模态视频大模型Kling O1,标志AI视频进入“全流程语义控制时代”。它将多种视频创作能力统一,有全能引擎等五大亮点,性能对比优势明显,让AI视频生成更可控。

开源星探
产品应用8

Seedream 4.0 来了,AI 图片创业的新机会也来了

今年AI生图领域爆款不断,Google旗下Nano Banana模型虽火但中文支持欠佳。火山引擎推出豆包·图像创作模型Seedream 4.0,主体一致性强,支持4K多模态生图,有多图融合、精准编辑等能力,或给AI图片创业带来新机会。

Founder Park
7

又一个Genie 3来了!刚上线挤爆服务器,Mirage 2把世界模型玩成在线游戏

全球首款AI原生UGC游戏引擎Mirage迎来2.0版本。它能将图像转为可互动3D世界,还能用文本重塑。和Genie 3相比控制类别更丰富,虽有进展但仍有动作控制、视觉稳定等问题待解决。

新智元
产品应用8

Listen Labs:把用户研究“黑灯流水线”化,AI Agent 系统实现小时级洞察

Listen Labs由两位哈佛校友在2024年底创立,2025年4月获2700万美元融资。今年2 - 5月发布三项核心能力,可实现全流程自动化深访。文章详解其如何实现小时级交付,分析竞争态势与优势,也指出未来待改进处。

海外独角兽
新闻资讯7

传 GPT-5.6 明日发布:要打赢 Fable 5,光靠刷分可不行

近期GPT-5.6发布消息不断,上线或进入倒计时。它被拿来与Fable 5对比,Fable 5长任务处理出色,而GPT-5.5有短板。GPT-5.6虽跑分亮眼,但被指‘benchmaxxed’,还存在脱离现实常识问题。

AI科技评论
推荐文章7

李飞飞World Labs最新判断:AI写完代码,下一步是「写世界」?

这篇来自 World Labs 的博客探讨了 AI 参与空间创作和现实世界任务时的通用接口,认为是 3D 。它像代码一样可结构化表达,还分析了神经图形学、模拟引擎的作用,并介绍了相关项目。

机器之心
新闻资讯7

先验+后验加持,大模型能否 hold 住推理预测的现实「溢出」?

多数大模型评估基准依赖固定数据集,难测真实推理实力。字节跳动等推出的 FutureX 动态评测基准,将重点移至动态预测能力。实验显示不同模型在不同任务表现有别,大模型在现实场景运用仍待优化。

机器之心