「训练可用度」共找到 5763 篇相关文章

推荐文章7

Agent 都这么厉害了,「AI 员工」为什么今天还没有真正出现?

AI员工呼声高却未落地,瓶颈可从其源起探寻。早期自动化工具非真正数字员工,大模型带来新可能,但存在时效性、场景定义、意图澄清、知识更新、博弈能力等问题,未来建议局部替代,先以实习生角色上岗。

Founder Park
开源动态8

智谱AI、清华开源新视觉大模型:刷新41项纪录,同级别最强

智谱AI与清华联合开源GLM - 4.5V视觉大模型,它基于GLM - 4.5 - Air开发,架构独特。在42项主流测试中创41项新纪录,多领域表现超Qwen2.5 - VL等模型,还采用新训练策略。

AIGC开放社区
产品应用8

拿下3D生成行业新标杆!昆仑万维Matrix-3D新模型鲨疯了,一张图建模游戏场景

昆仑万维推出3D世界生成框架Matrix - 3D,能从单图像生成高质量、轨迹一致的全景视频并还原可漫游3D空间。它优势明显,还突破多项技术难题,背后是昆仑万维对空间智能的战略布局。

量子位
产品应用7

构建能源领域的AI专家:一个多智能体框架的实践与思考

本文介绍阿里团队在能源领域构建多智能体框架的实践。因单智能体处理复杂任务有“注意力发散”问题,团队研发综合能源智能体平台,阐述框架搭建、各组件功能及设计考量,还分享思考与可优化点。

阿里云开发者
产品应用7

Claude Opus 4.1模型发布,OpenAI继续被拉开差距

Anthropic发布Claude Opus 4.1模型,在各指标上超越Opus 4。Anthropic ARR达50亿美元,API收入首超OpenAI。新模型在多场景有进步,官网等渠道统一可用,还给出Claude Code使用建议。

花叔
产品应用8

Listen Labs:把用户研究“黑灯流水线”化,AI Agent 系统实现小时级洞察

Listen Labs由两位哈佛校友在2024年底创立,2025年4月获2700万美元融资。今年2 - 5月发布三项核心能力,可实现全流程自动化深访。文章详解其如何实现小时级交付,分析竞争态势与优势,也指出未来待改进处。

海外独角兽
算法论文8

CVPR 2025 多模态大一统:斯坦福 x 复旦提出符号主义建模生成式任务

来自多机构研究团队提出基于符号化表征的生成任务描述框架,将符号化思维引入生成任务建模。实验证明,该框架在跨模态生成任务中表现出色,为推进生成式人工智能能力提供了成本效益高且可扩展的基础。

机器之心
Product Application7

文档OCR新范式0.84 页/秒,吊打MinerU Qwen2.5VL

MonkeyOCR采用SRR三元组范式,简化多工具管道,避免整页文档处理低效率。与MinerU、Gemini 2.5 Pro等对比,性能表现优,处理速度达0.84页/秒,但对扫描件效果欠佳,架构含多模型,可通过特定地址测试。

CourseAI
产品应用7

谷歌Veo 3玩法大升级!“360°”关键词解锁3D效果,Fast版同分辨率价格暴降5倍

谷歌旗舰视频模型Veo 3玩法再升级,添加“360°”提示词可解锁3D环绕效果。其Fast版速度更快、价格更便宜,同分辨率下价格暴降5倍,虽面部细节和光照表现有下降,但解决了部分问题。

量子位
开源动态8

这款开源神器把Excel翻译卷出新高度!免费、无限文件大小、公式精准!

翻译大型或复杂文档一直是痛点,免费工具效果差或限制文件大小,付费成本高。infrost开发的DeeplxFile基于Deeplx和Playwright打造,免费、不限文件大小,擅长处理超长文本和复杂Excel公式,还能转PDF为可编辑文件。

开源星探