「维苏威挑战赛」共找到 1111 篇相关文章
松下发布多模态大模型,文本、图像、音频随意切换
多模态数据处理成热点,但现有模型处理复杂任务有挑战。松下开发多模态大模型OmniFlow,采用模块化设计、多模态引导机制,实验显示其在多任务中有卓越表现。
Ilya回归,获授「第四学位」!AI将完成人类能做的一切,毕业演讲实录
曾梦想打造类人计算机的Ilya Sutskever,近日重返多伦多大学获授荣誉理学博士学位。他在演讲中称AI将学会人类所有事情,还谈到AI对职业的影响等观点。
谷歌向左、李飞飞往右,阿里世界模型「快乐生蚝」杀出第三条路
阿里推出世界模型HappyOyster(快乐生蚝),基于原生多模态架构,有漫游和导演两大核心功能,可实时构建和交互。与文生视频模型不同,它能随时被干预。虽世界模型尚处早期,但应用场景广泛。
当 Claude 开始自己做增长,Anthropic 真正关心的是什么?
Anthropic面临模型迭代外的挑战,增长负责人Amol Avasare在访谈中披露公司战略。如应对‘Success Disasters’、降低产品使用门槛、优化引导流程等,还提及增长职能演进。
AI穿越战争迷雾,72%的准确率化身中东冲突预言家
阿联酋和美国研究人员用中东冲突测试AI推理表现,发现其能看透利益博弈、预判战局演变。AI擅沿客观限制推演,在经济领域敏锐,政治领域较难,整体预测准确率达72%。
Legora、Mercor 都在用,Reducto 能成为独立的 LLM 数据入口吗?
当前企业AI落地瓶颈在数据质量,Reducto聚焦数据准确性,以文档解析API提供Agentic OCR能力。它获多轮融资,估值达6亿美元,但面临多模态模型竞争及定价等问题,其未来走向待察。
R1一周年,DeepSeek Model 1悄然现身
2025年1月20日,DeepSeek发布DeepSeek - R1开启新开源LLM时代,其在Hugging Face获赞最多。一年后,DeepSeek新模型Model1在GitHub现身,经Gemini分析或为DeepSeek - V4,还给出相关技术细节。
机器人界的「Imagenet 时刻」,李飞飞团队官宣全球顶级具身智能挑战赛
李飞飞团队与斯坦福AI实验室官宣首届BEHAVIOR挑战赛将登陆NeurIPS 2025。这是具身智能“超级benchmark”,涵盖1000个日常任务,以50个长时段任务为核心赛题,还是全面的具身智能研究资源。
马斯克狂烧14万亿,5000万H100算力五年上线!终极爆冲数十亿
马斯克宣布5年内实现5000万张H100的算力,成本超2万亿美元。他已有Colossus超算集群,Grok系列模型也展现强大实力。目前Colossus 2在分批落地,供电采取多元化措施。
科研写作神器,超越Mathpix的科学公式提取工具已开源
LaTeX公式OCR现有方法处理真实文献面临挑战,DocTron团队提出系统性方案。构建CSFormula数据集,提出DocTron - Formula模型,在评测和实际应用中表现出色,超越Mathpix等工具。