「双模式引擎」共找到 982 篇相关文章
何恺明改进了谢赛宁的REPA:极大简化但性能依旧强悍
扩散生成模型在建模复杂数据分布表现出色,但与表征学习领域关联不大。谢赛宁团队提出REPA,不过较麻烦。何恺明团队提出Dispersive Loss,简化且性能强,无需预训练等,适用于多种模型。
一份PPT 创 5000万美金ARR,挑战微软和Google,这家华人创业AI公司火了丨PMF 001
本文介绍华人团队创办的AI PPT企业Gamma,它获5000万用户,ARR破5000万美金且连续盈利15个月。其精准踩中AI节点,运用PLG模式打败Tome,从AI PPT升级为创意创作平台。
马斯克:AI巨浪已至,吸干全球救命钱!
马斯克警告AI激流已至,过去一年全球AI推理Token用量暴增25倍。ARK首席未来学家指出AI基础设施投资回报高,引发资本转移与挤出效应,传统企业融资难、人才流失,将被AI“吸干”资本。
4.4k星!给Agent接上「本地免费搜索爬虫」,内置11个skill执行数据搜索、爬取、自动研究
文章推荐开源本地搜索工具wigolo,它是专门给Agent使用的本地网络能力层,可解决本地运行Agent查找资料时使用API麻烦费钱的问题。它功能多样,有搜索、缓存等工具,自带11个Skill。
Agent 形态一天一个样,Infra 到底该为谁而建?
过去一年,Agent 应用形态多变,但进入稳定生产环境的项目有限。清程极智师天麾认为,Agent Infra 重要性待显,当前应提高 Token 生产交付效率。还探讨了 Agent 发展问题、Token 相关指标及收费模式等。
手握1000项专利的“药物狂人”,为何在AI制药时代选择逆行?
手握约1000项专利的再生元联合创始人乔治·扬科普洛斯,在AI制药成热点时选择逆行,坚持内部研发、人类遗传学和基础生物学。他批评跟风,强调深入理解疾病机制,认为AI可增效但不能决定方向。
全网实测Gemini Omni!一句话改视频,草图变大片
谷歌在Google I/O大会推出Gemini Omni,它结合推理与生成能力,在多方面有重大飞跃,能生成逼真视频等。它打破命名体系,训练目标不同,有涌现能力,谷歌还为其设置限制。
还在为拍视频头疼?AI 一键生成短视频,这工具也太香了吧!
文章介绍开源工具 Pixelle-Video,它能让视频创作变得简单。输入主题,它可自动撰写文案、生成配图、合成语音、添加音乐并合成视频,还支持多种功能和大模型,有多种使用和付费方案。
解决VLA模型落地难,普通硬件也能跑!全透明全开源的高效VLA模型把推理成本砍掉76%
2026年4月,中山大学与MBZUAI联合推出A₁模型,它是完全开源透明、自适应高效的截断式视觉 - 语言 - 动作模型,能削减推理成本、实现低成本落地,在仿真与真机上表现优异。
这脑洞神了!两AI「互喷」,竟治好祖传科研软件95%老毛病?
科学计算领域开源工具多,但大多难以直接运行,制约AI4S与Agentic Science发展。深势科技推出Deploy - Master,以执行为中心,经搜索和构建,将约50万个仓库筛选收敛,构建成功率达95%以上。