「视频时代」共找到 2110 篇相关文章
成都中专生,干出3500亿
AI东风下,新易盛靠光模块业务半年暴赚40亿,市值超3500亿。其掌舵者高光荣中专出身,近40岁创业。新易盛产能达历史高峰,机构看多助推估值飙升,同行也在风口起飞。
稚晖君新大招:机器人二次开发0门槛了!
在智元机器人首届合作伙伴大会上,联合创始人稚晖君发布机器人动作与表达创作平台灵创平台。它以AI加持,能将机器人二次开发抽象成模块化工具,降低难度,适配多款机器人,10月上线beta版。
万万没想到,这家央企竟让香农和图灵又“握了一次手”
中国电信人工智能研究院研发布局的智传网(AI Flow),让信息技术和通信技术融合。在WAIC中,李学龙提出智传网三律,即信容律、同源律和集成律,打破传递智能的‘壁’,为数字世界带来深远影响。
刚刚,奥特曼放出ChatGPT「统一智能体」!惊呼真AGI,最卷打工人来了
奥特曼带队直播发布ChatGPT agent,它融合三大技术优势,可自主工作,还能上网直出PPT、Excel。在多项测试中刷新SOTA,2025年将成全新AI杠杆,解锁「超级个体」模式。
UofT、UBC、MIT和复旦等联合发布:扩散模型驱动的异常检测与生成全面综述
多伦多大学、麻省理工学院等高校研究者合作完成长文综述,聚焦扩散模型在异常检测与生成领域的应用,梳理图像、视频等异常检测任务进展,提供分类体系,展望未来趋势。
有一说一,老周还真的挺懂 Agent 的
360 AI 发布会,老周回应市场部一事,称是让员工养成用 AI 习惯。他懂 Agent,认为其将成 AI 应用标准形态,360 从搜索切入,推出纳米 AI 超级搜索智能体,还发布两款 AI 硬件。
首创像素空间推理,7B模型领先GPT-4o,让VLM能像人类一样「眼脑并用」
当前主流视觉语言模型(VLM)依赖文本token间接翻译视觉信息,缺乏直接视觉操作能力。滑铁卢大学等团队提出「像素空间推理」范式,让VLM能像人类一样「眼脑并用」,在四大视觉推理基准测试中,7B的Pixel - Reasoner表现碾压GPT - 4o等。
Andrej Karpathy最新暴论:这类软件正走向绝境,PS首当其冲?
Andrej Karpathy认为,人机协作时代,复杂UI、缺脚本支持、基于自定义二进制格式的软件前景堪忧。他按风险等级列举不同软件,还强调不主动改造的产品处境艰难。
我用了一个月Dia浏览器,已经彻底抛弃了Chrome!
作者黄叔结合创始人Josh Miller复盘文,介绍Dia浏览器使用技巧,如信息检索、内容创作等,还对比Arc,指出Dia核心是Chat和Personalization,设计理念优,更适合大众,建议大家使用。
微软又搞大新闻:GitHub Copilot 开源,VS Code 要变天了。
微软官宣将把 GitHub Copilot Chat 扩展代码开源,重构相关组件到 VS Code 核心,使其成开源 AI 编辑器。还推出 Coding Agent,能自动化处理多种开发任务,目前在 Copilot Pro Plus 版本预览。