「音视频实时交互模型」共找到 1740 篇相关文章
刚刚开源的学术论文阅读神器,AI 驱动的个性化“暴躁教授”助你攻克论文!
学术论文阅读常因晦涩内容和语言壁垒让人望而却步。Mad-Professor是开源的AI驱动学术论文阅读工具,集成多种功能,通过AI问答和语音交互解答疑惑,赋予个性化角色,让阅读体验高效且生动。
国内首部“AI生成内容合规”标准来了!现公开征集起草单位和专家
2026年6月14日,短视频AI内容强制标注新规实施,网络内容治理迈向“强制合规”。在此背景下,首个AI生成内容合规团体标准《人工智能生成内容合规管理指南》诞生,亮点多,现征集起草单位与专家。
今天,Claude入职了!
Anthropic官宣Claude Tag,这是团队协作用Claude的全新方式,像“AI同事”般出现在Slack会话栏,响应主动,完成65%代码编写。它是Claude Code升级版,与前两代AI交互方式不同,Anthropic已离不开它。
人类或将沦为“NPC”!智谱创始人唐杰最新研判:LLM正从攻克长程任务到全自主进化
智谱创始人唐杰认为今年LLM技术突破点在长程任务,能在智能体环境交互完成复杂任务。随能力提升,将迈向‘无人公司’时代,人类或成‘NPC’。后续要攻克记忆、学习等技术,实现自我进化,重塑产业。
0人类数据,让机器臂自学拧灯泡:MIT初创要打造机器人界的AlphaZero
Eka Robotics 发布机械臂视频,其能自主拧灯泡、抓取物品。该公司提出 VFA 模型,不依赖人类数据,让机器人在仿真环境自主探索。创始人期望实现超人级灵巧操作,算法还展现泛化和自主发明策略能力。
AI能自己打红警了!经济拉满零交战惨遭打脸,玩家笑疯
Hugging Face推出OpenRA-RL,将《红色警戒》改造成大模型的Agent训练场,50个MCP游戏工具全量暴露,25Hz实时状态流推送,打通三条训练路线,原生接入OpenEnv生态。实战中,Agent经济满分但战斗零分。
Qwen3.6-Max-Preview来了!
继Qwen3.6 - Plus发布,推出Qwen3.6 - Max - Preview预览版,相比前者有更强世界知识、指令遵循能力,智能体编程表现显著提升。可在Qwen Studio交互,也将通过阿里云百炼API调用。
终于,Claude革了设计行业的命:Figma、Adobe股价重挫
Anthropic 发布全新 AI 产品 Claude Design,能将自然语言等转化为高保真、可交互的设计,为设计师和大众提供创作方式。它遵循自然创作流程,支持协作和多种导出方式,上线后获好评,还给出使用建议。
最强开源搜索再升级,研究、预测能力实测超惊艳!
MiroMind团队发布新一代模型MiroThinker-1.7和MiroThinker-H1,定位为重型推理智能体。其研究能力强、推理可靠,还能生成网页报告。新版本升级显著,靠两项关键技术实现有效交互,且预测案例表现出色。
15岁少年养AI龙虾,月入3万美元!智能体黄金时代真来了
OpenClaw发布2026.3.13更新,实现无需插件关联用户实时会话的技术突破。15岁少年用其赚超3万美元合同收入,还有多人借AI创业。AI正从工具向员工、创业者转变,未来或现AI经理人。