「实时开放世界模拟」共找到 1727 篇相关文章
刚刚2岁的Llama,「爸妈」都跑了!小扎手拆Meta AI,LeCun保持独立
面对谷歌、OpenAI等劲敌及Llama 4翻车、人才流失困境,小扎决定重组Meta GenAI团队,设三大架构。2023年Llama首版论文14名作者只剩3人,Llama 4也问题不断,而LeCun坚持自己的路线。
3.9K Star!Inkeep 把 AI 原生 Markdown 编辑器做成了开源项目!
Inkeep 团队开源 OpenKnowledge,这是真正为 AI 设计的知识库工具,已获 3.9K Star。它有所见即所得、AI 协作等亮点,还基于 Git 同步,保障数据安全,值得 Markdown 工具使用者关注。
Hugging Face 发布 FineTranslations:一个万亿级的多语言平行文本数据集
Hugging Face 发布 FineTranslations,这是含超 1 万亿 Token 的多语言数据集,用于提升机器翻译质量。它源于 FineWeb2,用 Gemma3 27B 翻译创建,数据生成流程可复现公开,还能用在其他任务。
250美元起售,还开源,Hugging Face 发布史上最亲民人形机器人
Hugging Face 开源两款人形机器人 HopeJR 和 Reachy Mini,前者全尺寸有 66 个驱动自由度,售价约 3000 美元;后者成本低至 250 美元,可用于测试 AI 应用。虽被指外观不佳,但推动开源机器人生态发展。
Cursor这波1.0升级,真的要把程序员饭碗摔碎了~
今天Cursor 1.0硬核发布,跨越多个版本。它集成主流MCP、Memory、Agent技术,有BugBot自动代码审查等功能,支持Jupyter Notebook集成,聊天界面体验也更丰富,大幅提升开发生产力。
北京798多觉工场开幕首展·《觉:数字艺术在中国》
2026年6月,北京798多觉工场开幕,首展《觉:数字艺术在中国》同期亮相。这是全球首个以“多觉艺术”为核心理念的实体空间,汇聚27位艺术家50余件作品,涵盖多种媒介,让观众调动感官,实现“艺术平权”。
最低 306KB,这款低延迟语音检测神器太绝了!
语音交互中,VAD至关重要。新开源的TEN VAD能精准识别语音起止,是替代WebRTC VAD和Silero VAD的优选。它低延迟、高准确率、极致轻量,已被Kaldi集成,还能跨平台部署,使用方便。
中科院甩出多模态“核弹”!类GPT-4o多模态模型开源!支持语言-视觉-语音任意组合交互!
中国科学院计算技术研究所(ICTNLP)开源类GPT - 4o多模态模型Stream - Omni,支持文本、视觉和语音任意组合交互,核心是高效模态对齐技术,少量多模态数据即可训练,有多种使用场景。
关于GPT-6 Astra的三条判断|甲子光年
北京时间9月4日凌晨,OpenAI发布GPT-6 Astra,演示其多种能力。「甲子光年」判断:GUI没消亡,是软件兼容层;Astra会“吞噬”App入口;传统Benchmark难描述Agent,任务闭环成关键。
更省 Token 的国产 Codex:ZCode,加上 DeepSeek 更夯!
介绍国产 Codex 平替 ZCode,它有 100 万用户,能接 DeepSeek,模型选择开放,缓存命中率高省 Token,插件生态完善,还介绍了安装、接入方法及多种实用功能。