--:--
今日 PV 0
独立 IP 0
在线 0
今日实时08/26LIVE
0今日访问
真人访问050%
搜索蜘蛛050%
当前在线0now
0PV 浏览量
0独立 IP
0蜘蛛抓取
24 小时访问趋势暂无数据
小伍的游乐场大数据
CATEGORY · 42

Ai Build

08-10

阿里最新放出来了一款全新端到端角色图像动画框架:Wan-Animate-2,实时驱动角色,延迟极低

阿里最新放出来了一款全新端到端角色图像动画框架:Wan Animate 2,实时驱动角色,延迟极低 Wan Animate 2的一大核心是实时交互,直接解锁直播主播、交互式数字人场景 首先,Teacher forcing+错误缓冲+Self…

760
08-05

😱 4GB 显存跑 70B 大模型

😱 4GB 显存跑 70B 大模型?真的不是在开玩笑! 刚刷到这个开源神器 AirLLM,直接颠覆了我的认知: ✅ 单卡 4GB 就能跑 Llama3 70B ✅ 8GB 可以上 405B ✅ 甚至 2.8T 的超大模型也能硬刚(最新已支…

780
08-03

开源项目 LoopX:超长程 Agent 自主运行 200+ hours,状态不漂移

开源项目 LoopX:超长程 Agent 自主运行 200+ hours,状态不漂移。 我的技术主张是:LLM 上下文有限,长程 Agent 需要外置状态,通过完备的状态管理、监督和规划,让 Agent 无人干预时跑得稳、持续有产出;有人干…

820
07-26

字节跳动 TableVerse:从互联网图片到 10 万个可仿真桌面操作场景 | Paper: 100K Simulation-Ready Tabletop Scenes

【中文】论文速递 字节跳动 TableVerse:从互联网图片到 10 万个可仿真桌面操作场景 机器人操作研究长期受限于大规模高保真场景数据:文本生成布局或程序化生成往往物理不合理、复杂度不足。字节跳动提出 TableVerse,一条 Re…

1030
07-26

港中文 MMLab:把相机与屏幕当作耦合系统的端到端校色 | Paper: Color Pass-Through via Camera-Display Coupling

【中文】论文速递 港中文 MMLab:把相机与屏幕当作耦合系统的端到端校色 手机拍的照片在自家屏幕上显示,颜色、亮度、对比度却常与实景对不上——传统流水线对相机和屏幕分别标定,低维颜色变换层层累积误差。港中文 MMLab 团队提出 Colo…

1030
07-26

微软:LLM 会在“不断变化的用户意图”中迷失 | Paper: LLMs Get Lost in Evolving User Intent

【中文】论文速递 微软:LLM 会在“不断变化的用户意图”中迷失 微软研究发现大模型评测的一个盲区:现有基准多为单轮、需求一次说清的设定,而真实协作中用户目标是逐步披露、反复修改甚至中途转向的。团队提出一个转换框架,把现有静态基准改造成“意…

900
07-26

Robostral Navigate:Mistral 的 8B 单目导航 VLM,超越深度多相机方案 | Paper: Mistral's Monocular Navigation VLM

【中文】论文速递 Robostral Navigate:Mistral 的 8B 单目导航 VLM,超越深度多相机方案 Mistral AI 发布 Robostral Navigate,一个仅凭单目 RGB 视频预测路径点的 8B 视觉 语…

850
07-26

腾讯 WorkBuddy Bench:抗数据污染的多领域编码智能体基准 | Paper: A Contamination-Resistant Coding-Agent Benchmark

【中文】论文速递 腾讯 WorkBuddy Bench:抗数据污染的多领域编码智能体基准 腾讯发布 WorkBuddy Bench,覆盖 Code、Web、Office、Security 四个领域的编码智能体评测套件。针对“基准题目被模型在…

980
Ai Build | 小伍的游乐场