--:--
今日 PV 0
独立 IP 0
在线 0
今日实时08/06LIVE
0今日访问
真人访问050%
搜索蜘蛛050%
当前在线0now
0PV 浏览量
0独立 IP
0蜘蛛抓取
24 小时访问趋势暂无数据
小伍的游乐场大数据
CATEGORY · 41

Ai Build

08-05

😱 4GB 显存跑 70B 大模型

😱 4GB 显存跑 70B 大模型?真的不是在开玩笑! 刚刷到这个开源神器 AirLLM,直接颠覆了我的认知: ✅ 单卡 4GB 就能跑 Llama3 70B ✅ 8GB 可以上 405B ✅ 甚至 2.8T 的超大模型也能硬刚(最新已支…

120
08-03

开源项目 LoopX:超长程 Agent 自主运行 200+ hours,状态不漂移

开源项目 LoopX:超长程 Agent 自主运行 200+ hours,状态不漂移。 我的技术主张是:LLM 上下文有限,长程 Agent 需要外置状态,通过完备的状态管理、监督和规划,让 Agent 无人干预时跑得稳、持续有产出;有人干…

170
07-26

字节跳动 TableVerse:从互联网图片到 10 万个可仿真桌面操作场景 | Paper: 100K Simulation-Ready Tabletop Scenes

【中文】论文速递 字节跳动 TableVerse:从互联网图片到 10 万个可仿真桌面操作场景 机器人操作研究长期受限于大规模高保真场景数据:文本生成布局或程序化生成往往物理不合理、复杂度不足。字节跳动提出 TableVerse,一条 Re…

530
07-26

港中文 MMLab:把相机与屏幕当作耦合系统的端到端校色 | Paper: Color Pass-Through via Camera-Display Coupling

【中文】论文速递 港中文 MMLab:把相机与屏幕当作耦合系统的端到端校色 手机拍的照片在自家屏幕上显示,颜色、亮度、对比度却常与实景对不上——传统流水线对相机和屏幕分别标定,低维颜色变换层层累积误差。港中文 MMLab 团队提出 Colo…

460
07-26

微软:LLM 会在“不断变化的用户意图”中迷失 | Paper: LLMs Get Lost in Evolving User Intent

【中文】论文速递 微软:LLM 会在“不断变化的用户意图”中迷失 微软研究发现大模型评测的一个盲区:现有基准多为单轮、需求一次说清的设定,而真实协作中用户目标是逐步披露、反复修改甚至中途转向的。团队提出一个转换框架,把现有静态基准改造成“意…

470
07-26

Robostral Navigate:Mistral 的 8B 单目导航 VLM,超越深度多相机方案 | Paper: Mistral's Monocular Navigation VLM

【中文】论文速递 Robostral Navigate:Mistral 的 8B 单目导航 VLM,超越深度多相机方案 Mistral AI 发布 Robostral Navigate,一个仅凭单目 RGB 视频预测路径点的 8B 视觉 语…

410
07-26

腾讯 WorkBuddy Bench:抗数据污染的多领域编码智能体基准 | Paper: A Contamination-Resistant Coding-Agent Benchmark

【中文】论文速递 腾讯 WorkBuddy Bench:抗数据污染的多领域编码智能体基准 腾讯发布 WorkBuddy Bench,覆盖 Code、Web、Office、Security 四个领域的编码智能体评测套件。针对“基准题目被模型在…

460
07-26

寻汇 SUNRATE × 万事达发布“Agentic 跨境支付”白皮书:16 个痛点、13 个用例 | Sunrate × Mastercard Define Agentic Global Payments

【中文】寻汇 SUNRATE × 万事达发布“Agentic 跨境支付”白皮书:16 个痛点、13 个用例 7月25日,跨境支付平台寻汇 SUNRATE 与万事达卡联合发布白皮书,首次系统定义 B2B 跨境金融中的“Agentic Glob…

490
Ai Build | 小伍的游乐场