群发资讯网
斌叔OKmath的文章
Kubernetes 遇上 LLM 推理。Google、NVIDIA、IBM 和
2026-08-28 22:57
Kubernetes 遇上 LLM 推理。Google、NVIDIA、IBM 和
一家AI会计初创公司在48小时内达到了10亿美元估值。该团队刚刚详细阐述了其底层
2026-08-28 18:57
一家AI会计初创公司在48小时内达到了10亿美元估值。该团队刚刚详细阐述了其底层
Nvidia 以约 129 亿美元收购 Hugging Face。但谁拿到了 ?
2026-08-28 13:05
Nvidia 以约 129 亿美元收购 Hugging Face。但谁拿到了 ?
谷歌训练了一个AI,通过在地图上统计咖啡店、公交车站和高楼的数量来预测你所在社区
2026-08-28 13:05
谷歌训练了一个AI,通过在地图上统计咖啡店、公交车站和高楼的数量来预测你所在社区
谷歌训练了一个AI,通过在地图上统计咖啡店、公交车站和高楼的数量来预测你所在社区的收入。没有人告诉它什么是收入。 这个模型名为S2Vec,由Google Research作为其Earth AI计划的一部分发布。它将建成环境(一个区域内的每栋建筑、道路、公园和商家)转化为分层图像。网格单元中的三家咖啡店和一个公
2026-08-29 09:20
谷歌训练了一个AI,通过在地图上统计咖啡店、公交车站和高楼的数量来预测你所在社区的收入。没有人告诉它什么是收入。 这个模型名为S2Vec,由Google Research作为其Earth AI计划的一部分发布。它将建成环境(一个区域内的每栋建筑、道路、公园和商家)转化为分层图像。网格单元中的三家咖啡店和一个公
今天我们有一个巨大的消息要分享!今天我们揭开了第一个真正易得的 RL 机器人——
2026-08-28 13:05
今天我们有一个巨大的消息要分享!今天我们揭开了第一个真正易得的 RL 机器人——
Salesforce 刚刚将其整个 CRM 集成到 Claude 中,这将允许销
2026-08-28 13:05
Salesforce 刚刚将其整个 CRM 集成到 Claude 中,这将允许销
人类对话是 AI 中最棘手的问题之一。今天,我们推出 Sparrow-2,这是我
2026-08-28 13:04
人类对话是 AI 中最棘手的问题之一。今天,我们推出 Sparrow-2,这是我
我们刚刚干掉了 Exa、Tavily、SerpAPI 和 Brave。你的智能体
2026-08-28 11:58
我们刚刚干掉了 Exa、Tavily、SerpAPI 和 Brave。你的智能体
我们刚刚干掉了 Exa、Tavily、SerpAPI 和 Brave。 你的智能体现在可以免费搜索并获取任何网页,100% 免费。 他们:每 1,000 次搜索 7 美元。 我们:0 美元。没有订阅,没有配额。 人类可以免费搜索 Google。智能体也不应该付费。 由 和 使之成为可能。 [视频] We don't need
2026-08-28 16:17
我们刚刚干掉了 Exa、Tavily、SerpAPI 和 Brave。 你的智能体现在可以免费搜索并获取任何网页,100% 免费。 他们:每 1,000 次搜索 7 美元。 我们:0 美元。没有订阅,没有配额。 人类可以免费搜索 Google。智能体也不应该付费。 由 和 使之成为可能。 [视频] We don't need
介绍 PhoneLLM,一个用于语音代理的开源模型。GPT 5.6 Terra
2026-08-28 09:56
介绍 PhoneLLM,一个用于语音代理的开源模型。GPT 5.6 Terra
孙宇晨起诉景甜 景甜,看起来那么清纯。。。
2026-08-27 20:57
孙宇晨起诉景甜 景甜,看起来那么清纯。。。
RadixArk的Qwen3.8-Flash-Next-NVFP4 用这个Fre
2026-08-27 19:57
RadixArk的Qwen3.8-Flash-Next-NVFP4 用这个Fre
RadixArk的Qwen3.8-Flash-Next-NVFP4 用这个FreeToken在codex里改造后终于达到了不错的的速度 Active小所以速度还行 RAM DDR5 8ch GPU - RTX5090 x1 Prefill 277.5 tok/s Decode 59.13 tok/s - RTX5090 x2 Prefill 619.5 tok/s Decode 83.14 tok/s [视频] qwen4exp用改造FreeToken
2026-08-27 22:33
RadixArk的Qwen3.8-Flash-Next-NVFP4 用这个FreeToken在codex里改造后终于达到了不错的的速度 Active小所以速度还行 RAM DDR5 8ch GPU - RTX5090 x1 Prefill 277.5 tok/s Decode 59.13 tok/s - RTX5090 x2 Prefill 619.5 tok/s Decode 83.14 tok/s [视频] qwen4exp用改造FreeToken
埃隆·马斯克解释为什么你永远不应该将电动车充到 100%最后 20% 并非小事一
2026-08-27 19:56
埃隆·马斯克解释为什么你永远不应该将电动车充到 100%最后 20% 并非小事一
(转)Qwen3.8-Flash-Next 的 GGUF,111GB 模型在双
2026-08-27 11:00
(转)Qwen3.8-Flash-Next 的 GGUF,111GB 模型在双
(转)Qwen3.8-Flash-Next 的 GGUF,111GB 模型在双 4090 96G 竟然跑通了。 这模型是真的邪门。 我这台机器是: 2× RTX 4090 48G = 96GB 显存 62GB 内存 跑的是 Unsloth 的 UD-Q4_K_XL。 没开 MTP 下,最后实测生成速度稳定在: 66 tokens/s。 而且不是 1bit 那种“能跑就行”的版本,是 103.7 GiB
2026-08-27 22:44
(转)Qwen3.8-Flash-Next 的 GGUF,111GB 模型在双 4090 96G 竟然跑通了。 这模型是真的邪门。 我这台机器是: 2× RTX 4090 48G = 96GB 显存 62GB 内存 跑的是 Unsloth 的 UD-Q4_K_XL。 没开 MTP 下,最后实测生成速度稳定在: 66 tokens/s。 而且不是 1bit 那种“能跑就行”的版本,是 103.7 GiB
第一页
作者信息
斌叔OKmath
感谢大家的关注
分类: 教育
热门分类
推荐
热榜
军事
NBA
体育
社会
明星八卦
娱乐
财经
科技
汽车
历史
国际
游戏
动漫
公益
搞笑
商业
互联网
数码
国际足球
房产
家居
时尚
科学探索
职场
育儿
股票
教育
影视
情感
热点
中国军情
武器
中国南海
中国足球
亚洲杯
科比
综合体育
CBA
投资
楼市
大咖秀
外汇
创业
风口
SUV
豪车
概念车
优惠
新能源
美国
欧洲
朝日韩
俄罗斯
孕期
街拍
恋爱攻略
婚姻
正能量
兄弟网站
泡泡词典网