群发资讯网

三金笑说商业的文章

曾经的 Jim Fan 发个帖子,媒体都能写一篇文章,再不济也是「GPT Ast

曾经的 Jim Fan 发个帖子,媒体都能写一篇文章,再不济也是「GPT Ast

曾经的 Jim Fan 发个帖子,媒体都能写一篇文章,再不济也是「GPT Ast

散步强制思考,记录强制总结。无论如何,不要放弃散步和写。 ​​​

散步强制思考,记录强制总结。无论如何,不要放弃散步和写。 ​​​

一个畅想:LLM 做 3D模型 + DLSS5,按照这个趋势下去,是不是所有资产

一个畅想:LLM 做 3D模型 + DLSS5,按照这个趋势下去,是不是所有资产
[思考] ​​​

[思考] ​​​

[思考] ​​​

曾经的 three.js,现在的 blender,都是评测模型能力最直观的试验场

曾经的 three.js,现在的 blender,都是评测模型能力最直观的试验场
几乎在 GPT‑6 Astra 发布的同一时间,伯尼·桑德斯和格雷格·卡萨尔宣布

几乎在 GPT‑6 Astra 发布的同一时间,伯尼·桑德斯和格雷格·卡萨尔宣布

几乎在 GPT‑6 Astra 发布的同一时间,伯尼·桑德斯和格雷格·卡萨尔宣布
《自然》上的一篇文章:作为写作助手的 LLM 被广泛使用,与语言多样性的下降存在

《自然》上的一篇文章:作为写作助手的 LLM 被广泛使用,与语言多样性的下降存在

《自然》上的一篇文章:作为写作助手的 LLM 被广泛使用,与语言多样性的下降存在
一份 GEO 研究 by Trellner Research向 Perplexi

一份 GEO 研究 by Trellner Research向 Perplexi

一份 GEO 研究 by Trellner Research向 Perplexi
一份 GEO 研究 by Trellner Research

向 Perplexity 询问 380 个软件类别的最佳产品,返回 7,534 条引用,其中有 59.8% 来自于全球流量排名前 10 万名以外的“非主流、低质量网站”。

而维基百科只被引用了 3 次。

链接:trellner.com/reports/manufactured-sources-behind-ai-recommendations ​

一份 GEO 研究 by Trellner Research 向 Perplexity 询问 380 个软件类别的最佳产品,返回 7,534 条引用,其中有 59.8% 来自于全球流量排名前 10 万名以外的“非主流、低质量网站”。 而维基百科只被引用了 3 次。 链接:trellner.com/reports/manufactured-sources-behind-ai-recommendations ​

一份 GEO 研究 by Trellner Research 向 Perplexity 询问 380 个软件类别的最佳产品,返回 7,534 条引用,其中有 59.8% 来自于全球流量排名前 10 万名以外的“非主流、低质量网站”。 而维基百科只被引用了 3 次。 链接:trellner.com/reports/manufactured-sources-behind-ai-recommendations ​
用丰田 5why 来拷打自己 ​​​

用丰田 5why 来拷打自己 ​​​

用丰田 5why 来拷打自己 ​​​
看到了一个 AI 一对一教育应用,hyperknow- 白板 + 语音教学- A

看到了一个 AI 一对一教育应用,hyperknow- 白板 + 语音教学- A

看到了一个 AI 一对一教育应用,hyperknow- 白板 + 语音教学- A
看到了一个 AI 一对一教育应用,hyperknow

- 白板 + 语音教学
- AI 在讲解完一个知识点后会主动提问(选择题),用户也可以随时提问打断 AI 

链接:agent.hyperknow.io ​

看到了一个 AI 一对一教育应用,hyperknow - 白板 + 语音教学 - AI 在讲解完一个知识点后会主动提问(选择题),用户也可以随时提问打断 AI 链接:agent.hyperknow.io ​

看到了一个 AI 一对一教育应用,hyperknow - 白板 + 语音教学 - AI 在讲解完一个知识点后会主动提问(选择题),用户也可以随时提问打断 AI 链接:agent.hyperknow.io ​
Harness 的评测榜单 FrontierHarness v1.0 测试 ha

Harness 的评测榜单 FrontierHarness v1.0 测试 ha

Harness 的评测榜单 FrontierHarness v1.0 测试 ha
Harness 的评测榜单 FrontierHarness v1.0 

测试 harness 包括:Pi、Exo、Claude Code、Codex、DeepSeek Harness(4款)、Hermes、OpenCode、Oh My Pi、Kimi Code

测试模型:Kimi K3(选择K3,而不是 GPT、Claude,是因为测试者不想偏向 Codex 和 Claude Code)

任务类型: 21 项终端基准测试任务和  ​

Harness 的评测榜单 FrontierHarness v1.0 测试 harness 包括:Pi、Exo、Claude Code、Codex、DeepSeek Harness(4款)、Hermes、OpenCode、Oh My Pi、Kimi Code 测试模型:Kimi K3(选择K3,而不是 GPT、Claude,是因为测试者不想偏向 Codex 和 Claude Code) 任务类型: 21 项终端基准测试任务和 ​

Harness 的评测榜单 FrontierHarness v1.0 测试 harness 包括:Pi、Exo、Claude Code、Codex、DeepSeek Harness(4款)、Hermes、OpenCode、Oh My Pi、Kimi Code 测试模型:Kimi K3(选择K3,而不是 GPT、Claude,是因为测试者不想偏向 Codex 和 Claude Code) 任务类型: 21 项终端基准测试任务和 ​
大模型是新时代的零售业? ​​​

大模型是新时代的零售业? ​​​

大模型是新时代的零售业? ​​​

有了社交媒体和短视频之后,人在清醒的每一刻都是被填满的,不眠不休。 ​​​

有了社交媒体和短视频之后,人在清醒的每一刻都是被填满的,不眠不休。 ​​​
Kimi 要上市了 ​​​

Kimi 要上市了 ​​​

Kimi 要上市了 ​​​
Manus 关于“隐喻率”的模型评测指标,by 胡迪Hoodie

---

如何 eval agent 产出的调研报告是否易读?

分享我们 team 实践中用的一个简洁指标——「隐喻率」:

隐喻是常见的语言学现象,简单理解就是在句子中“悄悄”使用比喻。

来感受一个隐喻率很高的句子:

“全栈 AI 帝国率领评估军团与标注大 ​

Manus 关于“隐喻率”的模型评测指标,by 胡迪Hoodie --- 如何 eval agent 产出的调研报告是否易读? 分享我们 team 实践中用的一个简洁指标——「隐喻率」: 隐喻是常见的语言学现象,简单理解就是在句子中“悄悄”使用比喻。 来感受一个隐喻率很高的句子: “全栈 AI 帝国率领评估军团与标注大 ​

Manus 关于“隐喻率”的模型评测指标,by 胡迪Hoodie --- 如何 eval agent 产出的调研报告是否易读? 分享我们 team 实践中用的一个简洁指标——「隐喻率」: 隐喻是常见的语言学现象,简单理解就是在句子中“悄悄”使用比喻。 来感受一个隐喻率很高的句子: “全栈 AI 帝国率领评估军团与标注大 ​
谷歌昨天提升了 Gemini 3.7 Flash、3.6 Flash 及 3.5

谷歌昨天提升了 Gemini 3.7 Flash、3.6 Flash 及 3.5

谷歌昨天提升了 Gemini 3.7 Flash、3.6 Flash 及 3.5
谷歌昨天提升了 Gemini 3.7 Flash、3.6 Flash 及 3.5 Flash-Lite 的智能视频理解能力。

主要提升了视频分析的准确性,并降低了 token 消耗(最高可降 88%)。

实现手段:将模型的核心推理能力与原生视频工具相结合,能够跨视觉帧、音频和转录文本动态搜索、扫描和检测目标视频片段。使 Gemini 能够主 ​

谷歌昨天提升了 Gemini 3.7 Flash、3.6 Flash 及 3.5 Flash-Lite 的智能视频理解能力。 主要提升了视频分析的准确性,并降低了 token 消耗(最高可降 88%)。 实现手段:将模型的核心推理能力与原生视频工具相结合,能够跨视觉帧、音频和转录文本动态搜索、扫描和检测目标视频片段。使 Gemini 能够主 ​

谷歌昨天提升了 Gemini 3.7 Flash、3.6 Flash 及 3.5 Flash-Lite 的智能视频理解能力。 主要提升了视频分析的准确性,并降低了 token 消耗(最高可降 88%)。 实现手段:将模型的核心推理能力与原生视频工具相结合,能够跨视觉帧、音频和转录文本动态搜索、扫描和检测目标视频片段。使 Gemini 能够主 ​