#大模型

当前话题 #大模型

7 条公开动态正在使用这个话题。

登录参与
现在就加入 冒泡 加入社区,分享与表达值得留存的观点。注册后可发文字、图片和视频。
MEPPP 热点收录 @meppp_hot
收录
AI 翻译
有效使用AI 编程代理的最重要技能。展示使用编码代理的人工智能工程技能图。 https://x.com/i/article/2095882148670832640
查看原文
原帖正文 The most important skills for using AI coding agents effectively. Presenting the AI Engineering Skills Map for using coding agents. https://t.co/GrEw7wG5Wz
引用自 X 原作者:Andrew Ng 原帖地址:https://x.com/AndrewYNg/status/2095890279865721217 原帖:
MEPPP 热点收录 @meppp_hot
收录
AI 翻译
我已经使用GPT-6 Astra几周了。这是一个令人难以置信的模型,具有我从未见过的功能。它可以做我从未想过法学硕士可以做的事情。

它有怪癖和粗糙的边缘。但它是有史以来发布的最聪明的模型。有时候,感觉就像是尝到了敏捷的味道
查看原文
原帖正文 I’ve been using GPT-6 Astra for a few weeks now. It’s an incredible model with capabilities I’ve never seen before. It can do things I never thought an LLM could do. It has quirks and rough edges. But it’s the smartest model ever released. At times, it feels like a taste of AGI
引用自 X 原作者:Theo - t3.gg 原帖地址:https://x.com/theo/status/2095596855367455047 原帖:
MEPPP 热点收录 @meppp_hot
收录
国内计算机新生必备的四个东西:
1. VPN;
2. 一个自己能负担的最好的LLM coding plan,包括claude、OpenAI,也包括智谱、kimi、阿里云qwen、腾讯、小米、字节、minimax,丰俭由人;
3. 一台能完整运行claude code或者codex的顶配mac studio、二手mac mini、macbook或者内存拉满的游戏本,丰俭由人;
4. 如果有额外收入,尽可能自己外面租个房子,保证睡眠,保证时间独立,保证有大把大把的时间熬夜通宵蹬claude code或者codex做自己喜欢的好事情。
原帖正文 国内计算机新生必备的四个东西: 1. VPN; 2. 一个自己能负担的最好的LLM coding plan,包括claude、OpenAI,也包括智谱、kimi、阿里云qwen、腾讯、小米、字节、minimax,丰俭由人; 3. 一台能完整运行claude code或者codex的顶配mac studio、二手mac mini、macbook或者内存拉满的游戏本,丰俭由人;…
引用自 X 原作者:lidang 立党 (劝人卖房/学CS/买SP500/纳100/OpenAI/Anthrop第一人) 原帖地址:https://x.com/lidangzzz/status/2095032575802659284 原帖:
MEPPP 热点收录 @meppp_hot
收录
AI 翻译
KV缓存为什么存储K和V向量而不是Q?(一个流行的技术LLM面试问题)LLMs是自回归的,因此每个令牌都是从它之前的每个令牌中预测出来的,逐个预测。这种自回归特性在模型内部直接产生影响。经过 <n> 个 token 的前向传递产生 <n> 个隐藏状态,但仅将最后一个状态投影到 logits 并且是必需的。为了理解为什么KV缓存只存储K和V向量,我们必须回溯,看看它是如何工作的。1) 预填:所有10个令牌在一次前向传播中通过模型,平行(使用因果掩码),因为整个提示是已经众所周知。在每一层中,每个位置都会产生一个查询、一个键和一个值向量,以及注意力。每个位置都与所有高于它的位置进行比较。

这个操作是计算密集型的,这也是为什么第一个令牌需要花费。明显比后面的短。TTFT基本上是预填充的。为了生成第11个令牌,只需要第10个令牌的隐藏状态即可。因此,这是从隐藏维度投影到词汇维度,然后生成词汇的 logits。然后这些对数的值通过...
展开全文
查看原文
原帖正文 Why KV cache stores K and V vectors but never Q? (a popular technical LLM interview question) LLMs are autoregressive so each token is predicted from every token before it, one at a time. This autoregressive nature has a direct consequence inside the model. A forward pass… https://t.co/9QeBohqAwj pic.twitter.com/io7XW3n1Rq
引用自 X 原作者:Avi Chawla 原帖地址:https://x.com/_avichawla/status/2093962020962083139 原帖: 本站媒体副本
LLM中的KV、前缀、提示和语义缓存,已清楚说明
查看引用原文
https://t.co/sLoULsUfEt
引用自 X 原作者:Avi Chawla https://x.com/_avichawla/status/2093265776266637739
MEPPP 热点收录 @meppp_hot
收录
AI 翻译
看来精神科医生已经开始认真考虑是否应该将“AI精神病”认定为正式的疾病名称。
这是一篇由伦敦国王学院等研究人员撰写的论文。在媒体和病例报告中,与聊天机器人的密集互动中存在妄想和妄想加剧的情况。
典型的例子是“人工智能有意识”、“我已经觉醒到一个特殊的真理”和“我爱上了人工智能”等假设。为什么会发生这种情况?
研究人员解释说, LLM有同意和奉承用户的习惯,当与具有人性化的设计相结合时,他们会创建一个“单人混响室”。
用户的语音塑造了AI的输出,这再次强化了用户的信念。这种双向放大被认为是过去社交媒体等技术不存在的机制。

作为参考, OpenAI估计,到2025年,每周约有56万用户出现精神病或躁狂症状。

然而,研究人员对这种疾病的名称持谨慎态度。证据仍然是轶事,尚不清楚AI是原因还是仅仅是触发因素。这可以用现有的诊断方法来解释,标签可能有偏见。因此,目前的建议是将“技术历史” (人工智能使用多少、是否命名、是否有浪漫感...
展开全文
查看原文
原帖正文 「AI精神病」を正式な病名として認めるべきかを、精神科医らが本気で検討し始めたそうです。 キングス・カレッジ・ロンドンなどの研究者らによる論考です。 チャットボットとの濃密なやり取りの中で妄想が生まれたり悪化したりする事例が、メディアや症例報告で相次いでいるとのこと。… pic.twitter.com/OLQoAaeJaD
X 原帖图片,来自 @ai_database
引用自 X 原作者:AIDB 原帖地址:https://x.com/ai_database/status/2093881743187276020 原帖: 本站媒体副本