原推:Sponsored: Located Oceanfront…
分类: 英文推特
GeekWire: 华盛顿州立法者试图禁止初创公司 geekwire.com/2023/washingto 出售的家用强奸检测试剂盒……
原推:Washington state lawmakers se…
Elon Musk: 埃隆·马斯克转发推文: Booster 7 twitter.com/i/broadcasts/1 上的 33 个 Raptor 引擎的首次静态点火尝试…
原推: Elon Musk retweeted: First s…
Elon Musk: 总有一天,星际飞船会带我们去火星 https://t.co/oMrnBIiBjY 引用来自@SpaceX 的推文: Booster 7 静态点火测试的无人机视图 https://t.co/KN4sk1nohf
原推:One day, Starship will take u…
Elon Musk: 埃隆·马斯克转发推文: 33 Raptor 发动机静态点火尝试即将到来
原推: Elon Musk retweeted: 33 Rapt…
Elon Musk: @CatherinScience 我必须承认天生乐观(否则不会存在 SpaceX 和 Tesla),但我认为 5 年是可能的,10 年的可能性很大
原推:@CatherinScience I must admit…
Mark Gurman: @wojespn湖人队
原推:@wojespn Lakers https://twitt…
Brett Winton: @NaveenGRao 我明白了(我想) 但我具体谈论的是偏好模型的大小(人择的词汇——其他人使用“奖励模型”)。 Anthropic 在扩大参数数量(至 50b)时获得了更好的结果 无法通过相对少量的 HF 数据进行平方。
原推:@NaveenGRao I get that (I thi…
Brett Winton: 关于人类反馈强化学习的问题 RL 偏好模型数据集(50k 数据点)与模型大小(50b 参数)的比率 与底层语言模型非常不同(1,500b 标记到 70b 参数) 为什么? 我是在比较苹果和橙子吗?
原推:question on reinforcement lea…
Brett Winton: @_BruceX_(RLHF 我指的是奖励/偏好模型)
原推:@_BruceX_ (by the RLHF I mean…
Brett Winton: @_BruceX_ 那为什么RLHF模型需要那么多参数呢? 在参数数量和用于训练模型的数据量之间的权衡方面,我有什么误解吗?从某种意义上说,这个比率不应该是可以概括的吗?
原推:@_BruceX_ Then why does the R…
Brett Winton: 这只是一个经济问题吗? (收集人类反馈是昂贵的) 这不会导致偏好模型过度拟合吗?
原推:Is it just a matter of econom…
Brett Winton: @NaveenGRao 试图弄清楚/了解公司将如何优化底层语言模型和强化学习调整之间的预算……
原推:@NaveenGRao Trying to figure …
一些最好的创始人是“难相处”的人
在参考检查两极分化的企业家时要寻找什么 在对初创公司 CEO 进…
Steph Smith: 8️⃣ 合规是一种竞争优势 多德-弗兰克法案后,30,000 项金融法规迅速激增至 50,000 项。 @astrange 解释了这些法规如何对金融服务公司产生重大影响,但同样是创始人帮助公司跟上步伐的机会。
原推:8️⃣ Compliance as a Competiti…
Steph Smith: @MichelleVolz???很干净!
原推:@MichelleVolz ??? It’s …
Steph Smith: 我们今年正式完成了 10%,但这意味着我们还有 90% 的时间来创造非凡的东西。 不确定要构建什么? 以下是来自 @a16z 合作伙伴的 12 个重要创意,从游戏到合规性从医疗保健到太空,当然还有……很多人工智能机会。
原推:We’re officially 10% through …