AI探索指南
36.7K subscribers
14.1K photos
1.25K videos
557 files
5.41K links
关于AIGC人工智能、思维方式、知识拓展,能力提升等。投稿/合作: @inside1024_bot
AIGC 领域的最新工具、开源项目以及行业大事件
Download Telegram
虽然迟到将近 1 个小时,但发布会开场效果确实炸。
机器人跳舞、调酒看着虽然没啥大用(看不出续航和长期稳定性),但这几步还是走得蛮流畅的。递东西的手法简直像真人。比前几年 Optimus 亮相时进步明显。
就这个步态,目前也不是那么容易做到。(WAIC 上,中国20几个人性机器人,大部分像手办一样要靠架子撑起或绳子吊脖)

目前看到的一些要点:
-Robotaxi 车辆形态
重点显然是轿车版(P4),无方向盘,无刹车板,完全为自动驾驶设计的新车辆。现场至少已有十台以上样车。
而且真如此前彭博社的路透,是个蝶翼门(why?开车门半径很大呀,这实用吗?)

-成本
轿车成本在2-3万美元。
这比百度萝卜快跑第六代贵,百度由江铃代工的第六代无人出租车预计成本会在 20 万元人民币左右。比 Waymo 的车便宜。

-巴士版(P5)
也无方向看,看直播是对向双排座,大概可以坐20+人。没说成本等更多信息。

❗️BUT!
马斯克这次没说 Robotaxi 的计划运营范围,这是个关键指标。最初准备在多大范围跑呢?能超过 Waymo吗?(旧金山主城区)和萝卜快跑比(武汉三镇主城区)呢?

-运营时间:预计明年(和之前各方消息一致)

不到一个小时,发布会已经结束了?!发布时长小于迟到时长。有点虎头蛇尾了!😅

不过特斯拉有了一票新东西,可以期待一下之后陆续的进展了。😆
2👍2
试了一下智谱新发布的基于思维链的AI搜索,有点🐂🍺的。

前几周Open AI 发布O1和O1 mini之后,基本上大家都看到了思维链和模型推理能力的价值,对于事实核查以及复杂问题的解决有非常大的作用。

而这类解决方案除了帮助科学家和开发者之外,离普通用户最近的需求就是搜索了。

推理能力和长文本阅读可以大幅解决之前AI搜索的幻觉问题,另外可以对搜索结果进行复杂总结给出更深入和准确的结果,节约整理和一定的逻辑推理成本。

智谱新发布的AI搜索就结合了网页深度阅读和多步推理能力,可以实现:

- 可以支持单次阅读超过100多个网页;
- 支持多级推理的思维链;
- 可以联动智谱其他的AI工具

你可以在多步复杂内容上增加需要计算的问题,比如这个每天吃5个苹果的热量占正常人类消耗的百分之多少。

推理能力的最好提现是你可以在一个问题中询问多个逻辑相关的问题他都能给出回答,比如这里询问二战密码破译机的发明者以及他的贡献以及对AI的影响。

除了能整理内容之外核心是可以对内容进行一定处理,比如下面截图里面的A股历史牛市分析它可以深入阅读网页信息并且给出对应的表格,之后还可以用Python画出对应的图表。

最后是终极问题,之前的AI搜索即使我降低难度问AI领域的歸藏是谁很多都答不对,开始给我介绍歸藏易,智谱回答和介绍的非常好。

智谱“AI搜索”智能体已经正式上线,感兴趣可以试试。
👍32
没想到机器人已经发展到这种程度了
还得说是马斯克啊

Invalid media: video
总结一下自己最近的自学,感觉进入了一个新的阶段。

这一年我的重心随着 AI 的发展也逐渐从直接使用 AI 模型 -> 创建 ComfyUI 工作流 -> 用 AI 代码来做AI 产品小 demo

整个过程中我感觉我的能力边界越来越宽,好像也变得越来越自由。

比如:炼出拼贴画模型后,我发现我可以通过梳理 ComfyUI 工作流来告诉其他人应该怎么使用这个模型,这个模型的潜力在哪里。

在这个过程中,我也发现 ComfyUI 对于普通人来说还是太复杂了,交互非常不友好,需要更简单的界面。

在 Cursor 出来以后,我开始接触 AI 代码,为我的拼贴画、鸡尾酒和商务照变成了小应用~!

从图3到图6到图9,能做出来的 UI 也越来越成熟。

我好像看到自己成为超级个体的机会。
👍111👏1
中国刚刚重新铺设了一条全长 158 公里的高速公路,仅使用无人机和机器人——几乎雇佣零建筑工人。

每看到这类消息,我好自豪!
👏17🤡11💩6🤔4🤨21
This media is not supported in your browser
VIEW IN TELEGRAM
Meta 这个AI视频的应用很好。

帮助广告主把静态图片广告变成视频,或者将横屏视频扩展成竖屏。

可以大幅提高广告表现力,改善用户体验,广告主的素材制作成本也低很多。
👍3
关注 AI 必读!Anthropic CEO 万字长文-预测强人工智能的积极未来。#ai#

描述了自己思考中的强人工智能的定义,详细介绍了强人工智能可能在五个核心方面对未来人类的积极作用。

叙述极为严谨在每个领域都有严密详细的推理过程,值得所有人关注 AI 的人看一下。

全文的翻译在这里:https://mp.weixin.qq.com/s/StZeb__lyrZl_as_sQ8l6A

下面是整理的要点:

- 大多数人都低估了 AI 可能带来的巨大积极影响,就像他们低估了潜在风险的严重性一样。

- Dario Amodei经常对许多 AI 风险领域的公众人物(更不用说 AI 公司领导人(说你呢 Sam))谈论后通用人工智能 (AGI) 世界的方式感到不适。

- Dario Amodei认为强人工智能可能最早会在 2026 年出现,尽管也有可能需要更长的时间。

- 强人工智能在形式上可能类似于今天的大型语言模型 (LLM),但可能采用不同的架构,可能涉及多个相互作用的模型,并可能以不同的方式进行训练。**强人工智能具体的特点有**:

- 在纯粹的智力方面,它比大多数相关领域的顶尖专家更聪明。

- 除了作为一个"聪明的对话伙伴",它还具备虚拟工作环境中人类可用的所有"接口",包括文字、语音、视频、鼠标键盘控制和互联网访问。

- 它不只是被动回答问题,而是可以接受需要数小时、数天甚至数周才能完成的任务。

- 它没有物理实体(除了存在于计算机系统中),但可以通过计算机控制现有的物理工具、机器人或实验室设备。

- 用于训练这个模型的计算资源可以重新用于同时运行数百万个实例。这个模型可以以比人类快 10-100 倍的速度吸收信息和产生行动。

- 这数百万个副本中的每一个都可以独立执行不同的任务,或者在需要时像人类团队一样协作工作。

- **可能与强人工智能互补的因素和限制性因素:**

- 外部世界的速度。智能体需要在现实世界中互动才能完成任务和学习。但现实世界的运转速度是有限的。

- 数据需求。有时候,原始数据的缺乏会成为瓶颈,在这种情况下,再高的智能也无济于事。

- 内在复杂性。有些系统本质上是不可预测或混沌的,即使是最强大的 AI 也无法比现有的人类或计算机做出更好的预测或解析。
4👍1