hubio 1 345 Opublikowano 20 Lipca Opublikowano 20 Lipca @sino ale przeczytałeś cały artykuł czy tylko nagłówek? Badanie było zrobione pod tezę, że ludzie za bardzo ufają Ai... Więc pytania dotyczyły koloru strojów w filmach itp bzdury gdzie wiadomo, że Ai będzie halucynować... Sens badania nie był taki aby podważać sens Ai tylko pokazać, że ludzie bezrefleksyjnie ufają Ai. W tym celu zadano pytania z d. 99,999% ludzi nie pyta się o kolor stroju w filmie... Choć rozumiem intencje badaczy bo rzeczywiście to błąd, że Ai nie mając pewności wymyśla i powinno mówić, że nie wie i to jest akurat źle rozwiązane. Bo lepszy brak odp. niż błędna odp. Albo nawet tak jak ludzie algorytmy kiedy nie wiedzą na 100% powinny pisać: "wydaje mi się, że"... Ja obecnie oprócz wywoływania red flag jak mam zły humor wyzywam Ai od najgorszych itp i jak nawet po takim wyzwaniu potwierdza, że ma rację to ma rzeczywiście rację... Ostatnio testowałem z jednym z modów do gry co myślałem, że nie ma na steam, ale źle szukałem i Ai napisało, że na pewno jest i był... Ale jak się myli i się wyzwie to potrafi się przyznać. Choć też czasami w 2 stronę, że ma rację i przeprasza... Różnie bywa. Zawsze warto bardzo ważne informacje weryfikować, ale z grubsza (jak tu już pisałem wiele razy) w 80% przypadków, przynajmniej o co ja pytałem były dobre odp.
Pentium D Opublikowano 21 Lipca Opublikowano 21 Lipca @musichunter1x Przed chwilą widziałem te kopaniny na innym kanale i robi wrażenie. Głównie to jak szybko potrafią wstać, ale i zachowanie balansu w niektórych sekwecjach.
oldfashioned Opublikowano 21 Lipca Opublikowano 21 Lipca 6 godzin temu, hubio napisał(a): Ja obecnie oprócz wywoływania red flag jak mam zły humor wyzywam Ai od najgorszych itp i jak nawet po takim wyzwaniu potwierdza, że ma rację to ma rzeczywiście rację... Ale jak się myli i się wyzwie to potrafi się przyznać. Choć też czasami w 2 stronę, że ma rację i przeprasza... Wystarczy Dzeminaja zwyzywac od bycia glupia Dzesika, czy Clauda od bycia tepym Klaudiuszem i wtedy juz podaja poprawne zweryfikowane odpowiedzi? Kurde, ze tez nie wiedzialem ze to takie proste
JeRRyF3D Opublikowano 21 Lipca Opublikowano 21 Lipca Full AI. https://www.ppe.pl/news/419059/tworca-dystryktu-9-mierzy-sie-z-krytyka-neill-blomkamp-stworzyl-caly-film-przez-ai-jest-dostepny-na-youtube.html
Wu70 Opublikowano 21 Lipca Opublikowano 21 Lipca 7 godzin temu, hubio napisał(a): Bo lepszy brak odp. niż błędna odp. A zastanawiałeś się kiedyś dlaczego? Bo w życiu jest dokładnie odwrotnie, już od najmłodszych lat jesteś uczony że lepiej strzelić na egzaminie niż zostawić puste pole. Dokładnie ta sama geneza jest w przypadku AI, próba odpowiedzi daje większą szansę sukcesu. OpenAI jakiś dłuższy czas temu wydało art że to trudny problem do przeskoczenia.
musichunter1x Opublikowano 21 Lipca Opublikowano 21 Lipca (edytowane) Wystarczyłoby nauczyć AI polskiego - "Nie wiem, ale się domyślam." Ostatnio na szybko chciałem sprawdzić all core boost na i5 12600t to AI googla halucynowało mi w jednym oknie, nawet po zwróceniu uwagi że to procesor T, a w drugim było poprawne. Do szukania nietypowej obudowy PC, czy nawet klasycznej nie nadaje się, bo nie rozumie pozycji komponentów.... Mam większą szansę na znalezienie poprzez przypadkowe przeglądanie allegro i właśnie tak znalazłem jedną. Edytowane 21 Lipca przez musichunter1x
Wu70 Opublikowano 21 Lipca Opublikowano 21 Lipca (edytowane) Bal trwa w OpenAI, ostatnie ~1.5 tygodnia to jakieś 8 resetów tygodniowych limitów, praktycznie bez ograniczeń dostęp do topowych modeli, nawet dla darmowych kont (ale tu nie tak dużo jak w subskrypcjach). Edytowane 21 Lipca przez Wu70
nozownikzberlina Opublikowano 21 Lipca Opublikowano 21 Lipca 28 minut temu, Wu70 napisał(a): nawet dla darmowych kont (ale tu nie tak dużo jak w subskrypcjach). no na darmowym mi blokada wskakuje po kilku wiadomościach i trwa 24 godziny, a nie używałem ich kilka miesięcy chyba więc nie mam zfloodowanego konta
Wu70 Opublikowano 21 Lipca Opublikowano 21 Lipca Już Ci pisałem że ChatGPT Work i ChatGPT Codex mają oddzielne limity od zwykłego chatu. Work/Codex nawet nie mają limitu wiadomości tylko faktycznego zużycia (tokeny).
galakty Opublikowano Środa o 13:27 Opublikowano Środa o 13:27 @Wu70 mam udostępnione lokalnie GPT-5.6-Sol, GPT-5.6-Terra and GPT-5.6-Luna - coś poradzisz?
Wu70 Opublikowano Środa o 17:35 Opublikowano Środa o 17:35 Co masz na myśli? Sol będzie najlepszy, przy 5.6 dodali też nowy najwyższy reasoning effort (MAX) i tryb ultra (multi agent) a jak przez API to można jeszcze wbić reasoning mode PRO.
galakty Opublikowano Czwartek o 06:40 Opublikowano Czwartek o 06:40 13 godzin temu, Wu70 napisał(a): Co masz na myśli? Sol będzie najlepszy, przy 5.6 dodali też nowy najwyższy reasoning effort (MAX) i tryb ultra (multi agent) a jak przez API to można jeszcze wbić reasoning mode PRO. Jak się sprawuje względem innych
sabaru128 Opublikowano Czwartek o 07:35 Opublikowano Czwartek o 07:35 W dniu 21.07.2026 o 08:27, JeRRyF3D napisał(a): Full AI. https://www.ppe.pl/news/419059/tworca-dystryktu-9-mierzy-sie-z-krytyka-neill-blomkamp-stworzyl-caly-film-przez-ai-jest-dostepny-na-youtube.html Nawet nie oglądam bo zaraz będę miał pełno tego badziewia wyświetlanego w proponowanych.
Wu70 Opublikowano Czwartek o 10:27 Opublikowano Czwartek o 10:27 3 godziny temu, galakty napisał(a): Jak się sprawuje względem innych Ogólny konsensus bez konkretnej podkategorii: Fable 5 > GPT 5.6 Sol > Opus 4.8 >> Gemini Niższych modeli (Terra, Luna) nie używam zazwyczaj, ludzie nawet chwalą ten najmniejszy Luna. Ja raczej okazjonalnie więc nie chcę oceniać. W pracy ostatnio puszczałem Opus vs Sonnet 5 vs 5.6 Sol na kilkunastu issue równolegle każdym modelem, 5.6 Sol i Opus top, Sonnet wyraźnie gorzej. Do domowych zastosowań 5.6 Sol to obecnie TOP, przede wszystkim przez kosmiczne limity od openai w subskrypcjach. Rekordowego 15 lipca zużyłem 1.3mld tokenów, 916$ po cenach API, kosmos Mając tak gigantyczne budżety obecnie inne modele nie mają sensu.
GordonLameman Opublikowano Czwartek o 12:01 Opublikowano Czwartek o 12:01 Ja mam teraz pustkę w sercu po tym jak Fable przeszedł na usage poza subskrypcją. Świetny model do pracy - najlepszy z dotychczasowych.
Wu70 Opublikowano Czwartek o 12:12 Opublikowano Czwartek o 12:12 Absolutne TOP1, nowa klasa modeli na którą nie będzie przez jakiś czas odpowiedzi od OpenAI (GPT-6) i Google (Gemini 4). Na pocieszenie rozdali wszystkim 100$ usage Fable 5 więc trzeba przemyśleć na co wydać
GordonLameman Opublikowano Czwartek o 14:57 Opublikowano Czwartek o 14:57 2 godziny temu, Wu70 napisał(a): Absolutne TOP1, nowa klasa modeli na którą nie będzie przez jakiś czas odpowiedzi od OpenAI (GPT-6) i Google (Gemini 4). Na pocieszenie rozdali wszystkim 100$ usage Fable 5 więc trzeba przemyśleć na co wydać Akurat mam projekt z dużą ilością dokumentów i żmudnego poprawiania to będzie akurat
Oldman Opublikowano Piątek o 22:43 Opublikowano Piątek o 22:43 w końcu jakas ciekawa koncepcja a nie zwykły bełkot z generatora
Wu70 Opublikowano Sobota o 10:00 Opublikowano Sobota o 10:00 (edytowane) Anthropic mocno odpowiada! Opus 5 https://www.anthropic.com/news/claude-opus-5 Według benchmarków to nawet lepiej niż Fable 5. Wstępnie to wygląda na bardzo podobny model do Fable, mniejszy model ale świetny progress w wynikach. Innymi słowy nowe TOP1 do domowego wykorzystania. Edytowane Sobota o 10:01 przez Wu70
Zas Opublikowano Sobota o 13:19 Opublikowano Sobota o 13:19 (edytowane) Pytam właśnie AI, dlaczego plik bat, który ma mi uruchomić VS Code, a następnie skrypt AHK do zmiany rozmiaru okna VSCode (problem z zapamiętywaniem przez każdą aplikację opartą na Chrome) raz pozwala się zamknąć terminalowi, a raz nie. Fakt, AI podało mi poprawny kod (konieczność użycia zmiennej do deklaracji ścieżki i uruchomienie przez PowerShell - z tym, że to pierwszy wynik ze StackOverflow, więc akurat wiele się nie napracowało) - ale przy próbie wyjaśnienia, dlaczego terminal przy ścieżce do pliku AHK z cudzysłowem się nie zamyka, a przy ścieżce bez cudzysłowu już tak, poległo kompletnie i "szyje" jak student na egzaminie, przed którym łoił do rana podlaski samogon. No cóż, na Stacku niestety tego nie wyjaśnili, bo to jakaś skomplikowana sprawa z tym, jak naprawdę uruchamiany jest code.exe (jakieś parametry via cmd czy coś) Ech, w takich sytuacjach wyłazi w 100% jak "rozumne" jest obecne AI. Zwykła wyszukiwarka, tylko że operująca na transformowaniu całych stron i brutalnej mocy obliczeniowej (dziękujemy za ceny RAM i SSD) do statystycznego składania transformowanych elementów i szukania wzorców. Oczywiście, daje to czasem spektakularne rezultaty, z włamaniami hakerskimi włącznie , no i (hubio nadal się tym zachwyca?) ma się przy tym wrażenie rozmowy z angielskim dyplomatą, ale... OK, już łapię, do takiej wiedzy to też pewnie tylko specjalistyczne modele programistyczne trenowane na odpowiednich danych, prawda? A zysków nadal nie ma, pomimo tego, że już wszystkie korporacje przeszły na vibe coding... Edytowane Sobota o 13:30 przez Zas
nozownikzberlina Opublikowano Sobota o 22:27 Opublikowano Sobota o 22:27 (edytowane) 9 godzin temu, Zas napisał(a): Ech, w takich sytuacjach wyłazi w 100% jak "rozumne" jest obecne AI. Zwykła wyszukiwarka jakiś czas temu wrzucałem tutaj jak AI brutalnie zerżnął specyficzny kod z githuba, tylko pozmieniał nazwy zmiennych. edit: one po prostu kradną rzeczy, a jak czegoś nie mogą znaleźć to walą takie głupoty, że szok Edytowane Sobota o 22:40 przez nozownikzberlina
Rekomendowane odpowiedzi
Jeśli chcesz dodać odpowiedź, zaloguj się lub zarejestruj nowe konto
Jedynie zarejestrowani użytkownicy mogą komentować zawartość tej strony.
Zarejestruj nowe konto
Załóż nowe konto. To bardzo proste!
Zarejestruj sięZaloguj się
Posiadasz już konto? Zaloguj się poniżej.
Zaloguj się